ちょっと変わったマニアな作品が集結

例えば,
{-0.0027,0.0005,-0.0006,0.0003,-0.0002,-0.0002,0.0016,-0.0017,-0.0003,-0.0004,-0.0005,-0.0007}
のようなマイナスを含む誤差データがあるとします.
この誤差データの平均と分散を求めたいとしますと,単純に足してデータ数で割っただけだとマイナスでキャンセルされてしまって平均とは呼べないと思います.
そこで平均二乗誤差を使用してデータの平均を求めた場合,分散を計算するときに使用する平均値のデータとしては,平均二乗誤差を使用しても良いのでしょうか?

このようなデータ処理の仕方について,わかりやすい本がありましたらついでに教えていただけると助かります.

このQ&Aに関連する最新のQ&A

A 回答 (2件)

 


データの性格によって計算の方法を考えるべきでしょ。
例えば棒の直径を測って、基準の10mmからの差をデーターとした場合。
0.02
-0.01
0.01
0.01
-0.01
こんなデーターの場合は単純に合計し
0.02+-0.01+0.01+0.01+-0.01=0.02、平均は0.02/5=0.004
基準値の10に加算して、5本の棒の直径の平均は10.004mm

子の様にマイナスを含むデーターを単純に平均する時もあります。

 
    • good
    • 0
この回答へのお礼

早速の回答ありがとうございます.

データの性格としては,まさにl4330さんが例に出してくれたものと同じです.
例のように単純に合計して平均を出した場合,分散の計算方法は
その算出された平均10.004mmを用いて,誤差データではなく,
元の実測値データを用いて分散を計算するといった方法でしょうか?

お礼日時:2009/09/12 17:22

 


分散は偏差平方和
#1の例なら
(0.004-0.02)^2
(0.004--0.01)^2
(0.004-0.01)^2
(0.004-0.01)^2
(0.004--0.01)^2
これの合計ですよネ
何か問題でも?

 
    • good
    • 0
この回答へのお礼

確かにそうですね...

つまりマイナスのデータでも通常通り
平均・分散を計算して問題ないということですね.

ありがとうございました!!

お礼日時:2009/09/12 17:54

このQ&Aに関連する人気のQ&A

お探しのQ&Aが見つからない時は、教えて!gooで質問しましょう!

このQ&Aを見た人はこんなQ&Aも見ています

このQ&Aを見た人が検索しているワード

このQ&Aと関連する良く見られている質問

Qエクセル STDEVとSTDEVPの違い

エクセルの統計関数で標準偏差を求める時、STDEVとSTDEVPがあります。両者の違いが良くわかりません。
宜しかったら、恐縮ですが、以下の具体例で、『噛み砕いて』教えて下さい。
(例)
セルA1~A13に1~13の数字を入力、平均値=7、STDEVでは3.89444、STDEVPでは3.741657となります。
また、平均値7と各数字の差を取り、それを2乗し、総和を取る(182)、これをデータの個数13で割る(14)、この平方根を取ると3.741657となります。
では、STDEVとSTDEVPの違いは何なのでしょうか?統計のことは疎く、お手数ですが、サルにもわかるようご教授頂きたく、お願い致します。

Aベストアンサー

データが母集団そのものからとったか、標本データかで違います。また母集団そのものだったとしても(例えばクラス全員というような)、その背景にさらならる母集団(例えば学年全体)を想定して比較するような時もありますので、その場合は標本となります。
で標本データの時はSTDEVを使って、母集団の時はSTDEVPをつかうことになります。
公式の違いは分母がn-1(STDEV)かn(STDEVP)かの違いしかありません。まぁ感覚的に理解するなら、分母がn-1になるということはそれだけ結果が大きくなるわけで、つまりそれだけのりしろを多くもって推測に当たるというようなことになります。
AとBの違いがあるかないかという推測をする時、通常は標本同士の検証になるわけですので、偏差を余裕をもってわざとちょっと大きめに見るということで、それだけ確証の度合いを上げるというわけです。

Q統計の変動係数について

あるn個のデータがあります。その標準偏差s(a)と、変動係数CV(a)を求めます。
次に、n個のデータすべてに10を足し、足された後のデータの標準偏差s(b)と、
変動係数CV(b)を求めたとします。

この場合、標準偏差の値は、s(a)=s(b)となりますよね。
でも、変動係数はCV(a)>CV(b)となると思います。

「変動係数は平均値などが異なっている場合に、ばらつきを比べられるようにしたもの」
という参考書の説明でした。
でも、上の条件でのばらつきは”感覚的に”同じだと思えてしまうのですが、係数としては差が出ます。

どのように考えれば良いのでしょうか。

Aベストアンサー

「標準偏差」は絶対的なもので、グラフを平行移動しても変わりません。グラフの形は変わりません。
 従って、「10cm分右にずれただけという物」の「標準偏差」としてのばらつきは変わりません。平均値が右にずれた分、相対値としての「変動係数」は変わります。No.2の例に示したように。

 「変動係数」は相対的なもので、これを比較のために動かすのは、グラフの移動ではなく、左右方向の縮尺を変えることに相当します。平均値の位置を右に10cmずらすと、全体が右方向に延びます。平均値の位置を左方向にずらせば、全体が左方向に縮まります。そんなイメージでしょう。

 いずれにせよ、「標準偏差」と「変動係数」は別なものです。一方は一定でも他方が変わり、同じように変化するということはありません。
 No.2の例のように、「標準偏差」が一定でも平均値によって相対誤差は変化しますし、相対誤差(%で表わした精度)が一定なら、平均値によって「標準偏差」の絶対値は変化します。

Q分散分析における誤差項が負値になります

初めまして。

データの統計分析について質問があります。

現在、評価実験により得たデータの統計分析を行っています。
しかし、分散分析を行ったところ、誤差項が負値になってしまいます。

統計学に関しては全くの素人であり、
何が原因なのか(そもそも負値になることはあり得るのか)
調べてもわかりませんでした。

漠然とした質問で恐縮ですが、
この原因としてどのような事が考えられ、
どのように対処すべきか教えていただけないでしょうか。

必要な情報があれば仰ってください。

宜しくお願いいたします。

Aベストアンサー

何のデータをどのようにして(どのソフトウェアで、どのような手順、あるいは関数を用いて)分析したのかを明示しない限り、適切な答えはでないでしょう。もしかしたら、"変な値"がデータセットに含まれている場合に、あるプログラムは適切な処理をできないのかもしれない。

> そもそも負値になることはあり得るのか

誤差項というのは誤差平方和のことなんでしょうね。。。 名前が示すとおり、平方して足すわけですからマイナスの値を取ることは普通ありえませんね。

QEXCELについて:ある範囲の中に混在する正の値と負の値を各々計算したい

MS-EXCELの関数で教えて欲しいのですが。
次のようなことが関数で出来ますか?

あるセル範囲の中に正の値と負の値が混在しています。
その中から、正の値のみ、負の値のみを各々計算するような関数を作成するにはどうしたら良いでしょうか?

ex.A1~A10までの10個のセルの中に正の値が7個、負の値が3個あると仮定します。A11に正の値を計算する(7個のみを判断して計算)式を、A12に負の値(3個のみを判断して計算)を計算する式を作成したいのです。

お分かりになる方教えてください。

Aベストアンサー

どのような計算をするのでしょうか?

例えば、正の数だけの合計や負の数だけの合計を求めたいのであれば、

正の数の和は
=SUMIF(A1:A10,">0")
負の数の和は
=SUMIF(A1:A10,"<0")

例えば、正の数だけの平均や負の数だけの平均を求めたいのであれば、

正の数の平均は
=SUMIF(A1:A10,">0")/COUNTIF(A1:A10,">0")
負の数の平均は
=SUMIF(A1:A10,"<0")/COUNTIF(A1:A10,"<0")

といったように出来ます。
どの様な計算をしたいのか補足をしてください。

QExcel 平均値負の値を表示したい

下記B2~B5セルに、C~Eの平均時間を表示したいです。

1904年から計算するにはチェックが入っています。
マイナスデータは『'-0:**』と入力しています。
E3~G6セルの書式設定は、h:mm:ssです。
D3~D6セルの関数は『=(SUBSTITUTE(TEXT(SUMPRODUCT(SUBSTITUTE(TEXT(E10:U10,"[h]:mm")&"/60",":"," ")+0),"0!:00/60"),"/60",))/C10』が入っています。

以上、よろしくお願い致します。

Aベストアンサー

負の時刻を入力する時は、「'-h:m」じゃなくて「=0-"h;m"」として
下さい。そうすればちゃんと数値になって、普通にaverage関数が使
えます。

Q加重平均と平均の違い

加重平均と平均の違いってなんですか?
値が同じになることが多いような気がするんですけど・・・
わかりやす~い例で教えてください。

Aベストアンサー

例えば,テストをやって,A組の平均点80点,B組70点,C組60点だったとします.
全体の平均は70点!・・・これが単純な平均ですね.
クラスごとの人数が全く同じなら問題ないし,
わずかに違う程度なら誤差も少ないです.

ところが,A組100人,B組50人,C組10人だったら?
これで「平均70点」と言われたら,A組の生徒は文句を言いますよね.
そこで,クラスごとに重みをつけ,
(80×100+70×50+60×10)÷(100+50+10)=75.6
とやって求めるのが「加重平均」です.

QExcelで平方2乗平均を計算するには

Excel2003で
平方2乗平均を計算するにはどうしたら良いのでしょうか?
手っ取り早い方法を教えて下さい。
よろしくお願い致します。

Aベストアンサー

訂正。

誤:平方2乗平均は、各要素を2乗した物の和の平方根です。
正:平方2乗平均は、各要素を2乗した物の和を要素数で割った物の平方根です。

従って、A1~A30の30個のセルの平方2乗平均は以下の式で求めます。
=SQRT(SUMSQ(A1:A30)/COUNT(A1:A30))

平方和を要素数で割るのを忘れてました。

Q統計学的に信頼できるサンプル数って?

統計の「と」の字も理解していない者ですが、
よく「統計学的に信頼できるサンプル数」っていいますよね。

あれって「この統計を調べたいときはこれぐらいのサンプル数があれば信頼できる」という決まりがあるものなのでしょうか?
また、その標本数はどのように算定され、どのような評価基準をもって客観的に信頼できると判断できるのでしょうか?
たとえば、99人の専門家が信頼できると言い、1人がまだこの数では信頼できないと言った場合は信頼できるサンプル数と言えるのでしょうか?

わかりやすく教えていただけると幸いです。

Aベストアンサー

> この統計を調べたいときはこれぐらいのサンプル数があれば信頼できる・・・
 調べたいどの集団でも、ある一定数以上なら信頼できるというような決まりはありません。
 何かサンプルを集め、それをなんかの傾向があるかどうかという仮説を検証するために統計学的検定を行って、仮設が否定されるかされないかを調べる中で、どの検定方法を使うかで、最低限必要なサンプル数というのはあります。また、集めたサンプルを何か基準とすべき別のサンプルと比べる検定して、基準のサンプルと統計上差を出すに必要なサンプル数は、比べる検定手法により計算できるものもあります。
 最低限必要なサンプル数ということでは、例えば、ある集団から、ある条件で抽出したサンプルと、条件付けをしないで抽出したサンプル(比べるための基準となるサンプル)を比較するときに、そのサンプルの分布が正規分布(正規分布解説:身長を5cmきざみでグループ分けし、低いグループから順に並べたときに、日本人男子の身長なら170cm前後のグループの人数が最も多く、それよりも高い人のグループと低い人のグループの人数は、170cmのグループから離れるほど人数が減ってくるような集団の分布様式)でない分布形態で、しかし分布の形は双方とも同じような場合「Wilcoxon符号順位検定」という検定手法で検定することができますが、この検定手法は、サンプルデータに同じ値を含まずに最低6つのサンプル数が必要になります。それ以下では、いくらデータに差があるように見えても検定で差を検出できません。
 また、統計上差を出すのに必要なサンプル数の例では、A国とB国のそれぞれの成人男子の身長サンプルがともに正規分布、または正規分布と仮定した場合に「t検定」という検定手法で検定することができますが、このときにはその分布を差がないのにあると間違える確率と、差があるのにないと間違える確率の許容値を自分で決めた上で、そのサンプルの分布の値のばらつき具合から、計算して求めることができます。ただし、その計算は、現実に集めたそれぞれのサンプル間で生じた平均値の差や分布のばらつき具合(分散値)、どのくらいの程度で判定を間違える可能性がどこまで許されるかなどの条件から、サンプル間で差があると認められるために必要なサンプル数ですから、まったく同じデータを集めた場合でない限り、計算上算出された(差を出すために)必要なサンプル数だけサンプルデータを集めれば、差があると判定されます(すなわち、サンプルを無制限に集めることができれば、だいたい差が出るという判定となる)。よって、集めるサンプルの種類により、計算上出された(差を出すために)必要なサンプル数が現実的に妥当なものか、そうでないのかを、最終的には人間が判断することになります。

 具体的に例示してみましょう。
 ある集団からランダムに集めたデータが15,12,18,12,22,13,21,12,17,15,19、もう一方のデータが22,21,25,24,24,18,18,26,21,27,25としましょう。一見すると後者のほうが値が大きく、前者と差があるように見えます。そこで、差を検定するために、t検定を行います。結果として計算上差があり、前者と後者は計算上差がないのにあると間違えて判断する可能性の許容値(有意確率)何%の確率で差があるといえます。常識的に考えても、これだけのサンプル数で差があると計算されたのだから、差があると判断しても差し支えないだろうと判断できます。
 ちなみにこの場合の差が出るための必要サンプル数は、有意確率5%、検出力0.8とした場合に5.7299、つまりそれぞれの集団で6つ以上サンプルを集めれば、差を出せるのです。一方、サンプルが、15,12,18,12,21,20,21,25,24,19の集団と、22,21125,24,24,15,12,18,12,22の集団ではどうでしょう。有意確率5%で差があるとはいえない結果になります。この場合に、このサンプルの分布様式で拾い出して差を出すために必要なサンプル数は551.33となり、552個もサンプルを抽出しないと差が出ないことになります。この計算上の必要サンプル数がこのくらい調査しないといけないものならば、必要サンプル数以上のサンプルを集めて調べなければなりませんし、これだけの数を集める必要がない、もしくは集めることが困難な場合は差があるとはいえないという判断をすることになるかと思います。

 一方、支持率調査や視聴率調査などの場合、比べるべき基準の対象がありません。その場合は、サンプル数が少ないレベルで予備調査を行い、さらにもう少しサンプル数を増やして予備調査を行いを何回か繰り返し、それぞれの調査でサンプルの分布形やその他検討するべき指数を計算し、これ以上集計をとってもデータのばらつきや変化が許容範囲(小数点何桁レベルの誤差)に納まるようなサンプル数を算出していると考えます。テレビ視聴率調査は関東では300件のサンプル数程度と聞いていますが、調査会社ではサンプルのとり方がなるべく関東在住の家庭構成と年齢層、性別などの割合が同じになるように、また、サンプルをとる地域の人口分布が同じ割合になるようにサンプル抽出条件を整えた上で、ランダムに抽出しているため、数千万人いる関東の本当の視聴率を割合反映して出しているそうです。これはすでに必要サンプル数の割り出し方がノウハウとして知られていますが、未知の調査項目では必要サンプル数を導き出すためには試行錯誤で適切と判断できる数をひたすら調査するしかないかと思います。

> どのような評価基準をもって客観的に信頼できると判断・・・
 例えば、工場で作られるネジの直径などは、まったくばらつきなくぴったり想定した直径のネジを作ることはきわめて困難です。多少の大きさのばらつきが生じてしまいます。1mm違っても規格外品となります。工場では企画外品をなるべく出さないように、統計を取って、ネジの直径のばらつき具合を調べ、製造工程をチェックして、不良品の出る確率を下げようとします。しかし、製品をすべて調べるわけにはいきません。そこで、調べるのに最低限必要なサンプル数を調査と計算を重ねてチェックしていきます。
 一方、農場で生産されたネギの直径は、1mmくらいの差ならほぼ同じロットとして扱われます。また、農産物は年や品種の違いにより生育に差が出やすく、そもそも規格はネジに比べて相当ばらつき具合の許容範囲が広くなっています。ネジに対してネギのような検査を行っていたのでは信頼性が損なわれます。
 そもそも、統計学的検定は客観的判断基準の一指針ではあっても絶対的な評価になりません。あくまでも最終的に判断するのは人間であって、それも、サンプルの質や検証する精度によって、必要サンプルは変わるのです。

 あと、お礼の欄にあった専門家:統計学者とありましたが、統計学者が指摘できるのはあくまでもそのサンプルに対して適切な検定を使って正しい計算を行ったかだけで、たとえ適切な検定手法で導き出された結果であっても、それが妥当か否か判断することは難しいと思います。そのサンプルが、何を示し、何を解き明かし、何に利用されるかで信頼度は変化するからです。
 ただ、経験則上指標的なものはあります。正規分布を示すサンプルなら、20~30のサンプル数があれば検定上差し支えない(それ以下でも問題ない場合もある)とか、正規分布でないサンプルは最低6~8のサンプル数が必要とか、厳密さを要求される調査であれば50くらいのサンプル数が必要であろうとかです。でも、あくまでも指標です。

> この統計を調べたいときはこれぐらいのサンプル数があれば信頼できる・・・
 調べたいどの集団でも、ある一定数以上なら信頼できるというような決まりはありません。
 何かサンプルを集め、それをなんかの傾向があるかどうかという仮説を検証するために統計学的検定を行って、仮設が否定されるかされないかを調べる中で、どの検定方法を使うかで、最低限必要なサンプル数というのはあります。また、集めたサンプルを何か基準とすべき別のサンプルと比べる検定して、基準のサンプルと統計上差を出すに必要な...続きを読む

Qエクセルで、絶対値の平均を算出したいのですが

具体的に
    A
1  125
2  -56
3  560
4  関数式?

セルA4に,、=AVERAGE(ABS(A1:A3)) とか =AVERAGE(ABS(A1):ABS(A3)) とか
いろいろやって見ましたが、ダメでした。B列に絶対値のデータを並べれば、
できることはわかっていますが、なんとか一発の関数式できないものかと?
ご存知の方、教えて下さい。

Aベストアンサー

こんばんは

=AVERAGE(ABS(A1:A3))

この式を Ctrl+Shift+Enter同時押しにて
配列数式として確定

{=AVERAGE(ABS(A1:A3))}

このようにすればいいのではないでしょうか?

Qエクセルで計算すると2.43E-19などと表示される。Eとは何ですか?

よろしくお願いします。
エクセルの回帰分析をすると有意水準で2.43E-19などと表示されますが
Eとは何でしょうか?

また、回帰分析の数字の意味が良く分からないのですが、
皆さんは独学されましたか?それとも講座などをうけたのでしょうか?

回帰分析でR2(決定係数)しかみていないのですが
どうすれば回帰分析が分かるようになるのでしょうか?
本を読んだのですがいまいち難しくて分かりません。
教えてください。
よろしくお願いします。

Aベストアンサー

★回答
・最初に『回帰分析』をここで説明するのは少し大変なので『E』のみ説明します。
・回答者 No.1 ~ No.3 さんと同じく『指数表記』の『Exponent』ですよ。
・『指数』って分かりますか?
・10→1.0E+1(1.0×10の1乗)→×10倍
・100→1.0E+2(1.0×10の2乗)→×100倍
・1000→1.0E+3(1.0×10の3乗)→×1000倍
・0.1→1.0E-1(1.0×1/10の1乗)→×1/10倍→÷10
・0.01→1.0E-2(1.0×1/10の2乗)→×1/100倍→÷100
・0.001→1.0E-3(1.0×1/10の3乗)→×1/1000倍→÷1000
・になります。ようするに 10 を n 乗すると元の数字になるための指数表記のことですよ。
・よって、『2.43E-19』とは?
 2.43×1/(10の19乗)で、
 2.43×1/10000000000000000000となり、
 2.43×0.0000000000000000001だから、
 0.000000000000000000243という数値を意味します。

補足:
・E+数値は 10、100、1000 という大きい数を表します。
・E-数値は 0.1、0.01、0.001 という小さい数を表します。
・数学では『2.43×10』の次に、小さい数字で上に『19』と表示します。→http://ja.wikipedia.org/wiki/%E6%8C%87%E6%95%B0%E8%A1%A8%E8%A8%98
・最後に『回帰分析』とは何?下の『参考URL』をどうぞ。→『数学』カテゴリで質問してみては?

参考URL:http://ja.wikipedia.org/wiki/%E5%9B%9E%E5%B8%B0%E5%88%86%E6%9E%90

★回答
・最初に『回帰分析』をここで説明するのは少し大変なので『E』のみ説明します。
・回答者 No.1 ~ No.3 さんと同じく『指数表記』の『Exponent』ですよ。
・『指数』って分かりますか?
・10→1.0E+1(1.0×10の1乗)→×10倍
・100→1.0E+2(1.0×10の2乗)→×100倍
・1000→1.0E+3(1.0×10の3乗)→×1000倍
・0.1→1.0E-1(1.0×1/10の1乗)→×1/10倍→÷10
・0.01→1.0E-2(1.0×1/10の2乗)→×1/100倍→÷100
・0.001→1.0E-3(1.0×1/10の3乗)→×1/1000倍→÷1000
・になります。ようするに 10 を n 乗すると元の数字になるた...続きを読む


このQ&Aを見た人がよく見るQ&A

人気Q&Aランキング