情報処理論 1987...2002年度講義資料
[Syllabus], [Prev], [Next], [Text & references]

 

  1. 統計データの読み方(Excelによる統計解析)

 これまでは,時系列データと横断面データを素材とし,Excelを利用してこれらの基本的な読み方を説明してきた。 そこでは,表作成,グラフ作成,関数,データベースなどの機能を利用することによって,高校レベルの数学の知識さえ使わずに,データから情報を読み取る方法を学べることを示してきた。 また,このような直感的な見方の大切さを指摘し,Excelが表示する結果を自分自身で確認することを強調してきた。

 しかしながら,本格的にデータを分析し,データに潜む情報(規則性と予測性)を引き出すためには,統計学(記述統計と推測統計)に関する基本的な知識が必要になる。 記述統計では 本章では,データの収集とその集計・整理作業を中心とする記述統計を取り扱う。作業の中心は、平均値や標準偏差などの「分布の特性値」を求めたり、ヒストグラムや散布図などのグラフ化によって、データの分類や層別を行うことである。このような基本的な統計分析について,Excelの分析ツールを利用して説明する。

 今年は,シラバスにあるように2つの教科書の該当する章・節を教材とする。必要なデータのうち,入力に時間がかかるものはこのページからダウンロードできるようにしてある。

  1. 1 統計処理の基本
  1. データの種類
    1. 量的データと質的データ
      • 質的データは、統計処理の準備として、コード化して量的データに変換しておく必要がある。
    2. 変量と変数
      • 2種類以上の変量を同時に扱う場合を多変量データという。
    3. 離散量データと連続量データ

  2. 統計的推測
    1. 母集団と標本(サンプル):対象とする集団全体を母集団、母集団の性質を推測するために無作為(ランダム)に抽出した一部分を標本(サンプル)という。
    2. 区間推定と点推定:

  1. 2 Excelによる基本統計

  1. 基本統計量
    1. データの代表値
      1. 平均値: AVERAGE()関数
      2. 中央値(メジアン): MEDIAN()関数(教科書5章p.74-75)
      3. 最頻値(モード): MODE()関数 (教科書5章p.73)
    2. データのバラつき度合
      1. 分散: VAR(), VARP()関数("P"は母集団を対象とする場合)
      2. 標準偏差: STDEV(), STDEVP()関数
      3. 不偏分散: VAR関数( = ��j{(平均値)-(データj)}2/(データの自由度), データの自由度とはデータの個数‐1のこと)
    3. データの分布形
      1. 尖度(センド): KURT()関数(度数分布が、裾を長く引いて中央がとがった形であれば尖度は大きくなり、中央が平らで両端が急に落ちる形のとき値は小さくなる)
      2. 歪度(ワイド): SKEW()関数(度数分布が左右対称であれば値は0となる。平均値の左に(右に)裾を引いていれば正の値(負の値)になる。)
    4. その他
      1. 最大値、最小値、データの範囲
      2. データの個数

 【例題1】

  1. 分析ツールの利用
  2. 分析ツールは、Excelの標準ツールには含まれないアドイン関数である。[ツール]メニューを開き、[アドインの登録と管理]で分析ツールを使えるように設定しておく必要がある。

  1. 基本統計量ツール

 【例題2】

    基本統計量ツールのダイアログボックスで以下のように指定する。
  1. 入力範囲は、$C$4:$D$29
  2. チェック:先頭行をラベルとして使用(L)
  3. チェック:平均の信頼区間の出力(N) [95%  ]
  4. チェック:K 番目に大きな値(A) [1  ]
  5. チェック:K 番目に小きな値(M) [1  ]
  6. 出力先: [Sheet2!$A1$1  ]
  7. チェック:統計情報(S)


lec.31) Go to TOP ----- (c) T.K     Last updated: