数学I / データの分析

変量の変換(1次式)と標準化

★★ 標準変量の変換

問題

変量 のデータの平均値は 、標準偏差は である。

(1) で新しい変量 を定めるとき、 の平均値・分散・標準偏差を求めよ。

(2) で新しい変量 を定めるとき、 の平均値と標準偏差を求めよ。

ヒントを見る

(2)は を『 の形』に開けば、いつもの変換公式で処理できる。結果に注目 — 平均と標準偏差が特別な値になるはず。これが『標準化』で、偏差値の正体だ。

解答・解説

方針

(1)は変換公式 の練習だ。

(2)がこの問題のヤマだ。、つまり『平均を引いて標準偏差で割る』という変換だ。これも と展開すればただの1次式変換なので、同じ公式で処理できる。

でも結果に注目してほしい。平均が 、標準偏差が になる。この操作は標準化と呼ばれ、どんなデータもこの変換で平均 ・標準偏差 の共通のものさしに乗る。偏差値の正体もこれだ。

解答

⓪ 発想 — どう考え始めるか。 1次式の変換 では、平均はそのまま変換され()、散らばりは 倍だけ効く( は足しても散らばりに影響しない)。

(2)の も、展開すれば というただの1次式だ。同じ公式で処理できる。

結果は平均 、標準偏差 。この「平均を引いて標準偏差で割る」変換には標準化という名前が付いている。

公式変量の変換 :

(1) の1次式変換なので

分散は 倍ではなく 倍()だ。標準偏差と分散のどちらを聞かれているかを見落とさないこと。

(2) 分数の形のままだと公式が使いにくいので、まず展開する。 なので、 だ。

よって の平均値は 、標準偏差は だ。

まとめ:結果が という『きれいすぎる値』になったのは偶然ではない。引いた がちょうど平均、割った がちょうど標準偏差だからだ。この変換(平均を引いて標準偏差で割る)を標準化という。データの単位や水準のちがいを消して共通のものさしに乗せる操作で、模試の偏差値は標準化した値を『 倍して を足した』もの( に対して )にすぎない。数学Bの『統計的な推測』でも中心的な役割を果たす、先につながる操作だ。

発展 — 一歩先へ。 標準化は「単位や満点の違うもの同士を比べる」ための共通の物差しだ。数学 点と英語 点、どちらが相対的に良いかは、標準化した値(平均から標準偏差いくつ分か)で初めて比べられる。

数学Bの統計的な推測では、正規分布をこの標準化で「標準正規分布」に統一し、1枚の数表であらゆる場合を処理する。今日の変換はその心臓部の予行演習である。

(1) 平均 、分散 、標準偏差 (2) 平均 、標準偏差

別解

(2)は計算の前に、変換の「意味」から結果を予言できる。

は、目盛りの張り替えだ。まず (平均)を引く。これで平均の位置が原点 に来る。次に (標準偏差)で割る。これで標準偏差が 目盛りになる。

つまり は「平均から標準偏差いくつ分離れているか」を表す数だ。平均 ・標準偏差 になるのは、そういう物差しを作ったのだから当然である。

身近な応用が偏差値だ。偏差値は 、つまり標準化した値を「平均 ・標準偏差 」の物差しに乗せ替えたもの。テストの偏差値 は「平均より標準偏差1つ分上」という意味だと、この変換から読める。

ポイント

  • → 平均は同じ変換、標準偏差は 倍、分散は
  • (標準化)は必ず平均 ・標準偏差 になる
  • 分数の形の変換も の形に直して公式を適用する

よくある間違い

  • (1)で分散を とする(分散は 倍)
  • (2)で平均への を忘れて と答える
  • 標準偏差に でなく をそのまま使い、負の標準偏差を書いてしまう