CHAPTER 02 · TOPIC 06
F分布
独立な二つの平均変動の比からF分布を構成し、二つの自由度、t分布、ANOVAとの関係を学びます。
このページの内容
F分布(F-distribution)はR. A. Fisherの姓の頭文字に由来します。互いに独立な二つのカイ二乗変数をそれぞれ自由度で割り、その比をとった分布で、主に独立した二つの変動量の相対的な大きさを比較するために使います。
F分布はどのように作られるか?#
UとVを互いに独立なカイ二乗変数とし、自由度をそれぞれν₁、ν₂とします。UとVを各自由度で割ってから比をとると、Fは分子自由度ν₁、分母自由度ν₂のF分布に従います。
| 記号 | 意味 |
| U、V | 互いに独立な二つのカイ二乗変数 |
| ν₁ | Uに対応する分子自由度 |
| ν₂ | Vに対応する分母自由度 |
| U/ν₁、V/ν₂ | 各カイ二乗変数を自由度で割った平均変動量 |
| Fν₁,ν₂ | 分子・分母の二つの自由度をもつF分布 |
| ⊥ | 二つの確率変数が独立であることを表す |
なぜF値は0未満にならないのか?#
UとVはいずれも二乗和なので負になりません。正の自由度で割って比をとるFも正の値だけをとります。F=1は分子と分母の平均変動が等しいこと、F>1は分子側が大きいこと、F<1は分母側が大きいことを示します。
二つの自由度は形にどう影響するか?#
F分布は通常右に歪み、右側に長い裾をもちます。具体的な形は分子自由度ν₁と分母自由度ν₂の両方で決まります。自由度が低いと分散推定が不安定で、分布は広く右裾も厚くなります。自由度が増えると、比は一般に1付近へ集中します。
F分布の確率密度関数#
分子自由度ν₁、分母自由度ν₂のF分布は次の確率密度関数をもちます。二つの自由度が係数、指数、分母に同時に現れるため、どちらかを変えるだけでも曲線の形が変わります。
| 記号 | 意味 |
| f(x) | 位置xにおけるF分布の確率密度 |
| x | 0より大きいF確率変数の可能値 |
| ν₁、ν₂ | 分子自由度と分母自由度 |
| Γ | 密度関数の正規化係数に使うGamma関数 |
補足:F密度関数の導出
第1段階:二つの独立なカイ二乗変数から出発する
U~χ²ν₁、V~χ²ν₂とし、UとVは独立とします。X=(U/ν₁)/(V/ν₂)と定義し、補助変数Y=Vを残します。
UとVが独立なので、同時密度は二つのカイ二乗密度の積です。逆変換を代入し、Jacobianを掛けるとXとYの同時密度が得られます。
第2段階:補助変数Yを積分消去する
すべてのy>0について積分するとXの周辺密度が得られます。yに関する部分を整理すると、積分は再びGamma積分の形になります。
Gamma積分公式で簡約し定数を整理すると、本文のF密度関数が得られます。F密度は別に仮定された式ではなく、二つの独立なカイ二乗密度、比の定義、変数変換から導かれます。
| 記号 | 導出での意味 |
| X | 導出中のF確率変数 |
| Y | Vに等しい補助変数 |
| fX,Y | XとYの同時密度 |
| ∂(u,v)/∂(x,y) | 変数変換のJacobian行列式 |
F分布とt分布の関係#
Tが自由度νのt分布に従うなら、T²は分子自由度1、分母自由度νのF分布に従います。Tの分子Zを二乗すると自由度1のカイ二乗分布になり、分母にはもともとU/νが含まれているためです。
なぜ両側確率が一つにまとまるのか?#
t分布は0を中心に左右対称です。両側検定の総有意水準がαなら、左右の裾は各α/2です。二乗するとT≤−|t|とT≥|t|の両方がT²≥t²へ写るため、左右の確率がF分布の右裾一つにまとまります。これが「両側が重なるため確率が2倍になる」という説明の正確な意味です。
補足:密度関数からT²がF分布に従うことを導く
第1段階:F分布の分子自由度を1にする
F分布の密度関数で分子自由度ν₁=1、分母自由度ν₂=νとし、Γ(1/2)=√πと(1/ν)^(1/2)=1/√νを使って係数を整理します。
第2段階:t分布の密度と比較する
自由度νのt密度でt²をyへ置き換えると、y^(-1/2)以外はF(1,ν)の密度と一致します。この追加因子は任意の定数ではなく、二乗変換による横軸尺度の変化を補正するJacobianです。
第3段階:二乗変換で二つのt値が同じF値へ写る
Y=T²とすると、各y>0にはt=√yとt=−√yの二つの元があります。Yの密度はt分布の左右両側の確率を集める必要があり、逆変換t=±√yの導関数の絶対値はいずれも1/(2√y)です。
t分布は左右対称なのでf_T(−√y)=f_T(√y)です。両側を加えた2と導関数中の2が打ち消し合い、1/√y=y^(−1/2)が残ります。
| 記号 | 導出での意味 |
| T | 自由度νのt確率変数 |
| Y=T² | 二乗変換後の非負確率変数 |
| fT | t分布の確率密度関数 |
| fY | 二乗後のYの確率密度関数 |
| 1/(2√y) | t=±√yをyで微分したJacobian補正 |
| F(1,ν) | 分子自由度1、分母自由度νのF分布 |
Fはtの拡張と考えられるか?#
分子自由度が1ならF統計量はt統計量の二乗であり、F検定は両側t検定を正値だけを見る右側検定へ書き換えたものと考えられます。一般のF分布は分子自由度を1より大きくでき、複数の効果を同時に検定できます。この意味では二乗t検定の多自由度への拡張ですが、すべてのF分布が一つのt分布と同じとはいえません。
| 比較方法 | 答える問い | 得られる情報 |
| 全体F検定 | 複数群の平均に少なくとも一つ差があるか? | 全体差を判断するが、どの群が異なるかは直接示さない |
| 2群t検定 | 指定した2群の平均が異なるか? | 差の方向とその組の詳細を示せる |
| 事後の対比較 | 全体Fが有意な後、どの群に差があるか? | 複数の組を比較するが、多重比較による第1種過誤の増加を補正する必要がある |
複数群では、まずF検定で「全体として差があるか」を調べ、次に対ごとのt型比較や事後比較で「どの群が異なるか」を調べられます。ただし未補正のt検定を多数繰り返してはならず、通常はTukey、Bonferroni、Holmなどで全体の誤り率を制御します。
F分布はどこで使うか?#
- 二つの母分散を比較する
- ANOVAで群間変動と群内変動を比較する
- 回帰モデル全体に説明力があるかを検定する
- 入れ子モデルで母数追加による適合改善を比較する
- 分散成分に関する信頼区間や検定を作る