この章の目標
- 確率空間・確率変数・分布・期待値・独立性を測度論の言葉で定義し、確率論の用語と測度論の用語の対応を説明できる
- 分布関数の性質を証明し、代表的な離散分布・連続分布を扱える
- マルコフ・チェビシェフ・イェンセンの不等式を使える
- π-系による独立性の判定とボレル–カンテリの補題を証明し、応用できる
前提:06-measure-integration 第1章、第3章、第5章
1.1 確率空間
サイコロを 1 回振るなら、標本点の集合 Ω={1,…,6} の部分集合 A に確率 ∣A∣/6 を与えればよい。コインを n 回投げるなら Ω={0,1}n(1 が表)で P(A)=∣A∣/2n である。有限の場合、確率は「数えること」で済む。
ところが次の二つの状況では、数えることが破綻する。
- コインを無限回投げる。Ω={0,1}N は非可算で、特定の一つの列が出る確率は 0 である。点の確率を足し合わせて事象の確率を得ることはできない。
- 区間 [0,1] から一様に点を選ぶ。P([a,b])=b−a であってほしいが、これはルベーグ測度そのものであり、ヴィタリの定理(06-measure-integration 第2章 定理 2.16)によって、平行移動で不変という性質を保ったまま [0,1] のすべての部分集合に確率を与えることはできない。
したがって、確率を与える集合(事象)の族を σ-加法族に制限し、確率を測度として公理化する必要がある。これがコルモゴロフ(A. N. Kolmogorov, 1933)の確率論の公理化である。実は上の二つの状況は本質的に同じものである(例 1.32)。
定義 1.1(確率空間, probability space)測度空間 (Ω,F,P) で P(Ω)=1 を満たすものを確率空間という。Ω を標本空間 (sample space)、F の元を事象 (event)、P を確率測度 (probability measure)、P(A) を事象 A の確率という。ある性質が確率 1 の事象の上で成り立つとき、その性質はほとんど確実に (almost surely, a.s.) 成り立つという。
「a.s.」は測度論の「P-a.e.」と同じ意味である。
例 1.2(離散確率空間)Ω を有限または可算集合、p:Ω→[0,1] を ∑ω∈Ωp(ω)=1 を満たす関数とし、F=P(Ω)、P(A)=∑ω∈Ap(ω) とおく。非負項級数は並べ替えても和が変わらないので P は可算加法的であり、(Ω,F,P) は確率空間になる。Ω が有限で p が定数のとき P(A)=∣A∣/∣Ω∣ であり、これが「同様に確からしい」場合の古典的な確率である。
例 1.3(一様分布)Ω=[0,1]、F=B([0,1])、P をルベーグ測度 λ とすると確率空間になる。各点 {ω} の確率は 0 であるが、どれかの点は必ず選ばれる。確率 0 の事象は「起こりえない」事象ではない。
命題 1.4 確率空間 (Ω,F,P) と A,B,An∈F について次が成り立つ。
- P(Ac)=1−P(A)。A⊂B ならば P(A)≤P(B)。
- P(A∪B)=P(A)+P(B)−P(A∩B)。
- (劣加法性)P(⋃nAn)≤∑nP(An)。
- (連続性)An↑A ならば P(An)→P(A)。An↓A ならば P(An)→P(A)。
証明. 1 と 2 は有限加法性を Ω=A⊔Ac、B=A⊔(B∖A)(A⊂B のとき)、A∪B=A⊔(B∖A)、B=(B∖A)⊔(A∩B) に適用すればよい。3 と 4 は一般の測度の性質である(06-measure-integration 第1章 命題 1.19、定理 1.20)。上からの連続性に必要な有限性は P(A1)≤1 で保証される。□
1.2 確率変数と分布
実験で観測するのは多くの場合「数」である。サイコロ 2 個の目の和、n 回のコイン投げでの表の回数などは、標本点 ω に数を対応させる関数である。「和が 7 以下である確率」を問うには {ω∣X(ω)≤7} が事象でなければならない。これが可測性の要請である。
定義 1.5(確率変数, random variable)確率空間 (Ω,F,P) 上の F-可測関数 X:Ω→R を確率変数という。すなわち、任意の B∈B(R) について {X∈B}:=X−1(B)∈F である。Rd 値の可測写像を d 次元確率ベクトル (random vector) という。B(Rd) 上の確率測度
μX(B)=P(X∈B)=P(X−1(B))(B∈B(Rd))
を X の分布 (distribution, law) という。σ(X)={X−1(B)∣B∈B(Rd)} を X が生成する σ-加法族という。
分布 μX は測度論でいう像測度 P∘X−1 である。X と Y の分布が等しいとき X=dY と書く。σ-加法族 σ(X) は「X の値を観測すれば起こったかどうかが判定できる事象」の全体と解釈できる。可測性の判定には、すべての x∈R で {X≤x}∈F を確かめれば十分である(06-measure-integration 第3章)。
定義 1.6(分布関数, distribution function)確率変数 X に対し FX(x)=P(X≤x)(x∈R)を X の分布関数という。
定理 1.7(分布関数の性質)F=FX は次を満たす。
- 単調非減少である。
- 右連続である。
- limx→−∞F(x)=0、limx→∞F(x)=1。
さらに F(x−):=limy↑xF(y)=P(X<x) であり、P(X=x)=F(x)−F(x−) である。逆に、1〜3 を満たす関数 F:R→R に対し、分布関数が F となる確率変数が存在し、その分布は F によって一意に定まる。
証明. x≤y ならば {X≤x}⊂{X≤y} だから 1 が成り立つ。F は単調なので、極限は単調な数列に沿って調べればよい。xn↓x のとき {X≤xn}↓{X≤x} だから、上からの連続性より F(xn)→F(x) となり 2 が従う。xn↓−∞ なら {X≤xn}↓∅、xn↑∞ なら X が実数値なので {X≤xn}↑Ω であり、3 を得る。yn↑x(yn<x)なら {X≤yn}↑{X<x} だから F(x−)=P(X<x) であり、P(X=x)=P(X≤x)−P(X<x) である。
逆を示す。Ω=(0,1)、P=λ とし、u∈(0,1) に対し
X(u)=inf{y∈R∣F(y)≥u}
とおく。Au={y∣F(y)≥u} は、3 より空でなく下に有界であり、1 より y∈Au かつ y′>y ならば y′∈Au を満たす。さらに 2 より下限 X(u) 自身が Au に属するので、Au=[X(u),∞) である。よって
X(u)≤x⟺x∈Au⟺u≤F(x)
であり、{X≤x}=(0,F(x)]∩(0,1) となる。これはボレル集合で測度は F(x) である。ゆえに X は確率変数で FX=F である。一意性:分布関数 F をもつ確率測度は区間 (a,b] に F(b)−F(a) を与え、区間全体と ∅ は B(R) を生成する π-系だから、測度の一意性(06-measure-integration 第1章 系 1.32)により分布は一つに定まる。□
証明で作った X=F−1 を分位点関数 (quantile function) という。U が (0,1) 上の一様分布に従えば F−1(U) の分布関数は F である。計算機で乱数を生成するときの逆関数法はこの事実に基づく。たとえば F(x)=1−e−λx(x≥0)なら F−1(u)=−log(1−u)/λ である。
例 1.9(代表的な離散分布)0<p<1、λ>0 とする。
- ベルヌーイ分布 Be(p):P(X=1)=p、P(X=0)=1−p。表の出る確率が p のコインを 1 回投げたときの表の回数。
- 二項分布 B(n,p):P(X=k)=(kn)pk(1−p)n−k(k=0,1,…,n)。そのコインを n 回投げたときの表の回数。
- 幾何分布 Ge(p):P(X=k)=(1−p)k−1p(k∈N)。初めて表が出るまでに投げる回数。
- ポアソン分布 Po(λ):P(X=k)=e−λλk/k!(k∈Z≥0)。まれな事象の生起回数のモデル(第4章の少数の法則)。
例 1.10(代表的な連続分布)密度関数で与える。a<b、λ>0、m∈R、σ>0 とする。
- 一様分布 U(a,b):f(x)=b−a11(a,b)(x)。
- 指数分布 Exp(λ):f(x)=λe−λx1(0,∞)(x)。待ち時間のモデル。
- 正規分布 N(m,σ2):f(x)=2πσ21exp(−2σ2(x−m)2)。∫f=1 はガウス積分から従う。N(0,1) を標準正規分布といい、その分布関数を Φ と書く。
- コーシー分布:f(x)=π(1+x2)1。Θ∼U(−π/2,π/2) のとき tanΘ がこの分布に従う(問題 1.6)。点 (0,1) から下半平面に向けて一様にランダムな向きに光線を出したとき、それが x 軸と交わる位置の分布である。
平均と分散(1.3 節で定義する)をまとめておく。
| 分布 |
平均 |
分散 |
| B(n,p) |
np |
np(1−p) |
| Ge(p) |
1/p |
(1−p)/p2 |
| Po(λ) |
λ |
λ |
| U(a,b) |
(a+b)/2 |
(b−a)2/12 |
| Exp(λ) |
1/λ |
1/λ2 |
| N(m,σ2) |
m |
σ2 |
| コーシー分布 |
存在しない |
存在しない |
1.3 期待値
サイコロの目 X の「平均的な値」は ∑k=16k⋅61=3.5 である。一般には「値 × その値をとる確率」の和を考えたい。ルベーグ積分はまさに値域を分割して「値 × その値をとる集合の測度」を足し合わせる積分であり、期待値の定義にうってつけである。
定義 1.11(期待値, expectation)確率変数 X≥0 に対し E[X]=∫ΩX dP∈[0,∞] と定める。E[∣X∣]<∞ のとき X は可積分であるといい、E[X]=∫ΩX dP を X の期待値(平均, mean)という。A∈F に対し E[X;A]:=E[X1A] と書く。
期待値は積分なので、線形性・単調性・単調収束定理・ファトゥの補題・優収束定理(06-measure-integration 第3章)がそのまま使える。P(A)=E[1A] である。
定理 1.12(分布による期待値の計算)X を Rd 値確率ベクトル、g:Rd→R をボレル可測関数とする。g≥0 または E[∣g(X)∣]<∞ ならば
E[g(X)]=∫Rdg(x) μX(dx)
特に X が離散分布 P(X=xk)=pk をもてば E[g(X)]=∑kg(xk)pk、密度 f をもてば E[g(X)]=∫g(x)f(x) dx である。
証明. g=1B なら両辺とも P(X∈B)=μX(B) である。線形性により非負単関数で成り立つ。可測な g≥0 に対しては単関数列 0≤gn↑g をとると(06-measure-integration 第3章 定理 3.7)gn(X)↑g(X) なので、両辺に単調収束定理を用いればよい。一般の場合は g=g+−g− と分ける。離散の場合は μX=∑kpkδxk、密度の場合は μX(dx)=f(x) dx に対して同じ議論を行えばよい。□
この定理により、期待値は Ω の取り方によらず分布だけで決まる。確率論で標本空間 Ω を具体的に書かないことが多いのはこのためである。
例 1.13 X∼Exp(λ) なら E[X]=∫0∞xλe−λx dx=1/λ。X∼N(0,1) なら xe−x2/2 が可積分な奇関数なので E[X]=0、部分積分で E[X2]=1。X がコーシー分布に従うと E[∣X∣]=∫Rπ(1+x2)∣x∣ dx=∞ であり、期待値は存在しない。
命題 1.14 X≥0 ならば E[X]=∫0∞P(X>t) dt である。特に任意の確率変数 X について
n=1∑∞P(∣X∣≥n)≤E[∣X∣]≤1+n=1∑∞P(∣X∣≥n)
であり、X が可積分であることと ∑nP(∣X∣≥n)<∞ は同値である。
証明. X(ω)=∫0∞1{X(ω)>t} dt であり、(ω,t)↦X(ω)−t は直積 σ-加法族について可測であるから、トネリの定理(06-measure-integration 第5章 定理 5.6)により積分の順序を交換して最初の式を得る。t∈[n−1,n) のとき {∣X∣≥n}⊂{∣X∣>t}⊂{∣X∣≥n−1} だから、[n−1,n) 上で積分して n≥1 について足せば不等式を得る。□
定義 1.15(モーメントと分散)p>0 に対し E[∣X∣p] を p 次の絶対モーメント、E[Xk] を k 次のモーメント (moment) という。E[X2]<∞ のとき
Var(X)=E[(X−E[X])2]=E[X2]−E[X]2
を分散 (variance)、Var(X) を標準偏差という。E[X2],E[Y2]<∞ のとき Cov(X,Y)=E[(X−E[X])(Y−E[Y])] を共分散 (covariance) といい、Cov(X,Y)=0 のとき X,Y は無相関 (uncorrelated) であるという。
後で見るように確率空間では L2⊂L1 なので(例 1.20)、分散は E[X2]<∞ だけで定義できる。展開すると
Var(i=1∑nXi)=i=1∑nVar(Xi)+2i<j∑Cov(Xi,Xj)
であり、無相関なら分散は加法的である。
例 1.16(期待値の線形性の威力)1,…,n を一様ランダムに並べ替えたとき(n! 通りが同様に確からしい)、自分の位置に留まる数の個数 X の期待値を求める。Ai={i は動かない} とおくと X=∑i1Ai、P(Ai)=(n−1)!/n!=1/n だから、E[X]=∑iP(Ai)=1 である。Ai たちは独立でないが、線形性は独立性を必要としない。
最後に、確率論の用語と測度論の用語の対応をまとめておく。確率論は「全測度が 1 の測度論」であり、定理の多くは測度論の定理をそのまま翻訳したものである。一方で、独立性と条件付けは確率論に固有の概念であり、確率論の個性はそこから生まれる。
| 確率論 |
測度論 |
| 標本空間 Ω、事象 |
全体集合、可測集合 |
| 確率測度 P |
全測度 1 の測度 |
| 確率変数 X |
可測関数 |
| 分布 μX |
像測度 P∘X−1 |
| 分布関数 FX |
ルベーグ–スティルチェス測度を定める単調関数 |
| 確率密度関数 |
ルベーグ測度に関するラドン–ニコディム導関数 |
| 期待値 E[X] |
積分 ∫ΩX dP |
| ほとんど確実に(a.s.) |
ほとんど至るところ(a.e.) |
| 確率収束(第2章) |
測度収束 |
| 独立性(1.5 節) |
直積測度 |
| 条件付き期待値(第5章) |
ラドン–ニコディム導関数 |
1.4 基本的な不等式
分布が完全にはわからなくても、期待値や分散から確率を評価したい場面は多い。
定理 1.17(マルコフの不等式, Markov's inequality)X≥0、a>0 ならば P(X≥a)≤E[X]/a である。より一般に、φ:[0,∞)→[0,∞) が単調非減少で φ(a)>0 ならば P(∣X∣≥a)≤E[φ(∣X∣)]/φ(a) である。
証明. 各点で φ(a)1{∣X∣≥a}≤φ(∣X∣) が成り立つので、期待値をとればよい。□
系 1.18(チェビシェフの不等式, Chebyshev's inequality)E[X2]<∞、a>0 ならば P(∣X−E[X]∣≥a)≤Var(X)/a2 である。
証明. X−E[X] と φ(x)=x2 に定理 1.17 を適用する。□
たとえば公平なコインを 100 回投げたときの表の回数 S は E[S]=50、Var(S)=25 なので P(∣S−50∣≥10)≤1/4 である。実際の値は約 0.057 なので評価は粗いが、分布の形によらず使えるのが強みである。
定理 1.19(イェンセンの不等式, Jensen's inequality)I⊂R を開区間、φ:I→R を凸関数とし、X は可積分で P(X∈I)=1 とする。このとき E[X]∈I であり、E[φ(X)] は (−∞,∞] の値として定まって
φ(E[X])≤E[φ(X)]
証明. m=E[X] とおく。I の左端 a が有限なら X−a>0 a.s. なので E[X−a]≥0 であり、等号なら X=a a.s. となって矛盾するから m>a。右端についても同様で、m∈I である。凸関数の傾き x−mφ(x)−φ(m) は x について単調非減少なので、c=supx<mx−mφ(x)−φ(m) は有限で、すべての x∈I について φ(x)≥φ(m)+c(x−m)(m における支持直線)が成り立つ。凸関数は連続なので φ(X) は確率変数であり、φ(X)≥φ(m)+c(X−m) の右辺は可積分だから φ(X)− は可積分である。期待値をとって E[φ(X)]≥φ(m) を得る。□
例 1.20 (1) φ(x)=x2 として E[X]2≤E[X2]。(2) φ(x)=ex として eE[X]≤E[eX]。(3)(リャプノフの不等式)0<p<q ならば E[∣X∣p]1/p≤E[∣X∣q]1/q。実際、右辺が有限なら ∣X∣p≤1+∣X∣q より Y=∣X∣p は可積分で、凸関数 y↦∣y∣q/p にイェンセンの不等式を使えばよい。特に確率空間では Lq⊂Lp(p<q)である。無限測度の空間ではこの包含は成り立たない(06-measure-integration 第4章)。
1.5 独立性
サイコロを 2 個振るとき「1 個目が 6 かつ 2 個目が 6」の確率は 1/36=61⋅61 である。互いに影響しないという直観を、積の公式で定式化する。
定義 1.21(独立性, independence)
- 事象の族 (Aλ)λ∈Λ が独立であるとは、相異なる任意の有限個の添字 λ1,…,λk について P(Aλ1∩⋯∩Aλk)=P(Aλ1)⋯P(Aλk) が成り立つことをいう。
- 部分集合族 Cλ⊂F(λ∈Λ)が独立であるとは、各 λ について Aλ∈Cλ をどう選んでも (Aλ)λ が独立であることをいう。
- 確率変数(確率ベクトル)の族 (Xλ)λ が独立であるとは、(σ(Xλ))λ が独立であることをいう。
確率変数については、任意の有限個の相異なる添字とボレル集合 Bj について P(Xλ1∈B1,…,Xλk∈Bk)=∏jP(Xλj∈Bj) が成り立つことと同値である。同じ分布をもつ独立な確率変数列を i.i.d.(independent and identically distributed, 独立同分布)という。
例 1.22(対ごとに独立でも独立とは限らない)公平なコインを 2 回投げ、A={1 回目が表}、B={2 回目が表}、C={2 回の結果が一致} とする。どの二つも積の公式を満たす(たとえば P(A∩C)=P(表表)=1/4)が、P(A∩B∩C)=1/4=1/8 である。
独立性を定義どおりに確かめるには、σ-加法族のすべての元について積の公式を調べる必要がある。次の定理により、生成系が π-系ならその上で調べれば十分である。
定理 1.23(π-系による独立性の判定)P1,…,Pn⊂F をそれぞれ π-系とし、任意の Ai∈Pi∪{Ω}(i=1,…,n)について
P(A1∩⋯∩An)=P(A1)⋯P(An)
が成り立つとする。このとき σ(P1),…,σ(Pn) は独立である。
証明. Ai∈Pi∪{Ω}(i=2,…,n)を固定し、C=A2∩⋯∩An、π=P(A2)⋯P(An) とおき
D={A∈F∣P(A∩C)=P(A)π}
とする。D が λ-系であることを示す。仮定で A1=Ω とすれば P(C)=π なので Ω∈D。A∈D なら P(Ac∩C)=P(C)−P(A∩C)=π−P(A)π=P(Ac)π なので Ac∈D。互いに交わらない Bk∈D については、両辺の可算加法性から ⋃kBk∈D。仮定より P1⊂D だから、π-λ 定理(06-measure-integration 第1章 定理 1.30)により σ(P1)⊂D である。こうして、定理の仮定は P1 を π-系 σ(P1) に置き換えても成り立つ。同じ議論を i=2,…,n について順に繰り返すと、すべての Ai∈σ(Pi) について積の公式が成り立つ。一部の Ai を Ω∈σ(Pi) とすれば部分族についての積の公式も得られるので、σ(P1),…,σ(Pn) は独立である。□
系 1.24
- 確率変数 X1,…,Xn が独立であるための必要十分条件は、すべての x1,…,xn∈R について P(X1≤x1,…,Xn≤xn)=∏iP(Xi≤xi) となることである。可算集合に値をとる場合は、すべての値 xi について P(X1=x1,…,Xn=xn)=∏iP(Xi=xi) となることと同値である。
- (グループ化)σ-加法族の族 (Fλ)λ∈Λ が独立で、Λ1,Λ2,… が Λ の互いに交わらない部分集合ならば、Gj=σ(⋃λ∈ΛjFλ) たちは独立である。特に独立な X1,…,Xn とボレル関数 f,g について、f(X1,…,Xk) と g(Xk+1,…,Xn) は独立である。
証明. 1. Pi={{Xi≤x}∣x∈R} は σ(Xi) を生成する π-系である。一部の xi→∞ とすれば、条件は Ai=Ω を許しても成り立つ。定理 1.23 を適用すればよい。可算値の場合は {{Xi=x}}∪{∅} を π-系とし、Ω=⨆x{Xi=x} について和をとれば Ai=Ω の場合も得られる。
- λ1,…,λk∈Λj と Aλl∈Fλl による有限共通部分 Aλ1∩⋯∩Aλk の全体 Pj は、Ω を含み Gj を生成する π-系である。有限個の Pj1,…,Pjm について積の公式が成り立つことは (Fλ) の独立性から従うので、定理 1.23 よりよい。関数については σ(f(X1,…,Xk))⊂σ(X1,…,Xk) に注意すればよい。□
定理 1.25(独立性と直積測度)確率ベクトル X=(X1,…,Xn) について、X1,…,Xn が独立であることと、X の分布が直積測度 μX1⊗⋯⊗μXn に等しいことは同値である。このとき、X1,…,Xn が可積分ならば X1⋯Xn も可積分で
E[X1⋯Xn]=E[X1]⋯E[Xn]
証明. 二つの確率測度 μX と μX1⊗⋯⊗μXn が長方形 B1×⋯×Bn 上で一致することは、独立性の定義そのものである。長方形全体は B(Rn)=B(R)⊗n を生成する π-系なので、測度の一意性(06-measure-integration 第1章 定理 1.31)より同値性が従う。後半は、定理 1.12 とトネリの定理から E[∣X1⋯Xn∣]=∫∣x1∣⋯∣xn∣ d(μX1⊗⋯⊗μXn)=∏iE[∣Xi∣]<∞ であり、絶対値を外した等式はフビニの定理(06-measure-integration 第5章 定理 5.7)から従う。□
特に独立ならば無相関であり、独立な確率変数の和の分散は各分散の和になる。逆は成り立たない。X∼N(0,1)、Y=X2 なら Cov(X,Y)=E[X3]=0 だが、P(∣X∣≤1,Y>1)=0=P(∣X∣≤1)P(Y>1) である。
例 1.26 独立な事象 A1,…,An で P(Ai)=p となるものについて、S=∑i1Ai∼B(n,p) であり、Var(1Ai)=p−p2 だから Var(S)=np(1−p) である。
例 1.27(独立な和と畳み込み)X,Y が独立で密度 f,g をもてば、X+Y は密度 f∗g(06-measure-integration 第5章 定義 5.12)をもつ。実際、定理 1.25 とトネリの定理、変数変換 u=x+y により
P(X+Y≤z)=∬1{x+y≤z}f(x)g(y) dxdy=∫−∞z(∫f(u−y)g(y) dy)du
である。たとえば X,Y∼Exp(λ) が独立なら、X+Y の密度は z>0 で ∫0zλe−λxλe−λ(z−x) dx=λ2ze−λz である(ガンマ分布)。
1.6 ボレル–カンテリの補題
コインを無限回投げるとき、「10 回連続で表」は無限回起こるだろうか。このような「無限にしばしば起こるか」という問いに答える基本道具がボレル–カンテリの補題である。事象列 (An) に対し
n→∞limsupAn=n=1⋂∞k=n⋃∞Ak={ω∣無限個の n で ω∈An}
を {An i.o.}(infinitely often, 無限にしばしば)とも書く。補集合は liminfnAnc=⋃n⋂k≥nAkc(ある番号から先はずっと Anc)である。
定理 1.28(ボレル–カンテリの補題, Borel–Cantelli lemma)A1,A2,⋯∈F とする。
- (第 1 補題)∑nP(An)<∞ ならば P(limsupnAn)=0。
- (第 2 補題)An が独立で ∑nP(An)=∞ ならば P(limsupnAn)=1。
証明. 1. 各 n について P(limsupkAk)≤P(⋃k≥nAk)≤∑k≥nP(Ak) であり、右辺は収束級数の余りなので n→∞ で 0 に収束する。
- 定理 1.23 を π-系 {Ak} に適用すると σ(Ak)={∅,Ak,Akc,Ω} たちが独立なので、Akc たちも独立である。1−x≤e−x を使うと、n≤N について
P(k=n⋂NAkc)=k=n∏N(1−P(Ak))≤exp(−k=n∑NP(Ak))N→∞0
上からの連続性より P(⋂k≥nAkc)=0 であり、可算個の和をとって P(liminfnAnc)=0、すなわち P(limsupnAn)=1 を得る。□
例 1.30(パターンの出現)公平なコインを無限回投げ、Bj を「10j+1 回目から 10j+10 回目までがすべて表」という事象とする。ブロックが重ならないので Bj たちは独立で(系 1.24)、P(Bj)=2−10、∑jP(Bj)=∞ である。第 2 補題より、10 連続の表は確率 1 で無限回現れる。同じ議論で、どんな有限のパターンも確率 1 で無限回現れる。
例 1.31(最大値の増え方)X1,X2,… を Exp(1) に従う i.i.d. とすると P(Xn>clogn)=n−c である。c>1 なら ∑nn−c<∞ なので、第 1 補題より a.s. で有限個の n を除き Xn≤clogn、すなわち limsupnXn/logn≤c である。c=1+1/k(k∈N)について確率 1 の事象の共通部分をとれば limsupnXn/logn≤1 a.s.。一方 c=1 なら ∑n1/n=∞ で事象 {Xn>logn} は独立だから、第 2 補題より limsupnXn/logn≥1 a.s.。ゆえに
n→∞limsuplognXn=1a.s.
1.7 独立な確率変数列の存在
次章以降では「i.i.d. 列 X1,X2,… をとる」ことから議論を始める。有限個なら直積測度 μ1⊗⋯⊗μn 上の座標関数をとればよいが、無限列が存在するかは自明でない。まず、ルベーグ測度そのものが無限回のコイン投げであることを見る。
例 1.32(2 進展開とコイン投げ)Ω=[0,1)、P=λ とし、ω=∑n≥1dn(ω)2−n を 2 進展開とする(有限で終わる展開を選ぶ)。e1,…,en∈{0,1} について {d1=e1,…,dn=en} は長さ 2−n の区間 [a,a+2−n)(a=∑k≤nek2−k)だから
P(d1=e1,…,dn=en)=2−n=k=1∏nP(dk=ek)
である。系 1.24 より d1,d2,… は Be(1/2) に従う i.i.d. である。[0,1) から一様に点を選ぶことは、公平なコインを無限回投げることと同じである。
定理 1.33(独立な確率変数列の存在)R 上の確率測度の列 μ1,μ2,… に対し、([0,1),B([0,1)),λ) 上に独立な確率変数列 X1,X2,… で、各 Xk の分布が μk となるものが存在する。
証明. N を互いに交わらない無限集合 Nk={2k−1(2j−1)∣j∈N}(k∈N)に分け、Nk の j 番目の元を n(k,j) とする。Uk=∑j≥1dn(k,j)2−j とおくと、Uk は σ(dn∣n∈Nk)-可測なので、系 1.24 の 2 より U1,U2,… は独立である。Uk の分布を調べる。2 進区間 I=[a2−m,(a+1)2−m) に対し、事象 {Uk∈I} と「(dn(k,1),…,dn(k,m)) が a の 2 進表示に一致する」という事象の違いは、「j>m で dn(k,j)=1 がずっと続く」という確率 0 の事象に含まれる。よって P(Uk∈I)=2−m=λ(I) である。2 進区間の全体に ∅ を加えた族は B([0,1)) を生成する π-系だから、Uk は U(0,1) に従う(値 1 をとる確率 0 の事象では Uk=0 と定め直す)。最後に Gk を μk の分位点関数(定理 1.7 の証明)として Xk=Gk(Uk) とおけば(Uk=0 となる確率 0 の事象では Xk=0 とする)、Xk の分布は μk で、系 1.24 の 2 より Xk たちは独立である。□
依存関係のある列や、ブラウン運動(第7章)のような非可算個の確率変数の族を構成するには、次の定理が基本になる。
定理 1.34(コルモゴロフの拡張定理, Kolmogorov extension theorem)各 n∈N について Rn 上の確率測度 νn が与えられ、整合性条件 νn+1(B×R)=νn(B)(B∈B(Rn))を満たすとする。このとき、RN 上の直積 σ-加法族(すべての座標写像を可測にする最小の σ-加法族)上の確率測度 P で、すべての n と B∈B(Rn) について P({ω∣(ω1,…,ωn)∈B})=νn(B) を満たすものがただ一つ存在する。
ここでは主張のみ述べる。一意性は筒集合 {(ω1,…,ωn)∈B} の全体が π-系であることから従う。存在の証明は、筒集合の代数上の有限加法的測度が可算加法的であることを Rn 上のボレル確率測度の内部正則性(コンパクト集合による近似)を使って示し、ホップの拡張定理(06-measure-integration 第2章 定理 2.6)を適用する(Durrett の教科書、Billingsley の教科書を参照)。νn=μ1⊗⋯⊗μn とすれば無限直積測度 ⨂kμk が得られ、座標関数 Xk(ω)=ωk が求める独立列になる。添字集合が非可算の場合にも、有限次元分布の整合的な族から確率測度が構成できる。
まとめ
- 確率空間は全測度 1 の測度空間であり、確率変数は可測関数、分布は像測度、期待値はルベーグ積分、「a.s.」は「a.e.」である。
- 分布関数は単調非減少・右連続で、−∞ で 0、∞ で 1 に近づく。逆にこの性質をもつ関数は分位点関数によって確率変数として実現され、分布を一意に定める。
- 期待値 E[g(X)] は分布 μX だけで決まる。E[X]=∫0∞P(X>t) dt(X≥0)。
- マルコフ・チェビシェフの不等式は期待値・分散から確率を評価する。イェンセンの不等式から、確率空間では p<q のとき Lq⊂Lp。
- 独立性は積の公式で定義され、生成系が π-系ならその上で確かめればよい(π-λ 定理)。独立性は分布が直積測度になることと同値である。
- ボレル–カンテリの第 1 補題(和が有限なら有限回しか起こらない)と第 2 補題(独立で和が無限なら無限回起こる)は、a.s. の挙動を調べる基本道具である。
- ルベーグ測度は無限回のコイン投げと同じであり、これを使えば任意の分布をもつ独立列が構成できる。一般にはコルモゴロフの拡張定理による。
演習問題
問題 1.1 ★ 分布関数 F の不連続点は高々可算個であることを示せ。
解答
定理 1.7 より x が不連続点であることと P(X=x)=F(x)−F(x−)>0 は同値である。Dk={x∣P(X=x)>1/k} とおく。Dk の相異なる m 点 x1,…,xm について、事象 {X=xi} は互いに交わらないので m/k<∑iP(X=xi)≤1、よって ∣Dk∣<k である。不連続点全体は ⋃kDk なので高々可算である。
問題 1.2 ★ X∼Ge(p) について P(X>n)=(1−p)n を示し、E[X]=1/p、Var(X)=(1−p)/p2 を導け。
解答
q=1−p とおく。{X>n} は「最初の n 回がすべて裏」なので P(X>n)=∑k>nqk−1p=qn。X は整数値なので命題 1.14 より E[X]=∫0∞P(X>t) dt=∑n≥0P(X>n)=∑n≥0qn=1/p。次に ∑k≥2k(k−1)qk−2=2/(1−q)3(べき級数 ∑kqk=1/(1−q) を 2 回微分)より E[X(X−1)]=pq⋅2/p3=2q/p2。よって
Var(X)=E[X(X−1)]+E[X]−E[X]2=p22q+p1−p21=p22q+p−1=p2q
問題 1.3 ★ X∼Po(λ) について E[X]=Var(X)=λ を示せ。また X∼Po(λ) と Y∼Po(μ) が独立ならば X+Y∼Po(λ+μ) であることを示せ。
解答
E[X]=∑k≥1ke−λλk/k!=λ∑k≥1e−λλk−1/(k−1)!=λ。同様に E[X(X−1)]=λ2 なので Var(X)=λ2+λ−λ2=λ。独立性と二項定理より
P(X+Y=n)=k=0∑ne−λk!λke−μ(n−k)!μn−k=n!e−(λ+μ)k=0∑n(kn)λkμn−k=e−(λ+μ)n!(λ+μ)n
問題 1.4 ★★(無記憶性)X は確率変数で、すべての t≥0 について P(X>t)>0、かつ P(X>0)=1 とする。すべての s,t≥0 について P(X>s+t)=P(X>s)P(X>t) が成り立つ(「s だけ待ったという条件のもとで、さらに t 待つ確率は最初と同じ」)ならば、ある λ>0 について X∼Exp(λ) であることを示せ。
解答
G(t)=P(X>t) とおくと G(0)=1、G>0、G(s+t)=G(s)G(t) であり、G は単調非増加かつ右連続である。G(1)=e−λ(λ≥0)と書くと、G(1/n)n=G(1) より G(1/n)=e−λ/n、さらに G(m/n)=G(1/n)m=e−λm/n である。任意の t≥0 に有理数 rk↓t をとれば右連続性から G(t)=e−λt。t→∞ で G(t)→0(X は実数値)なので λ>0 である。よって FX(t)=1−e−λt(t≥0)、FX(t)=0(t<0)となり、X∼Exp(λ)。
問題 1.5 ★★ 確率変数 X が自分自身と独立(X と X が独立)ならば、ある定数 c について X=c a.s. であることを示せ。
解答
F(x)=P(X≤x,X≤x)=F(x)2 なので F(x)∈{0,1}。F は単調非減少で極限が 0 と 1 だから c=inf{x∣F(x)=1} は有限で、右連続性から F=1[c,∞)。よって P(X=c)=F(c)−F(c−)=1。
問題 1.6 ★★ Θ∼U(−π/2,π/2) とする。X=tanΘ がコーシー分布に従うことを示し、1/X もコーシー分布に従うことを示せ。
解答
tan は (−π/2,π/2) 上で狭義単調増加なので P(X≤x)=P(Θ≤arctanx)=π1(arctanx+2π)。微分して密度 π(1+x2)1 を得る。X=0 a.s. であり、y=0 について P(1/X≤y) を計算すると、y>0 なら P(1/X≤y)=P(X<0)+P(X≥1/y)=21+π1(2π−arctany1)。y>0 で arctan(1/y)=π/2−arctany だから、これは 21+π1arctany に等しく、コーシー分布の分布関数と一致する。y<0 も同様(または対称性 X=d−X を使う)。
問題 1.7 ★★ X1,X2,… を i.i.d. とする。E[∣X1∣]<∞ であることと P(∣Xn∣≥n i.o.)=0 は同値であることを示せ。さらに E[∣X1∣]=∞ ならば limsupn∣Xn∣/n=∞ a.s. であることを示せ。
解答
同分布なので ∑nP(∣Xn∣≥n)=∑nP(∣X1∣≥n) であり、命題 1.14 よりこれが有限であることと E[∣X1∣]<∞ は同値である。有限ならボレル–カンテリの第 1 補題より P(∣Xn∣≥n i.o.)=0。無限なら、事象 {∣Xn∣≥n} は独立なので第 2 補題より確率は 1 である。後半:C∈N について E[∣X1/C∣]=∞ なので、前半を Xn/C に適用して P(∣Xn∣≥Cn i.o.)=1。よって limsupn∣Xn∣/n≥C a.s.。C∈N について共通部分をとればよい。
問題 1.8 ★★★(連の長さ)公平なコインを無限回投げ、ℓn を n 回目から始まる表の連の長さ(n 回目が裏なら 0)とする。limsupnℓn/log2n=1 a.s. を示せ。
解答
P(ℓn≥k)=2−k である。r>1 のとき P(ℓn≥rlog2n)≤2−rlog2n=n−r は総和有限なので、第 1 補題より limsupnℓn/log2n≤r a.s.。r=1+1/k として ≤1 を得る。
逆向きには重ならないブロックを使う。n1=2、nk+1=nk+⌈log2nk⌉ とし、Ak を「nk 回目から nk+1−1 回目までがすべて表」とする。ブロックは重ならないので Ak たちは独立で、Ak⊂{ℓnk≥log2nk}、P(Ak)=2−⌈log2nk⌉≥1/(2nk)。h(x)=1/(xlog2x) は x≥2 で単調減少なので
nk1=nk⌈log2nk⌉nk+1−nk≥2nklog2nknk+1−nk≥21∫nknk+1xlog2xdx
(⌈log2nk⌉≤2log2nk を使った)。nk→∞ なので ∑k1/nk≥21∫2∞xlog2xdx=∞。第 2 補題より Ak は a.s. 無限回起こり、limsupnℓn/log2n≥1 a.s.。
問題 1.9 ★★★ (N,P(N)) 上の確率測度 P で、すべての k∈N について P(kN)=1/k を満たすもの(「自然数からの一様な選択」)は存在しないことを示せ。ただし素数の逆数の和が発散することは用いてよい。
解答
そのような P があったとする。素数 p について Ap=pN とおく。相異なる素数 p1,…,pr について Ap1∩⋯∩Apr=(p1⋯pr)N だから、P(Ap1∩⋯∩Apr)=p1⋯pr1=∏iP(Api) となり、(Ap)p は独立である。∑pP(Ap)=∑p1/p=∞ なので、第 2 補題より「無限個の素数で割り切れる自然数」の集合の確率が 1 になる。しかしそのような自然数は存在しないので矛盾である。(有限加法的な「密度」なら存在しうるが、可算加法性と両立しない。)