Lemma数学ロードマップ

02 線形代数 · 第 6 章

ジョルダン標準形

目安 13〜17 時間定理など 9演習 10 問

この章の目標

  • 一般固有空間分解を証明し、線形変換を固有値ごとの部分に分けて考えられるようになる
  • 冪零変換の標準形をヤング図形で理解し、その存在と一意性を証明できる
  • ジョルダン標準形の存在と一意性を理解し、具体的な行列について標準形と変換行列を計算できる
  • 行列の指数関数を定義・計算し、定数係数線形微分方程式の解を書き下せる
  • 有理標準形や加群の構造定理との関係を知る

前提:第5章(特に補題 5.27 とケーリー–ハミルトンの定理)。6.6 節では級数の絶対収束(微分積分学 第2章)を使う。

6.1 動機:対角化できない行列の「標準形」

第5章で見たように、すべての行列が対角化できるわけではない。例 5.10 の行列(第 1 行 (1,1)(1, 1)、第 2 行 (−1,3)(-1, 3))は固有値 2 しかもたず、固有空間は 1 次元なので、どう基底を選んでも対角行列にはならない。では、相似変換 A↦P−1APA \mapsto P^{-1}AP でどこまで簡単にできるだろうか。

これは「線形変換 f ⁣:V→Vf\colon V \to V を最もよく表す座標系は何か」という問いであり、同時に「二つの行列が相似かどうか(同じ線形変換の異なる座標表示かどうか)をどう判定するか」という相似の分類問題でもある。第3章で見たように、定義域と値域の基底を独立に選べる場合(同値)には不変量は階数だけだった。相似の場合にはるかに豊かな答えがジョルダン標準形である。

定義 6.1(ジョルダン細胞)λ∈K\lambda \in K、k∈Nk \in \mathbb{N} に対し、対角成分がすべて λ\lambda、そのすぐ右上の成分がすべて 11、他が 00 の kk 次正方行列

J(λ,k)=(λ1λ⋱⋱1λ)J(\lambda, k) = \begin{pmatrix} \lambda & 1 & & \\ & \lambda & \ddots & \\ & & \ddots & 1 \\ & & & \lambda \end{pmatrix}

をジョルダン細胞(ジョルダンブロック, Jordan block)という(空白は 0)。ジョルダン細胞を対角に並べたブロック対角行列をジョルダン行列という。

Nk:=J(0,k)N_k := J(0, k) とおくと J(λ,k)=λIk+NkJ(\lambda, k) = \lambda I_k + N_k である。

例 6.2(NkN_k の性質)Nke1=0N_k e_1 = 0、Nkej=ej−1N_k e_j = e_{j-1} (j≥2)(j \geq 2) なので、NkN_k は基本ベクトルを ek↦ek−1↦⋯↦e1↦0e_k \mapsto e_{k-1} \mapsto \cdots \mapsto e_1 \mapsto 0 と一つずつずらす。したがって NkjN_k^j は eje_j 以前を 0 に送り、rank⁡Nkj=k−j\operatorname{rank} N_k^j = k - j (0≤j≤k)(0 \leq j \leq k)、Nkk=ON_k^k = O である。J(λ,k)J(\lambda, k) の固有値は λ\lambda だけで、代数的重複度は kk、幾何的重複度は dim⁡Ker⁡Nk=1\dim \operatorname{Ker} N_k = 1、最小多項式は (t−λ)k(t - \lambda)^k である。k≥2k \geq 2 なら対角化可能でない。

本章の主定理は、固有多項式が一次式の積に分解する(例えば K=CK = \mathbb{C} の)とき、任意の行列はジョルダン行列と相似であり、そのジョルダン行列はブロックの並べ方を除いて一意である、というものである。証明は 2 段階に分かれる:(1) 空間を固有値ごとの「一般固有空間」に分解する(6.2 節)、(2) 各一般固有空間上で「冪零変換」の標準形を求める(6.3 節)。

以下、VV は体 KK 上の nn 次元ベクトル空間、f ⁣:V→Vf\colon V \to V は線形変換とする。

6.2 一般固有空間分解

固有空間 V(λ)=Ker⁡(f−λ)V(\lambda) = \operatorname{Ker}(f - \lambda) だけでは空間全体を覆えないことがある(対角化不可能な場合)。そこで f−λf - \lambda を何回か施して 0 になるベクトルまで範囲を広げる。以下、f−λ idVf - \lambda\ \mathrm{id}_V を f−λf - \lambda と略記する。

定義 6.3(一般固有空間, generalized eigenspace)λ∈K\lambda \in K に対し

W(λ)={v∈V∣ある m∈N について (f−λ)mv=0}=⋃m≥1Ker⁡(f−λ)mW(\lambda) = \lbrace v \in V \mid \text{ある } m \in \mathbb{N} \text{ について } (f - \lambda)^m v = 0 \rbrace = \bigcup_{m \geq 1} \operatorname{Ker}(f - \lambda)^m

を λ\lambda の一般固有空間(広義固有空間)という。

Ker⁡(f−λ)⊂Ker⁡(f−λ)2⊂⋯\operatorname{Ker}(f - \lambda) \subset \operatorname{Ker}(f - \lambda)^2 \subset \cdots は増大列である。ある mm で Ker⁡(f−λ)m=Ker⁡(f−λ)m+1\operatorname{Ker}(f - \lambda)^m = \operatorname{Ker}(f - \lambda)^{m+1} となれば以後一定である:v∈Ker⁡(f−λ)m+2v \in \operatorname{Ker}(f - \lambda)^{m+2} なら (f−λ)v∈Ker⁡(f−λ)m+1=Ker⁡(f−λ)m(f - \lambda)v \in \operatorname{Ker}(f - \lambda)^{m+1} = \operatorname{Ker}(f - \lambda)^m なので v∈Ker⁡(f−λ)m+1v \in \operatorname{Ker}(f - \lambda)^{m+1}。次元は nn 以下なので、真に増える回数は nn 回以下であり、W(λ)=Ker⁡(f−λ)nW(\lambda) = \operatorname{Ker}(f - \lambda)^n は部分空間である。

定理 6.4(一般固有空間分解)Φf(t)=(t−λ1)m1⋯(t−λk)mk\Phi_f(t) = (t - \lambda_1)^{m_1} \cdots (t - \lambda_k)^{m_k}(λ1,…,λk∈K\lambda_1, \dots, \lambda_k \in K は相異なる)と分解するとする。このとき

  1. V=W(λ1)⊕⋯⊕W(λk)V = W(\lambda_1) \oplus \cdots \oplus W(\lambda_k) であり、W(λi)=Ker⁡(f−λi)miW(\lambda_i) = \operatorname{Ker}(f - \lambda_i)^{m_i} は ff-不変である。
  2. dim⁡W(λi)=mi\dim W(\lambda_i) = m_i(代数的重複度)。
  3. f∣W(λi)f\vert_{W(\lambda_i)} の固有値は λi\lambda_i だけであり、(f−λi)∣W(λi)(f - \lambda_i)\vert_{W(\lambda_i)} は冪零である。

証明. Ui=Ker⁡(f−λi)miU_i = \operatorname{Ker}(f - \lambda_i)^{m_i} とおく。多項式 (t−λi)mi(t - \lambda_i)^{m_i} (i=1,…,k)(i = 1, \dots, k) はどの 2 つも互いに素である(モニックな公約元が 1 でなければ根をもち、その根は λi\lambda_i と λj\lambda_j の両方に等しくなってしまう)。ケーリー–ハミルトンの定理より Φf(f)=0\Phi_f(f) = 0 なので、補題 5.27 から V=U1⊕⋯⊕UkV = U_1 \oplus \cdots \oplus U_k で、各 UiU_i は ff-不変である。

3(UiU_i について):UiU_i 上で (f−λi)mi=0(f - \lambda_i)^{m_i} = 0 なので (f−λi)∣Ui(f - \lambda_i)\vert_{U_i} は冪零である。v∈Uiv \in U_i が f(v)=μvf(v) = \mu v, v≠0v \neq 0 を満たせば 0=(f−λi)miv=(μ−λi)miv0 = (f - \lambda_i)^{m_i} v = (\mu - \lambda_i)^{m_i} v より μ=λi\mu = \lambda_i。

2(UiU_i について):V=⨁UiV = \bigoplus U_i に合わせた基底では表現行列はブロック対角になるので、Φf=∏iΦf∣Ui\Phi_f = \prod_i \Phi_{f\vert_{U_i}}(命題 5.18)。各 Φf∣Ui\Phi_{f\vert_{U_i}} は Φf\Phi_f を割り切るので一次式の積であり、その根は f∣Uif\vert_{U_i} の固有値、すなわち λi\lambda_i だけである。よって Φf∣Ui=(t−λi)dim⁡Ui\Phi_{f\vert_{U_i}} = (t - \lambda_i)^{\dim U_i}。K[t]K[t] の因数分解の一意性から dim⁡Ui=mi\dim U_i = m_i。

最後に Ui=W(λi)U_i = W(\lambda_i) を示す。Ui⊂W(λi)U_i \subset W(\lambda_i) は定義から明らか。v∈W(λi)v \in W(\lambda_i) とし、(f−λi)Nv=0(f - \lambda_i)^N v = 0 とする。v=∑jujv = \sum_j u_j(uj∈Uju_j \in U_j)と分解すると、(f−λi)N(f - \lambda_i)^N は各 UjU_j を保つので、直和であることから (f−λi)Nuj=0(f - \lambda_i)^N u_j = 0 がすべての jj で成り立つ。j≠ij \neq i なら λi\lambda_i は f∣Ujf\vert_{U_j} の固有値でないので f−λif - \lambda_i は UjU_j 上で単射であり、uj=0u_j = 0。よって v=ui∈Uiv = u_i \in U_i。□\square

この分解に合わせて基底をとると、ff の表現行列は

(A1⋱Ak),Ai=λiImi+(冪零行列)\begin{pmatrix} A_1 & & \\ & \ddots & \\ & & A_k \end{pmatrix}, \qquad A_i = \lambda_i I_{m_i} + (\text{冪零行列})

というブロック対角行列になる。残る問題は、各ブロックの冪零部分をどこまで簡単にできるかである。

系 6.5(ジョルダン分解, Jordan–Chevalley decomposition)定理 6.4 の仮定のもとで、f=s+νf = s + \nu となる線形変換 s,νs, \nu で、ss は対角化可能、ν\nu は冪零、sν=νss\nu = \nu s を満たすものが存在する。さらに s,νs, \nu は ff の多項式として書ける。

証明. qi=∏j≠i(t−λj)mjq_i = \prod_{j \neq i} (t - \lambda_j)^{m_j} とおく。q1,…,qkq_1, \dots, q_k に共通なモニックな約元は 1 だけである(根をもてばそれはある λj\lambda_j で、qj(λj)≠0q_j(\lambda_j) \neq 0 に反する)。補題 5.26 の証明と同じ議論({∑aiqi}\lbrace \sum a_i q_i \rbrace の次数最小のモニックな元は全 qiq_i を割り切る)により、∑iaiqi=1\sum_i a_i q_i = 1 となる ai∈K[t]a_i \in K[t] がある。πi=ai(f)qi(f)\pi_i = a_i(f)q_i(f) とおく。v∈W(λj)v \in W(\lambda_j) に対し、i≠ji \neq j なら qiq_i は因子 (t−λj)mj(t - \lambda_j)^{m_j} を含むので qi(f)v=0q_i(f)v = 0。よって v=∑iπiv=πjvv = \sum_i \pi_i v = \pi_j v、πiv=0\pi_i v = 0 (i≠j)(i \neq j) となり、πi\pi_i は分解 V=⨁W(λj)V = \bigoplus W(\lambda_j) に関する W(λi)W(\lambda_i) への射影である。s=∑iλiπis = \sum_i \lambda_i \pi_i、ν=f−s\nu = f - s とおくと、ss は W(λi)W(\lambda_i) 上で λi\lambda_i 倍なので対角化可能であり、ν\nu は W(λi)W(\lambda_i) 上で f−λif - \lambda_i に等しいので冪零である。s,νs, \nu は ff の多項式なので互いに可換である。□\square

この分解は一意である(問題 6.9)。

6.3 冪零変換の標準形

この節では WW を mm 次元ベクトル空間、N ⁣:W→WN\colon W \to W を冪零な線形変換(ある pp で Np=0N^p = 0)とする。

定義 6.6(ジョルダン鎖)v∈Wv \in W, v≠0v \neq 0 に対し、Nkv=0N^k v = 0 となる最小の k≥1k \geq 1 を vv の高さという。高さ kk のベクトル vv から作られる列

Nk−1v, Nk−2v, …, Nv, vN^{k-1}v,\ N^{k-2}v,\ \dots,\ Nv,\ v

を長さ kk のジョルダン鎖 (Jordan chain) という。

ジョルダン鎖は一次独立である:∑j=0k−1cjNjv=0\sum_{j=0}^{k-1} c_j N^j v = 0 に Nk−1N^{k-1} を施すと c0Nk−1v=0c_0 N^{k-1}v = 0 より c0=0c_0 = 0、次に Nk−2N^{k-2} を施すと c1=0c_1 = 0、以下同様。鎖が張る部分空間は NN-不変であり、基底 (Nk−1v,…,Nv,v)(N^{k-1}v, \dots, Nv, v) に関する NN の表現行列は、各元が一つ前の元に写る(最初の元は 0 に写る)ので、ちょうど Nk=J(0,k)N_k = J(0, k) である。

定理 6.7(冪零変換の標準形:存在)WW は、いくつかのジョルダン鎖を合わせた基底をもつ。すなわち、v1,…,vr∈Wv_1, \dots, v_r \in W と k1≥⋯≥kr≥1k_1 \geq \cdots \geq k_r \geq 1 が存在して、Nkivi=0N^{k_i}v_i = 0 かつ

{Njvi∣1≤i≤r, 0≤j<ki}\lbrace N^j v_i \mid 1 \leq i \leq r,\ 0 \leq j < k_i \rbrace

は WW の基底である。この基底(各鎖を Nki−1vi,…,viN^{k_i - 1}v_i, \dots, v_i の順に並べる)に関する NN の表現行列は diag⁡(Nk1,…,Nkr)\operatorname{diag}(N_{k_1}, \dots, N_{k_r}) である。

証明. m=dim⁡Wm = \dim W に関する帰納法。m=0m = 0 なら空の基底でよい。m≥1m \geq 1 とする。NN は単射でない(単射なら NpN^p も単射で、Np=0N^p = 0 に反する)ので dim⁡Im⁡N<m\dim \operatorname{Im} N < m である。Im⁡N\operatorname{Im} N は NN-不変で N∣Im⁡NN\vert_{\operatorname{Im} N} は冪零だから、帰納法の仮定により、u1,…,ur∈Im⁡Nu_1, \dots, u_r \in \operatorname{Im} N と l1,…,lr≥1l_1, \dots, l_r \geq 1 で、Nliui=0N^{l_i}u_i = 0 かつ {Njui∣0≤j<li}\lbrace N^j u_i \mid 0 \leq j < l_i \rbrace が Im⁡N\operatorname{Im} N の基底となるものがある(Im⁡N={0}\operatorname{Im} N = \lbrace 0 \rbrace なら r=0r = 0)。

ui∈Im⁡Nu_i \in \operatorname{Im} N なので Nvi=uiNv_i = u_i となる vi∈Wv_i \in W を選ぶ。ベクトル Nlivi=Nli−1uiN^{l_i}v_i = N^{l_i - 1}u_i (i=1,…,r)(i = 1, \dots, r) は Ker⁡N\operatorname{Ker} N に属し(Nliui=0N^{l_i}u_i = 0)、Im⁡N\operatorname{Im} N の基底の一部なので一次独立である。これに w1,…,wsw_1, \dots, w_s を加えて Ker⁡N\operatorname{Ker} N の基底に延長する。このとき

B={Njvi∣1≤i≤r, 0≤j≤li}∪{w1,…,ws}\mathcal{B} = \lbrace N^j v_i \mid 1 \leq i \leq r,\ 0 \leq j \leq l_i \rbrace \cup \lbrace w_1, \dots, w_s \rbrace

が WW の基底であることを示す。viv_i の鎖は長さ li+1l_i + 1、whw_h の鎖は長さ 1(Nwh=0Nw_h = 0)なので、これで主張が示される(最後に長さの順に並べ替える)。

個数:∑i(li+1)+s=dim⁡Im⁡N+(r+s)=dim⁡Im⁡N+dim⁡Ker⁡N=m\sum_i (l_i + 1) + s = \dim \operatorname{Im} N + (r + s) = \dim \operatorname{Im} N + \dim \operatorname{Ker} N = m(次元定理)。

一次独立性:∑i∑j=0licijNjvi+∑hbhwh=0\sum_i \sum_{j=0}^{l_i} c_{ij} N^j v_i + \sum_h b_h w_h = 0 とする。NN を施すと、Nwh=0Nw_h = 0 と Nli+1vi=Nliui=0N^{l_i + 1}v_i = N^{l_i}u_i = 0 から ∑i∑j=0li−1cijNjui=0\sum_i \sum_{j=0}^{l_i - 1} c_{ij} N^j u_i = 0 となり、Im⁡N\operatorname{Im} N の基底の一次独立性から cij=0c_{ij} = 0 (j<li)(j < l_i)。残った式 ∑iciliNlivi+∑hbhwh=0\sum_i c_{i l_i} N^{l_i}v_i + \sum_h b_h w_h = 0 は Ker⁡N\operatorname{Ker} N の基底の一次関係なので、係数はすべて 0。mm 個の一次独立な元なので基底である。□\square

定理 6.8(冪零変換の標準形:一意性)定理 6.7 のような基底について、dj=dim⁡Ker⁡Njd_j = \dim \operatorname{Ker} N^j(d0=0d_0 = 0)とおくと、長さが jj 以上の鎖の本数は

#{i∣ki≥j}=dj−dj−1=rank⁡Nj−1−rank⁡Nj\#\lbrace i \mid k_i \geq j \rbrace = d_j - d_{j-1} = \operatorname{rank} N^{j-1} - \operatorname{rank} N^j

である。したがって鎖の長さの組 (k1,…,kr)(k_1, \dots, k_r) は、基底の選び方によらず NN だけで決まる。

証明. 例 6.2 の計算より dim⁡Ker⁡Nkj=min⁡(j,k)\dim \operatorname{Ker} N_k^j = \min(j, k) で、ブロック対角行列の核は各ブロックの核の直和だから dj=∑imin⁡(j,ki)d_j = \sum_i \min(j, k_i)。min⁡(j,ki)−min⁡(j−1,ki)\min(j, k_i) - \min(j - 1, k_i) は ki≥jk_i \geq j なら 1、そうでなければ 0 なので、差 dj−dj−1d_j - d_{j-1} は ki≥jk_i \geq j となる ii の個数である。後半の等式は次元定理から。数列 ∣{i∣ki≥j}∣\lvert \lbrace i \mid k_i \geq j \rbrace \rvert (j=1,2,… )(j = 1, 2, \dots) がわかれば、各長さの鎖の本数 ∣{i∣ki=j}∣\lvert \lbrace i \mid k_i = j \rbrace \rvert がその差として決まる。□\square

ヤング図形による理解

定理 6.8 は、ヤング図形 (Young diagram) を使うと見通しよく理解できる。鎖の長さ k1≥k2≥⋯≥krk_1 \geq k_2 \geq \cdots \geq k_r は m=∑kim = \sum k_i の分割であり、長さ kik_i の列(縦の並び)を左から順に並べた図形を考える。例えば m=8m = 8、(k1,k2,k3,k4)=(3,2,2,1)(k_1, k_2, k_3, k_4) = (3, 2, 2, 1) なら

□ □ □ □     1 行目: 4 個 = d1 − d0 (鎖の本数 = 固有ベクトルの空間の次元)
□ □ □       2 行目: 3 個 = d2 − d1
□           3 行目: 1 個 = d3 − d2

となる。第 ii 列の上から jj 番目の箱は、ベクトル Nki−jviN^{k_i - j}v_i に対応させる。このベクトルは Ker⁡Nj\operatorname{Ker} N^j に属するが Ker⁡Nj−1\operatorname{Ker} N^{j-1} には属さない(高さがちょうど jj)。したがって

  • 第 1 行の箱は Ker⁡N\operatorname{Ker} N の基底(固有ベクトル)であり、その個数 d1d_1 は鎖の本数に等しい。
  • 上から jj 行目までの箱の総数は dj=dim⁡Ker⁡Njd_j = \dim \operatorname{Ker} N^j に等しい。つまり第 jj 行の長さは dj−dj−1d_j - d_{j-1}。
  • NN は各箱を一つ上の箱に写し、第 1 行の箱を 0 に写す。

ランク(または核の次元)の列 d1,d2,…d_1, d_2, \dots から各行の長さがわかり、図形が決まり、列の長さとして鎖の長さ(ジョルダン細胞のサイズ)が読み取れる。上の例では d1=4d_1 = 4、d2=7d_2 = 7、d3=8d_3 = 8 であり、NN は diag⁡(N3,N2,N2,N1)\operatorname{diag}(N_3, N_2, N_2, N_1) と相似である。

特に、mm 次の冪零行列の相似類は mm の分割と一対一に対応する。例えば 4 次の冪零行列の相似類は、分割 (4),(3,1),(2,2),(2,1,1),(1,1,1,1)(4), (3, 1), (2, 2), (2, 1, 1), (1, 1, 1, 1) に対応する 5 個である。

例 6.9 7 次の冪零行列 NN で rank⁡N=4\operatorname{rank} N = 4、rank⁡N2=2\operatorname{rank} N^2 = 2、rank⁡N3=1\operatorname{rank} N^3 = 1、rank⁡N4=0\operatorname{rank} N^4 = 0 とする。dj=7−rank⁡Njd_j = 7 - \operatorname{rank} N^j は 3,5,6,73, 5, 6, 7 なので、行の長さは 3,2,1,13, 2, 1, 1 である。

□ □ □
□ □
□
□

列の長さは 4,2,14, 2, 1 なので、NN は diag⁡(N4,N2,N1)\operatorname{diag}(N_4, N_2, N_1) と相似である。検算:このジョルダン行列について rank⁡Nj=∑imax⁡(ki−j,0)\operatorname{rank} N^j = \sum_i \max(k_i - j, 0) は j=1,2,3,4j = 1, 2, 3, 4 で 3+1=43 + 1 = 4、22、11、00 となり、与えられた値に一致する。

6.4 ジョルダン標準形の存在と一意性

定理 6.10(ジョルダン標準形, Jordan normal form)Φf(t)\Phi_f(t) が K[t]K[t] で一次式の積に分解するとする(例えば K=CK = \mathbb{C})。このとき VV の基底をうまく選ぶと、ff の表現行列はジョルダン行列

J=(J(μ1,k1)⋱J(μs,ks))J = \begin{pmatrix} J(\mu_1, k_1) & & \\ & \ddots & \\ & & J(\mu_s, k_s) \end{pmatrix}

になる(μ1,…,μs\mu_1, \dots, \mu_s は重複してよい)。このジョルダン行列はブロックの順序を除いて一意であり、各固有値 λ\lambda と j≥1j \geq 1 について

#{固有値 λ、サイズ j 以上のジョルダン細胞}=rank⁡(f−λ)j−1−rank⁡(f−λ)j\#\lbrace \text{固有値 } \lambda \text{、サイズ } j \text{ 以上のジョルダン細胞} \rbrace = \operatorname{rank}(f - \lambda)^{j-1} - \operatorname{rank}(f - \lambda)^j

が成り立つ。JJ を ff(あるいは表現行列 AA)のジョルダン標準形という。

証明. 存在:定理 6.4 により V=⨁iW(λi)V = \bigoplus_i W(\lambda_i) と分解し、各 W(λi)W(\lambda_i) 上の冪零変換 Ni=(f−λi)∣W(λi)N_i = (f - \lambda_i)\vert_{W(\lambda_i)} に定理 6.7 を適用して鎖からなる基底をとる。その基底に関して f∣W(λi)=λi+Nif\vert_{W(\lambda_i)} = \lambda_i + N_i の表現行列は diag⁡(J(λi,ki1),J(λi,ki2),… )\operatorname{diag}(J(\lambda_i, k_{i1}), J(\lambda_i, k_{i2}), \dots) であり、全体を合わせればジョルダン行列になる。

一意性(公式):ff がある基底でジョルダン行列 JJ で表されたとする。rank⁡(J−λI)j\operatorname{rank}(J - \lambda I)^j はブロックごとの階数の和である。固有値 μ≠λ\mu \neq \lambda の細胞では J(μ,k)−λI=(μ−λ)I+NkJ(\mu, k) - \lambda I = (\mu - \lambda)I + N_k は正則なので、その jj 乗の階数は kk で jj によらない。固有値 λ\lambda の細胞では (J(λ,k)−λI)j=Nkj(J(\lambda, k) - \lambda I)^j = N_k^j の階数は max⁡(k−j,0)\max(k - j, 0) である。よって差 rank⁡(J−λI)j−1−rank⁡(J−λI)j\operatorname{rank}(J - \lambda I)^{j-1} - \operatorname{rank}(J - \lambda I)^j では前者の寄与が消え、後者から max⁡(k−j+1,0)−max⁡(k−j,0)\max(k - j + 1, 0) - \max(k - j, 0)、すなわち k≥jk \geq j なら 1、そうでなければ 0 が残る。これは主張の公式であり、右辺は ff だけで決まる(表現行列の階数は写像の階数)ので、各固有値・各サイズの細胞の個数は ff で決まる。□\square

系 6.11 A,B∈M⁡n(C)A, B \in \operatorname{M}_n(\mathbb{C}) とする。

  1. AA と BB が相似   ⟺  \iff ジョルダン標準形が(ブロックの順序を除いて)一致する   ⟺  \iff すべての λ∈C\lambda \in \mathbb{C} と j≥1j \geq 1 で rank⁡(A−λI)j=rank⁡(B−λI)j\operatorname{rank}(A - \lambda I)^j = \operatorname{rank}(B - \lambda I)^j。
  2. 固有値 λ\lambda の代数的重複度は λ\lambda の細胞のサイズの和、幾何的重複度は λ\lambda の細胞の個数である。
  3. μA(t)=∏λ(t−λ)eλ\mu_A(t) = \prod_\lambda (t - \lambda)^{e_\lambda}、ここで eλe_\lambda は λ\lambda の細胞の最大サイズである。特に、AA が対角化可能   ⟺  \iff すべての細胞のサイズが 1。

証明. 1:相似な行列は同じ線形変換を表すので、定理 6.10 の一意性から同じ標準形をもつ。逆に同じ標準形 JJ をもてば A∼J∼BA \sim J \sim B。二つ目の同値は定理 6.10 の公式から(階数は相似で不変)。2:dim⁡W(λ)\dim W(\lambda) と dim⁡Ker⁡(A−λI)\dim \operatorname{Ker}(A - \lambda I) を JJ で数える。3:ブロック対角行列 diag⁡(J1,…,Js)\operatorname{diag}(J_1, \dots, J_s) に多項式 pp を代入すると diag⁡(p(J1),…,p(Js))\operatorname{diag}(p(J_1), \dots, p(J_s)) なので、p(J)=O  ⟺  p(J) = O \iff すべての ii で μJi=(t−μi)ki\mu_{J_i} = (t - \mu_i)^{k_i} が pp を割り切る。そのような pp のうち次数最小のモニックなものが主張の形である。□\square

補足

K=RK = \mathbb{R} で固有多項式が実数の範囲で分解しない場合、R\mathbb{R} 上のジョルダン標準形は存在しない。そのときは、複素共役な固有値の対 a±bia \pm bi (b≠0)(b \neq 0) を、第 1 行が (a,−b)(a, -b)、第 2 行が (b,a)(b, a) の 2 次実行列をブロックとしてまとめた「実ジョルダン標準形」を使う。より一般の体では 6.8 節の有理標準形を使う。

6.5 計算手順と例

ジョルダン標準形 JJ と、P−1AP=JP^{-1}AP = J となる変換行列 PP は、次の手順で求められる。

  1. 固有多項式 ΦA\Phi_A を計算し、固有値 λ\lambda と代数的重複度 m(λ)m(\lambda) を求める。
  2. 各固有値 λ\lambda について rj=rank⁡(A−λI)jr_j = \operatorname{rank}(A - \lambda I)^j を j=1,2,…j = 1, 2, \dots と計算し、dj=n−rjd_j = n - r_j が m(λ)m(\lambda) に達したら止める。
  3. dj−dj−1d_j - d_{j-1} を行の長さとするヤング図形を描き、列の長さ(細胞のサイズ)を読み取って JJ を決める。
  4. PP を求めるには、各固有値の各鎖について、鎖の先頭 vv(高さ kk、すなわち v∈Ker⁡(A−λI)kv \in \operatorname{Ker}(A - \lambda I)^k だが v∉Ker⁡(A−λI)k−1v \notin \operatorname{Ker}(A - \lambda I)^{k-1})を選び、(A−λI)k−1v,…,(A−λI)v,v(A - \lambda I)^{k-1}v, \dots, (A - \lambda I)v, v をこの順に PP の列に並べる。同じ固有値に複数の鎖があるときは、全体が一次独立になるように先頭を選ぶ(長い鎖から順に選ぶとよい)。

鎖の並べ方 (Nk−1v,…,Nv,v)(N^{k-1}v, \dots, Nv, v) を逆にすると、1 が対角のすぐ下に並ぶ行列になってしまうので注意する。

例 6.12(固有値が 2 種類)次の行列 CC を考える。

C=(21−1−111011)C = \begin{pmatrix} 2 & 1 & -1 \\ -1 & 1 & 1 \\ 0 & 1 & 1 \end{pmatrix}

第 1 行で展開して det⁡C=2(1−1)−(−1−0)+(−1)(−1−0)=2\det C = 2(1 - 1) - (-1 - 0) + (-1)(-1 - 0) = 2、tr⁡C=4\operatorname{tr} C = 4 である。ΦC(t)=(t−1)2(t−2)\Phi_C(t) = (t - 1)^2(t - 2)(展開して確かめよ。tr⁡\operatorname{tr} と det⁡\det はこれと整合する)。

λ=1\lambda = 1:C−IC - I の第 1 行 (1,1,−1)(1, 1, -1)、第 2 行 (−1,0,1)(-1, 0, 1)、第 3 行 (0,1,0)(0, 1, 0) で、第 1 行 ++ 第 2 行 == 第 3 行なので階数 2、d1=1<2=m(1)d_1 = 1 < 2 = m(1)。よって固有値 1 の細胞は 1 個でサイズ 2。(C−I)2(C - I)^2 を計算すると第 1 行が 0、第 2, 3 行がともに (−1,0,1)(-1, 0, 1) となり、Ker⁡(C−I)2={x1=x3}\operatorname{Ker}(C - I)^2 = \lbrace x_1 = x_3 \rbrace(2 次元)である。鎖の先頭として Ker⁡(C−I)2\operatorname{Ker}(C - I)^2 の元で Ker⁡(C−I)\operatorname{Ker}(C - I) に属さない v=t(0,1,0)v = {}^t(0, 1, 0) を選ぶと、(C−I)v=t(1,0,1)(C - I)v = {}^t(1, 0, 1)(C−IC - I の第 2 列)。

λ=2\lambda = 2:(C−2I)x=0(C - 2I)x = 0 は x2−x3=0x_2 - x_3 = 0、−x1−x2+x3=0-x_1 - x_2 + x_3 = 0 で、固有ベクトル t(0,1,1){}^t(0, 1, 1)。

P=(100011101),P−1CP=(110010002)P = \begin{pmatrix} 1 & 0 & 0 \\ 0 & 1 & 1 \\ 1 & 0 & 1 \end{pmatrix}, \qquad P^{-1}CP = \begin{pmatrix} 1 & 1 & 0 \\ 0 & 1 & 0 \\ 0 & 0 & 2 \end{pmatrix}

検算:CP=PJCP = PJ を列ごとに確かめる。C t(1,0,1)=t(1,0,1)C\ {}^t(1, 0, 1) = {}^t(1, 0, 1)(固有値 1)、C t(0,1,0)=t(1,1,1)=t(0,1,0)+t(1,0,1)C\ {}^t(0, 1, 0) = {}^t(1, 1, 1) = {}^t(0, 1, 0) + {}^t(1, 0, 1)、C t(0,1,1)=t(0,2,2)C\ {}^t(0, 1, 1) = {}^t(0, 2, 2)。また det⁡P=1≠0\det P = 1 \neq 0。

例 6.13(固有値が 1 種類、細胞が 2 個)

A=(31−1020111)A = \begin{pmatrix} 3 & 1 & -1 \\ 0 & 2 & 0 \\ 1 & 1 & 1 \end{pmatrix}

ΦA(t)=(t−2)3\Phi_A(t) = (t - 2)^3 である(第 2 行で展開すると ΦA=(t−2)((t−3)(t−1)+1)=(t−2)(t−2)2\Phi_A = (t - 2)\left((t - 3)(t - 1) + 1\right) = (t - 2)(t - 2)^2)。N=A−2IN = A - 2I の各行は (1,1,−1)(1, 1, -1)、(0,0,0)(0, 0, 0)、(1,1,−1)(1, 1, -1) で rank⁡N=1\operatorname{rank} N = 1、d1=2d_1 = 2。また N2=ON^2 = O(NN の列ベクトル t(1,0,1){}^t(1, 0, 1) と行ベクトル (1,1,−1)(1, 1, -1) の積が 1+0−1=01 + 0 - 1 = 0 だから)なので d2=3d_2 = 3。ヤング図形の行の長さは 2,12, 1、列の長さは 2,12, 1 で、

J=(210020002)J = \begin{pmatrix} 2 & 1 & 0 \\ 0 & 2 & 0 \\ 0 & 0 & 2 \end{pmatrix}

長さ 2 の鎖の先頭に v=e1∉Ker⁡Nv = e_1 \notin \operatorname{Ker} N をとると Nv=t(1,0,1)Nv = {}^t(1, 0, 1)。長さ 1 の鎖には、Ker⁡N={x1+x2−x3=0}\operatorname{Ker} N = \lbrace x_1 + x_2 - x_3 = 0 \rbrace の元で t(1,0,1){}^t(1, 0, 1) と一次独立な t(0,1,1){}^t(0, 1, 1) をとる。

P=(110001101)P = \begin{pmatrix} 1 & 1 & 0 \\ 0 & 0 & 1 \\ 1 & 0 & 1 \end{pmatrix}

検算:A t(1,0,1)=t(2,0,2)A\ {}^t(1, 0, 1) = {}^t(2, 0, 2)、Ae1=t(3,0,1)=2e1+t(1,0,1)A e_1 = {}^t(3, 0, 1) = 2e_1 + {}^t(1, 0, 1)、A t(0,1,1)=t(0,2,2)A\ {}^t(0, 1, 1) = {}^t(0, 2, 2)。det⁡P=1\det P = 1。

例 6.14(細胞が 1 個)

B=(110−111011),N=B−I=(010−101010),N2=(−101000−101)B = \begin{pmatrix} 1 & 1 & 0 \\ -1 & 1 & 1 \\ 0 & 1 & 1 \end{pmatrix}, \qquad N = B - I = \begin{pmatrix} 0 & 1 & 0 \\ -1 & 0 & 1 \\ 0 & 1 & 0 \end{pmatrix}, \qquad N^2 = \begin{pmatrix} -1 & 0 & 1 \\ 0 & 0 & 0 \\ -1 & 0 & 1 \end{pmatrix}

N3=ON^3 = O が確かめられる(N2N^2 の行 (−1,0,1)(-1, 0, 1) と NN の各列の積が 0)。ΦB(t)=(t−1)3\Phi_B(t) = (t - 1)^3 であり(NN が冪零なので BB の固有値は 1 のみ)、rank⁡N=2\operatorname{rank} N = 2、rank⁡N2=1\operatorname{rank} N^2 = 1 より d1,d2,d3=1,2,3d_1, d_2, d_3 = 1, 2, 3、ヤング図形は 1 列 3 行で、J=J(1,3)J = J(1, 3)。先頭 v=e1v = e_1(N2e1=t(−1,0,−1)≠0N^2 e_1 = {}^t(-1, 0, -1) \neq 0)から鎖 N2v=t(−1,0,−1)N^2 v = {}^t(-1, 0, -1)、Nv=t(0,−1,0)Nv = {}^t(0, -1, 0)、v=t(1,0,0)v = {}^t(1, 0, 0) を得て

P=(−1010−10−100),P−1BP=(110011001)P = \begin{pmatrix} -1 & 0 & 1 \\ 0 & -1 & 0 \\ -1 & 0 & 0 \end{pmatrix}, \qquad P^{-1}BP = \begin{pmatrix} 1 & 1 & 0 \\ 0 & 1 & 1 \\ 0 & 0 & 1 \end{pmatrix}

(det⁡P=−1≠0\det P = -1 \neq 0)。

例 6.15(階数だけから決める)A∈M⁡6(C)A \in \operatorname{M}_6(\mathbb{C}) が ΦA=(t−2)4(t+1)2\Phi_A = (t - 2)^4(t + 1)^2、rank⁡(A−2I)=4\operatorname{rank}(A - 2I) = 4、rank⁡(A−2I)2=3\operatorname{rank}(A - 2I)^2 = 3、rank⁡(A−2I)3=2\operatorname{rank}(A - 2I)^3 = 2、rank⁡(A+I)=5\operatorname{rank}(A + I) = 5 を満たすとする。λ=2\lambda = 2 では dj=6−rjd_j = 6 - r_j が 2,3,42, 3, 4 で m(2)=4m(2) = 4 に達するので、行の長さ 2,1,12, 1, 1、列の長さ 3,13, 1。λ=−1\lambda = -1 では d1=1d_1 = 1 なので細胞は 1 個で、サイズは m(−1)=2m(-1) = 2。よって

J=J(2,3)⊕J(2,1)⊕J(−1,2),μA(t)=(t−2)3(t+1)2J = J(2, 3) \oplus J(2, 1) \oplus J(-1, 2), \qquad \mu_A(t) = (t - 2)^3 (t + 1)^2

(⊕\oplus はブロック対角に並べることを表す)。

6.6 行列の指数関数

この節では K=RK = \mathbb{R} または C\mathbb{C} とする。ジョルダン標準形の重要な応用は、行列の関数、特に指数関数の計算である。

行列 A=(aij)∈M⁡n(K)A = (a_{ij}) \in \operatorname{M}_n(K) に対し ∥A∥max⁡=max⁡i,j∣aij∣\lVert A \rVert_{\max} = \max_{i,j} \lvert a_{ij} \rvert とおくと、∣(AB)ij∣≤∑l∣ail∣∣blj∣≤n∥A∥max⁡∥B∥max⁡\lvert (AB)_{ij} \rvert \leq \sum_l \lvert a_{il} \rvert \lvert b_{lj} \rvert \leq n \lVert A \rVert_{\max} \lVert B \rVert_{\max} より ∥Ak∥max⁡≤nk−1∥A∥max⁡k\lVert A^k \rVert_{\max} \leq n^{k-1} \lVert A \rVert_{\max}^k である。よって各成分について

∑k=0∞∣(Ak)ij∣k!≤1+∑k=1∞(n∥A∥max⁡)kn⋅k!<∞\sum_{k=0}^{\infty} \frac{\lvert (A^k)_{ij} \rvert}{k!} \leq 1 + \sum_{k=1}^{\infty} \frac{(n \lVert A \rVert_{\max})^k}{n \cdot k!} < \infty

となり、次の級数は成分ごとに絶対収束する。

定義 6.16(行列の指数関数)A∈M⁡n(K)A \in \operatorname{M}_n(K) に対し eA=exp⁡A=∑k=0∞Akk!\displaystyle e^A = \exp A = \sum_{k=0}^{\infty} \frac{A^k}{k!} と定める(A0=IA^0 = I)。

命題 6.17

  1. eO=Ie^O = I。P∈GL⁡n(K)P \in \operatorname{GL}_n(K) に対し ePAP−1=PeAP−1e^{PAP^{-1}} = Pe^AP^{-1}。ブロック対角行列 diag⁡(A1,…,As)\operatorname{diag}(A_1, \dots, A_s) の指数関数は diag⁡(eA1,…,eAs)\operatorname{diag}(e^{A_1}, \dots, e^{A_s})。
  2. AB=BAAB = BA ならば eA+B=eAeBe^{A+B} = e^A e^B。特に eAe^A は正則で (eA)−1=e−A(e^A)^{-1} = e^{-A}。
  3. t∈Rt \in \mathbb{R} の関数として ddtetA=AetA=etAA\dfrac{d}{dt} e^{tA} = Ae^{tA} = e^{tA}A。
  4. det⁡eA=etr⁡A\det e^A = e^{\operatorname{tr} A}。

証明. 1:(PAP−1)k=PAkP−1(PAP^{-1})^k = PA^kP^{-1} なので部分和で等式が成り立ち、極限をとればよい。ブロック対角も同様。

2:AB=BAAB = BA なら二項定理 (A+B)k=∑i+j=kk!i!j!AiBj(A + B)^k = \sum_{i+j=k} \frac{k!}{i!j!}A^iB^j が成り立つので

∑k=0∞(A+B)kk!=∑k=0∞∑i+j=kAii!Bjj!\sum_{k=0}^\infty \frac{(A + B)^k}{k!} = \sum_{k=0}^{\infty} \sum_{i+j=k} \frac{A^i}{i!} \frac{B^j}{j!}

右辺は二重級数 ∑i,jAii!Bjj!\sum_{i,j} \frac{A^i}{i!}\frac{B^j}{j!} を i+ji + j ごとにまとめたものであり、この二重級数は成分ごとに絶対収束する(上の評価による)ので、和の順序を変えて (∑iAii!)(∑jBjj!)=eAeB\left(\sum_i \frac{A^i}{i!}\right)\left(\sum_j \frac{B^j}{j!}\right) = e^Ae^B に等しい(級数の積についてのコーシー積の定理、微分積分学 第2章)。B=−AB = -A とすれば eAe−A=eO=Ie^Ae^{-A} = e^O = I。

3:etAe^{tA} の各成分は tt のべき級数 ∑ktkk!(Ak)ij\sum_k \frac{t^k}{k!}(A^k)_{ij} で、収束半径は無限大である。べき級数は項別微分できる(微分積分学 第6章)ので、ddtetA=∑k≥1tk−1(k−1)!Ak=AetA\frac{d}{dt}e^{tA} = \sum_{k \geq 1} \frac{t^{k-1}}{(k-1)!}A^k = Ae^{tA}。AA と etAe^{tA} が可換なことは部分和から明らか。

4:C\mathbb{C} 上で三角化して A=PTP−1A = PTP^{-1}(TT は上三角、対角成分 λ1,…,λn\lambda_1, \dots, \lambda_n)とする。TkT^k は上三角で対角成分は λik\lambda_i^k なので、eTe^T は対角成分 eλie^{\lambda_i} の上三角行列である。よって det⁡eA=det⁡eT=∏ieλi=e∑iλi=etr⁡A\det e^A = \det e^T = \prod_i e^{\lambda_i} = e^{\sum_i \lambda_i} = e^{\operatorname{tr} A}(系 5.20)。□\square

注意

AB≠BAAB \neq BA のとき、eA+B=eAeBe^{A+B} = e^Ae^B は一般に成り立たない。A=E12A = E_{12}、B=E21B = E_{21}(2 次)とすると、A2=B2=OA^2 = B^2 = O より eA=I+Ae^A = I + A、eB=I+Be^B = I + B で、eAeBe^Ae^B は第 1 行 (2,1)(2, 1)、第 2 行 (1,1)(1, 1) の行列である。一方 (A+B)2=I(A + B)^2 = I より eA+B=(cosh⁡1)I+(sinh⁡1)(A+B)e^{A+B} = (\cosh 1)I + (\sinh 1)(A + B) で、その (1,1)(1, 1) 成分 cosh⁡1≈1.543\cosh 1 \approx 1.543 は 2 でない。

ジョルダン細胞の指数関数. J(λ,k)=λI+NkJ(\lambda, k) = \lambda I + N_k で λI\lambda I と NkN_k は可換、Nkk=ON_k^k = O なので、命題 6.17 の 2 より

etJ(λ,k)=eλtetNk=eλt∑j=0k−1tjj!Nkj,例えばetJ(λ,3)=eλt(1tt2/201t001)e^{tJ(\lambda, k)} = e^{\lambda t} e^{tN_k} = e^{\lambda t} \sum_{j=0}^{k-1} \frac{t^j}{j!} N_k^j, \qquad \text{例えば} \quad e^{tJ(\lambda, 3)} = e^{\lambda t} \begin{pmatrix} 1 & t & t^2/2 \\ 0 & 1 & t \\ 0 & 0 & 1 \end{pmatrix}

となる。一般の AA については、A=PJP−1A = PJP^{-1} なら etA=PetJP−1e^{tA} = Pe^{tJ}P^{-1} で、etJe^{tJ} はブロックごとに上の形になる。固有値が一つだけのときは、A=λI+NA = \lambda I + N(NN は冪零)と書いて直接計算する方が速い。

例 6.18 例 6.13 の A=2I+NA = 2I + N、N2=ON^2 = O について

etA=e2t(I+tN)=e2t(1+tt−t010tt1−t)e^{tA} = e^{2t}(I + tN) = e^{2t} \begin{pmatrix} 1 + t & t & -t \\ 0 & 1 & 0 \\ t & t & 1 - t \end{pmatrix}

例 6.14 の B=I+NB = I + N、N3=ON^3 = O について

etB=et(I+tN+t22N2)=et(1−t2/2tt2/2−t1t−t2/2t1+t2/2)e^{tB} = e^{t}\left(I + tN + \frac{t^2}{2}N^2\right) = e^t \begin{pmatrix} 1 - t^2/2 & t & t^2/2 \\ -t & 1 & t \\ -t^2/2 & t & 1 + t^2/2 \end{pmatrix}

t=0t = 0 で II になること、det⁡etA=e6t=ettr⁡A\det e^{tA} = e^{6t} = e^{t \operatorname{tr} A} を確かめよ(前者の行列部分の行列式は 1)。

例 6.19(回転)AA を第 1 行 (0,−1)(0, -1)、第 2 行 (1,0)(1, 0) の行列とすると A2=−IA^2 = -I なので、偶数次と奇数次の項に分けて

etA=∑j(−1)jt2j(2j)!I+∑j(−1)jt2j+1(2j+1)!A=(cos⁡t)I+(sin⁡t)A=(cos⁡t−sin⁡tsin⁡tcos⁡t)e^{tA} = \sum_{j} \frac{(-1)^j t^{2j}}{(2j)!} I + \sum_j \frac{(-1)^j t^{2j+1}}{(2j+1)!} A = (\cos t) I + (\sin t) A = \begin{pmatrix} \cos t & -\sin t \\ \sin t & \cos t \end{pmatrix}

となり、回転行列 R(t)R(t) が得られる。これはオイラーの公式 eit=cos⁡t+isin⁡te^{it} = \cos t + i\sin t の行列版であり、AA は回転の「無限小生成子」である(リー群と表現論 第2章)。

6.7 定数係数線形微分方程式への応用

定理 6.20 A∈M⁡n(K)A \in \operatorname{M}_n(K)、x0∈Knx_0 \in K^n とする。微分可能な関数 x ⁣:R→Knx\colon \mathbb{R} \to K^n で

x′(t)=Ax(t),x(0)=x0x'(t) = Ax(t), \qquad x(0) = x_0

を満たすものはただ一つ存在し、x(t)=etAx0x(t) = e^{tA}x_0 で与えられる。

証明. 存在:命題 6.17 の 3 より ddt(etAx0)=AetAx0\frac{d}{dt}(e^{tA}x_0) = Ae^{tA}x_0、また e0x0=x0e^{0}x_0 = x_0。一意性:y(t)y(t) を解とすると、積の微分法則(成分ごとに成り立つ)と命題 6.17 の 3 から

ddt(e−tAy(t))=−Ae−tAy(t)+e−tAAy(t)=0\frac{d}{dt}\left(e^{-tA}y(t)\right) = -Ae^{-tA}y(t) + e^{-tA}Ay(t) = 0

(AA と e−tAe^{-tA} は可換)。よって e−tAy(t)e^{-tA}y(t) は定数ベクトルで y(0)=x0y(0) = x_0 に等しく、y(t)=etAx0y(t) = e^{tA}x_0。□\square

解全体は初期値 x0∈Knx_0 \in K^n と一対一に対応する nn 次元のベクトル空間である。ジョルダン標準形からわかるように、解の成分は tjeλtt^j e^{\lambda t}(λ\lambda は固有値、jj はその固有値の細胞の最大サイズ未満)の一次結合である。対角化可能なら指数関数 eλte^{\lambda t} だけで書け、対角化できないときに teλt,t2eλt,…te^{\lambda t}, t^2e^{\lambda t}, \dots が現れる。また、すべての固有値の実部が負なら t→∞t \to \infty で etA→Oe^{tA} \to O となり、解は 0 に収束する(安定性、微分方程式 第4章)。

例 6.21 2 階の方程式 x′′−2x′+x=0x'' - 2x' + x = 0 は、y=t(x,x′)y = {}^t(x, x') とおくと y′=Myy' = My、

M=(01−12)M = \begin{pmatrix} 0 & 1 \\ -1 & 2 \end{pmatrix}

と書ける。ΦM(t)=t2−2t+1=(t−1)2\Phi_M(t) = t^2 - 2t + 1 = (t - 1)^2 で、M−IM - I の 2 行はともに (−1,1)(-1, 1) の定数倍(第 1 行 (−1,1)(-1, 1)、第 2 行 (−1,1)(-1, 1))なので (M−I)2=O(M - I)^2 = O である。よって

etM=et(I+t(M−I))=et(1−tt−t1+t)e^{tM} = e^t(I + t(M - I)) = e^t \begin{pmatrix} 1 - t & t \\ -t & 1 + t \end{pmatrix}

であり、x(t)=et((1−t)x(0)+tx′(0))x(t) = e^t\left((1 - t)x(0) + t x'(0)\right)。解空間の基底は et,tete^t, te^t である。検算:x=et(a+(b−a)t)x = e^t(a + (b - a)t) とおくと x(0)=ax(0) = a、x′=et(b+(b−a)t)x' = e^t(b + (b - a)t) で x′(0)=bx'(0) = b、x′′=et(2b−a+(b−a)t)x'' = e^t(2b - a + (b - a)t) となり、x′′−2x′+x=et((2b−a)−2b+a)+ett((b−a)−2(b−a)+(b−a))=0x'' - 2x' + x = e^t\left((2b - a) - 2b + a\right) + e^t t\left((b - a) - 2(b - a) + (b - a)\right) = 0。

例 6.22(重根をもつ漸化式)漸化式 an+2=2αan+1−α2ana_{n+2} = 2\alpha a_{n+1} - \alpha^2 a_n(α≠0\alpha \neq 0)の係数行列は固有値 α\alpha の重根をもち、αI+N\alpha I + N(N2=ON^2 = O)の形のジョルダン標準形 J(α,2)J(\alpha, 2) をもつ。(αI+N)n=αnI+nαn−1N(\alpha I + N)^n = \alpha^n I + n\alpha^{n-1}N(二項定理)より、一般項は an=(c1+c2n)αna_n = (c_1 + c_2 n)\alpha^n の形になる。例 5.35 の後で予告した「nαnn\alpha^n 型の解」はここから現れる。

線形微分方程式系の一般論(変数係数の場合、基本解行列、非同次方程式)は微分方程式 第3章で扱う。

6.8 有理標準形と加群の構造定理

固有多項式が一次式の積に分解しない体(Q\mathbb{Q} や R\mathbb{R})では、ジョルダン標準形は使えない。その代わりになるのが有理標準形(フロベニウス標準形)である。モニック多項式 p(t)=tm+cm−1tm−1+⋯+c0p(t) = t^m + c_{m-1}t^{m-1} + \cdots + c_0 に対し、

C(p)=(00⋯0−c010⋯0−c101⋯0−c2⋮⋱⋮00⋯1−cm−1)C(p) = \begin{pmatrix} 0 & 0 & \cdots & 0 & -c_0 \\ 1 & 0 & \cdots & 0 & -c_1 \\ 0 & 1 & \cdots & 0 & -c_2 \\ \vdots & & \ddots & & \vdots \\ 0 & 0 & \cdots & 1 & -c_{m-1} \end{pmatrix}

を pp の同伴行列(コンパニオン行列)という。C(p)C(p) は e1↦e2↦⋯↦eme_1 \mapsto e_2 \mapsto \cdots \mapsto e_m と写し、ΦC(p)=μC(p)=p\Phi_{C(p)} = \mu_{C(p)} = p である(最後の列で展開すれば確かめられる)。次の定理が成り立つ。

定理 6.23(有理標準形, rational canonical form)任意の体 KK 上で、任意の A∈M⁡n(K)A \in \operatorname{M}_n(K) は、p1∣p2∣⋯∣psp_1 \mid p_2 \mid \cdots \mid p_s を満たすモニック多項式(不変因子, invariant factors)の同伴行列を対角に並べた行列 diag⁡(C(p1),…,C(ps))\operatorname{diag}(C(p_1), \dots, C(p_s)) と KK 上で相似であり、不変因子は AA によって一意に定まる。さらに ps=μAp_s = \mu_A、p1⋯ps=ΦAp_1 \cdots p_s = \Phi_A である。

本科目ではこの定理の証明は省略する(以下に述べる加群の構造定理から従う。代数学 第7章を参照)。

この定理とジョルダン標準形は、ともに次の観点から統一的に理解される。線形変換 ff が与えられたとき、VV に多項式の作用 p(t)⋅v:=p(f)(v)p(t) \cdot v := p(f)(v) を入れると、VV は多項式環 K[t]K[t] 上の加群になる。K[t]K[t] は単項イデアル整域なので、単項イデアル整域上の有限生成加群の構造定理により

V≅K[t]/(p1)⊕⋯⊕K[t]/(ps)V \cong K[t]/(p_1) \oplus \cdots \oplus K[t]/(p_s)

と分解する。各 K[t]/(pi)K[t]/(p_i) の上で tt 倍の作用を基底 1,t,…,tm−11, t, \dots, t^{m-1} で表したものが同伴行列であり(有理標準形)、pip_i を (t−λ)k(t - \lambda)^k のべきに分解して得られる分解(単因子)の各成分 K[t]/((t−λ)k)K[t]/((t - \lambda)^k) の上で基底 (t−λ)k−1,…,(t−λ),1(t - \lambda)^{k-1}, \dots, (t - \lambda), 1 をとると、ジョルダン細胞 J(λ,k)J(\lambda, k) が得られる。この観点は代数学 第7章で詳しく扱う。構造定理から、例えば「A,B∈M⁡n(K)A, B \in \operatorname{M}_n(K) が拡大体 L⊃KL \supset K 上で相似なら KK 上でも相似である」ことも従う(不変因子は体を広げても変わらないため)。

まとめ

  • ジョルダン細胞 J(λ,k)=λI+NkJ(\lambda, k) = \lambda I + N_k は、NkN_k が基底を一つずつずらす冪零行列であるような行列で、対角化できない線形変換の基本的な「部品」である。
  • 固有多項式が分解すれば、VV は一般固有空間 W(λ)=Ker⁡(f−λ)m(λ)W(\lambda) = \operatorname{Ker}(f - \lambda)^{m(\lambda)} の直和に分解し、dim⁡W(λ)=m(λ)\dim W(\lambda) = m(\lambda)。証明の鍵はケーリー–ハミルトンの定理と核の分解(補題 5.27)である。
  • 冪零変換はジョルダン鎖からなる基底をもち、鎖の長さの組(分割)は dj=dim⁡Ker⁡Njd_j = \dim \operatorname{Ker} N^j で決まる。ヤング図形の第 jj 行の長さが dj−dj−1d_j - d_{j-1}、列の長さが細胞のサイズである。
  • ジョルダン標準形は存在し、ブロックの順序を除いて一意である。サイズ jj 以上の λ\lambda の細胞の個数は rank⁡(A−λI)j−1−rank⁡(A−λI)j\operatorname{rank}(A - \lambda I)^{j-1} - \operatorname{rank}(A - \lambda I)^j。二つの複素行列が相似   ⟺  \iff ジョルダン標準形が一致する。
  • 変換行列 PP は、鎖 (A−λI)k−1v,…,v(A - \lambda I)^{k-1}v, \dots, v をこの順に列に並べて作る。計算後は AP=PJAP = PJ で検算する。
  • eA=∑Ak/k!e^A = \sum A^k/k! は絶対収束し、可換な行列については eA+B=eAeBe^{A+B} = e^Ae^B。etJ(λ,k)=eλt∑j<ktjNkj/j!e^{tJ(\lambda, k)} = e^{\lambda t}\sum_{j< k} t^jN_k^j/j! から etAe^{tA} が計算でき、x′=Axx' = Ax の解は etAx0e^{tA}x_0 である。
  • 一般の体では有理標準形が、概念的には K[t]K[t] 加群の構造定理がジョルダン標準形の背後にある。

演習問題

問題 6.1 ★ 次の行列のジョルダン標準形を求めよ。

A1=(111011001),A2=(101010001),A3=(01−44)A_1 = \begin{pmatrix} 1 & 1 & 1 \\ 0 & 1 & 1 \\ 0 & 0 & 1 \end{pmatrix}, \qquad A_2 = \begin{pmatrix} 1 & 0 & 1 \\ 0 & 1 & 0 \\ 0 & 0 & 1 \end{pmatrix}, \qquad A_3 = \begin{pmatrix} 0 & 1 \\ -4 & 4 \end{pmatrix}
解答
  • A1A_1:固有値 1 のみ(上三角)。A1−IA_1 - I の零でない行は (0,1,1)(0, 1, 1), (0,0,1)(0, 0, 1) で階数 2、d1=1d_1 = 1 なので細胞は 1 個、J=J(1,3)J = J(1, 3)。
  • A2A_2:A2−I=E13A_2 - I = E_{13} は階数 1、d1=2d_1 = 2、E132=OE_{13}^2 = O より d2=3d_2 = 3。細胞のサイズは 2 と 1:J=J(1,2)⊕J(1,1)J = J(1, 2) \oplus J(1, 1)。
  • A3A_3:Φ=t2−4t+4=(t−2)2\Phi = t^2 - 4t + 4 = (t - 2)^2。A3−2IA_3 - 2I の行は (−2,1)(-2, 1), (−4,2)(-4, 2) で階数 1、細胞は 1 個:J=J(2,2)J = J(2, 2)。

問題 6.2 ★ A∈M⁡5(C)A \in \operatorname{M}_5(\mathbb{C}) が ΦA=(t−1)5\Phi_A = (t - 1)^5、rank⁡(A−I)=2\operatorname{rank}(A - I) = 2、(A−I)2=O(A - I)^2 = O を満たすとき、AA のジョルダン標準形と最小多項式を求めよ。

解答

d1=5−2=3d_1 = 5 - 2 = 3、d2=5d_2 = 5。ヤング図形の行の長さは 3,23, 2、列の長さは 2,2,12, 2, 1。よって J=J(1,2)⊕J(1,2)⊕J(1,1)J = J(1, 2) \oplus J(1, 2) \oplus J(1, 1)、μA=(t−1)2\mu_A = (t - 1)^2。

問題 6.3 ★★ 次の行列 DD について、P−1DPP^{-1}DP がジョルダン標準形になる PP を求めよ。

D=(0100011−33)D = \begin{pmatrix} 0 & 1 & 0 \\ 0 & 0 & 1 \\ 1 & -3 & 3 \end{pmatrix}
解答

DD は (t−1)3=t3−3t2+3t−1(t - 1)^3 = t^3 - 3t^2 + 3t - 1 の同伴行列の転置であり、ΦD(t)=(t−1)3\Phi_D(t) = (t - 1)^3(最後の行で展開して確かめられる)。N=D−IN = D - I の行は (−1,1,0)(-1, 1, 0), (0,−1,1)(0, -1, 1), (1,−3,2)(1, -3, 2) で、第 3 行 =−= -第 1 行 +2×+ 2 \times 第 2 行なので階数 2。細胞は 1 個で J=J(1,3)J = J(1, 3)。N2N^2 はすべての行が (1,−2,1)(1, -2, 1) の行列(計算せよ)、N3=ON^3 = O。先頭 v=e1v = e_1 から N2v=t(1,1,1)N^2 v = {}^t(1, 1, 1)、Nv=t(−1,0,1)Nv = {}^t(-1, 0, 1)、v=t(1,0,0)v = {}^t(1, 0, 0) で

P=(1−11100110)P = \begin{pmatrix} 1 & -1 & 1 \\ 1 & 0 & 0 \\ 1 & 1 & 0 \end{pmatrix}

det⁡P=1\det P = 1。検算:D t(1,1,1)=t(1,1,1)D\ {}^t(1, 1, 1) = {}^t(1, 1, 1)、D t(−1,0,1)=t(0,1,2)=t(−1,0,1)+t(1,1,1)D\ {}^t(-1, 0, 1) = {}^t(0, 1, 2) = {}^t(-1, 0, 1) + {}^t(1, 1, 1)、De1=t(0,0,1)=e1+t(−1,0,1)De_1 = {}^t(0, 0, 1) = e_1 + {}^t(-1, 0, 1)。(微分方程式 x′′′−3x′′+3x′−x=0x''' - 3x'' + 3x' - x = 0 の解が et,tet,t2ete^t, te^t, t^2e^t の一次結合になることに対応する。)

問題 6.4 ★★ 次の行列 AA について etAe^{tA} を求め、連立微分方程式 x′=3x−yx' = 3x - y、y′=x+yy' = x + y、x(0)=1x(0) = 1、y(0)=0y(0) = 0 を解け。

A=(3−111)A = \begin{pmatrix} 3 & -1 \\ 1 & 1 \end{pmatrix}
解答

ΦA=(t−3)(t−1)+1=(t−2)2\Phi_A = (t - 3)(t - 1) + 1 = (t - 2)^2。N=A−2IN = A - 2I の行は (1,−1)(1, -1), (1,−1)(1, -1) で、N2=ON^2 = O(計算せよ)。よって

etA=e2t(I+tN)=e2t(1+t−tt1−t),(xy)=etA(10)=e2t(1+tt)e^{tA} = e^{2t}(I + tN) = e^{2t}\begin{pmatrix} 1 + t & -t \\ t & 1 - t \end{pmatrix}, \qquad \begin{pmatrix} x \\ y \end{pmatrix} = e^{tA}\begin{pmatrix} 1 \\ 0 \end{pmatrix} = e^{2t}\begin{pmatrix} 1 + t \\ t \end{pmatrix}

検算:x′=e2t(3+2t)x' = e^{2t}(3 + 2t)、3x−y=e2t(3+2t)3x - y = e^{2t}(3 + 2t)。y′=e2t(1+2t)y' = e^{2t}(1 + 2t)、x+y=e2t(1+2t)x + y = e^{2t}(1 + 2t)。

問題 6.5 ★★ 任意の A∈M⁡n(C)A \in \operatorname{M}_n(\mathbb{C}) は tA{}^t A と相似であることを示せ。

解答

RR を反対角成分がすべて 1 の kk 次行列(Rej=ek+1−jRe_j = e_{k+1-j}、R2=IR^2 = I)とすると、RJ(λ,k)R−1=tJ(λ,k)RJ(\lambda, k)R^{-1} = {}^t J(\lambda, k) である(RR で基底の順序を逆にすると、ej↦ej−1e_j \mapsto e_{j-1} のずらしが ej↦ej+1e_j \mapsto e_{j+1} のずらしになる)。A=PJP−1A = PJP^{-1}、JJ をジョルダン行列とし、各細胞に対応する RR を並べたブロック対角行列を SS とすると SJS−1=tJSJS^{-1} = {}^t J。よって tA=tP−1 tJ tP=tP−1SJS−1 tP=(tP−1SP−1)A(tP−1SP−1)−1{}^t A = {}^t P^{-1}\ {}^t J\ {}^t P = {}^t P^{-1} SJS^{-1}\ {}^t P = ({}^t P^{-1}SP^{-1}) A ({}^t P^{-1} S P^{-1})^{-1} となり相似である。(系 6.11 の 1 と rank⁡ tX=rank⁡X\operatorname{rank}\ {}^t X = \operatorname{rank} X を使って示すこともできる。)

問題 6.6 ★★ 4 次の冪零行列の相似類をすべて挙げ、それぞれについて rank⁡N\operatorname{rank} N, rank⁡N2\operatorname{rank} N^2, rank⁡N3\operatorname{rank} N^3 と最小多項式を答えよ。6 次ではいくつあるか。

解答

4 の分割に対応して 5 個:

細胞のサイズ rank⁡N\operatorname{rank} N rank⁡N2\operatorname{rank} N^2 rank⁡N3\operatorname{rank} N^3 最小多項式
(4)(4) 3 2 1 t4t^4
(3,1)(3, 1) 2 1 0 t3t^3
(2,2)(2, 2) 2 0 0 t2t^2
(2,1,1)(2, 1, 1) 1 0 0 t2t^2
(1,1,1,1)(1, 1, 1, 1) 0 0 0 tt

(rank⁡Nj=∑imax⁡(ki−j,0)\operatorname{rank} N^j = \sum_i \max(k_i - j, 0)。)(3,1)(3, 1) と (2,2)(2, 2) は rank⁡N\operatorname{rank} N が同じだが rank⁡N2\operatorname{rank} N^2 で区別される。6 次では 6 の分割の数 p(6)=11p(6) = 11 個ある。

問題 6.7 ★★ ΦA=(t−2)4\Phi_A = (t - 2)^4、μA=(t−2)2\mu_A = (t - 2)^2 を満たす A∈M⁡4(C)A \in \operatorname{M}_4(\mathbb{C}) のジョルダン標準形として可能なものをすべて挙げよ。それらは何によって区別されるか。

解答

細胞はすべて固有値 2、最大サイズが 2、サイズの和が 4 なので、分割 (2,2)(2, 2) と (2,1,1)(2, 1, 1) の 2 通り:J(2,2)⊕J(2,2)J(2, 2) \oplus J(2, 2) と J(2,2)⊕J(2,1)⊕J(2,1)J(2, 2) \oplus J(2, 1) \oplus J(2, 1)。前者は rank⁡(A−2I)=2\operatorname{rank}(A - 2I) = 2、後者は 11 で区別される(固有空間の次元がそれぞれ 2, 3)。固有多項式と最小多項式だけでは相似類は決まらない例である。

問題 6.8 ★★ N∈M⁡n(K)N \in \operatorname{M}_n(K) が冪零ならば Nn=ON^n = O であることを示せ。また、NN のジョルダン標準形がただ一つの細胞からなるための必要十分条件は rank⁡N=n−1\operatorname{rank} N = n - 1 であることを示せ。

解答

Np=ON^p = O なら tpt^p は零化多項式なので μN∣tp\mu_N \mid t^p、すなわち μN=te\mu_N = t^e。μN∣ΦN\mu_N \mid \Phi_N かつ deg⁡ΦN=n\deg \Phi_N = n より e≤ne \leq n で、Nn=Nn−eNe=ON^n = N^{n-e}N^e = O。(6.2 節の議論から直接 Ker⁡Nn=W(0)=Kn\operatorname{Ker} N^n = W(0) = K^n としてもよい。)後半:細胞の個数は dim⁡Ker⁡N=n−rank⁡N\dim \operatorname{Ker} N = n - \operatorname{rank} N(定理 6.8 の j=1j = 1)なので、1 個   ⟺  rank⁡N=n−1\iff \operatorname{rank} N = n - 1。

問題 6.9 ★★★(ジョルダン分解の一意性)f=s+ν=s′+ν′f = s + \nu = s' + \nu' で、s,s′s, s' は対角化可能、ν,ν′\nu, \nu' は冪零、sν=νss\nu = \nu s、s′ν′=ν′s′s'\nu' = \nu's' とする。系 6.5 で構成した s,νs, \nu(ff の多項式)について、s=s′s = s'、ν=ν′\nu = \nu' を示せ。

解答

s′s' は s′s' 自身および ν′\nu' と可換なので f=s′+ν′f = s' + \nu' と可換であり、したがって ff の多項式である s,νs, \nu とも可換である。同様に ν′\nu' も s,νs, \nu と可換である。s−s′=ν′−νs - s' = \nu' - \nu とおく。左辺:s,s′s, s' は可換な対角化可能変換なので同時対角化でき(定理 5.32)、s−s′s - s' は対角化可能である。右辺:ν,ν′\nu, \nu' は可換な冪零変換なので、νa=ν′b=0\nu^a = \nu'^b = 0 なら二項展開により (ν′−ν)a+b=0(\nu' - \nu)^{a+b} = 0 で冪零である。対角化可能かつ冪零な変換は 0(系 5.30 の 3)なので s=s′s = s'、ν=ν′\nu = \nu'。

問題 6.10 ★★★ 正則な A∈M⁡n(C)A \in \operatorname{M}_n(\mathbb{C}) は平方根をもつ(B2=AB^2 = A となる B∈M⁡n(C)B \in \operatorname{M}_n(\mathbb{C}) が存在する)ことを示せ。また N2=J(0,2)N_2 = J(0, 2) は平方根をもたないことを示せ。

解答

A=PJP−1A = PJP^{-1} とすると、JJ の各細胞の平方根 BiB_i を並べた SS について (PSP−1)2=PJP−1=A(PSP^{-1})^2 = PJP^{-1} = A なので、細胞 J(λ,k)J(\lambda, k) (λ≠0)(\lambda \neq 0) について示せばよい。J(λ,k)=λ(I+M)J(\lambda, k) = \lambda(I + M)、M=λ−1NkM = \lambda^{-1}N_k、Mk=OM^k = O。二項級数 (1+x)1/2=∑j≥0(1/2j)xj(1 + x)^{1/2} = \sum_{j \geq 0} \binom{1/2}{j}x^j は形式的べき級数として (∑j(1/2j)xj)2=1+x\left(\sum_j \binom{1/2}{j}x^j\right)^2 = 1 + x を満たす(係数の等式は ∣x∣<1\lvert x \rvert < 1 での実関数の等式と、べき級数展開の一意性から従う)。q(x)=∑j<k(1/2j)xjq(x) = \sum_{j< k} \binom{1/2}{j}x^j とおくと q(x)2−(1+x)q(x)^2 - (1 + x) は xkx^k で割り切れる多項式であり、Mk=OM^k = O から q(M)2=I+Mq(M)^2 = I + M。λ\lambda の平方根 λ\sqrt{\lambda} を一つ選び B=λ q(M)B = \sqrt{\lambda}\ q(M) とすれば B2=J(λ,k)B^2 = J(\lambda, k)。

N2N_2 について:B2=N2B^2 = N_2 とすると B4=N22=OB^4 = N_2^2 = O なので BB は冪零で、問題 6.8 より B2=OB^2 = O となり N2≠ON_2 \neq O に矛盾する。

この章を読み終えたら

「読了」にすると学習記録とロードマップに反映されます。演習の自己採点もお忘れなく。

この章の誤りを報告GitHub で見る