# 対角化とジョルダン標準形：変換が一番簡単に見える座標を探す

> 行列の対角化を「線形変換が最も簡単に見える基底を選ぶこと」と捉え、可能性の判定を重複度で与える。べき乗計算や実対称行列の直交対角化に応用し、対角化できない行列にはジョルダン標準形の構造と細胞の決め方までを扱う。
> https://rikai.mugen-giken.com/mathematics/linear-algebra/diagonalization-and-jordan-form

## 0. この記事の要点

- 対角化とは「行列を変形する」ことではなく、**同じ線形変換を、それが一番素直に見える座標系（固有ベクトルの基底）から眺め直す**ことです。座標を替えると表現行列は $P^{-1}AP$ に変わり、うまい $P$ を選ぶと対角行列になります。
- $n$ 次行列 $A$ が対角化可能であることと、$A$ の固有ベクトルからなる基底が取れることは同値です。判定は重複度で完結します。すなわち、固有多項式が 1 次式の積に分解し、かつ**各固有値で幾何的重複度と代数的重複度が一致する**ことが必要十分です。
- 対角化できれば $A^k = PD^kP^{-1}$ となり、べき乗・行列指数関数・線形漸化式・線形微分方程式がすべて固有値のスカラー計算に還元されます。フィボナッチ数列の一般項もこれで出ます。
- **実対称行列は必ず直交行列で対角化できます**。この定理が二次形式の主軸変換を保証し、データ解析の主成分分析（PCA）を支えています。
- 対角化できない行列でも、複素数の範囲では**ジョルダン標準形**（対角成分の 1 つ上に $1$ が並ぶだけの形）まで簡単にできます。細胞の大きさは $\operatorname{rank}(A - \lambda I)^j$ の階差だけで決まります。

## 1. 動機：なぜ「一番簡単な行列」を探すのか

[ベクトル空間と線形変換](/mathematics/linear-algebra/vector-spaces) で見たとおり、行列は数を並べた四角い表そのものではなく、**基底を 1 つ固定したときの線形変換の影**です。同じ変換でも、基底を替えれば行列の見た目は変わります。ここから自然な問いが出てきます。

> 与えられた線形変換 $T$ に対して、その行列表示が**最も簡単**になるような基底を選べるだろうか。そして「最も簡単」とは何だろうか。

いちばん簡単な行列は対角行列です。対角行列 $D = \operatorname{diag}(\lambda_1, \ldots, \lambda_n)$ が表す変換は、$n$ 本の座標軸のそれぞれを独立に $\lambda_i$ 倍に伸縮するだけで、軸どうしが混ざりません。つまり **$n$ 次元の問題が 1 次元の問題 $n$ 個に分解される**ということです。この分解ができれば、変換を何回も繰り返す計算も、指数関数を取る計算も、各軸ごとのスカラー計算になります。

具体的な御利益を 1 つ挙げます。$A = \begin{pmatrix} 4 & 1 \\ 2 & 3\end{pmatrix}$ に対して $A^{100}$ を求めたいとします。素朴に掛け算を繰り返すのは（繰り返し二乗法を使っても）成分の一般式を与えてくれません。しかし後で見るように、$A$ の固有値 $5, 2$ を使えば

$$
A^{k} = \frac{1}{3}\begin{pmatrix} 2\cdot 5^{k} + 2^{k} & 5^{k} - 2^{k} \\ 2\cdot 5^{k} - 2\cdot 2^{k} & 5^{k} + 2\cdot 2^{k}\end{pmatrix}
$$

という閉じた式が一気に出ます。$k = 100$ を代入するだけです。

歴史的にも、この問いは天下り的に生まれたものではありません。19 世紀前半、コーシーは二次曲面の**主軸問題**、すなわち $x^{\mathsf{T}} A x = 1$ という曲面の軸の方向を決める問題を研究し、実対称行列の固有値がつねに実数であることを示しました。一方、対角化がいつでもできるわけではないことも早くから知られていました。「対角化できない行列は、どこまで簡単にできるのか」という問いに完全な答えを与えたのがワイエルシュトラスの単因子論（1868 年）とジョルダンの著作（1870 年）で、そこから得られる標準形が本記事後半の主役です。

この記事では、[固有値と固有ベクトル](/mathematics/linear-algebra/eigenvalues) で導入した固有値・固有ベクトル（<Ref to="mathematics/linear-algebra/eigenvalues#def-eigen" />）を道具として、次の 3 つに答えます。

1. どんなときに対角化できるか（判定条件）。
2. 対角化できると何が嬉しいか（応用）。
3. 対角化できないとき、代わりに何が得られるか（ジョルダン標準形）。

<div data-gated data-pagefind-ignore>

## 2. 準備：基底の取り替えと相似

$V$ を体 $K$ 上の $n$ 次元ベクトル空間、$T \colon V \to V$ を線形変換とします。基底 $\mathcal{B} = (b_1, \ldots, b_n)$ を固定すると、各 $T b_j$ を基底で展開した係数を並べて表現行列 $A$ が定まりました。別の基底 $\mathcal{C} = (c_1, \ldots, c_n)$ を取り、$c_j$ を $\mathcal{B}$ で展開した係数を第 $j$ 列に並べた行列を $P$ とします。$P$ は基底から基底への変換なので正則で、$\mathcal{C}$ に関する表現行列は $P^{-1} A P$ になります（<Ref to="mathematics/linear-algebra/matrices-and-linear-systems#thm-change-of-basis" text="表現行列の変換則" />）。

<Figure caption="基底の取り替え。同じ変換 T を 2 つの座標系から見ており、四角形は可換です。">
<Mermaid code={`flowchart LR
  c1["v の C 座標"] -->|"D = P⁻¹AP を掛ける"| c2["Tv の C 座標"]
  c1 -->|"P を掛ける"| b1["v の B 座標"]
  b1 -->|"A を掛ける"| b2["Tv の B 座標"]
  c2 -->|"P を掛ける"| b2`} />
</Figure>

この「見え方の違い」を行列の言葉だけで書いたのが次の関係です。

<Definition id="def-similar" title="相似">
$A, B \in M_n(K)$ に対し、ある正則行列 $P \in GL_n(K)$ が存在して $B = P^{-1} A P$ となるとき、$A$ と $B$ は**相似**であるといい、$A \sim B$ と書く。
</Definition>

相似は同値関係です（$P = I$ で反射律、$A = (P^{-1})^{-1} B P^{-1}$ で対称律、$Q^{-1}(P^{-1}AP)Q = (PQ)^{-1}A(PQ)$ で推移律）。同値関係については [関係と同値関係](/mathematics/foundations/equivalence-relations) の <Ref to="mathematics/foundations/equivalence-relations#def-equivalence" /> を参照してください。相似な行列は**同じ変換の別の座標での姿**ですから、変換そのものの性質は相似で変わらないはずです。それを確認します。

<Proposition id="prop-similarity-invariants" title="相似不変量">
$A \sim B$ ならば、次が成り立つ。

1. $A$ と $B$ の固有多項式は一致する。すなわち $\det(tI - A) = \det(tI - B)$。したがって固有値の全体も、各固有値の代数的重複度も一致する。
2. $\operatorname{tr} A = \operatorname{tr} B$、$\det A = \det B$。
3. 任意のスカラー $\lambda \in K$ と任意の整数 $j \ge 0$ に対し $\operatorname{rank}(A - \lambda I)^j = \operatorname{rank}(B - \lambda I)^j$。
</Proposition>

<Proof of="prop-similarity-invariants">
$B = P^{-1}AP$ とします。

(1) $tI = P^{-1}(tI)P$ ですから

$$
tI - B = P^{-1}(tI)P - P^{-1}AP = P^{-1}(tI - A)P
$$

となります。行列式の乗法性（[行列式とその性質](/mathematics/linear-algebra/determinants) の <Ref to="mathematics/linear-algebra/determinants#thm-product" />）より

$$
\det(tI - B) = \det(P^{-1})\det(tI - A)\det(P) = \det(tI-A)
$$

です。$\det(P^{-1}) = \det(P)^{-1}$ を使いました。固有多項式が同じなら、その根である固有値も、根としての重複度（代数的重複度）も同じです。

(2) 固有多項式を展開すると $t^n - (\operatorname{tr}A)t^{n-1} + \cdots + (-1)^n \det A$ となるので、(1) から係数どうしが一致します。

(3) $(B - \lambda I)^j = (P^{-1}(A - \lambda I)P)^j = P^{-1}(A-\lambda I)^j P$ です（間の $PP^{-1}$ が消えます）。正則行列を左右から掛けても階数は変わらないので（[行列と連立一次方程式](/mathematics/linear-algebra/matrices-and-linear-systems)）、階数は等しくなります。
</Proof>

<Remark id="rem-invariants-not-enough">
逆は成り立たない。固有多項式が同じでも相似とは限らない。実際 $I_2$ と $\begin{pmatrix}1 & 1\\ 0 & 1\end{pmatrix}$ はともに固有多項式 $(t-1)^2$ をもつが、$P^{-1}I_2P = I_2$ なので $I_2$ と相似な行列は $I_2$ だけであり、両者は相似でない。「どこまで不変量を集めれば相似が決まるか」という問いの答えが、この記事の最後に出るジョルダン標準形である。
</Remark>

## 3. 対角化可能性の判定

<Definition id="def-diagonalizable" title="対角化可能">
$A \in M_n(K)$ が $K$ 上**対角化可能**であるとは、ある正則行列 $P \in GL_n(K)$ と対角行列 $D \in M_n(K)$ が存在して $P^{-1}AP = D$ となることをいう。このとき $P$ を対角化する行列、$D$ を $A$ の対角形という。
</Definition>

「対角化可能」は $A$ 単独の性質ではなく、**どの体の上で考えるか**に依存します。この点は後で反例とともに確認します。まず、対角化という代数的な条件が、幾何的には何を意味するかを押さえます。

<Theorem id="thm-diagonalizable-basis" title="対角化と固有基底">
$A \in M_n(K)$ について、次の 2 条件は同値である。

1. $A$ は $K$ 上対角化可能である。
2. $K^n$ は $A$ の固有ベクトルからなる基底をもつ。

さらにこのとき、(2) の基底 $(p_1, \ldots, p_n)$ を列に並べた行列 $P = (p_1\ \cdots\ p_n)$ に対して $P^{-1}AP = \operatorname{diag}(\lambda_1, \ldots, \lambda_n)$ が成り立つ。ここで $\lambda_i$ は $p_i$ に対応する固有値である。
</Theorem>

<Proof of="thm-diagonalizable-basis">
どちらの向きも、等式 $P^{-1}AP = D$ を $AP = PD$ と書き直して**列ごとに**読むのが鍵です。$P$ の第 $i$ 列を $p_i$、$D = \operatorname{diag}(\lambda_1,\ldots,\lambda_n)$ とすると、行列の積の定義から

$$
(AP)\text{ の第 } i \text{ 列} = A p_i, \qquad (PD)\text{ の第 } i \text{ 列} = \lambda_i p_i
$$

です。後者は、$D$ の第 $i$ 列が $\lambda_i e_i$ であることから従います。したがって

$$
AP = PD \iff A p_i = \lambda_i p_i \quad (i = 1, \ldots, n)
$$

が成り立ちます。

(1) $\Rightarrow$ (2)：$P^{-1}AP = D$ とすると上の同値から $Ap_i = \lambda_i p_i$ です。$P$ は正則なので $p_i \ne 0$ であり、$p_i$ は固有値 $\lambda_i$ の固有ベクトルです。また $P$ が正則であることは、その列 $p_1, \ldots, p_n$ が $K^n$ の基底をなすことと同値ですから、(2) が得られます。

(2) $\Rightarrow$ (1)：固有ベクトルからなる基底 $(p_1,\ldots,p_n)$ を取り、$Ap_i = \lambda_i p_i$ とします。これらを列に並べた $P$ は基底を列にもつので正則です。上の同値より $AP = PD$、すなわち $P^{-1}AP = D$ となります。
</Proof>

つまり対角化とは、**固有ベクトルを座標軸に採用すること**にほかなりません。対角化できるかどうかは「固有ベクトルが十分たくさんあるか」という一点にかかっています。では、どういうときに足りなくなるのでしょうか。まず、足りることを保証する十分条件から見ます。

<Lemma id="lem-independent-eigenvectors" title="異なる固有値の固有ベクトルは一次独立">
$A \in M_n(K)$ の相異なる固有値 $\lambda_1, \ldots, \lambda_r$ に対し、$v_i$ を $\lambda_i$ に属する固有ベクトル（$v_i \ne 0$、$Av_i = \lambda_i v_i$）とする。このとき $v_1, \ldots, v_r$ は一次独立である。
</Lemma>

<Proof of="lem-independent-eigenvectors">
$r$ についての帰納法で示します（帰納法については [証明の技術](/mathematics/foundations/proof-techniques) の <Ref to="mathematics/foundations/proof-techniques#thm-induction" /> を参照してください）。

$r = 1$ のとき、$v_1 \ne 0$ なので $c_1v_1 = 0 \Rightarrow c_1 = 0$ であり、一次独立です。

$r - 1$ 個までで成立するとします。$c_1v_1 + \cdots + c_rv_r = 0$ とおきます。両辺に $A - \lambda_r I$ を掛けると、$(A - \lambda_r I)v_i = (\lambda_i - \lambda_r)v_i$ なので

$$
\sum_{i=1}^{r-1} c_i(\lambda_i - \lambda_r)v_i = 0
$$

となります（$i = r$ の項は $(\lambda_r - \lambda_r)v_r = 0$ で消えます）。帰納法の仮定により $v_1, \ldots, v_{r-1}$ は一次独立ですから、すべての $i \le r-1$ で $c_i(\lambda_i - \lambda_r) = 0$ です。仮定より固有値は相異なるので $\lambda_i - \lambda_r \ne 0$、よって $c_i = 0$ です。これを最初の式に戻すと $c_rv_r = 0$ となり、$v_r \ne 0$ から $c_r = 0$ を得ます。
</Proof>

<Corollary id="cor-distinct-eigenvalues" title="相異なる n 個の固有値をもつ行列">
$A \in M_n(K)$ が $K$ の中に相異なる $n$ 個の固有値をもてば、$A$ は $K$ 上対角化可能である。
</Corollary>

<Proof of="cor-distinct-eigenvalues">
各固有値に固有ベクトルを 1 つずつ選ぶと、<Ref to="lem-independent-eigenvectors" /> により一次独立な $n$ 本のベクトルが得られます。$n$ 次元空間 $K^n$ の中の一次独立な $n$ 本は基底ですから、<Ref to="thm-diagonalizable-basis" /> により $A$ は対角化可能です。
</Proof>

固有値に重複があるときが問題です。重複度には 2 種類あり、その食い違いが対角化を妨げます。

<Definition id="def-multiplicities" title="代数的重複度と幾何的重複度">
$\lambda$ を $A \in M_n(K)$ の固有値とする。固有多項式 $\chi_A(t) = \det(tI - A)$ における因子 $(t-\lambda)$ の重複度、すなわち $\chi_A(t) = (t-\lambda)^m g(t)$、$g(\lambda) \ne 0$ となる $m$ を $\lambda$ の**代数的重複度**といい $m_a(\lambda)$ と書く。一方、固有空間

$$
E_\lambda = \ker(A - \lambda I) = \{\,x \in K^n : Ax = \lambda x\,\}
$$

の次元 $\dim E_\lambda = n - \operatorname{rank}(A - \lambda I)$ を $\lambda$ の**幾何的重複度**といい $m_g(\lambda)$ と書く。
</Definition>

代数的重複度は「特性方程式の根としての多重度」という代数的な量、幾何的重複度は「その固有値に属する独立な方向の本数」という幾何的な量です。両者はつねに一致するとは限らず、次の一方向の不等式だけが成り立ちます。

<Proposition id="prop-geometric-le-algebraic" title="幾何的重複度は代数的重複度を超えない">
$\lambda$ を $A \in M_n(K)$ の固有値とすると

$$
1 \le m_g(\lambda) \le m_a(\lambda) \le n
$$

が成り立つ。
</Proposition>

<Proof of="prop-geometric-le-algebraic">
$\lambda$ は固有値なので固有ベクトルが存在し、$m_g(\lambda) = \dim E_\lambda \ge 1$ です。$m_a(\lambda) \le n$ は固有多項式の次数が $n$ であることから従います。残るは $m_g(\lambda) \le m_a(\lambda)$ です。

$m = m_g(\lambda)$ とおき、$E_\lambda$ の基底 $(u_1, \ldots, u_m)$ を取り、これを $K^n$ の基底 $(u_1, \ldots, u_m, u_{m+1}, \ldots, u_n)$ に延長します（基底の延長ができることは [ベクトル空間と線形変換](/mathematics/linear-algebra/vector-spaces) の <Ref to="mathematics/linear-algebra/vector-spaces#prop-finite-dim-facts" /> です）。$P = (u_1\ \cdots\ u_n)$ とおくと $P$ は正則で、$B = P^{-1}AP$ を考えます。<Ref to="thm-diagonalizable-basis" /> の証明中の計算と同じく、$B$ の第 $i$ 列は $Au_i$ を基底 $(u_1,\ldots,u_n)$ で表した座標です。$i \le m$ のときは $Au_i = \lambda u_i$ なので、その座標は $\lambda e_i$ です。したがって $B$ はブロック上三角の形

$$
B = \begin{pmatrix} \lambda I_m & C \\ O & E \end{pmatrix}
$$

をもちます（$C$ は $m \times (n-m)$、$E$ は $(n-m)$ 次）。ブロック上三角行列の行列式はブロックの行列式の積なので

$$
\det(tI - B) = \det\bigl((t-\lambda)I_m\bigr)\cdot \det(tI_{n-m} - E) = (t-\lambda)^m \det(tI_{n-m}-E)
$$

となります。<Ref to="prop-similarity-invariants" /> により $\chi_A = \chi_B$ ですから、$\chi_A(t)$ は $(t-\lambda)^m$ で割り切れます。代数的重複度は $(t-\lambda)$ で割り切れる最大回数ですから $m \le m_a(\lambda)$ です。
</Proof>

これで判定条件を述べる準備が整いました。

<Theorem id="thm-diagonalizability-criterion" title="対角化可能性の判定">
$A \in M_n(K)$ が $K$ 上対角化可能であるための必要十分条件は、次の 2 つがともに成り立つことである。

1. 固有多項式 $\chi_A(t)$ が $K$ 上で 1 次式の積に分解する。すなわち相異なる $\lambda_1, \ldots, \lambda_s \in K$ と正整数 $m_1, \ldots, m_s$ により $\chi_A(t) = \prod_{i=1}^{s}(t-\lambda_i)^{m_i}$ と書ける。
2. すべての固有値 $\lambda_i$ について $m_g(\lambda_i) = m_a(\lambda_i)$ が成り立つ。

同値な言い換えとして、$A$ が対角化可能であることと $\sum_{i=1}^{s} m_g(\lambda_i) = n$ であることは同値である。
</Theorem>

<Proof of="thm-diagonalizability-criterion">
**必要性。** $P^{-1}AP = D = \operatorname{diag}(d_1,\ldots,d_n)$ とします。$\chi_D(t) = \prod_{j=1}^n (t - d_j)$ は 1 次式の積であり、<Ref to="prop-similarity-invariants" /> (1) より $\chi_A = \chi_D$ なので条件 1 が成り立ちます。次に固有値 $\lambda$ を固定し、$D$ の対角成分に $\lambda$ が現れる回数を $m$ とします。このとき $\chi_D$ における $(t-\lambda)$ の重複度は $m$ なので $m_a(\lambda) = m$ です。一方 $D - \lambda I$ は対角行列で、対角成分のうちちょうど $m$ 個が $0$、残り $n - m$ 個が $0$ でないので $\operatorname{rank}(D - \lambda I) = n - m$ です。<Ref to="prop-similarity-invariants" /> (3) より $\operatorname{rank}(A - \lambda I) = n-m$ なので $m_g(\lambda) = n - (n-m) = m$ となり、条件 2 が成り立ちます。

**十分性。** 条件 1, 2 を仮定します。各 $i$ について固有空間 $E_{\lambda_i}$ の基底を 1 組ずつ取り、それらをすべて並べたベクトルの族を $\mathcal{F}$ とします。$\mathcal{F}$ の本数は $\sum_i m_g(\lambda_i) = \sum_i m_a(\lambda_i) = \deg \chi_A = n$ です（条件 2 と条件 1 を順に使いました）。

$\mathcal{F}$ が一次独立であることを示します。$\mathcal{F}$ の元の一次結合が $0$ になったとし、同じ固有値に属する項どうしをまとめて

$$
w_1 + w_2 + \cdots + w_s = 0, \qquad w_i \in E_{\lambda_i}
$$

と書きます。もし $w_i \ne 0$ となる $i$ が存在すれば、その $i$ たちだけを取り出した等式は、相異なる固有値に属する固有ベクトルたちの自明でない一次関係になり、<Ref to="lem-independent-eigenvectors" /> に反します。よってすべての $i$ で $w_i = 0$ です。すると各 $i$ について、$E_{\lambda_i}$ の基底の一次結合が $0$ になったことになり、基底の一次独立性から係数はすべて $0$ です。

以上より $\mathcal{F}$ は $n$ 本の一次独立な固有ベクトルの族、すなわち $K^n$ の基底です。<Ref to="thm-diagonalizable-basis" /> により $A$ は対角化可能です。

**言い換えについて。** <Ref to="prop-geometric-le-algebraic" /> より $\sum_i m_g(\lambda_i) \le \sum_i m_a(\lambda_i) \le n$ であり、右の不等号が等号になるのは条件 1 のとき、左が等号になるのは条件 2 のときです。したがって $\sum_i m_g(\lambda_i) = n$ は条件 1 かつ条件 2 と同値です。
</Proof>

<Example id="ex-diagonalize-2x2" title="対角化の実行と 100 乗">
$A = \begin{pmatrix} 4 & 1 \\ 2 & 3\end{pmatrix}$ を対角化します。固有多項式は

$$
\chi_A(t) = \det\begin{pmatrix} t-4 & -1 \\ -2 & t-3\end{pmatrix} = (t-4)(t-3) - 2 = t^2 - 7t + 10 = (t-5)(t-2)
$$

です。固有値 $5, 2$ は相異なる 2 個なので、<Ref to="cor-distinct-eigenvalues" /> によりすでに対角化可能とわかります。固有ベクトルを求めます。

$\lambda = 5$：$A - 5I = \begin{pmatrix} -1 & 1 \\ 2 & -2\end{pmatrix}$ で、$-x_1 + x_2 = 0$ より $p_1 = (1, 1)^{\mathsf{T}}$。検算すると $Ap_1 = (4+1, 2+3)^{\mathsf{T}} = (5,5)^{\mathsf{T}} = 5p_1$ です。

$\lambda = 2$：$A - 2I = \begin{pmatrix} 2 & 1 \\ 2 & 1\end{pmatrix}$ で、$2x_1 + x_2 = 0$ より $p_2 = (1, -2)^{\mathsf{T}}$。検算すると $Ap_2 = (4-2, 2-6)^{\mathsf{T}} = (2,-4)^{\mathsf{T}} = 2p_2$ です。

$P = \begin{pmatrix} 1 & 1 \\ 1 & -2\end{pmatrix}$ とおくと $\det P = -3 \ne 0$ で、

$$
P^{-1} = \frac{1}{-3}\begin{pmatrix} -2 & -1 \\ -1 & 1\end{pmatrix} = \frac{1}{3}\begin{pmatrix} 2 & 1 \\ 1 & -1\end{pmatrix}, \qquad P^{-1}AP = \begin{pmatrix} 5 & 0 \\ 0 & 2\end{pmatrix}
$$

です。これを使って $A^k$ を計算します。$A^k = PD^kP^{-1}$ なので

$$
\begin{aligned}
A^k &= \begin{pmatrix} 1 & 1 \\ 1 & -2\end{pmatrix}\begin{pmatrix} 5^k & 0 \\ 0 & 2^k\end{pmatrix}\cdot\frac{1}{3}\begin{pmatrix} 2 & 1 \\ 1 & -1\end{pmatrix} \\
&= \frac{1}{3}\begin{pmatrix} 5^k & 2^k \\ 5^k & -2\cdot 2^k\end{pmatrix}\begin{pmatrix} 2 & 1 \\ 1 & -1\end{pmatrix}
= \frac{1}{3}\begin{pmatrix} 2\cdot 5^k + 2^k & 5^k - 2^k \\ 2\cdot 5^k - 2\cdot 2^k & 5^k + 2\cdot 2^k\end{pmatrix}.
\end{aligned}
$$

検算します。$k=0$ とすると $\frac13\begin{pmatrix}3 & 0\\ 0 & 3\end{pmatrix} = I$、$k=1$ とすると $\frac13\begin{pmatrix}12 & 3\\ 6 & 9\end{pmatrix} = A$ となり、正しいことが確かめられます。$k = 100$ を代入すれば $A^{100}$ が得られます。
</Example>

<Example id="ex-shear" title="対角化できない行列（せん断）">
$N = \begin{pmatrix} 1 & 1 \\ 0 & 1 \end{pmatrix}$ を考えます。固有多項式は $\det\begin{pmatrix} t-1 & -1\\ 0 & t-1\end{pmatrix} = (t-1)^2$ なので、固有値は $1$ のみで $m_a(1) = 2$ です。一方

$$
N - I = \begin{pmatrix} 0 & 1 \\ 0 & 0\end{pmatrix}, \qquad \operatorname{rank}(N-I) = 1
$$

なので $m_g(1) = 2 - 1 = 1$ です。$m_g(1) < m_a(1)$ となり、<Ref to="thm-diagonalizability-criterion" /> の条件 2 が破れているので $N$ は対角化できません。

別の見方もできます。もし $N$ が対角化できたとすると、対角形の対角成分は固有値なので $D = I$ となり、$N = PIP^{-1} = I$ となって矛盾します。

幾何的には、$N$ は $x$ 軸方向への**せん断**です。$N(x_1, x_2)^{\mathsf{T}} = (x_1 + x_2, x_2)^{\mathsf{T}}$ なので、高さ $x_2$ の点ほど右へ大きくずれます。不変な方向は $x$ 軸だけで、独立な固有方向が 1 本しかありません。「軸が足りない」というこの状況が、対角化を妨げる本質です。
</Example>

<Remark id="rem-field-matters">
対角化可能性は考える体に依存する。回転行列 $R = \begin{pmatrix} 0 & -1 \\ 1 & 0\end{pmatrix}$ の固有多項式は $t^2+1$ で、$\mathbb{R}$ 上に根をもたない（実数の範囲では不変な直線が 1 本もない。$90^\circ$ 回転なのだから当然である）。よって $\mathbb{R}$ 上では対角化できない。しかし $\mathbb{C}$ 上では固有値 $\pm i$ が相異なる 2 個なので、<Ref to="cor-distinct-eigenvalues" /> により対角化可能である。<Ref to="thm-diagonalizability-criterion" /> の条件 1 は、$K = \mathbb{C}$ では代数学の基本定理により自動的に満たされる。つまり複素数の上では、対角化の障害は条件 2 だけである。
</Remark>

## 4. 対角化の御利益：べき乗・行列関数・線形システム

<Proposition id="prop-power-of-diagonalizable" title="対角形による関数計算">
$P^{-1}AP = D = \operatorname{diag}(\lambda_1, \ldots, \lambda_n)$ とする。このとき次が成り立つ。

1. 任意の整数 $k \ge 0$ に対し $A^k = PD^kP^{-1} = P\operatorname{diag}(\lambda_1^k, \ldots, \lambda_n^k)P^{-1}$。$A$ が正則ならば負の整数 $k$ に対しても成り立つ。
2. 任意の多項式 $f \in K[t]$ に対し $f(A) = P\operatorname{diag}(f(\lambda_1), \ldots, f(\lambda_n))P^{-1}$。
3. $K = \mathbb{R}$ または $\mathbb{C}$ とし、べき級数 $f(z) = \sum_{k\ge 0} a_kz^k$ が各 $\lambda_i$ で絶対収束するとする。このとき $f(A) = \sum_{k \ge 0}a_kA^k$ は収束し、$f(A) = P\operatorname{diag}(f(\lambda_1), \ldots, f(\lambda_n))P^{-1}$ が成り立つ。とくに $e^{A} = P\operatorname{diag}(e^{\lambda_1},\ldots,e^{\lambda_n})P^{-1}$ である。
</Proposition>

<Proof of="prop-power-of-diagonalizable">
(1) $A = PDP^{-1}$ です。$k$ についての帰納法で示します。$k=0$ では両辺とも $I$ です。$A^k = PD^kP^{-1}$ を仮定すると

$$
A^{k+1} = A^kA = (PD^kP^{-1})(PDP^{-1}) = PD^k(P^{-1}P)DP^{-1} = PD^{k+1}P^{-1}
$$

となります。対角行列のべきは各成分のべきです。$A$ が正則なら $\lambda_i$ はすべて $0$ でなく（$\det A = \prod \lambda_i \ne 0$）、$A^{-1} = PD^{-1}P^{-1}$ から同様に負べきも従います。

(2) $f(t) = \sum_k a_kt^k$ とすると、(1) と和・スカラー倍の分配から

$$
f(A) = \sum_k a_kPD^kP^{-1} = P\Bigl(\sum_k a_kD^k\Bigr)P^{-1} = Pf(D)P^{-1}
$$

です。対角行列の多項式は対角成分ごとの多項式なので $f(D) = \operatorname{diag}(f(\lambda_i))$ です。

(3) 部分和 $S_m = \sum_{k=0}^{m}a_kA^k$ は (2) より $S_m = P\bigl(\sum_{k=0}^m a_kD^k\bigr)P^{-1}$ です。$\sum_{k=0}^m a_kD^k = \operatorname{diag}\bigl(\sum_{k=0}^m a_k\lambda_i^k\bigr)$ は仮定より $m \to \infty$ で成分ごとに $\operatorname{diag}(f(\lambda_i))$ に収束します。写像 $X \mapsto PXP^{-1}$ は有限次元空間上の線形写像なので連続であり、極限と交換します。よって $S_m \to P\operatorname{diag}(f(\lambda_i))P^{-1}$ となります。
</Proof>

この命題の意味は「**対角化とは、行列の世界の問題をスカラーの世界の問題 $n$ 個に翻訳する辞書である**」ということです。翻訳して各軸で計算し、$P$ で元の座標に戻すだけです。典型的な応用を 1 つ、最後まで計算して見せます。

<Example id="ex-fibonacci" title="フィボナッチ数列の一般項（ビネの公式）">
$F_0 = 0$, $F_1 = 1$, $F_{n+1} = F_n + F_{n-1}$ で定まる数列を考えます。$A = \begin{pmatrix} 1 & 1 \\ 1 & 0\end{pmatrix}$ とおくと

$$
A\begin{pmatrix} F_n \\ F_{n-1}\end{pmatrix} = \begin{pmatrix} F_n + F_{n-1} \\ F_n \end{pmatrix} = \begin{pmatrix} F_{n+1} \\ F_{n}\end{pmatrix}
$$

なので、$(F_1, F_0)^{\mathsf{T}} = (1,0)^{\mathsf{T}}$ から出発して

$$
\begin{pmatrix} F_{n+1} \\ F_n \end{pmatrix} = A^n \begin{pmatrix} 1 \\ 0\end{pmatrix}
$$

が成り立ちます。あとは $A^n$ です。固有多項式は $\det\begin{pmatrix} t-1 & -1 \\ -1 & t\end{pmatrix} = t(t-1) - 1 = t^2 - t - 1$ で、根は

$$
\varphi = \frac{1+\sqrt5}{2}, \qquad \psi = \frac{1-\sqrt5}{2}
$$

です。相異なる 2 実根なので <Ref to="cor-distinct-eigenvalues" /> より対角化できます。$\lambda \in \{\varphi, \psi\}$ に対し $(A - \lambda I)v = 0$ は $(1-\lambda)v_1 + v_2 = 0$ かつ $v_1 - \lambda v_2 = 0$ で、後者から $v = (\lambda, 1)^{\mathsf{T}}$ と取れます（このとき前者は $(1-\lambda)\lambda + 1 = \lambda - \lambda^2 + 1 = 0$、すなわち $\lambda^2 = \lambda + 1$ から成り立ちます）。そこで

$$
P = \begin{pmatrix} \varphi & \psi \\ 1 & 1\end{pmatrix}, \qquad \det P = \varphi - \psi = \sqrt5, \qquad P^{-1} = \frac{1}{\sqrt5}\begin{pmatrix} 1 & -\psi \\ -1 & \varphi\end{pmatrix}
$$

とおきます。<Ref to="prop-power-of-diagonalizable" /> より $A^n = P\operatorname{diag}(\varphi^n, \psi^n)P^{-1}$ なので、右から $(1,0)^{\mathsf{T}}$ を掛けて順に計算します。

$$
\begin{aligned}
P^{-1}\begin{pmatrix}1\\0\end{pmatrix} &= \frac{1}{\sqrt5}\begin{pmatrix} 1 \\ -1\end{pmatrix}, \\
\operatorname{diag}(\varphi^n,\psi^n)\cdot \frac{1}{\sqrt5}\begin{pmatrix}1\\-1\end{pmatrix} &= \frac{1}{\sqrt5}\begin{pmatrix} \varphi^n \\ -\psi^n\end{pmatrix}, \\
P\cdot\frac{1}{\sqrt5}\begin{pmatrix}\varphi^n\\-\psi^n\end{pmatrix} &= \frac{1}{\sqrt5}\begin{pmatrix} \varphi^{n+1} - \psi^{n+1} \\ \varphi^n - \psi^n\end{pmatrix}.
\end{aligned}
$$

第 2 成分を読めば

$$
F_n = \frac{\varphi^n - \psi^n}{\sqrt5} = \frac{1}{\sqrt5}\left[\left(\frac{1+\sqrt5}{2}\right)^{n} - \left(\frac{1-\sqrt5}{2}\right)^{n}\right]
$$

です。$n=2$ で確かめると、$\varphi^2 - \psi^2 = (\varphi+\psi)(\varphi-\psi) = 1\cdot\sqrt5$ なので $F_2 = 1$ となり、正しい値です。$|\psi| = 0.618\ldots < 1$ なので第 2 項は急速に $0$ に近づき、$F_n$ が $\varphi^n/\sqrt5$ に漸近することも読み取れます。
</Example>

同じ仕組みが連立線形微分方程式にも効きます。$\frac{d}{dt}\boldsymbol{x}(t) = A\boldsymbol{x}(t)$、$\boldsymbol{x}(0) = \boldsymbol{x}_0$ の解は $\boldsymbol{x}(t) = e^{tA}\boldsymbol{x}_0$ ですが、<Ref to="prop-power-of-diagonalizable" /> (3) より $A$ が対角化可能なら

$$
\boldsymbol{x}(t) = P\operatorname{diag}(e^{\lambda_1t},\ldots,e^{\lambda_nt})P^{-1}\boldsymbol{x}_0
$$

です。固有ベクトルの方向ごとに独立な指数関数が走り、$\operatorname{Re}\lambda_i < 0$ がすべての $i$ で成り立てば解は $0$ に収束します。これが線形系の安定性判定の原理です。

<Aside type="caution">
理論と数値計算は区別してください。対角化の公式は正しくても、$P$ が「ほとんど特異」な場合（固有ベクトルどうしの角度が非常に小さい場合）、$PD^kP^{-1}$ の計算は丸め誤差を激しく増幅します。数値計算では対角化ではなく、直交（ユニタリ）行列だけを使うシューア分解や特異値分解を用いるのが標準です。
</Aside>

## 5. 実対称行列はつねに直交行列で対角化できる

対角化できない行列があると分かった以上、「この種類なら必ず対角化できる」という十分条件が欲しくなります。応用上いちばん重要なのが実対称行列です。$A^{\mathsf{T}} = A$ という一見些細な条件が、固有値の実数性・固有ベクトルの直交性・対角化可能性のすべてを一挙に与えます。以下、$\mathbb{R}^n$ には標準内積 $\langle x, y\rangle = x^{\mathsf{T}}y$ を、$\mathbb{C}^n$ には $\langle x, y\rangle = \bar{x}^{\mathsf{T}}y$ を入れて考えます（[内積空間とグラム・シュミット直交化](/mathematics/linear-algebra/inner-product-spaces) の <Ref to="mathematics/linear-algebra/inner-product-spaces#ex-standard-inner-product" /> を参照してください）。

<Lemma id="lem-symmetric-basic" title="実対称行列の固有値と固有ベクトル">
$A \in M_n(\mathbb{R})$ が $A^{\mathsf{T}} = A$ を満たすとする。このとき次が成り立つ。

1. $A$ を複素行列とみなしたときの固有値はすべて実数である。したがって固有ベクトルも実ベクトルの範囲で取れる。
2. 相異なる固有値 $\lambda \ne \mu$ に属する固有ベクトル $v, w \in \mathbb{R}^n$ は直交する。すなわち $\langle v, w\rangle = 0$。
</Lemma>

<Proof of="lem-symmetric-basic">
(1) $\lambda \in \mathbb{C}$ を固有値、$v \in \mathbb{C}^n \setminus \{0\}$ を対応する固有ベクトルとし、$Av = \lambda v$ とします。$v^{*} = \bar{v}^{\mathsf{T}}$ と書き、スカラー $\alpha = v^{*}Av$ を考えます。一方では

$$
\alpha = v^{*}(\lambda v) = \lambda\, v^{*}v = \lambda \|v\|^2
$$

です。他方、$1\times 1$ 行列の共役転置はそれ自身の複素共役ですから

$$
\bar{\alpha} = (v^{*}Av)^{*} = v^{*}A^{*}v = v^{*}Av = \alpha
$$

となります。ここで $A$ が実行列で対称であることから $A^{*} = \bar{A}^{\mathsf{T}} = A^{\mathsf{T}} = A$ を使いました。$\bar\alpha = \alpha$ なので $\alpha$ は実数です。$\|v\|^2 > 0$ は正の実数なので $\lambda = \alpha/\|v\|^2$ も実数です。$\lambda$ が実数なら $A - \lambda I$ は実行列であり、実の連立一次方程式 $(A-\lambda I)x = 0$ が非自明解をもつので、実ベクトルの固有ベクトルが取れます。

(2) $Av = \lambda v$, $Aw = \mu w$ とします。$A^{\mathsf{T}} = A$ より

$$
\lambda\langle v, w\rangle = (\lambda v)^{\mathsf{T}}w = (Av)^{\mathsf{T}}w = v^{\mathsf{T}}A^{\mathsf{T}}w = v^{\mathsf{T}}(Aw) = \mu\, v^{\mathsf{T}}w = \mu\langle v,w\rangle
$$

です。よって $(\lambda - \mu)\langle v,w\rangle = 0$ となり、$\lambda \ne \mu$ から $\langle v,w\rangle = 0$ を得ます。
</Proof>

<Theorem id="thm-spectral-symmetric" title="実対称行列のスペクトル定理">
$A \in M_n(\mathbb{R})$ が $A^{\mathsf{T}} = A$ を満たすとする。このとき直交行列 $Q \in M_n(\mathbb{R})$（$Q^{\mathsf{T}}Q = I$）と実対角行列 $D = \operatorname{diag}(\lambda_1,\ldots,\lambda_n)$ が存在して

$$
Q^{\mathsf{T}}AQ = D, \qquad \text{すなわち} \qquad A = QDQ^{\mathsf{T}} = \sum_{i=1}^{n}\lambda_i q_iq_i^{\mathsf{T}}
$$

が成り立つ。ここで $q_i$ は $Q$ の第 $i$ 列である。言い換えると、$\mathbb{R}^n$ は $A$ の固有ベクトルからなる正規直交基底をもつ。
</Theorem>

<Proof of="thm-spectral-symmetric">
$n$ についての帰納法で示します。

$n = 1$ のときは $Q = (1)$ とすればよく、主張は自明に成り立ちます。

$n \ge 2$ とし、$n-1$ 次以下の実対称行列について主張が成り立つと仮定します。固有多項式 $\chi_A$ は $\mathbb{C}$ 上に根をもつ（代数学の基本定理）ので $A$ は複素固有値をもち、<Ref to="lem-symmetric-basic" /> (1) よりそれは実数です。その 1 つを $\lambda_1$ とし、対応する実固有ベクトルを長さ $1$ に正規化して $q_1$ とします。

$W = \{\, w \in \mathbb{R}^n : \langle q_1, w\rangle = 0 \,\}$ とおくと $\dim W = n-1$ です。$W$ が $A$ で不変であることを示します。$w \in W$ とすると

$$
\langle q_1, Aw\rangle = q_1^{\mathsf{T}}Aw = (A^{\mathsf{T}}q_1)^{\mathsf{T}}w = (Aq_1)^{\mathsf{T}}w = \lambda_1 q_1^{\mathsf{T}}w = 0
$$

なので $Aw \in W$ です（2 番目の等号で $A^{\mathsf{T}} = A$ を使いました）。

$W$ の正規直交基底 $(u_2, \ldots, u_n)$ を取り（<Ref to="mathematics/linear-algebra/inner-product-spaces#thm-gram-schmidt" text="グラム・シュミットの直交化" /> で作れます）、$A|_W$ のこの基底に関する表現行列を $B \in M_{n-1}(\mathbb{R})$ とします。$B$ は対称です。実際、正規直交基底に関する表現行列の成分は $B_{ij} = \langle u_i, Au_j\rangle$ と書け、

$$
B_{ij} = \langle u_i, Au_j\rangle = u_i^{\mathsf{T}}Au_j = (Au_i)^{\mathsf{T}}u_j = \langle Au_i, u_j\rangle = \langle u_j, Au_i \rangle = B_{ji}
$$

となります（ここでも $A^{\mathsf{T}} = A$ と実内積の対称性を使いました）。

帰納法の仮定より、$W$ は $A|_W$ の固有ベクトルからなる正規直交基底 $(q_2, \ldots, q_n)$ をもちます。これらは $W$ の元なので $q_1$ と直交し、$(q_1, q_2, \ldots, q_n)$ は $\mathbb{R}^n$ の正規直交基底で、すべて $A$ の固有ベクトルです。これらを列に並べた $Q$ は $Q^{\mathsf{T}}Q = I$ を満たし（列が正規直交だから）、<Ref to="thm-diagonalizable-basis" /> より $Q^{-1}AQ = D$、$Q^{-1} = Q^{\mathsf{T}}$ なので $Q^{\mathsf{T}}AQ = D$ です。最後の表示 $A = \sum_i \lambda_iq_iq_i^{\mathsf{T}}$ は $QDQ^{\mathsf{T}}$ をブロック的に展開したものです。
</Proof>

幾何的に言えば、実対称行列は**直交する $n$ 本の軸を保ち、それぞれを $\lambda_i$ 倍に伸縮する変換**です。回転やせん断のような「軸のねじれ」は起こりません。複素行列（エルミート行列・正規行列）への一般化は [スペクトル定理](/mathematics/linear-algebra/spectral-theorem) の <Ref to="mathematics/linear-algebra/spectral-theorem#thm-spectral" /> で扱います。

<Example id="ex-pca" title="二次形式の主軸と主成分分析">
$A = \begin{pmatrix} 2 & 1 \\ 1 & 2\end{pmatrix}$ は対称です。$\chi_A(t) = (t-2)^2 - 1 = (t-3)(t-1)$ で固有値は $3, 1$。$\lambda = 3$ では $\begin{pmatrix}-1 & 1\\ 1 & -1\end{pmatrix}x = 0$ より $q_1 = \frac{1}{\sqrt2}(1,1)^{\mathsf{T}}$、$\lambda = 1$ では $q_2 = \frac{1}{\sqrt2}(1,-1)^{\mathsf{T}}$ です。<Ref to="lem-symmetric-basic" /> (2) の予告どおり $\langle q_1, q_2\rangle = \frac12(1 - 1) = 0$ と直交しています。$Q = \frac{1}{\sqrt2}\begin{pmatrix} 1 & 1 \\ 1 & -1\end{pmatrix}$ とおけば $Q^{\mathsf{T}}AQ = \operatorname{diag}(3,1)$ です。

二次形式 $q(x) = x^{\mathsf{T}}Ax = 2x_1^2 + 2x_1x_2 + 2x_2^2$ は、$y = Q^{\mathsf{T}}x$ と置き換えると $q = y^{\mathsf{T}}Dy = 3y_1^2 + y_2^2$ になります。したがって $q(x) = 1$ は楕円で、その主軸は $q_1, q_2$ の方向、半径はそれぞれ $1/\sqrt3$ と $1$ です。これがコーシーの主軸問題の答えの形です。

同じ定理がデータ解析の**主成分分析**を支えています。$N$ 個の $d$ 次元データを中心化して行に並べた行列を $X$ とすると、標本共分散行列 $S = \frac{1}{N-1}X^{\mathsf{T}}X$ は対称です（$(X^{\mathsf{T}}X)^{\mathsf{T}} = X^{\mathsf{T}}X$ だから）。<Ref to="thm-spectral-symmetric" /> より $S = Q\Lambda Q^{\mathsf{T}}$ と直交対角化でき、$\Lambda = \operatorname{diag}(\lambda_1 \ge \cdots \ge \lambda_d)$ とします。単位ベクトル $u$ 方向へ射影したデータの分散は $u^{\mathsf{T}}Su$ ですが、$y = Q^{\mathsf{T}}u$ とおくと $Q$ が直交なので $\|y\| = \|u\| = 1$ であり、

$$
u^{\mathsf{T}}Su = y^{\mathsf{T}}\Lambda y = \sum_{i=1}^{d}\lambda_iy_i^2 \le \lambda_1\sum_{i=1}^{d}y_i^2 = \lambda_1
$$

が成り立ちます。等号は $y = e_1$、すなわち $u = q_1$ のときに実際に達成されます。つまり**分散が最大になる方向は最大固有値の固有ベクトル**であり、その分散は最大固有値そのものです。第 2 主成分以降も、$q_1$ に直交する範囲で同じ議論を繰り返せば得られます。主成分どうしが直交するのは、対称行列の固有ベクトルが直交して取れるという <Ref to="thm-spectral-symmetric" /> の帰結です。
</Example>

## 6. 対角化できないとき：ジョルダン標準形

<Ref to="rem-field-matters" /> で見たとおり、$\mathbb{C}$ 上では固有多項式はつねに 1 次式の積に分解するので、対角化の障害は $m_g(\lambda) < m_a(\lambda)$、つまり**固有ベクトルの本数不足**だけです。足りない分をどう補うか。<Ref to="ex-shear" /> のせん断行列 $\begin{pmatrix}1&1\\0&1\end{pmatrix}$ は、対角化はできないものの、すでに「対角成分の 1 つ上に $1$ が 1 個あるだけ」という十分単純な形をしています。一般の行列もここまでは簡単にできる、というのがジョルダンの定理です。

<Definition id="def-jordan-block" title="ジョルダン細胞とジョルダン標準形">
$\lambda \in \mathbb{C}$ と正整数 $m$ に対し、$m$ 次正方行列

$$
J_m(\lambda) = \begin{pmatrix}
\lambda & 1 & & \\
& \lambda & \ddots & \\
& & \ddots & 1 \\
& & & \lambda
\end{pmatrix} = \lambda I_m + N_m
$$

を固有値 $\lambda$ の $m$ 次**ジョルダン細胞**という。ここで $N_m$ は $(i, i+1)$ 成分がすべて $1$、他が $0$ の $m$ 次行列（記していない成分はすべて $0$）である。ジョルダン細胞をブロック対角に並べた行列

$$
J = J_{m_1}(\lambda_1)\oplus \cdots \oplus J_{m_r}(\lambda_r)
$$

を**ジョルダン標準形**という（$\lambda_i$ は重複してよい）。$m_i = 1$ の細胞は $1$ 次の $(\lambda_i)$ であり、すべての細胞が $1$ 次のときジョルダン標準形は対角行列になる。
</Definition>

$J_m(\lambda)$ の意味は、$N_m$ の作用を見るとはっきりします。$N_m e_1 = 0$、$N_m e_j = e_{j-1}$ $(j \ge 2)$ なので、$N_m$ は基底ベクトルを 1 つずつ「押し下げて」いき、$m$ 回で $0$ になります（$N_m^m = O$）。つまり $A - \lambda I$ が作る 1 本の鎖が 1 つの細胞に対応します。

<Figure caption="ジョルダン鎖の構造。N = A − λI を掛けるたびに鎖を 1 段下り、最後は 0 に落ちる。鎖の長さが細胞の大きさ、鎖の本数が細胞の個数です。">
<svg viewBox="0 0 680 250" width="100%" role="img" aria-label="ジョルダン鎖を表す図">
  <defs>
    <marker id="jordan-arrowhead" viewBox="0 0 10 10" refX="9" refY="5" markerWidth="7" markerHeight="7" orient="auto-start-reverse">
      <path d="M 0 0 L 10 5 L 0 10 z" fill="currentColor" />
    </marker>
  </defs>
  <text x="20" y="30" fill="var(--sl-color-accent)" font-size="15">鎖 1（長さ 3）→ 細胞 J₃(λ)</text>
  <rect x="20" y="46" width="104" height="46" rx="8" fill="none" stroke="currentColor" stroke-width="1.5" />
  <text x="72" y="75" text-anchor="middle" fill="currentColor" font-size="17">v₃</text>
  <rect x="196" y="46" width="104" height="46" rx="8" fill="none" stroke="currentColor" stroke-width="1.5" />
  <text x="248" y="75" text-anchor="middle" fill="currentColor" font-size="17">v₂</text>
  <rect x="372" y="46" width="104" height="46" rx="8" fill="none" stroke="currentColor" stroke-width="1.5" />
  <text x="424" y="75" text-anchor="middle" fill="currentColor" font-size="17">v₁</text>
  <text x="562" y="75" text-anchor="middle" fill="currentColor" font-size="17">0</text>
  <line x1="128" y1="69" x2="190" y2="69" stroke="currentColor" stroke-width="1.5" marker-end="url(#jordan-arrowhead)" />
  <line x1="304" y1="69" x2="366" y2="69" stroke="currentColor" stroke-width="1.5" marker-end="url(#jordan-arrowhead)" />
  <line x1="480" y1="69" x2="544" y2="69" stroke="currentColor" stroke-width="1.5" marker-end="url(#jordan-arrowhead)" />
  <text x="159" y="58" text-anchor="middle" fill="var(--sl-color-accent)" font-size="14">N</text>
  <text x="335" y="58" text-anchor="middle" fill="var(--sl-color-accent)" font-size="14">N</text>
  <text x="512" y="58" text-anchor="middle" fill="var(--sl-color-accent)" font-size="14">N</text>
  <text x="372" y="136" fill="var(--sl-color-accent)" font-size="15">鎖 2（長さ 1）→ 細胞 J₁(λ)</text>
  <rect x="372" y="152" width="104" height="46" rx="8" fill="none" stroke="currentColor" stroke-width="1.5" />
  <text x="424" y="181" text-anchor="middle" fill="currentColor" font-size="17">w₁</text>
  <text x="562" y="181" text-anchor="middle" fill="currentColor" font-size="17">0</text>
  <line x1="480" y1="175" x2="544" y2="175" stroke="currentColor" stroke-width="1.5" marker-end="url(#jordan-arrowhead)" />
  <text x="512" y="164" text-anchor="middle" fill="var(--sl-color-accent)" font-size="14">N</text>
  <text x="20" y="228" fill="currentColor" font-size="14">最下段の v₁, w₁ が固有ベクトル（ker N の基底）、上段の v₂, v₃ は一般化固有ベクトル</text>
</svg>
</Figure>

<Theorem id="thm-jordan-existence" title="ジョルダン標準形の存在と一意性">
$A \in M_n(\mathbb{C})$ とする。このとき正則行列 $P \in GL_n(\mathbb{C})$、複素数 $\lambda_1, \ldots, \lambda_r$（重複を許す）、正整数 $m_1, \ldots, m_r$（$m_1 + \cdots + m_r = n$）が存在して

$$
P^{-1}AP = J_{m_1}(\lambda_1)\oplus\cdots\oplus J_{m_r}(\lambda_r)
$$

となる。さらに、現れる細胞の組（対 $(\lambda_i, m_i)$ の多重集合）は $A$ のみによって定まり、細胞を並べる順序を除いて一意である。各 $\lambda_i$ は $A$ の固有値であり、固有値 $\lambda$ の細胞の大きさの総和は $m_a(\lambda)$、細胞の個数は $m_g(\lambda)$ に等しい。
</Theorem>

<Proof of="thm-jordan-existence">
存在についてはここでは骨格のみを示し、詳細は Appendix と参考文献に譲ります。3 段階に分かれます。

**第 1 段階（一般化固有空間への分解）。** $A$ の相異なる固有値を $\mu_1,\ldots,\mu_s$ とし、$\tilde{E}_{\mu_i} = \ker(A-\mu_iI)^n$ とおくと

$$
\mathbb{C}^n = \tilde{E}_{\mu_1}\oplus\cdots\oplus\tilde{E}_{\mu_s}
$$

であり、各 $\tilde{E}_{\mu_i}$ は $A$ で不変です。これにより問題は「固有値がただ 1 つの場合」に帰着します。

**第 2 段階（冪零への還元）。** $\tilde{E}_{\mu}$ の上では $N = A - \mu I$ は冪零、すなわちある $k$ で $N^k = O$ です（定義から $N^n = O$）。$A = \mu I + N$ なので、$N$ を細胞の形にできれば $A$ も細胞の形になります。

**第 3 段階（冪零作用素の鎖分解）。** 冪零作用素 $N$ に対しては、上図のような鎖からなる基底が取れます。$N^{k}=O$、$N^{k-1}\ne O$ として、$\ker N^{k-1}$ の外にあるベクトル $u$ を取ると $u, Nu, \ldots, N^{k-1}u$ は一次独立な鎖をなします。これで張られる部分空間を除いて次元に関する帰納法を回すと、空間全体が鎖の直和に分かれます。鎖 1 本を長さの順に並べた基底に関する $N$ の行列は $N_m$ そのものなので、$A$ の行列は $J_m(\mu)$ になります。

一意性は完全に示せます。<Ref to="prop-jordan-block-count" /> により、固有値 $\lambda$ の大きさ $j$ の細胞の個数は $\operatorname{rank}(A-\lambda I)^{j-1}$, $\operatorname{rank}(A-\lambda I)^{j}$, $\operatorname{rank}(A-\lambda I)^{j+1}$ という $A$ だけで決まる量から一意に決まります。よって細胞の多重集合は $A$ で定まります。

最後の主張を確かめます。$J$ の固有多項式は各細胞の固有多項式の積で、$J_m(\lambda)$ は上三角なので $\chi_{J_m(\lambda)}(t) = (t-\lambda)^m$ です。よって固有値 $\lambda$ の細胞の大きさの総和が $m_a(\lambda)$ です。また細胞の個数は <Ref to="prop-jordan-block-count" /> で $j=1$ とした $n - \operatorname{rank}(A-\lambda I) = m_g(\lambda)$ に等しくなります。
</Proof>

<Remark id="rem-jordan-references">
第 1 段階と第 3 段階の完全な証明は Appendix に骨組みを示した。教科書としては齋藤『線型代数入門』第 6 章、Horn–Johnson, *Matrix Analysis*, Chapter 3、Axler, *Linear Algebra Done Right*, Chapter 8 が詳しい。単因子（行列 $tI - A$ の $\mathbb{C}[t]$ 上の標準形）を経由する証明もあり、佐武『線型代数学』はその流儀である。
</Remark>

<Proposition id="prop-jordan-block-count" title="細胞の個数を階数で数える">
$A \in M_n(\mathbb{C})$、$\lambda$ を $A$ の固有値とし、$N = A - \lambda I$ とおく（$N^0 = I_n$ と約束する）。$A$ のジョルダン標準形に現れる固有値 $\lambda$ の細胞のうち、大きさが $j$ 以上のものの個数を $s_j$ とすると、$j \ge 1$ に対して

$$
s_j = \operatorname{rank}N^{j-1} - \operatorname{rank}N^{j}
$$

が成り立つ。とくに大きさがちょうど $j$ の細胞の個数は

$$
s_j - s_{j+1} = \operatorname{rank}N^{j-1} - 2\operatorname{rank}N^{j} + \operatorname{rank}N^{j+1}
$$

である。
</Proposition>

<Proof of="prop-jordan-block-count">
$P^{-1}AP = J$ をジョルダン標準形とします。<Ref to="prop-similarity-invariants" /> (3) より $\operatorname{rank}N^{j} = \operatorname{rank}(J - \lambda I)^{j}$ なので、$J$ で計算すればよいことになります。$J - \lambda I$ はブロック対角で、階数はブロックごとの階数の和です。ブロックごとに $(J_m(\mu) - \lambda I)^j$ の階数を求めます。

**$\mu \ne \lambda$ の細胞。** $J_m(\mu) - \lambda I = (\mu-\lambda)I_m + N_m$ は対角成分がすべて $\mu - \lambda \ne 0$ の上三角行列なので、行列式は $(\mu-\lambda)^m \ne 0$ であり正則です。正則行列のべきも正則なので、階数はすべての $j \ge 0$ で $m$ です。したがって階差 $\operatorname{rank}N^{j-1} - \operatorname{rank}N^{j}$ への寄与は $m - m = 0$ です。

**$\mu = \lambda$ の細胞。** $J_m(\lambda) - \lambda I = N_m$ です。$N_m e_1 = 0$、$N_m e_i = e_{i-1}$ $(i\ge2)$ なので、$N_m^{j}e_i = e_{i-j}$（$i > j$ のとき）、$N_m^je_i = 0$（$i \le j$ のとき）となります。よって $N_m^{j}$ の像は $e_1, \ldots, e_{m-j}$ で張られ、

$$
\operatorname{rank}N_m^{j} = \max(m-j,\ 0)
$$

です。この細胞の階差への寄与は

$$
\max(m-j+1,0) - \max(m-j,0) = \begin{cases} 1 & (m \ge j) \\ 0 & (m \le j-1)\end{cases}
$$

となります。$m \ge j$ のときは $(m-j+1)-(m-j) = 1$、$m \le j-1$ のときは $m-j+1 \le 0$ なので両方 $0$ です。

すべての細胞について足し合わせると、階差は「固有値 $\lambda$ の細胞のうち大きさが $j$ 以上のものの個数」に等しくなります。これが $s_j$ です。大きさがちょうど $j$ の個数は「$j$ 以上の個数」から「$j+1$ 以上の個数」を引いたもの、すなわち $s_j - s_{j+1}$ であり、代入すると主張の式になります。
</Proof>

<Example id="ex-jordan-compute" title="3 次行列のジョルダン標準形と変換行列">

$$
A = \begin{pmatrix} 1 & 1 & 0 \\ -1 & 3 & 0 \\ -1 & 1 & 2\end{pmatrix}
$$

のジョルダン標準形と、それを与える $P$ を求めます。

**固有値。** 第 3 列に $0$ が 2 つ並んでいるので第 3 列で余因子展開すると

$$
\chi_A(t) = \det\begin{pmatrix} t-1 & -1 & 0 \\ 1 & t-3 & 0 \\ 1 & -1 & t-2\end{pmatrix} = (t-2)\bigl[(t-1)(t-3)+1\bigr] = (t-2)(t^2-4t+4) = (t-2)^3
$$

です。固有値は $2$ のみ、$m_a(2) = 3$。

**重複度。** $N = A - 2I = \begin{pmatrix} -1 & 1 & 0 \\ -1 & 1 & 0 \\ -1 & 1 & 0\end{pmatrix}$ は 3 つの行がすべて等しいので $\operatorname{rank}N = 1$、よって $m_g(2) = 3-1 = 2$ です。$m_g < m_a$ なので <Ref to="thm-diagonalizability-criterion" /> より対角化できません。

**細胞の形。** $N = ab^{\mathsf{T}}$（$a = (1,1,1)^{\mathsf{T}}$, $b = (-1,1,0)^{\mathsf{T}}$）と書けるので $N^2 = a(b^{\mathsf{T}}a)b^{\mathsf{T}} = (-1+1+0)N = O$ です。<Ref to="prop-jordan-block-count" /> を使うと、$\operatorname{rank}N^0 = 3$, $\operatorname{rank}N = 1$, $\operatorname{rank}N^2 = 0$ より

$$
s_1 = 3 - 1 = 2, \qquad s_2 = 1 - 0 = 1, \qquad s_3 = 0-0 = 0
$$

です。よって大きさ $1$ の細胞が $s_1 - s_2 = 1$ 個、大きさ $2$ の細胞が $s_2 - s_3 = 1$ 個で、

$$
J = J_2(2)\oplus J_1(2) = \begin{pmatrix} 2 & 1 & 0 \\ 0 & 2 & 0 \\ 0 & 0 & 2\end{pmatrix}
$$

と決まります。大きさの総和 $2+1 = 3 = m_a(2)$、細胞の個数 $2 = m_g(2)$ も合っています。

**変換行列。** 長さ 2 の鎖を作ります。$Nv_2 \ne 0$ となる $v_2$ を取ればよく、$v_2 = e_1 = (1,0,0)^{\mathsf{T}}$ とすると $v_1 = Nv_2 = (-1,-1,-1)^{\mathsf{T}} \ne 0$ です。$N^2 = O$ より $v_1 \in \ker N$ で、これが固有ベクトルです。次に $\ker N = \{x : -x_1+x_2 = 0\}$ から $v_1$ と一次独立な元を選びます。$v_3 = (0,0,1)^{\mathsf{T}}$ は $\ker N$ に属し（第 1・第 2 成分が $0$ なので）、$v_1$ とは一次独立です。そこで

$$
P = (v_1\ v_2\ v_3) = \begin{pmatrix} -1 & 1 & 0 \\ -1 & 0 & 0 \\ -1 & 0 & 1\end{pmatrix}
$$

とおきます。第 3 列で余因子展開すると $\det P = 1\cdot\det\begin{pmatrix}-1&1\\-1&0\end{pmatrix} = 1 \ne 0$ なので $P$ は正則です。実際に確かめます。

$$
Av_1 = 2v_1,\qquad Av_2 = \begin{pmatrix}1\\-1\\-1\end{pmatrix} = 2\begin{pmatrix}1\\0\\0\end{pmatrix} + \begin{pmatrix}-1\\-1\\-1\end{pmatrix} = 2v_2 + v_1, \qquad Av_3 = \begin{pmatrix}0\\0\\2\end{pmatrix} = 2v_3
$$

です（$Av_2$ は $A$ の第 1 列、$Av_3$ は第 3 列そのものです）。これは <Ref to="thm-diagonalizable-basis" /> の証明と同じ「列ごとの読み替え」により $AP = PJ$、すなわち $P^{-1}AP = J$ を意味します。

**べき乗。** $J_2(2) = 2I_2 + N_2$ で $N_2^2 = O$、しかも $2I_2$ と $N_2$ は可換なので二項定理が使えて

$$
J_2(2)^k = (2I_2)^k + k(2I_2)^{k-1}N_2 = \begin{pmatrix} 2^k & k2^{k-1} \\ 0 & 2^k\end{pmatrix}
$$

です。よって $A^k = P\bigl(J_2(2)^k \oplus (2^k)\bigr)P^{-1}$ が具体的に計算できます。対角化できなくても、べき乗は閉じた式で書けるということです。
</Example>

<Remark id="rem-repeated-root">
一般に $J_m(\lambda)^k = \sum_{j=0}^{m-1}\binom{k}{j}\lambda^{k-j}N_m^{j}$ である（$\lambda I$ と $N_m$ が可換なので二項定理が使え、$N_m^{m} = O$ で打ち切られる）。成分は $\binom{k}{j}\lambda^{k-j}$、すなわち $k$ の多項式と指数関数の積である。線形漸化式の特性方程式が重解 $\lambda$ をもつときに一般解へ $k\lambda^{k}$, $k^2\lambda^{k}$ といった項が現れる理由は、まさにこれである。<Ref to="ex-fibonacci" /> のように相異なる根しかない場合には純粋な指数関数だけが現れたことと対照的である。
</Remark>

## 7. 演習

<Exercise id="exr-similarity-invariants" difficulty="易">
$A, B \in M_n(K)$ が相似ならば $\operatorname{tr}A = \operatorname{tr}B$ かつ $\det A = \det B$ であることを示してください。また、$\operatorname{tr}$ と $\det$ と固有多項式がすべて一致しても相似とは限らないことを、$2$ 次の具体例で示してください。

<Solution>
前半は <Ref to="prop-similarity-invariants" /> (2) そのものです。念のため筋を再掲すると、$B = P^{-1}AP$ のとき固有多項式が一致し、その $t^{n-1}$ の係数が $-\operatorname{tr}$、定数項が $(-1)^n\det$ なので、両者が一致します。

後半は $A = I_2$, $B = \begin{pmatrix} 1 & 1 \\ 0 & 1\end{pmatrix}$ を取ります。どちらも固有多項式は $(t-1)^2$、トレースは $2$、行列式は $1$ です。しかし $A = I_2$ に相似な行列は $P^{-1}I_2P = I_2$ だけなので、$B \ne I_2$ より両者は相似ではありません。<Ref to="thm-diagonalizability-criterion" /> の言葉でいえば、$A$ は対角化可能、$B$ は $m_g(1) = 1 < 2 = m_a(1)$ なので対角化不可能であり、対角化可能性という性質で区別できています。
</Solution>
</Exercise>

<Exercise id="exr-jordan-power" difficulty="標準">
$A = \begin{pmatrix} 5 & -1 \\ 1 & 3\end{pmatrix}$ について、対角化可能かどうかを判定し、ジョルダン標準形 $J$ とそれを与える $P$ を求め、さらに $A^k$（$k \ge 0$）を求めてください。

<Solution>
固有多項式は $\det\begin{pmatrix} t-5 & 1 \\ -1 & t-3\end{pmatrix} = (t-5)(t-3)+1 = t^2-8t+16 = (t-4)^2$ なので、固有値は $4$ のみで $m_a(4) = 2$ です。$M = A - 4I = \begin{pmatrix} 1 & -1 \\ 1 & -1\end{pmatrix}$ は 2 つの行が等しいので $\operatorname{rank}M = 1$、よって $m_g(4) = 2-1 = 1$ です。$m_g < m_a$ なので <Ref to="thm-diagonalizability-criterion" /> より**対角化できません**。

<Ref to="prop-jordan-block-count" /> を使うと、$M^2 = O$（実際 $M^2 = \begin{pmatrix}1&-1\\1&-1\end{pmatrix}^2 = \begin{pmatrix}0&0\\0&0\end{pmatrix}$）なので $s_1 = 2-1 = 1$, $s_2 = 1-0 = 1$、大きさ $2$ の細胞が $s_2 - s_3 = 1$ 個、大きさ $1$ の細胞が $s_1 - s_2 = 0$ 個です。よって $J = J_2(4) = \begin{pmatrix} 4 & 1 \\ 0 & 4\end{pmatrix}$。

鎖を作ります。$v_2 = e_1 = (1,0)^{\mathsf{T}}$ とすると $v_1 = Mv_2 = (1,1)^{\mathsf{T}} \ne 0$ です。$P = \begin{pmatrix} 1 & 1 \\ 1 & 0\end{pmatrix}$ とおくと $\det P = -1 \ne 0$、$P^{-1} = \begin{pmatrix} 0 & 1 \\ 1 & -1\end{pmatrix}$ です。$Av_1 = (5-1, 1+3)^{\mathsf{T}} = 4v_1$、$Av_2 = (5,1)^{\mathsf{T}} = 4v_2 + v_1$ なので $AP = PJ$、すなわち $P^{-1}AP = J$ です。

べき乗は <Ref to="rem-repeated-root" /> の式より $J^k = \begin{pmatrix} 4^k & k4^{k-1} \\ 0 & 4^k\end{pmatrix}$ なので

$$
A^k = PJ^kP^{-1} = \begin{pmatrix} 4^k & k4^{k-1}+4^k \\ 4^k & k4^{k-1}\end{pmatrix}\begin{pmatrix} 0 & 1 \\ 1 & -1\end{pmatrix} = \begin{pmatrix} 4^k + k4^{k-1} & -k4^{k-1} \\ k4^{k-1} & 4^k - k4^{k-1}\end{pmatrix}
$$

です。$k=0$ で $I$、$k=1$ で $\begin{pmatrix}5&-1\\1&3\end{pmatrix} = A$ となり、検算できます。
</Solution>
</Exercise>

<Exercise id="exr-psd" difficulty="標準">
$A \in M_n(\mathbb{R})$ を実対称行列とします。次の 2 条件が同値であることを示してください。

1. すべての $x\in\mathbb{R}^n$ に対して $x^{\mathsf{T}}Ax \ge 0$（$A$ は半正定値）。
2. $A$ のすべての固有値は $0$ 以上である。

<Solution>
**(2) $\Rightarrow$ (1)。** <Ref to="thm-spectral-symmetric" /> より直交行列 $Q$ と $D = \operatorname{diag}(\lambda_1,\ldots,\lambda_n)$ で $A = QDQ^{\mathsf{T}}$ と書けます。$x \in \mathbb{R}^n$ を任意に取り $y = Q^{\mathsf{T}}x$ とおくと

$$
x^{\mathsf{T}}Ax = x^{\mathsf{T}}QDQ^{\mathsf{T}}x = y^{\mathsf{T}}Dy = \sum_{i=1}^{n}\lambda_iy_i^2
$$

です。仮定 (2) よりすべての $\lambda_i \ge 0$、また $y_i^2 \ge 0$ なので和は $0$ 以上です。

**(1) $\Rightarrow$ (2)。** $\lambda$ を $A$ の固有値とします。$A$ は実対称なので <Ref to="lem-symmetric-basic" /> (1) より $\lambda$ は実数で、実の固有ベクトル $v \ne 0$ が取れます。$x = v$ として仮定 (1) を使うと

$$
0 \le v^{\mathsf{T}}Av = v^{\mathsf{T}}(\lambda v) = \lambda\|v\|^2
$$

です。$\|v\|^2 > 0$ なので両辺を割って $\lambda \ge 0$ を得ます。

なお <Ref to="ex-pca" /> の共分散行列 $S = \frac{1}{N-1}X^{\mathsf{T}}X$ は、$x^{\mathsf{T}}Sx = \frac{1}{N-1}\|Xx\|^2 \ge 0$ なので半正定値であり、この同値性からその固有値（各主成分の分散）はすべて $0$ 以上だと分かります。
</Solution>
</Exercise>

<Exercise id="exr-rank-to-jordan" difficulty="難">
$A \in M_7(\mathbb{C})$ の固有多項式が $(t-\lambda)^7$ であり、$N = A - \lambda I$ について

$$
\operatorname{rank}N = 4,\quad \operatorname{rank}N^2 = 2,\quad \operatorname{rank}N^3 = 1,\quad \operatorname{rank}N^4 = 0
$$

が分かっているとします。$A$ のジョルダン標準形を決定してください。

<Solution>
固有値は $\lambda$ ただ 1 つです。$\operatorname{rank}N^0 = \operatorname{rank}I_7 = 7$ に注意して <Ref to="prop-jordan-block-count" /> を適用します。大きさ $j$ 以上の細胞の個数 $s_j$ は

$$
\begin{aligned}
s_1 &= 7 - 4 = 3, & s_2 &= 4 - 2 = 2, \\
s_3 &= 2 - 1 = 1, & s_4 &= 1 - 0 = 1, \\
s_5 &= 0 - 0 = 0. &&
\end{aligned}
$$

$j \ge 5$ ではすべて $0$ です。大きさがちょうど $j$ の細胞の個数は $s_j - s_{j+1}$ なので

$$
\begin{aligned}
\text{大きさ }1 &: s_1 - s_2 = 1, & \text{大きさ }2 &: s_2 - s_3 = 1, \\
\text{大きさ }3 &: s_3 - s_4 = 0, & \text{大きさ }4 &: s_4 - s_5 = 1
\end{aligned}
$$

です。したがって

$$
J = J_4(\lambda)\oplus J_2(\lambda)\oplus J_1(\lambda)
$$

です。検算として、大きさの総和は $4+2+1 = 7$ で行列のサイズと一致し、細胞の個数は $3 = s_1 = 7 - \operatorname{rank}N = m_g(\lambda)$ で <Ref to="thm-jordan-existence" /> の主張とも整合します。また最大の細胞の大きさ $4$ は、$N^4 = O$ かつ $N^3 \ne O$（$\operatorname{rank}N^3 = 1 \ne 0$）であることと合っています。
</Solution>
</Exercise>

## 参考文献

- 齋藤正彦『線型代数入門』東京大学出版会、1966 — 第 5 章（固有値と固有ベクトル）、第 6 章（単因子およびジョルダンの標準形）。
- 佐武一郎『線型代数学（新装版）』裳華房、2015 — 単因子論を経由してジョルダン標準形を構成する流儀の標準的な文献。
- Sheldon Axler, *Linear Algebra Done Right*, 3rd ed., Springer, 2015 — Chapter 7（内積空間上の作用素とスペクトル定理）、Chapter 8（複素ベクトル空間上の作用素と一般化固有ベクトル）。
- Roger A. Horn and Charles R. Johnson, *Matrix Analysis*, 2nd ed., Cambridge University Press, 2013 — Chapter 3（相似に関する標準形とジョルダン標準形）。
- Gilbert Strang, *Introduction to Linear Algebra*, 5th ed., Wellesley-Cambridge Press, 2016 — Chapter 6（固有値と固有ベクトル、対角化と対称行列）。
- Lloyd N. Trefethen and David Bau III, *Numerical Linear Algebra*, SIAM, 1997 — Part V（固有値問題。対角化を数値計算にそのまま使うことの危うさについて）。

## Appendix: 一般化固有空間分解の骨組み

<Ref to="thm-jordan-existence" /> の第 1 段階と第 3 段階について、証明の骨組みを補います。$A \in M_n(\mathbb{C})$ を固定し、$\lambda$ をその固有値、$N = A - \lambda I$ とします。

**核の増大列は必ず止まります。** $\ker N \subseteq \ker N^2 \subseteq \cdots$ は明らかに増大列です（$N^jx = 0$ なら $N^{j+1}x = N(N^jx) = 0$）。次元は $n$ で頭打ちなので、ある $k \le n$ で $\ker N^{k} = \ker N^{k+1}$ となります。さらに、いったん等号が成り立てばその先もずっと等号です。実際 $x \in \ker N^{k+2}$ とすると $Nx \in \ker N^{k+1} = \ker N^{k}$ なので $N^{k}(Nx) = 0$、すなわち $x \in \ker N^{k+1}$ です。したがって $\ker N^{n} = \ker N^{n+1} = \cdots$ であり、これを $\tilde{E}_\lambda$（一般化固有空間）と書きます。

**空間は核と像に分かれます。** $M = N^{n}$ とおくと $\mathbb{C}^n = \ker M \oplus \operatorname{im} M$ が成り立ちます。まず次元は次元定理（階数・退化次数の関係）より $\dim\ker M + \dim\operatorname{im}M = n$ です。交わりが $0$ であることを見ます。$x \in \ker M \cap \operatorname{im}M$ とすると $x = My$ と書け、$0 = Mx = M^2y = N^{2n}y$ です。前段落より $\ker N^{2n} = \ker N^{n}$ なので $y \in \ker N^n = \ker M$、よって $x = My = 0$ です。次元の和が $n$ で交わりが $0$ なら直和分解になります。$\ker M$ と $\operatorname{im}M$ はどちらも $A$ で不変です（$A$ と $M$ が可換だから）。

**残りの部分では $\lambda$ は固有値ではありません。** $\operatorname{im}M$ 上で $N$ は単射です（$x = My$ かつ $Nx = 0$ なら $x \in \ker N \cap \operatorname{im}M \subseteq \ker M\cap\operatorname{im}M = 0$）。つまり $\operatorname{im}M$ に制限した $A$ は固有値 $\lambda$ をもちません。よって固有値の個数に関する帰納法により、$\mathbb{C}^n$ はすべての固有値の一般化固有空間の直和に分かれます。

**冪零作用素は鎖に分かれます。** $\tilde{E}_\lambda$ 上で $N$ は冪零です。$N^{k} = O$、$N^{k-1}\ne O$ とし、$N^{k-1}u \ne 0$ となる $u$ を取ると、$u, Nu, \ldots, N^{k-1}u$ は一次独立です（$c_0u + c_1Nu+\cdots+c_{k-1}N^{k-1}u = 0$ に $N^{k-1}$ を掛けると $c_0N^{k-1}u = 0$ より $c_0 = 0$、以下 $N^{k-2}$ を掛けて $c_1 = 0$、と順に決まります）。この鎖が張る $N$ 不変部分空間を $U$ とすると、$U$ の $N$ 不変な補空間が取れることが示せ、その補空間で次元に関する帰納法を回すと、空間全体が鎖の直和になります。鎖を「短いものから長いものへ」並べれば、その基底に関する行列がジョルダン標準形です。この最後の補空間の存在が技術的な山場で、詳細は参考文献に挙げた各書を参照してください。


</div>
