MathLabs

解析学

作用素論

ヒルベルト空間上の有界および非有界線形作用素とそのスペクトルを研究する分野。

直観無限次元行列としての作用素

行列は有限個の数の並びを受け取り、成分を線形に混ぜ合わせて別の有限個の数の並びを出力する。作用素は関数に対してまったく同じ働きをする。微分 Df=f′Df=f' は関数を受け取り、線形に別の関数を生み出す。xx を掛ける、固定された核と畳み込む、フーリエ変換を施すことも、すべて作用素である。作用素論は、線形代数が Rn\mathbb{R}^n 上の行列を研究するのと同じように、ヒルベルト空間 HH 上のこうした写像を研究する。その固有値(今ではスペクトルと呼ばれる)は何か、どの作用素が「良い」ものか(対称行列のような自己随伴)、そして――真に無限次元特有の現象として――どの作用素がそもそも空間全体で定義されているのか、というのも、微分は行列の乗法とは異なり、HH のすべての関数に対して定義されているわけではないからである。

ユニタリ作用素が正規作用素に、コンパクト作用素が有界作用素に、有界作用素が非有界作用素に含まれる様子を示す有向グラフ。
作用素のクラスとその関係のネットワーク:ユニタリ作用素(ノード UU)は正規作用素の特別な場合であり、正規作用素には自己随伴作用素(ノード T=T∗T=T^*)や回転も含まれる。コンパクト作用素(ノード KK)は自己随伴であってもなくてもよく、すべての有界作用素の中に含まれ、それはさらに稠密にしか定義されない、はるかに大きな非有界作用素のクラスの中に含まれる。ノードをハイライトすると、そこに至る包含の連鎖をたどることができる。

大学有界作用素、随伴作用素、自己随伴性

定義: 有界線形作用素と作用素ノルム

ヒルベルト空間 HH からそれ自身への線形写像 TT が有界であるとは、ベクトルを無制限な倍率で引き伸ばさないこと、すなわちすべての x∈Hx\in H に対して ∥Tx∥≤c∥x∥\|Tx\|\le c\|x\| となる定数 cc が存在することをいう。そのような最小の cc が作用素ノルム ∥T∥=sup⁡∥x∥≤1∥Tx∥\|T\|=\sup_{\|x\|\le1}\|Tx\| であり、TT が単位ベクトルを引き伸ばせる最大の倍率である。線形写像に対して、有界性はちょうど連続性と同値であるため、「有界作用素」と「連続作用素」は同じ意味である。

式で書けば、作用素ノルムは TT が単位ベクトルをどれだけ引き伸ばせるかの上限である。

∥T∥=sup⁡∥x∥≤1∥Tx∥\|T\|=\sup_{\|x\|\le1}\|Tx\|

HH 上のすべての有界な TT は一意な随伴作用素 T∗T^* を持ち、すべての x,y∈Hx,y\in H に対して ⟨Tx,y⟩=⟨x,T∗y⟩\langle Tx,y\rangle=\langle x,T^*y\rangle によって定義される――これは各固定された yy に対する汎関数 x↦⟨Tx,y⟩x\mapsto\langle Tx,y\rangle にリースの表現定理を適用することで存在する。有限次元では、随伴を取ることは行列の共役転置を取ることに他ならない。TT は T=T∗T=T^* のとき自己随伴(エルミート)と呼ばれ、TT∗=T∗TTT^*=T^*T のとき正規、T∗T=TT∗=IT^*T=TT^*=I のときユニタリと呼ばれる――それぞれ対称行列、自身の転置と可換な行列、回転行列の作用素版である。

自己随伴性はこの理論において最も重要な性質である。なぜならそれは、スペクトルが実数であることを強制し、(以下で証明される)スペクトル定理へのアクセスを与えるちょうどその条件だからである。書き下すと、TT が自己随伴であるとは、内積の一方の側からもう一方へ TT を移動させても何も変わらないことに他ならない。

⟨Tx,y⟩=⟨x,Ty⟩∀x,y∈H\langle Tx,y\rangle=\langle x,Ty\rangle\quad\forall x,y\in H

これを実対称行列 A=ATA=A^{\mathsf T} と比較してみよう。この行列では ⟨Ax,y⟩=⟨x,Ay⟩\langle Ax,y\rangle=\langle x,Ay\rangle が自動的に成り立つ――自己随伴性はまさに行列の対称性の無限次元版である。異なる作用素のクラスは著しく異なるスペクトルを持ち、以下にまとめる。

作用素のクラスとそのスペクトル
クラス定義条件スペクトル σ(T)\sigma(T)
自己随伴T=T∗T=T^*実数: σ(T)⊂R\sigma(T)\subset\mathbb{R}
ユニタリT∗T=TT∗=IT^*T=TT^*=I単位円周: σ(T)⊂{∣z∣=1}\sigma(T)\subset\{|z|=1\}
コンパクト自己随伴T=T∗T=T^*、TT はコンパクト離散、λn→0\lambda_n\to0
L2[0,1]L^2[0,1] 上の xx による乗法Tf(x)=xf(x)Tf(x)=xf(x)連続: σ(T)=[0,1]\sigma(T)=[0,1]、固有値なし

大学二つの柱:スペクトル定理とヘリンガー・テプリッツの定理

TT をヒルベルト空間 HH 上のコンパクト自己随伴作用素とする。このとき、TT の固有ベクトル e1,e2,…e_1,e_2,\dots からなる HH の正規直交基底が存在し、実固有値 λ1,λ2,…\lambda_1,\lambda_2,\dots は HH が無限次元であれば λn→0\lambda_n\to0 を満たし、かつすべての x∈Hx\in H に対して Tx=∑nλn⟨x,en⟩enTx=\sum_n\lambda_n\langle x,e_n\rangle e_n が成り立つ。

なぜ正しいのか?

これは、コンパクト自己随伴作用素がどれほど複雑に見えても、適切な正規直交基底のもとでは実は対角行列であることを意味する――線形代数における対称行列が正規直交固有基底によって常に対角化可能であるのとまったく同じである。これにより、作用素の関数を定義したり、Tx=yTx=y を解いたり、信号や画像をその支配的な固有方向によって分解したりすることが可能になる(主成分分析は姿を変えたこの定理である)。

証明

まず、自己随伴作用素のすべての固有値は実数である。x≠0x\ne0 で Tx=λxTx=\lambda x ならば、λ∥x∥2=⟨Tx,x⟩=⟨x,Tx⟩=λˉ∥x∥2\lambda\|x\|^2=\langle Tx,x\rangle=\langle x,Tx\rangle=\bar\lambda\|x\|^2(中間のステップで自己随伴性を用いる)なので λ=λˉ\lambda=\bar\lambda である。同様に、異なる固有値 λ≠μ\lambda\ne\mu に対する固有ベクトルは直交する。λ⟨x,y⟩=⟨Tx,y⟩=⟨x,Ty⟩=μ⟨x,y⟩\lambda\langle x,y\rangle=\langle Tx,y\rangle=\langle x,Ty\rangle=\mu\langle x,y\rangle より ⟨x,y⟩=0\langle x,y\rangle=0 が強制される。

次に、コンパクト性により絶対値最大の固有値が実際に存在することが保証される。自己随伴な TT に対して作用素ノルムは ∥T∥=sup⁡∥x∥=1∣⟨Tx,x⟩∣\|T\|=\sup_{\|x\|=1}|\langle Tx,x\rangle| を満たし、コンパクト性により ∣⟨Tx,x⟩∣|\langle Tx,x\rangle| の最大化列から収束部分列を抽出でき、∣λ1∣=∥T∥|\lambda_1|=\|T\| を満たす Te1=λ1e1Te_1=\lambda_1 e_1 となる単位ベクトル e1e_1 が得られる。

次に帰納法を用いる。固有値 λ1,…,λn−1\lambda_1,\dots,\lambda_{n-1} を持つ正規直交固有ベクトル e1,…,en−1e_1,\dots,e_{n-1} が見つかったとして、TT を閉部分空間 Hn={e1,…,en−1}⊥H_n=\{e_1,\dots,e_{n-1}\}^\perp に制限する。TT は HnH_n をそれ自身へ写し(自己随伴性により不変部分空間の直交補空間も不変となる)、そこでもコンパクトかつ自己随伴のままであるから、同じ最大固有値の議論により次の固有ベクトル en∈Hne_n\in H_n(∣λn∣≤∣λn−1∣|\lambda_n|\le|\lambda_{n-1}|)が得られる。

最後に、この過程が終わらない場合、λn→0\lambda_n\to0 となる。そうでなければ無限個の ∣λn∣|\lambda_n| がある δ>0\delta>0 を超え続けることになるが、そのとき {Ten}={λnen}\{Te_n\}=\{\lambda_ne_n\} は収束部分列を持たない(正規直交性により n≠mn\ne m のとき ∥λnen−λmen∥2≥δ2⋅2\|\lambda_ne_n-\lambda_me_n\|^2\ge\delta^2\cdot2 となるため)ため、TT のコンパクト性に矛盾する。その後、{en}\{e_n\} の閉包と ker⁡T\ker T を合わせたものが HH を尽くすこと、および TT が ker⁡T\ker T 上で 00 として作用することを確認すれば、すべての x∈Hx\in H に対する固有展開 Tx=∑nλn⟨x,en⟩enTx=\sum_n\lambda_n\langle x,e_n\rangle e_n が得られる。

TT をヒルベルト空間 HH 全体(稠密な部分空間だけではない)で定義された線形作用素で、対称、すなわち ⟨Tx,y⟩=⟨x,Ty⟩∀x,y∈H\langle Tx,y\rangle=\langle x,Ty\rangle\quad\forall x,y\in H を満たすとする。このとき TT は自動的に有界である。

なぜ正しいのか?

これは、量子力学において非有界作用素が避けられない理由を説明する定理である。位置、運動量、ハミルトニアンのような物理的に重要な対称作用素は、実際には HH のすべてのベクトル上で定義することはできず(稠密な定義域上でのみ定義される)、もしそうであれば、この定理によって有界であることが強制されてしまう――しかし明らかにそれらは有界ではない。

証明

閉グラフ定理(ベールのカテゴリ定理の標準的な帰結)を用いる。ヒルベルト空間全体で定義された線形作用素が有界であることは、そのグラフ {(x,Tx):x∈H}\{(x,Tx):x\in H\} が H×HH\times H において閉であること、すなわち xn→xx_n\to x かつ Txn→yTx_n\to y ならば常に y=Txy=Tx が成り立つこととちょうど同値である。

xn→xx_n\to x かつ Txn→yTx_n\to y とする。y=Txy=Tx を示さねばならない。任意の固定された z∈Hz\in H に対し、対称性より各 nn について ⟨Txn,z⟩=⟨xn,Tz⟩\langle Tx_n,z\rangle=\langle x_n,Tz\rangle が成り立つ。

両辺で n→∞n\to\infty とすると、左辺は Txn→yTx_n\to y かつ内積が連続であることから ⟨Txn,z⟩→⟨y,z⟩\langle Tx_n,z\rangle\to\langle y,z\rangle となり、右辺は xn→xx_n\to x から ⟨xn,Tz⟩→⟨x,Tz⟩\langle x_n,Tz\rangle\to\langle x,Tz\rangle となる。したがって ⟨y,z⟩=⟨x,Tz⟩=⟨Tx,z⟩\langle y,z\rangle=\langle x,Tz\rangle=\langle Tx,z\rangle(右辺で再度対称性を用いる)。

⟨y,z⟩=⟨Tx,z⟩\langle y,z\rangle=\langle Tx,z\rangle がすべての z∈Hz\in H に対して成り立つので、すべての zz に対して ⟨y−Tx,z⟩=0\langle y-Tx,z\rangle=0 となる。z=y−Txz=y-Tx とおくと ∥y−Tx∥2=0\|y-Tx\|^2=0 となり、y=Txy=Tx を得る。ゆえに TT のグラフは閉であり、閉グラフ定理により TT は有界であると結論される。

大学実世界での応用と具体例

作用素論は量子力学(オブザーバブルは自己随伴作用素であり、エネルギーはハミルトニアンの固有値である)、工学における振動・安定性解析(固有振動数はコンパクト作用素の固有値である)、そしてデータサイエンス(主成分分析はコンパクト自己随伴な共分散作用素を対角化する)の数学的言語である。また、微妙な数学的配慮が物理的に不可欠となる場所でもある。非有界作用素は行列のように気軽には扱えない。

例: 工学とデータサイエンス:対称行列の対角化

2×22\times2 の対称行列は、R2\mathbb{R}^2 上のコンパクト自己随伴作用素として見ると、ばねで結ばれた二つの同一質量間の結合を表す:A=(2112)A=\begin{pmatrix}2&1\\1&2\end{pmatrix}。この単純な剛性行列モデルにおける固有値、すなわち固有振動数を求めよ。

解答

固有値は特性方程式 det⁡(A−λI)=0\det(A-\lambda I)=0 を解いて求める。A=(2112)A=\begin{pmatrix}2&1\\1&2\end{pmatrix} のとき、これは det⁡(2−λ112−λ)=0\det\begin{pmatrix}2-\lambda&1\\1&2-\lambda\end{pmatrix}=0 である。

この 2×22\times2 行列の行列式を展開すると (2−λ)(2−λ)−(1)(1)=0(2-\lambda)(2-\lambda)-(1)(1)=0、すなわち (2−λ)2−1=0(2-\lambda)^2-1=0 となる。

これは [(2−λ)−1][(2−λ)+1]=0[(2-\lambda)-1][(2-\lambda)+1]=0、すなわち (1−λ)(3−λ)=0(1-\lambda)(3-\lambda)=0 と因数分解でき、λ1=1\lambda_1=1、λ2=3\lambda_2=3 が得られる。

スペクトル定理が予測する通り、これらはいずれも実数であり(行列は対称)、対応する固有ベクトル (1,−1)/2(1,-1)/\sqrt2 と (1,1)/2(1,1)/\sqrt2 は直交している。二つの基準モードは、質量が逆位相で振動するもの(より低い振動数、より弱い実効剛性 λ1=1\lambda_1=1)と、同位相で振動するもの(より高い振動数、より強い実効剛性 λ2=3\lambda_2=3)である。

例: 物理学と信号処理:なぜ微分は非有界なのか

L2[0,1]L^2[0,1] 上で、両端点でゼロとなる滑らかな関数上の微分作用素 Df=f′Df=f' を考える。試験関数 fn(x)=sin⁡(nπx)f_n(x)=\sin(n\pi x)(n=1,2,3,…n=1,2,3,\dots)を用いて、TT がいかなる定数 cc に対しても ∥Df∥2≤c∥f∥2\|Df\|_2\le c\|f\|_2 という評価を満たせないこと、すなわち DD が非有界であることを示せ。これはヘリンガー・テプリッツの定理と整合的である(DD は L2[0,1]L^2[0,1] 全体ではなく稠密にのみ定義されているため)。

解答

まず ∥fn∥22=∫01sin⁡2(nπx) dx=12\|f_n\|_2^2=\int_0^1\sin^2(n\pi x)\,dx=\frac12(整数個の周期にわたる sin⁡2\sin^2 の平均は 12\tfrac12)がすべての nn について成り立つことを計算し、したがって nn が大きくなっても ∥fn∥2=1/2\|f_n\|_2=1/\sqrt2 は一定のままである。

次に微分する:Dfn(x)=fn′(x)=nπcos⁡(nπx)Df_n(x)=f_n'(x)=n\pi\cos(n\pi x)。そのノルムの二乗は ∥Dfn∥22=∫01(nπ)2cos⁡2(nπx) dx=(nπ)2⋅12\|Df_n\|_2^2=\int_0^1(n\pi)^2\cos^2(n\pi x)\,dx=(n\pi)^2\cdot\frac12 であるから ∥Dfn∥2=nπ2\|Df_n\|_2=\frac{n\pi}{\sqrt2} となり、nn に関して上界なく線形に増大する。

背理法として、ある固定された定数 cc について ∥Df∥2≤c∥f∥2\|Df\|_2\le c\|f\|_2 がすべてのそのような ff に対して成り立つと仮定する。これを fnf_n に適用すると nπ2≤c⋅12\frac{n\pi}{\sqrt2}\le c\cdot\frac{1}{\sqrt2}、すなわちすべての n=1,2,3,…n=1,2,3,\dots について nπ≤cn\pi\le c となるが、左辺は無制限に増大し cc は固定されているため、これは不可能である。

したがってそのような cc は存在しない:DD は非有界であり、これはまさに、稠密にのみ定義された対称作用素に対してヘリンガー・テプリッツの定理が強制する通りである。物理的には、これが量子力学における運動量作用素 p^=−iℏddx\hat p=-i\hbar\dfrac{d}{dx}――定数倍を除けば微分――が、波動関数の高周波成分をどれだけ増幅しうるかについて普遍的な上界を持たない理由である。

研究研究の最前線:ランダム作用素と多体作用素のスペクトル理論

TT がヒルベルト空間 HH 上の自己随伴作用素で、ある x≠0x\ne0 について Tx=λxTx=\lambda x が成り立つとき、λ\lambda について何が言えるか。

エルミート行列 A=(2112)A=\begin{pmatrix}2&1\\1&2\end{pmatrix} の固有値は何か。

ヘリンガー・テプリッツの定理は、ヒルベルト空間 HH 全体で定義された対称線形作用素 TT について何を述べているか。

fn(x)=sin⁡(nπx)f_n(x)=\sin(n\pi x) の例で、なぜ比 ∥Dfn∥2/∥fn∥2\|Df_n\|_2/\|f_n\|_2 は n→∞n\to\infty のとき無制限に増大し、微分作用素が非有界であることを示すのか。

参考文献

  1. Michael Reed, Barry Simon (1980). Methods of Modern Mathematical Physics I: Functional Analysis
  2. John B. Conway (2000). A Course in Operator Theory
  3. Werner Kirsch (2008). An Invitation to Random Schrödinger Operators · arXiv:0709.3707