MathLabs

分析学

算子理论

研究希尔伯特空间上有界与无界线性算子及其谱的学科。

直观作为无穷维矩阵的算子

矩阵接收一个有限数列,并通过线性混合各分量输出另一个有限数列。算子对函数做的正是同一件事:求导 Df=f′Df=f' 接收一个函数,线性地产生另一个函数;乘以 xx、与固定核做卷积,或做傅里叶变换,都是算子。算子理论研究希尔伯特空间 HH 上的这类映射,正如线性代数研究 Rn\mathbb{R}^n 上的矩阵:它们的特征值(现在称为谱)是什么,哪些算子是"好"的(自伴,类似对称矩阵),以及——一个真正只在无穷维才出现的现象——哪些算子究竟能在整个空间上处处有定义,因为求导不像矩阵乘法那样,对 HH 中的每个函数都有定义。

有向图展示酉算子被包含于正规算子、紧算子被包含于有界算子、有界算子被包含于无界算子。
算子类及其关系的网络:酉算子(节点 UU)是正规算子的特殊情形,正规算子既包括自伴算子(节点 T=T∗T=T^*)也包括旋转;紧算子(节点 KK)可以是自伴的也可以不是,它们都属于所有有界算子这一类,而有界算子又属于范围大得多、只在稠密定义域上有定义的无界算子这一类。高亮某个节点即可追溯通向它的包含链条。

大学有界算子、伴随算子与自伴性

定义: 有界线性算子与算子范数

从希尔伯特空间 HH 到自身的线性映射 TT 称为有界的,如果它不会以无限制的倍数拉伸向量:即存在常数 cc,使得对所有 x∈Hx\in H 都有 ∥Tx∥≤c∥x∥\|Tx\|\le c\|x\|。这样的最小常数 cc 就是算子范数 ∥T∥=sup⁡∥x∥≤1∥Tx∥\|T\|=\sup_{\|x\|\le1}\|Tx\|——即 TT 能拉伸单位向量的最大倍数。对线性映射而言,有界性恰好等价于连续性,所以"有界算子"与"连续算子"含义相同。

写成公式,算子范数就是 TT 能拉伸单位向量的倍数的上确界:

∥T∥=sup⁡∥x∥≤1∥Tx∥\|T\|=\sup_{\|x\|\le1}\|Tx\|

HH 上每个有界的 TT 都有唯一的伴随算子 T∗T^*,定义为对所有 x,y∈Hx,y\in H 都有 ⟨Tx,y⟩=⟨x,T∗y⟩\langle Tx,y\rangle=\langle x,T^*y\rangle——它的存在性由里斯表示定理给出,应用于每个固定 yy 对应的泛函 x↦⟨Tx,y⟩x\mapsto\langle Tx,y\rangle。在有限维中,取伴随恰好就是取矩阵的共轭转置。若 T=T∗T=T^*,则称 TT 为自伴(厄米)算子;若 TT∗=T∗TTT^*=T^*T,则称为正规算子;若 T∗T=TT∗=IT^*T=TT^*=I,则称为酉算子——它们分别是对称矩阵、与自身转置可交换的矩阵,以及旋转矩阵的算子类似物。

自伴性是该理论中最重要的性质,因为它恰好是迫使谱为实数、并使我们能够得到谱定理(下面将证明)的条件。写出来,TT 是自伴的,恰好就是说把 TT 从内积的一侧移到另一侧永远不会改变任何东西:

⟨Tx,y⟩=⟨x,Ty⟩∀x,y∈H\langle Tx,y\rangle=\langle x,Ty\rangle\quad\forall x,y\in H

把它与实对称矩阵 A=ATA=A^{\mathsf T} 相比较,对这种矩阵总有 ⟨Ax,y⟩=⟨x,Ay⟩\langle Ax,y\rangle=\langle x,Ay\rangle 自动成立——自伴性恰恰就是矩阵对称性的无穷维版本。不同的算子类具有明显不同的谱,总结如下。

算子类及其谱
类定义条件谱 σ(T)\sigma(T)
自伴T=T∗T=T^*实数: σ(T)⊂R\sigma(T)\subset\mathbb{R}
酉T∗T=TT∗=IT^*T=TT^*=I单位圆: σ(T)⊂{∣z∣=1}\sigma(T)\subset\{|z|=1\}
紧自伴T=T∗T=T^*,TT 紧离散, λn→0\lambda_n\to0
在 L2[0,1]L^2[0,1] 上乘以 xxTf(x)=xf(x)Tf(x)=xf(x)连续: σ(T)=[0,1]\sigma(T)=[0,1],无特征值

大学两大支柱:谱定理与海林格–特普利茨定理

设 TT 为希尔伯特空间 HH 上的紧自伴算子。那么存在由 TT 的特征向量 e1,e2,…e_1,e_2,\dots 组成的 HH 的一组标准正交基,其实特征值 λ1,λ2,…\lambda_1,\lambda_2,\dots 满足:若 HH 是无穷维的则 λn→0\lambda_n\to0,并且对每个 x∈Hx\in H 都有 Tx=∑nλn⟨x,en⟩enTx=\sum_n\lambda_n\langle x,e_n\rangle e_n。

为什么成立?

这说明紧自伴算子无论看起来多么复杂,在合适的标准正交基下其实都是对角矩阵——正如线性代数中的对称矩阵总能被一组正交特征基对角化一样。这使得我们可以定义算子的函数、求解 Tx=yTx=y,并按主导特征方向分解信号或图像(主成分分析正是这一定理的伪装形式)。

证明

首先,自伴算子的每个特征值都是实数:若 x≠0x\ne0 且 Tx=λxTx=\lambda x,则 λ∥x∥2=⟨Tx,x⟩=⟨x,Tx⟩=λˉ∥x∥2\lambda\|x\|^2=\langle Tx,x\rangle=\langle x,Tx\rangle=\bar\lambda\|x\|^2(中间一步用到自伴性),故 λ=λˉ\lambda=\bar\lambda。类似地,对应不同特征值 λ≠μ\lambda\ne\mu 的特征向量正交:λ⟨x,y⟩=⟨Tx,y⟩=⟨x,Ty⟩=μ⟨x,y⟩\lambda\langle x,y\rangle=\langle Tx,y\rangle=\langle x,Ty\rangle=\mu\langle x,y\rangle 迫使 ⟨x,y⟩=0\langle x,y\rangle=0。

接着,紧性保证确实存在绝对值最大的特征值:对自伴的 TT,算子范数满足 ∥T∥=sup⁡∥x∥=1∣⟨Tx,x⟩∣\|T\|=\sup_{\|x\|=1}|\langle Tx,x\rangle|,而紧性使我们能从 ∣⟨Tx,x⟩∣|\langle Tx,x\rangle| 的极大化序列中抽出收敛子列,从而得到单位向量 e1e_1,满足 Te1=λ1e1Te_1=\lambda_1 e_1,其中 ∣λ1∣=∥T∥|\lambda_1|=\|T\|。

现在用归纳法:已找到带特征值 λ1,…,λn−1\lambda_1,\dots,\lambda_{n-1} 的标准正交特征向量 e1,…,en−1e_1,\dots,e_{n-1},将 TT 限制到闭子空间 Hn={e1,…,en−1}⊥H_n=\{e_1,\dots,e_{n-1}\}^\perp 上。因为 TT 把 HnH_n 映到自身(自伴性使不变子空间的正交补也是不变的),并且在其上仍是紧且自伴的,同样的最大特征值论证给出下一个特征向量 en∈Hne_n\in H_n,满足 ∣λn∣≤∣λn−1∣|\lambda_n|\le|\lambda_{n-1}|。

最后,若此过程不终止,则 λn→0\lambda_n\to0:否则会有无穷多个 ∣λn∣|\lambda_n| 始终大于某个 δ>0\delta>0,但那样 {Ten}={λnen}\{Te_n\}=\{\lambda_ne_n\} 就不会有收敛子列(由标准正交性,当 n≠mn\ne m 时 ∥λnen−λmen∥2≥δ2⋅2\|\lambda_ne_n-\lambda_me_n\|^2\ge\delta^2\cdot2),这与 TT 的紧性矛盾。此后可验证 {en}\{e_n\} 的闭张成与 ker⁡T\ker T 一起穷尽了 HH,且 TT 在 ker⁡T\ker T 上作用为 00,由此对所有 x∈Hx\in H 得到特征展开 Tx=∑nλn⟨x,en⟩enTx=\sum_n\lambda_n\langle x,e_n\rangle e_n。

设 TT 是定义在整个希尔伯特空间 HH 上(而非仅在某个稠密子空间上)的线性算子,且是对称的,即满足 ⟨Tx,y⟩=⟨x,Ty⟩∀x,y∈H\langle Tx,y\rangle=\langle x,Ty\rangle\quad\forall x,y\in H。那么 TT 自动是有界的。

为什么成立?

这个定理解释了为什么无界算子在量子力学中是不可避免的:位置、动量、哈密顿量这类物理上重要的对称算子,实际上不能定义在 HH 的每一个向量上(只能定义在某个稠密的定义域上),因为如果它们真能处处有定义,这个定理就会迫使它们是有界的——但它们显然不是。

证明

我们使用闭图定理(贝尔纲定理的一个标准推论):定义在整个希尔伯特空间上的线性算子有界,当且仅当它的图 {(x,Tx):x∈H}\{(x,Tx):x\in H\} 在 H×HH\times H 中是闭的,即只要 xn→xx_n\to x 且 Txn→yTx_n\to y,就必有 y=Txy=Tx。

设 xn→xx_n\to x 且 Txn→yTx_n\to y。我们要证明 y=Txy=Tx。对任意固定的 z∈Hz\in H,由对称性对每个 nn 都有 ⟨Txn,z⟩=⟨xn,Tz⟩\langle Tx_n,z\rangle=\langle x_n,Tz\rangle。

两边取 n→∞n\to\infty:左边由 Txn→yTx_n\to y 及内积的连续性得 ⟨Txn,z⟩→⟨y,z⟩\langle Tx_n,z\rangle\to\langle y,z\rangle;右边由 xn→xx_n\to x 得 ⟨xn,Tz⟩→⟨x,Tz⟩\langle x_n,Tz\rangle\to\langle x,Tz\rangle。于是 ⟨y,z⟩=⟨x,Tz⟩=⟨Tx,z⟩\langle y,z\rangle=\langle x,Tz\rangle=\langle Tx,z\rangle(右边再次用到对称性)。

由于 ⟨y,z⟩=⟨Tx,z⟩\langle y,z\rangle=\langle Tx,z\rangle 对每个 z∈Hz\in H 都成立,故对所有 zz 都有 ⟨y−Tx,z⟩=0\langle y-Tx,z\rangle=0;取 z=y−Txz=y-Tx 得 ∥y−Tx∥2=0\|y-Tx\|^2=0,故 y=Txy=Tx。因此 TT 的图是闭的,由闭图定理得出 TT 是有界的。

大学实际应用与典型例题

算子理论是量子力学(可观测量是自伴算子,能量是哈密顿量的特征值)、工程学中振动与稳定性分析(固有频率是紧算子的特征值),以及数据科学(主成分分析对角化一个紧自伴的协方差算子)的数学语言。这也是精细的数学处理变得在物理上必不可少之处:无界算子不能像矩阵那样随意处理。

例题: 工程与数据科学:对角化一个对称矩阵

一个 2×22\times2 对称矩阵,视为 R2\mathbb{R}^2 上的紧自伴算子,代表由弹簧连接的两个相同质量之间的耦合:A=(2112)A=\begin{pmatrix}2&1\\1&2\end{pmatrix}。求它的特征值,即在这个简化刚度矩阵模型中的固有振动频率。

解答

特征值满足特征方程 det⁡(A−λI)=0\det(A-\lambda I)=0。当 A=(2112)A=\begin{pmatrix}2&1\\1&2\end{pmatrix} 时,即 det⁡(2−λ112−λ)=0\det\begin{pmatrix}2-\lambda&1\\1&2-\lambda\end{pmatrix}=0。

展开这个 2×22\times2 矩阵的行列式得 (2−λ)(2−λ)−(1)(1)=0(2-\lambda)(2-\lambda)-(1)(1)=0,即 (2−λ)2−1=0(2-\lambda)^2-1=0。

将其分解为 [(2−λ)−1][(2−λ)+1]=0[(2-\lambda)-1][(2-\lambda)+1]=0,即 (1−λ)(3−λ)=0(1-\lambda)(3-\lambda)=0,故 λ1=1\lambda_1=1,λ2=3\lambda_2=3。

正如谱定理所预言的,这两个特征值都是实数(矩阵对称),对应的特征向量 (1,−1)/2(1,-1)/\sqrt2 与 (1,1)/2(1,1)/\sqrt2 相互正交:两个简正模式分别是两个质量反相摆动(频率较低,有效刚度较弱 λ1=1\lambda_1=1)和同相摆动(频率较高,有效刚度较强 λ2=3\lambda_2=3)。

例题: 物理与信号处理:为什么求导是无界的?

在 L2[0,1]L^2[0,1] 上,考虑定义在两端点为零的光滑函数上的求导算子 Df=f′Df=f'。利用检验函数 fn(x)=sin⁡(nπx)f_n(x)=\sin(n\pi x)(n=1,2,3,…n=1,2,3,\dots),证明 TT 对任何常数 cc 都不能满足界 ∥Df∥2≤c∥f∥2\|Df\|_2\le c\|f\|_2——即 DD 是无界的,这与海林格–特普利茨定理一致(因为 DD 只在稠密定义域上有定义,而非在整个 L2[0,1]L^2[0,1] 上)。

解答

首先计算 ∥fn∥22=∫01sin⁡2(nπx) dx=12\|f_n\|_2^2=\int_0^1\sin^2(n\pi x)\,dx=\frac12 对每个 nn 都成立(在整数个周期上 sin⁡2\sin^2 的平均值是 12\tfrac12),因此当 nn 增大时 ∥fn∥2=1/2\|f_n\|_2=1/\sqrt2 保持不变。

接着求导:Dfn(x)=fn′(x)=nπcos⁡(nπx)Df_n(x)=f_n'(x)=n\pi\cos(n\pi x)。其范数的平方为 ∥Dfn∥22=∫01(nπ)2cos⁡2(nπx) dx=(nπ)2⋅12\|Df_n\|_2^2=\int_0^1(n\pi)^2\cos^2(n\pi x)\,dx=(n\pi)^2\cdot\frac12,故 ∥Dfn∥2=nπ2\|Df_n\|_2=\frac{n\pi}{\sqrt2},随 nn 线性增长且无上界。

反证假设存在某个固定常数 cc,使得 ∥Df∥2≤c∥f∥2\|Df\|_2\le c\|f\|_2 对所有这样的 ff 都成立。把它应用到 fnf_n 上得 nπ2≤c⋅12\frac{n\pi}{\sqrt2}\le c\cdot\frac{1}{\sqrt2},即对每个 n=1,2,3,…n=1,2,3,\dots 都有 nπ≤cn\pi\le c——这不可能,因为左边无限增长而 cc 是固定的。

所以不存在这样的 cc:DD 是无界的,这正是海林格–特普利茨定理对一个只在稠密定义域上有定义的对称算子所强制要求的结果。从物理上看,这正是为什么量子力学中的动量算子 p^=−iℏddx\hat p=-i\hbar\dfrac{d}{dx}——本质上是相差一个常数的求导——对它能把波函数的高频成分放大多少,没有一个普适的界。

研究开放研究前沿:随机与多体算子的谱理论

若 TT 是希尔伯特空间 HH 上的自伴算子,且对某个 x≠0x\ne0 有 Tx=λxTx=\lambda x,那么关于 λ\lambda 必定成立什么?

厄米矩阵 A=(2112)A=\begin{pmatrix}2&1\\1&2\end{pmatrix} 的特征值是什么?

海林格–特普利茨定理对定义在整个希尔伯特空间 HH 上的对称线性算子 TT 说了什么?

在 fn(x)=sin⁡(nπx)f_n(x)=\sin(n\pi x) 的例子中,为什么当 n→∞n\to\infty 时比值 ∥Dfn∥2/∥fn∥2\|Df_n\|_2/\|f_n\|_2 无限增长,从而说明求导算子是无界的?

参考文献

  1. Michael Reed, Barry Simon (1980). Methods of Modern Mathematical Physics I: Functional Analysis
  2. John B. Conway (2000). A Course in Operator Theory
  3. Werner Kirsch (2008). An Invitation to Random Schrödinger Operators · arXiv:0709.3707