MathLabs

Giải tích

Giải tích hàm

Nghiên cứu các không gian vectơ vô hạn chiều gồm hàm số và các toán tử tuyến tính tác động lên chúng.

Trực giácKhi nào ta có thể làm giải tích với vô hạn tọa độ?

Một vectơ trong Rn\mathbb{R}^n chỉ là một danh sách nn con số, và giải tích trên Rn\mathbb{R}^n hoạt động được vì ta có thể đo độ dài (∥x∥\|x\|) và góc (tích vô hướng) giữa các danh sách đó. Một hàm số như sóng âm, một bức ảnh, hay hàm sóng lượng tử thực chất là một danh sách vô hạn con số — giá trị của nó tại mọi điểm, hay tương đương là vô hạn hệ số Fourier của nó. Giải tích hàm đặt câu hỏi: liệu ta có thể tiếp tục đo "độ dài" và "góc" giữa các hàm số, và vẫn làm giải tích (giới hạn, đạo hàm, tối ưu hóa) trên không gian vô hạn chiều kết quả hay không? Câu trả lời là có, miễn là không gian đó đầy đủ — các tổng vô hạn và giới hạn không "rò rỉ" ra khỏi không gian — và đó chính xác là điều biến một không gian vectơ hàm số thông thường thành một không gian Banach, hay khi có tích vô hướng, thành một không gian Hilbert.

Đồ thị có hướng minh họa việc không gian Hilbert bao hàm trong không gian Banach, rồi trong không gian vectơ định chuẩn, kèm ví dụ cụ thể ở mỗi cấp.
Mạng lưới bao hàm giữa các không gian hàm số và dãy số: mọi không gian Hilbert (nút ℓ2\ell^2, nút L2[0,1]L^2[0,1]) đều là không gian Banach, và mọi không gian Banach (kể cả C[0,1]C[0,1] và ℓp\ell^p) đều là không gian vectơ định chuẩn, nhưng các mũi tên không đảo chiều được — C[0,1]C[0,1] với chuẩn sup không có tích vô hướng nào sinh ra nó. Bôi sáng một nút sẽ cho thấy nó thuộc lớp rộng hơn nào.

Đại họcChuẩn, tính đầy đủ và tích vô hướng

Định nghĩa: Không gian vectơ định chuẩn và không gian Banach

Một chuẩn trên không gian vectơ XX trên R\mathbb{R} hoặc C\mathbb{C} là một ánh xạ ∥x∥\|x\| thỏa ∥x∥\|x\|=0=0 khi và chỉ khi x=0x=0, ∥λx∥=∣λ∣∥x∥\|\lambda x\|=|\lambda|\|x\|, và bất đẳng thức tam giác ∥x+y∥≤∥x∥+∥y∥\|x+y\|\le\|x\|+\|y\|. Một dãy (xn)(x_n) là một dãy Cauchy nếu các số hạng của nó cuối cùng tiến gần nhau tùy ý; XX đầy đủ, gọi là một không gian Banach, nếu mọi dãy Cauchy trong XX hội tụ về một điểm nào đó của chính XX (chứ không chỉ của một không gian lớn hơn chứa nó). Tính đầy đủ là thứ cho phép ta xây dựng một hàm giới hạn từ một quá trình vô hạn — một chuỗi vô hạn các hàm, một lược đồ xấp xỉ lặp — và chắc chắn rằng giới hạn đó vẫn là một phần tử thực thụ của không gian.

Viết ra, điều kiện Cauchy nói rằng đuôi của dãy số bị dồn sát vào nhau xét theo chuẩn:

∀ε>0 ∃N: n,m≥N⟹∥xn−xm∥<ε\forall\varepsilon>0\ \exists N:\ n,m\ge N \Longrightarrow \|x_n-x_m\|<\varepsilon

Ở đây ε\varepsilon là sai số cho phép, NN là điểm mà từ đó trở đi mọi cặp số hạng đều nằm trong sai số đó, và ∥x∥\|x\| là chuẩn trên XX. Khi XX có thêm một tích vô hướng ⟨x,x⟩\langle x,x\rangle — một cặp song tuyến tính (hoặc song tuyến tính liên hợp) tổng quát hóa tích vô hướng thông thường, từ đó chuẩn được khôi phục là ∥x∥=⟨x,x⟩\|x\|=\sqrt{\langle x,x\rangle} — và đầy đủ theo chuẩn cảm sinh đó, XX được gọi là một không gian Hilbert, thường viết là HH. Tích vô hướng là thứ cho phép ta nói về tính trực giao và góc giữa các hàm số, chứ không chỉ độ dài của chúng.

∣⟨x,y⟩∣≤∥x∥ ∥y∥|\langle x,y\rangle|\le\|x\|\,\|y\|

Đây là bất đẳng thức Cauchy–Schwarz: tích vô hướng của hai vectơ không bao giờ vượt quá tích độ dài của chúng, hệt như u⃗⋅v⃗=∥u⃗∥∥v⃗∥cos⁡θ\vec u\cdot\vec v=\|\vec u\|\|\vec v\|\cos\theta trong không gian 3 chiều thông thường, nơi ∣cos⁡θ∣≤1|\cos\theta|\le1. Các không gian Hilbert còn được đặc trưng trong lớp không gian Banach bởi đẳng thức hình bình hành, ∥x+y∥2+∥x−y∥2=2∥x∥2+2∥y∥2\|x+y\|^2+\|x-y\|^2=2\|x\|^2+2\|y\|^2 — một đẳng thức thuần túy dựa trên chuẩn (không cần tích vô hướng để phát biểu) mà một chuẩn phải thỏa nếu và chỉ nếu nó thực sự đến từ một tích vô hướng. Đẳng thức này nói rằng tổng bình phương hai đường chéo của một hình bình hành bằng tổng bình phương các cạnh, tổng quát hóa hình học kiểu Pythagoras của không gian Euclid lên vô hạn chiều.

Các không gian Banach và Hilbert thường gặp
Không gianChuẩnĐầy đủ?Không gian Hilbert?
ℓ2\ell^2(∑i∣xi∣2)1/2\left(\sum_i|x_i|^2\right)^{1/2}CóCó
ℓp\ell^p, p≠2p\ne2(∑i∣xi∣p)1/p\left(\sum_i|x_i|^p\right)^{1/p}CóKhông
C[0,1]C[0,1]sup⁡t∣f(t)∣\sup_{t}|f(t)|CóKhông
L2[0,1]L^2[0,1](∫01∣f(t)∣2dt)1/2\left(\int_0^1|f(t)|^2dt\right)^{1/2}CóCó

Đại họcHai trụ cột: định lý biểu diễn Riesz và định lý Hahn–Banach

Cho HH là một không gian Hilbert và φ\varphi là một phiếm hàm tuyến tính bị chặn (liên tục) trên HH. Khi đó tồn tại duy nhất y∈Hy\in H sao cho φ(x)=⟨x,y⟩\varphi(x)=\langle x,y\rangle với mọi x∈Hx\in H, và hơn nữa ∥φ∥=∥y∥\|\varphi\|=\|y\|.

Vì sao đúng?

Nó nói rằng mọi cách gán một con số cho mỗi vectơ một cách tuyến tính và liên tục thực chất chỉ là "lấy tích vô hướng với một vectơ cố định nào đó" — các phiếm hàm trừu tượng không tổng quát hơn những phiếm hàm cụ thể nhất mà ta đã biết.

Chứng minh

Nếu φ=0\varphi=0, lấy y=0y=0 và xong. Ngược lại, đặt N=ker⁡φ={x∈H:φ(x)=0}N=\ker\varphi=\{x\in H:\varphi(x)=0\}; vì φ\varphi liên tục và tuyến tính, NN là một không gian con đóng thực sự của HH. Vì HH là không gian Hilbert, định lý chiếu cho phân tích trực giao H=N⊕N⊥H=N\oplus N^{\perp}, và vì NN là không gian con thực sự, N⊥N^{\perp} chứa một phần tử z≠0z\ne0 nào đó.

Với mọi x∈Hx\in H, xét vectơ u=φ(x)z−φ(z)xu=\varphi(x)z-\varphi(z)x. Áp dụng φ\varphi cho φ(u)=φ(x)φ(z)−φ(z)φ(x)=0\varphi(u)=\varphi(x)\varphi(z)-\varphi(z)\varphi(x)=0, nên u∈Nu\in N. Vì z∈N⊥z\in N^{\perp}, ta có ⟨u,z⟩=0\langle u,z\rangle=0, tức φ(x)⟨z,z⟩−φ(z)⟨x,z⟩=0\varphi(x)\langle z,z\rangle-\varphi(z)\langle x,z\rangle=0. Giải ra φ(x)\varphi(x) cho φ(x)=φ(z)∥z∥2⟨x,z⟩=⟨x,φ(z)‾∥z∥2z⟩\varphi(x)=\dfrac{\varphi(z)}{\|z\|^2}\langle x,z\rangle=\left\langle x,\dfrac{\overline{\varphi(z)}}{\|z\|^2}z\right\rangle, nên y=φ(z)‾∥z∥2zy=\dfrac{\overline{\varphi(z)}}{\|z\|^2}z biểu diễn φ\varphi.

Về tính duy nhất, nếu ⟨x,y1⟩=⟨x,y2⟩\langle x,y_1\rangle=\langle x,y_2\rangle với mọi xx, lấy x=y1−y2x=y_1-y_2 được ∥y1−y2∥2=0\|y_1-y_2\|^2=0, nên y1=y2y_1=y_2. Về đẳng thức chuẩn, Cauchy–Schwarz cho ∣φ(x)∣=∣⟨x,y⟩∣≤∥y∥∥x∥|\varphi(x)|=|\langle x,y\rangle|\le\|y\|\|x\|, nên ∥φ∥≤∥y∥\|\varphi\|\le\|y\|; và thay x=yx=y cho φ(y)=∥y∥2\varphi(y)=\|y\|^2, nên ∥φ∥≥∣φ(y)∣/∥y∥=∥y∥\|\varphi\|\ge|\varphi(y)|/\|y\|=\|y\|. Kết hợp lại, ∥φ∥=∥y∥\|\varphi\|=\|y\|.

Cho XX là một không gian vectơ định chuẩn thực, YY là một không gian con tuyến tính của XX, và φ\varphi là một phiếm hàm tuyến tính bị chặn trên YY với ∣φ(y)∣≤M∥y∥|\varphi(y)|\le M\|y\| với mọi y∈Yy\in Y. Khi đó tồn tại một phiếm hàm tuyến tính bị chặn Φ\Phi trên toàn bộ XX sao cho Φ(y)=φ(y)\Phi(y)=\varphi(y) với mọi y∈Yy\in Y, và ∣Φ(x)∣≤M∥x∥|\Phi(x)|\le M\|x\| với mọi x∈Xx\in X.

Vì sao đúng?

Nó bảo đảm rằng một phiếm hàm tuyến tính chỉ xác định trên một không gian con nhỏ — chẳng hạn chỉ biết "giá trị của một tín hiệu tại vài điểm mẫu" — luôn có thể mở rộng lên toàn không gian mà không làm tăng chặn của nó; không gì ép ta phải bó buộc làm việc trên một không gian con.

Chứng minh

Trước hết mở rộng thêm một chiều. Chọn x0∉Yx_0\notin Y và đặt Y1=Y⊕Rx0Y_1=Y\oplus\mathbb{R}x_0. Ta cần chọn giá trị c=Φ(x0)c=\Phi(x_0) sao cho ∣φ(y)+tc∣≤M∥y+tx0∥|\varphi(y)+tc|\le M\|y+tx_0\| với mọi y∈Y,t∈Ry\in Y,t\in\mathbb{R}; chia cho t≠0t\ne0 và thay y/t→yy/t\to y, điều này quy về việc cần cc với φ(y)−M∥y−x0∥≤c≤M∥y+x0∥−φ(y)\varphi(y)-M\|y-x_0\|\le c\le M\|y+x_0\|-\varphi(y) với mọi y∈Yy\in Y. Dùng φ(y1)−φ(y2)=φ(y1−y2)≤M∥y1−y2∥≤M∥y1+x0∥+M∥y2−x0∥\varphi(y_1)-\varphi(y_2)=\varphi(y_1-y_2)\le M\|y_1-y_2\|\le M\|y_1+x_0\|+M\|y_2-x_0\|, ta kiểm tra được cận trên đúng của các biểu thức bên trái theo y1y_1 không bao giờ vượt cận dưới đúng của các biểu thức bên phải theo y2y_2, nên tồn tại cc hợp lệ trong khoảng đó; điều này định nghĩa Φ\Phi trên Y1Y_1 với cùng chặn MM.

Tiếp theo, mở rộng lên toàn bộ XX bằng Bổ đề Zorn. Xét tập tất cả các cặp (Z,Ψ)(Z,\Psi) với ZZ là không gian con thỏa Y⊆Z⊆XY\subseteq Z\subseteq X và Ψ\Psi mở rộng φ\varphi lên ZZ với chặn MM, sắp thứ tự bộ phận bởi (Z1,Ψ1)≤(Z2,Ψ2)(Z_1,\Psi_1)\le(Z_2,\Psi_2) khi Z1⊆Z2Z_1\subseteq Z_2 và Ψ2∣Z1=Ψ1\Psi_2|_{Z_1}=\Psi_1. Mọi dây chuyền đều có cận trên (lấy hợp các không gian con và phiếm hàm khớp với từng cái trên miền của nó), nên Bổ đề Zorn cho một phần tử cực đại (Z∗,Φ)(Z^*,\Phi).

Cuối cùng, nếu Z∗≠XZ^*\ne X, bước mở rộng thêm một chiều ở trên áp dụng cho Z∗Z^* và bất kỳ x0∈X∖Z∗x_0\in X\setminus Z^* nào sẽ tạo ra một cặp hợp lệ lớn hơn thực sự, mâu thuẫn với tính cực đại của (Z∗,Φ)(Z^*,\Phi). Vậy Z∗=XZ^*=X, và Φ\Phi là mở rộng bảo toàn chặn cần tìm lên toàn bộ XX.

Đại họcỨng dụng thực tiễn và Ví dụ minh họa

Giải tích hàm là xương sống toán học của giải tích Fourier và xử lý tín hiệu (một tín hiệu sống trong L2[0,2π]L^2[0,2\pi] hoặc L2[0,1]L^2[0,1]), của cơ học lượng tử (trạng thái sống trong một không gian Hilbert HH), và của các bài toán thống kê, kỹ thuật, học máy quy về việc tìm điểm gần nhất trong một không gian con — từ hồi quy bình phương tối thiểu đến các bài toán ngược chính quy hóa Tikhonov.

Ví dụ: Xử lý tín hiệu: liệu sin⁡(nt)\sin(nt) có ổn định khi n→∞n\to\infty?

Cố định f∈L2[0,2π]f\in L^2[0,2\pi]. Chứng minh ∫02πf(t)sin⁡(nt) dt→0\int_0^{2\pi} f(t)\sin(nt)\,dt\to 0 khi n→∞n\to\infty (tức sin⁡(nt)⇀0\sin(nt)\rightharpoonup 0 theo nghĩa yếu), trong khi chuẩn ∥sin⁡(nt)∥2=π\|\sin(nt)\|_2=\sqrt{\pi} vẫn hằng — nên bản thân sin⁡(nt)\sin(nt) không bao giờ ổn định theo nghĩa mạnh (theo chuẩn).

Lời giải

Xét hệ trực chuẩn en(t)=sin⁡(nt)/πe_n(t)=\sin(nt)/\sqrt\pi trong L2[0,2π]L^2[0,2\pi] (tính trực giao suy ra từ ∫02πsin⁡(nt)sin⁡(mt) dt=0\int_0^{2\pi}\sin(nt)\sin(mt)\,dt=0 với n≠mn\ne m, và ∫02πsin⁡2(nt) dt=π\int_0^{2\pi}\sin^2(nt)\,dt=\pi).

Theo bất đẳng thức Bessel, ∑n=1∞∣⟨f,en⟩∣2≤∥f∥2\sum_{n=1}^{\infty}|\langle f,e_n\rangle|^2\le\|f\|^2, chuỗi bình phương các hệ số Fourier của ff đối với hệ trực chuẩn này hội tụ, vì ∥f∥2<∞\|f\|^2<\infty. Một chuỗi hội tụ có số hạng tiến về không, nên ∣⟨f,en⟩∣2→0|\langle f,e_n\rangle|^2\to0, tức ⟨f,en⟩→0\langle f,e_n\rangle\to0.

Vì ⟨f,en⟩=1π∫02πf(t)sin⁡(nt) dt\langle f,e_n\rangle=\frac{1}{\sqrt\pi}\int_0^{2\pi}f(t)\sin(nt)\,dt, đây chính xác là ∫02πf(t)sin⁡(nt) dt→0\int_0^{2\pi} f(t)\sin(nt)\,dt\to 0 — đây là bổ đề Riemann–Lebesgue ngụy trang, và chính xác là phát biểu sin⁡(nt)⇀0\sin(nt)\rightharpoonup 0.

Mặt khác, tính toán trực tiếp cho ∥sin⁡(nt)∥22=∫02πsin⁡2(nt) dt=π\|\sin(nt)\|_2^2=\int_0^{2\pi}\sin^2(nt)\,dt=\pi với mọi nn, nên ∥sin⁡(nt)∥2=π\|\sin(nt)\|_2=\sqrt{\pi} với mọi nn — chuẩn không bao giờ co lại. Vậy sin⁡(nt)\sin(nt) hội tụ về 00 khi thử với bất kỳ ff cố định nào (hội tụ yếu), nhưng không bao giờ hội tụ về 00 theo chuẩn (không hội tụ mạnh): dao động ngày càng nhanh và "trung bình triệt tiêu" khi thử với mọi đầu dò cố định, mà bản thân tín hiệu không mất năng lượng.

Ví dụ: Thống kê và kỹ thuật: hồi quy bình phương tối thiểu như một phép chiếu trực giao

Cho ma trận dữ liệu AA (các cột = các biến dự báo) và quan sát bb, hồi quy bình phương tối thiểu cực tiểu hóa ∥Ax−b∥2\|Ax-b\|^2 theo xx. Dùng ý tưởng chiếu trong không gian Hilbert (trường hợp hữu hạn chiều của lập luận Riesz/trực giao ở trên, với H=RnH=\mathbb{R}^n và tích vô hướng) để suy ra phương trình chuẩn tắc ATAx^=ATbA^{\mathsf T}A\hat x=A^{\mathsf T}b mà nghiệm cực tiểu x^\hat x phải thỏa.

Lời giải

Tập các đầu ra đạt được {Ax:x∈Rn}\{Ax:x\in\mathbb{R}^n\} là một không gian con ran(A)⊆Rm\mathrm{ran}(A)\subseteq\mathbb{R}^m (hữu hạn chiều, tự động đầy đủ, nên là không gian con đóng của không gian Hilbert Rm\mathbb{R}^m). Cực tiểu hóa ∥Ax−b∥2\|Ax-b\|^2 chính xác là bài toán tìm điểm của ran(A)\mathrm{ran}(A) gần bb nhất.

Theo định lý chiếu trong không gian Hilbert (cùng ý tưởng phân tích trực giao dùng để chứng minh định lý biểu diễn Riesz ở trên), điểm gần nhất Ax^A\hat x trong một không gian con đóng tới bb được đặc trưng bởi việc phần dư b−Ax^b-A\hat x trực giao với toàn bộ không gian con đó, tức ⟨b−Ax^, Av⟩=0  ∀v\langle b-A\hat x,\,Av\rangle=0\ \ \forall v.

Viết Av=A(v1,…,vn)Av=A(v_1,\dots,v_n) chạy qua mọi cột của AA khi vv chạy qua các vectơ cơ sở chuẩn tắc, điều kiện ⟨b−Ax^, Av⟩=0  ∀v\langle b-A\hat x,\,Av\rangle=0\ \ \forall v áp dụng cho từng cột aja_j của AA cho ⟨b−Ax^,aj⟩=0\langle b-A\hat x,a_j\rangle=0 với mọi jj, gộp lại thành một phương trình ma trận duy nhất chính xác là AT(b−Ax^)=0A^{\mathsf T}(b-A\hat x)=0.

Khai triển cho ATb−ATAx^=0A^{\mathsf T}b-A^{\mathsf T}A\hat x=0, tức phương trình chuẩn tắc ATAx^=ATbA^{\mathsf T}A\hat x=A^{\mathsf T}b. Vậy sự kiện trừu tượng trong không gian Hilbert "phần dư của xấp xỉ tốt nhất trực giao với không gian con xấp xỉ" chính là, dưới dạng ngụy trang, công thức đại số tuyến tính được dùng hàng ngày để khớp một đường hồi quy hay một mô hình nhân tố tài chính.

Nghiên cứuHướng nghiên cứu mở: hình học của các không gian vô hạn chiều

Không gian Banach nào sau đây không phải là không gian Hilbert (chuẩn của nó không đến từ một tích vô hướng)?

Trong một không gian Hilbert, nếu ∥x∥=3\|x\|=3 và ∥y∥=4\|y\|=4, thì ∥x+y∥2+∥x−y∥2\|x+y\|^2+\|x-y\|^2 bằng bao nhiêu?

Định lý biểu diễn Riesz bảo đảm điều gì về một phiếm hàm tuyến tính bị chặn φ\varphi trên một không gian Hilbert HH?

Trong ví dụ sin⁡(nt)\sin(nt), tại sao tín hiệu sin⁡(nt)\sin(nt) "trung bình triệt tiêu về không" khi thử với mọi đầu dò cố định ff khi n→∞n\to\infty, dù nó không bao giờ mất năng lượng?

Tài liệu tham khảo

  1. Walter Rudin (1991). Functional Analysis
  2. John B. Conway (2007). A Course in Functional Analysis
  3. Assaf Naor (2012). An introduction to the Ribe program · arXiv:1205.5993