经过了第一章的学习,我们对于线性代数的一些基本概念已经有所了解.在第一章中,我们主要研究的是对于给定向量和向量组之间的关系.那么在本章节里面我们将会从宏观的角度去进一步研究矩阵和向量之间的关系. 我们可以把矩阵和向量的乘法Ax=b当作是一个函数,其中矩阵便代表了这个函数的法则, x便代表了函数里的输入值.通过给定的法则我们便可以知道其结果b的取值.我们便很想知道这些法则之间究竟有着怎么样的奥秘?这些法则和函数之间的相同点与不同点分别是什么?在线性代数中,我们称这样的运算法则为线性变换,它是线性代数得以发展壮大的媒介,任何矩阵的背后都有其独特的线性变换.通过完成对本章的学习,我们将建立起矩阵和线性变换的关系,届时我们对线性代数的理解便会更上一层楼.
对于函数y=f(x)而言,我们可以写成映射的形式f:X→Y, 其中集合X代表函数f的定义域, 集合Y代表函数f的值域.即x∈X, y=f(x)∈Y.那么我们同样可以从函数的角度去考虑我们的老朋友Ax=b, 我们知道如果A为m×n矩阵,那么x∈Rn, b∈Rm.因此矩阵A同样也可以看作类同于f的运算法则,我们一般用T表示这样的运算法则.那么形如Ax=b的方程即可以表示为T:Rn⟶Rm.其中Rn即为运算T的定义域,我们一般也用集合U⊆Rn来表示定义域;用V⊆Rm来表示值域.我们知道,对于函数y=f(x)而言,对给定的x而言,有且仅有一个y使得f(x)=y,否则便不满足函数的定义.那么对于我们所定义的运算T而言,其当然也有一定的限制条件.我们把这种满足条件的运算T称作是线性变换 (Linear Transformation),其具体定义如下:
定义 2.1
在数域F和线性空间U,V上,若对任意的v,u∈U,λ∈F, 变换T:U→V满足
①T(x+y)=T(x)+T(y)②λT(x)=T(λx),我们则称T:U→V为定义在线性空间U,V之间的线性变换,
在目前阶段,除非有特殊说明,否则我们一律默认作用于线性变换的数域为全体实数R.看到这样的定义,读者能否尝试从函数的角度去理解?读者可以尝试构造出一个函数g(x), 使得其为线性变换.
定理 2.1
设T:U→V为定义在线性空间U,V之间的线性变换, 则:① T(0)=0②T(−v)=−T(v).
证明
① :根据零向量的定义,0=0+0, 则T(0)=T(0+0)=T(0)+T(0), 即T(0)=0.② : 我们取常数λ=−1, 则T(−v)=T((−1)v)=−T(v).∎
虽然我们发现T(0)=0, 但我们要注意“此零非彼零”:两个零向量分别指代线性空间U和V的零向量. 因此严格来讲我们有T(0U)=0V. 但是对于任何线性空间而言,零向量的定义是不变的,即0+u=u.
例题 2.1
设作用于R2上的运算H满足H(x,y)=(∣x∣,∣y∣), 那么H是否为线性变换?
解答 2.1
我们可以先验证零向量: 即验证H(0,0)=(0,0), 这一点显然满足题意.随后我们设u1=(x1,y1);u2=(x2,y2), 那么H(u1+u2)=H((x1+x2,y1+y2))=(∣x1+x2∣,∣y1+y2∣).而H(u1)+H(u2)=(∣x1∣,∣y1∣)+(∣x2∣,∣y2∣)=(∣x1∣+∣x2∣,∣y1∣+∣y2∣), 我们知道∣x+y∣≤∣x∣+∣y∣, 因此H(u1+u2)=H(u1)+H(u2).因此H不为线性变换.
例题 2.2
设运算D:Pn(x)⟶Pn−1(x), 设f(x)∈Pn(x), 满足D(f(x))=f′(x), 那么D是否为线性变换?
解答 2.2
由于常值函数的导数为零,因此f(x)=0时f′(x)=0. 根据求导法则,我们很容易知道(f(x)+g(x))′=f′(x)+g′(x);(cf(x))′=cf′(x), 因此D为线性变换.
接下来,在我们知道线性变换的抽象定义之后,我们怎么把抽象问题具体化呢?于是我们来一起研究一下线性变换和矩阵之间的关系.我们不妨设T:U⟶V为一个线性变换,然后我们再设β={u1,u2,⋯,un}为线性空间U的一组基底.那么我们知道对任意的x∈U, 存在唯一的线性组合x=c1u1+c2u2+⋯+cnun, 并且我们知道向量x在基底β下的坐标为
[x]β=(c1c2⋯cn)β⊤. 因此对x施加变换T, 我们有T(x)=T(c1u1+⋯+cnun). 再结合线性变换的性质, 我们得到
T(x)=c1T(u1)+⋯+cnT(un).
此时, 我们设矩阵A的列向量分别为T(u1),⋯,T(un), 那么我们便得到
T(x)=Ax=(T(u1)T(u2)⋯T(un))c1⋮cn=c1T(u1)+⋯+cnT(un).
如果此时我们假设V的一组基底为γ={v1,⋯,vm}, 然后我们将T(ui)写成在γ下的坐标[T(ui)]γ, 那么原来的线性变换便可以写作
[T(x)]γ=c1[T(u1)]γ+⋯+cn[T(un)]γ=[T]βγ[x]β.
经由上面的推理,我们发现在线性变换T:U→V中, 在选定U的基底β, V的基底γ的情况下, Tx便是将x在β基底下的坐标变换成Tx在γ基底下的坐标. 我们称此时的矩阵为该线性变换的矩阵形式. 我们不难发现, 不同的基底对应的矩阵形式不一定相同. 因此对于特定的问题而言,我们也要选取特定的基底γ, 使得运算更为简便.这一点我们会在后面几节当中深入学习.
定理 2.2
设T:U→V为定义在线性空间U,V之间的线性变换, β={u1,⋯,un}为U的一组基底, γ为V的一组基底,那么对于x=c1u1+⋯+cnun∈U, 有[T(x)]γ=c1[T(u1)]γ+⋯+cn[T(un)]γ=[T]βγ[x]β.
我们这样做的目的还是为了使得计算更加简便,当x整体不好计算时,我们可以把x写成若干基底向量的线性组合,然后对形式简单的基底向量施加线性变换,最后再进行加和.我们来通过一个具体的例子来看这种简化思想是怎么体现的:
例题 2.3
在平面直角坐标系R2中,线性变换R满足以下性质:对于任意的x∈R2,
R(x)的结果为将向量x绕坐标原点顺时针旋转角度θ(0≤θ≤π/2).
那么对于任意的向量x=(ab)而言, 计算其结果[R(x)]E
解答 2.3
对于本题中提到的线性变换R:R2⟶R2,此时我们可以统一选取标准基底E={(10),(01)}, 然后我们对基底向量施加变换R : 在平面直角坐标系中,通过几何关系便不难发现将(10)顺时针旋转角度θ之后得到(cos(θ)−sin(θ)). 同理不难求出R(01)=(sin(θ)cos(θ)), 则变换R在标准基底E下对应的矩阵形式即为[R]E=(cos(θ)−sin(θ)sin(θ)cos(θ)), 将其乘以向量x, 我们得到
[R](x)=a(cos(θ)−sin(θ))+b(sin(θ)cos(θ))=(acos(θ)+bsin(θ)−asin(θ)+bcos(θ)),该结果即为在标准基底E下的坐标.
我们便不难发现,基底的选取一定要巧妙. 如果我们选取
β={(20232024),(2024−2023)}
作为基底的话,不是不能算,但要是像这样去求这些向量绕原点旋转角度θ的话,与标准基底相比肯定就会复杂许多. 但是当我们选取简便的基底时, 我们需要格外小心. 再来看一个R2的例子:
例题 2.4
在平面直角坐标系R2中,线性变换P满足以下性质:对于任意的x∈R2,
P(x)的结果为将向量x投影至直线y=2x上.那么对于任意的向量x=(ab)而言, 计算其结果P(x)
解答 2.4
我们是不是可以直接选取这样的一组基底β={v1,v2}, 使得v1恰在直线上,这样一来P(v1)=v1=(10)β, 投影即为其自身; 对于v2而言,我们是否也可以找一个与直线垂直的向量?这样P(v2)=0=(00)β. 我们不妨设
v1=(12),v2=(−21).那么这样一来, 根据定义我们就有该线性变换的矩阵形式(P(v1)P(v2))=(1000). 我们如果取xOy内任意一点(ab), 那么将其投影到直线
y=2x之后的结果应该是a(10)+b(00)=(a0).这样计算有什么问题?
在此时的矩阵A=(P(v1)P(v2))为线性变换在基底β下的形式. 而我们随后乘以的向量x是在标准基底下的形式. 因此两者的基底不同, 我们便不能放在一起去运算. 我会在稍微靠后的章节中讲解基变换, 到时候我们便知道这两种方法之间的联系.
定理 2.3
设T,S:U→V为定义在线性空间U,V之间的线性变换, β={u1,⋯,un}为U的一组基底, 若对任意的vi∈β,有T(vi)=S(vi), 则T=S.
证明
任取x∈U, 则有x=c1v1+⋯+cnvn, 则T(x)=c1T(v1)+⋯+cnT(vn)=c1S(v1)+⋯+cnS(vn)=S(x).∎
例题 2.5
在空间直角坐标系R3中,线性变换P:R3⟶R3满足以下性质:
P1−12=100;P011=010;P21−1=001.据此求P420.
解答 2.5
由线性变换的性质,我们知道存在这样的线性组合:
420=c11−12+c2011+c321−1.不难解出原方程的解为c1=21,c2=43,c3=47这样一来
P420=21P1−12+43P011+47P21−1=231.
{2.1 练习}
1. 设T1,T2,T3,T4:R2⟶R2为4个线性变换,其在标准基底下的变化矩阵分别为
T1=(10−21);T2=(2101);T3=(0−1−12);T4=(0211);
那么对于如下图所示的图形而言,经过上述的四种变换之后分别对应下列选项中的哪一个图像?
2. 我们设T:Rn⟶Rn为线性变换,我们任取v1,v2⋯vn∈Rn, 那么v1,v2,⋯,vn彼此线性无关是T(v1),T(v2),⋯,T(vn)彼此线性无关的 ( )
(A) 充要条件 (B) 充分但不必要条件 (C) 必要但不充分条件
(D) 既不充分也不必要条件
3. 设线性变换T:R3⟶R3, 且
β={e1,e2,e3}为R3的一组基底,已知
T(e1+e2)=e3;T(e1+e3)=e2;T(e2+e3)=e1, 据此求出T(e1)+T(e2)+T(e3).
4. 设线性变换Q:P2(x)⟶R, 已知Q(x+2)=1;Q(1)=5;Q(x2+x)=0, 据此求Q(2−x+3x2).
5. 在平面直角坐标系xOy中,我们将抛物线y=x2以(0,0)为旋转中心绕原点顺时针旋转角度θ,(0<θ<π/2), 使得旋转过后抛物线与x轴相交于(5,0), 通过建立合适的线性变换模型,求出此时抛物线旋转的角度θ.