线性变换的定义
线性映射保持加法和数乘,固定原点。线和网格的规则形态是几何解释,并且允许压缩为低维;定义应以代数公理为准。
3Blue1Brown · YouTube · 10:58
视频将线性映射、标准基向量的像和矩阵列连接起来,以旋转、剪切及网格变化解释矩阵乘向量。
在学习检查器中查看要点和时刻,或切换阅读标签查看完整笔记。
依据视频画面与讲解整理,并非逐字语音转写。
线性代数的核心在于理解“变换”——即将输入向量映射到输出向量的函数。虽然数学上称为“函数”,但使用“变换”一词更能唤起对运动的直观感受。我们通过观察二维平面上每一个点的位移来可视化这一过程。与其绘制无数条箭头,不如追踪整个坐标系网格的形变。这种视角揭示了映射的全局结构,展示了空间本身如何围绕原点发生拉伸、旋转或剪切。
线性变换的定义是保持加法与实数数乘:,因此必定固定原点。网格的平行、等距和笔直是几何线索;非可逆线性映射也允许将直线压成一点或将整个平面压成直线,不能把“直线仍笔直”误解为必须保持维数。
我们如何用数字编码如此复杂的空间运动?令人惊讶的是,我们只需要追踪两个特定的向量:标准基向量 和 。由于线性变换保持向量加法和标量乘法不变,任意向量 都将严格按照相同的系数应用于移动后的基向量上进行变换。因此,只要知道 和 落在哪里,就能确定平面上任何其他点的去向。
我们将这些关键的落点坐标打包成一个 矩阵。第一列记录 的去向,第二列记录 的去向。当该矩阵乘以向量 时,实际上是在计算 。这将矩阵乘法从繁琐的算术配方重构为直观的几何构造:缩放变换后的基向量并将它们相加,从而在以矩阵定义的倾斜坐标系中找到最终位置。 这里的输入、输出坐标都按固定的标准基底记录;这是主动移动向量,而不是自动切换到一个新坐标系。变换后的基向量可能相关,未必构成新的基底。
来看具体的例子。逆时针旋转 会将 送到 ,将 送到 ,生成的矩阵为 。相反,水平剪切保持 固定在 ,同时将 沿对角线滑动至 ,产生矩阵 。通过读取这些基向量的终点,我们可以立即构建出代表该变换的矩阵,从而在抽象几何与计算代数之间架起桥梁。
矩阵第一列记录标准基向量î的像,第二列记录ĵ的像。把这些像与输入分量结合,就能求出所有向量的输出。若两列相关,映射会降维;两列仍是有效的矩阵表示。
矩阵乘输入列向量[x,y]ᵀ,得到在同一个标准坐标系中记录的输出坐标,等于x倍第一列加y倍第二列。基底转换与主动线性映射有关联,但不是同一个操作。
当把该特定矩阵作用于标准笛卡尔网格时,所有点都随移动的基向量一致偏移。注意平行线在整个运动过程中始终保持均匀间距且笔直;这种几何特征将有效的线性变换与非线性扭曲(如弯曲变形)区分开来。单纯将矩阵视为空间操作算子的思维方式,能为后续学习特征值、基底变换及行列式计算奠定关键直觉基础。
线性映射保持加法和数乘,固定原点。线和网格的规则形态是几何解释,并且允许压缩为低维;定义应以代数公理为准。
中的任何向量都可以表示为标准基向量 和 的线性组合。因为线性变换尊重这种组合关系,所以只需跟踪 和 的像,即可确定任意向量的像。
第一列为T(î)、第二列为T(ĵ),按固定输出基底记坐标。它们未必线性无关,所以不能无条件称为变换后的“基底”。
用矩阵 乘以向量 实际上是计算 的各列的加权和。权重来自 的分量。这代表了通过缩放变换后的基方向并将它们相加以构造新向量的过程。
第一列为T(î)、第二列为T(ĵ),按固定输出基底记坐标。它们未必线性无关,所以不能无条件称为变换后的“基底”。
矩阵右乘向量 的结果由 份首列向量叠加 份次列向量构成。这体现了线性本质:映射对加法和数乘保持兼容分配律。
线性映射保持加法和数乘,固定原点。线和网格的规则形态是几何解释,并且允许压缩为低维;定义应以代数公理为准。
代数上称函数 为线性需满足两条准则:可加性 和齐次性 。视觉上网格的规则变动恰与此双重要求等价。