机器学习数学基础:线代概率

机器学习本质上是用数学工具从数据中拟合规律。线性代数描述数据与参数的结构,概率统计刻画不确定性与泛化,微积分提供优化方法。三者共同构成理解模型的基石。

线性代数在算什么

模型输入通常是向量或矩阵,权重也是矩阵。一次前向传播往往就是矩阵乘法。理解转置、点积、逆矩阵与特征值,能帮你看清维度变化与信息压缩的过程。

import numpy as np

X = np.array([[1, 2], [3, 4]])        # 输入矩阵
W = np.array([[0.5], [0.5]])          # 权重
y = X @ W                             # 矩阵乘法得到预测
print(y)

概率与统计

  • 随机变量与分布:理解均值、方差、高斯分布。
  • 条件概率与贝叶斯:用于分类器与不确定性估计。
  • 期望与最大似然:损失函数优化的理论来源。

微积分与梯度

训练通过梯度下降最小化损失。掌握偏导数与链式法则,才能理解反向传播为何能对每一层参数求梯度。

学习建议

不必把数学书从头读完。带着问题学:看到损失函数就补微积分,看到协方差就补统计。配合 3Blue1Brown 的可视化讲解,抽象概念会更直观。

小结

线性代数处理结构与运算,概率统计处理不确定与推断,微积分处理优化与学习。把这三块补到「能看懂公式、能写出对应代码」的程度,足以支撑大部分入门到进阶的模型学习。

参考与延伸阅读

本文累计阅读