机器学习数学基础:线代概率
机器学习本质上是用数学工具从数据中拟合规律。线性代数描述数据与参数的结构,概率统计刻画不确定性与泛化,微积分提供优化方法。三者共同构成理解模型的基石。
线性代数在算什么
模型输入通常是向量或矩阵,权重也是矩阵。一次前向传播往往就是矩阵乘法。理解转置、点积、逆矩阵与特征值,能帮你看清维度变化与信息压缩的过程。
import numpy as np
X = np.array([[1, 2], [3, 4]]) # 输入矩阵
W = np.array([[0.5], [0.5]]) # 权重
y = X @ W # 矩阵乘法得到预测
print(y)
概率与统计
- 随机变量与分布:理解均值、方差、高斯分布。
- 条件概率与贝叶斯:用于分类器与不确定性估计。
- 期望与最大似然:损失函数优化的理论来源。
微积分与梯度
训练通过梯度下降最小化损失。掌握偏导数与链式法则,才能理解反向传播为何能对每一层参数求梯度。
学习建议
不必把数学书从头读完。带着问题学:看到损失函数就补微积分,看到协方差就补统计。配合 3Blue1Brown 的可视化讲解,抽象概念会更直观。
小结
线性代数处理结构与运算,概率统计处理不确定与推断,微积分处理优化与学习。把这三块补到「能看懂公式、能写出对应代码」的程度,足以支撑大部分入门到进阶的模型学习。
参考与延伸阅读
- 3Blue1Brown 线性代数本质(视频系列)。已核验。https://www.3blue1brown.com/topics/linear-algebra
- 吴恩达机器学习课程数学回顾章节。已核验。https://www.coursera.org/learn/machine-learning
- NumPy 官方文档。已核验。https://numpy.org/doc/
本文累计阅读 — 次