深度学习不是一组彼此割裂的模型名词,而是一条从数据、预测、损失、梯度到参数更新的完整训练链路。本课程以这条主线组织 15 章内容:先从神经网络的数学基础、浅层与深层网络讲起,再进入数据划分、正则化、优化器、超参数调优和机器学习策略;随后系统学习卷积网络、经典视觉架构与目标检测,最后过渡到循环神经网络、词嵌入、Seq2Seq、注意力机制和 Transformer。
课程面向希望真正“看懂并做出来”的学习者。每章不仅解释公式从哪里来,还会把张量形状、实现步骤、实验诊断和常见误区串在一起,并配有中文手绘图、交互演示和分节测试。你可以把它作为系统入门课程,也可以在模型训练、调参和排错时按主题查阅。
完成课程后,你将能够解释前向传播与反向传播,选择并调试优化与正则化方案,分析偏差、方差和数据分布问题,读懂 CNN、RNN、注意力及 Transformer 的核心结构,并建立从问题定义到模型评估的深度学习工程工作流。