
自然语言处理真正困难的地方,不是记住模型名称,而是理解文本如何变成可计算的表示,训练信号如何穿过网络,系统又该怎样用证据被检验。这门课程围绕“从语言现象到可验证系统”展开,帮助你把数学直觉、模型结构与工程判断连成一条完整路径。
课程共 15 章:从文本处理、词向量、神经网络与反向传播出发,逐步进入句法分析、循环神经网络、长依赖、机器翻译、子词模型和上下文预训练;随后拆解 Transformer、自注意力、文本生成、共指消解与多任务学习,最后讨论如何把能力、数据、评估、权限和持续监控放进同一套 NLP 系统视角。
每章都配有原理推导、彩色图解、可运行实验、交互练习与分节测试题。学完后,你不仅能调用现成模型,也能解释结果从哪里来,定位系统为何失败,并判断下一步应该改数据、训练目标、模型结构、解码策略还是评估方法。