打开官方教程 免费有中文
推荐从哪开始
从他官网的「But what is a neural network?」开头那集开始,看完再跳到 GPT 那集。B站搜「3Blue1Brown 神经网络」能找到带中文字幕版本。
学习时长
约2-3小时,可分2晚看完
查看详细资料(4 项)
先修要求
理解函数、向量等中学数学概念会更顺畅;以官方页面提供的语言和字幕为准。
适合谁
适合想搞清楚「AI到底是怎么做到的」、不想被各种「大模型原理」营销文忽悠的人。不需要高数基础,看完像看科普片。
许可/可否复用
视频内容免费观看,版权归 3Blue1Brown。教学用途可播放、引用;二次剪辑或商用需获作者授权。
最近复核
2026-07-27

一套不到2小时、用动画把ChatGPT原理讲明白的免费视频,看完你不会再觉得大模型是黑盒

很多人用了一年ChatGPT,还是觉得它是个「神秘黑盒」。其实大模型的核心原理不复杂,只是被一堆专业术语包得严严实实。3Blue1Brown 这个系列最难得的地方是:他用动画把那些抽象概念画出来,你能直接「看到」一个词是怎么变成一串数字、再被注意力机制筛出最相关信息的。

为什么推荐这套而不是别的

3Blue1Brown 的讲法一般科普文的讲法
动画演示数据如何流动文字描述「神经网络像大脑」
讲完每一步都给可视化贴一张架构图让你自己悟
推导严谨但起步慢讲得快但常常失真

看完能搞明白的三件事

  • 词是怎么变成向量(数字)的——为什么「猫」和「狗」在数学上离得近
  • 注意力机制到底在「注意」什么——为什么模型能联系上下文
  • GPT 为什么会预测下一个字——为什么这个机制就能续写文章

生活类比

看一张照片和看一段动画的区别

对应:动画让你看见过程,静态图只能让你猜过程

这个比方在哪会塌:动画讲不深到工程实现,只是帮你建立直觉,不要把动画里看到的东西当成模型代码

它防止的误解:防止把大模型当成不可知的神秘物,也防止把科普动画当成可以照搬的实现细节

想动手训一个?看 d2l.ai:看完原理科普,如果还想自己跑一遍神经网络的代码,可以去 d2l.ai(动手学深度学习),那里有完整的中文版实操课。

整理方式
编辑原创通俗解释
内容状态
已完成编辑复核

最后复核:2026-07-27

AI 领域更新很快,相关工具/价格/规则可能已变化,重要事实请以官方来源为准。