更新记录
更新记录
本书持续修订。这一页按周记录改了什么,好让上个月读完某一章的人知道它是否变过,以及有没有值得回头再看的新内容。更正与新增一样如实列出:某个说法当初错了,就写 明它原本怎么说、现在怎么说。
没有读者可见改动的周不予列出。版本标记也标在它所属的那一周。
2026 年 7 月 20 日至 26 日
本周把全书对着一手资料核了一遍,改掉 51 处经过核实的错误;基础设施那一部分已经长到十一章,于是拆成了两部分。发布为 v0.2.0。
新增
- 《法律、监管与政策》新增一节「开发者为自己写的那份框架」。前沿模型能不能部署,最终卡在这道闸门上:能力阈值如何划定,用哪套评测去测它,阈值一旦被触发要挂上哪一级防护;2026 年各家已公布的框架在哪里出现了分歧;以及 Anthropic 的 ASL-3 真正触发时是什么样子。
- 《RAG 与检索》新增一节「流水线漏掉的一环:谁有权读到」。检索漏斗一级一级讲下来,却始终没有回答提问的人是否有权读到检索结果:把访问控制清单写进索引,还是在查询时再做过滤,两条路各自的代价是什么;以及为什么检索之后再过滤会悄悄缩短结果列表,权限最窄的用户受损最重。
调整
- 第九部分拆成了两部分。第九部分现在叫「基础设施与算力」,从《加速器与网络》到《规模下不断失效的机器》共八章,结尾落在供给这个仍未有答案的问题上。新设的第十部分「前沿与极限」收下《学习在哪里遇到极限》《能力地平线与对它的测量》《验证前沿》三章。「生态与经济」顺延为第十一部分,「实践与运营」为第十二部分。这三章因此换了网址,此前收藏的旧链接仍然可用,一跳即可到达新页面。
- 十二个术语重新在第一次真正吃劲的地方给出了白话解释,包括《RLHF 与奖励建模》里强化学习意义上的 policy,以及思维链、留出集、LLM-as-judge、提示注入、叠加、注意力汇、交叉熵等。这些解释此前被当作冗余删掉了。《验证器与过程监督》和《软件基座:框架与自动微分》里的两个公式,现在先在正文中交代清楚每个符号,再摆出式子。质量 SLI 原本在实践部分的两章里各定义了一遍,如今只在《非确定系统的可靠性》里定义,《运营契约:SLO、成本、事故与多租户》一句带过,只讲自己能补充的部分。
- 中文页面上,侧边栏链接现在显示为中文,各部分开头的引文重新以固定引用面板的样式呈现,嵌套循环那张图的标注也不再互相压住。
更正
- 《分词》把 fertility 解释成每个 token 承载多少字符。fertility 是一个词平均被切成几个 token,与书里的说法互为倒数,于是建立在它之上的整段论证方向反了。
- 《超越稠密 Transformer:MoE、状态空间模型与混合架构》有一处图注,称 KV 缓存和注意力的单步开销随序列长度平方增长。这两者都是线性的,只有整条序列上的混合总开销才是平方,本章别处的说法本来就是对的。
- 《更快的解码》把 DeepSeek-V3 多 token 预测的接受率写成 80%,技术报告给出的是 85% 至 90%。
- 《选择模型》的前沿模型表还把 GPT-5.5 列为 OpenAI 的旗舰。表中现已换成 GPT-5.6 Sol、Terra 与 Luna,其中 Sol 为旗舰,2026-07-09 公开。长上下文加价的门槛是 272K 输入 token,章内有一处误写为 270K。同一页上的交互式选型组件此前仍为智能体编码推荐 GPT-5.5,与本章自己的决策图互相打架。
- 《AI 价值链》称硅片这一层让出了大约四个百分点的价值份额,而八行之上的表格写的是从 87% 降到 79%,是八个百分点,由基础设施与应用两层分掉。
- 《造出这块硅:封装、HBM,与算力的地缘政治》把 CoWoS 的月产能数字、一处交期,以及需求增长十一倍的说法,全都挂在同一篇 TrendForce 文章上,而那篇文章根本没有给出任何产能数字。每个数字现在都改引真正载有它的来源,并标明日期;交期的说法已经删除,因为没有一手来源给出过。NVIDIA 在 CoWoS 产能中的占比此前完全没有出处,现在换成有据可查的 2026-27 年订单占比和 2025 年 CoWoS-L 占比。
- 参考文献的摘要此前会在第一个百分号处被截断,读者看到的是「reduce inter-GPU communication by up to 95」这样戛然而止的句子。全书 232 处参考文献字段受此影响,现已完整显示。另有六条引用指向已经返回 404 的网址,现在都指向可访问的页面,其中两条的作者与年份也是错的。
2026 年 7 月 6 日至 12 日
阅读站点换了外观:页眉与侧栏改为浮在正文之上的半透明面板,不再以实心色块把正文框住。内容一侧,评测各章与沙箱内凭据的相关段落,按 2026 年年中模型 API 与密钥托管的真实做法做了对齐。v0.1.0 也在这一周发布。
新增
- 《安全与授权》新增出口替换,把它作为一种独立的凭据机制来讲:沙箱里只放一个不透明的占位串,由一个终止 TLS 的出口代理在链路上换成真实密钥,且只对该密钥被授权的主机生效。这一节配了一个可交互的分步演示,走过这套设计的三代演进,另有一张数据路径图。
调整
- 阅读器重做。页眉成为一颗浮动的胶囊,面板与抽屉半透明地叠在页面上,章节正文落在自己的面板里,阅读进度从顶部的一条细线改为带百分比的圆环,侧栏条目会随光标亮起。长章节滚动也比之前顺。
- 《运行框架》《评测智能体与能力》《评判与整体评测》《人类评测与评分准则》《运营评测与治理》五章围绕同一个判断重写:一个分数属于一整套设置,而不属于模型本身。这几章现在写明了必须钉住并记录的东西(服务路由、运行框架及其确切版本、镜像标签、effort 的配置值、发送值与实测值、提示词哈希),说明了为什么一个评判者的身份是模型 id 加评分准则哈希,以及为什么一个小的测量差异在检验通过之前只能算作噪声。
- 评测与编排两部分举的落地实例原先叫 agon。该产品已经下线,相关段落改为 Latere 的 Adversarial Review 能力。
- 评论服务出错时,整页原本会白屏。现在章节照常显示,只是评论数为零。
更正
- 书里把按请求设定思考预算写成当前做法,即由调用方自己设
budget_tokens。新模型已经不再接受这种写法。思考改为自适应,由模型在一个 effort 档位下自行调节,而这个档位是上限,不是花钱买到的量:档位调到最高,简单问题照样可能几乎不产生推理 token。照旧写法接线的读者,发出的请求会直接失败。 - 《搭建一套 2026 技术栈》曾说所有厂商都讲 OpenAI 的请求格式。实际在用的是三种互不兼容的方言,中间的网关是一个会丢信息的翻译层,而 OpenAI 的推理档位只有走 Responses API 才能配合工具调用。
- 《工具生态》曾把 Latere Cella 的密钥模型描述成:命令需要时把真实密钥注入沙箱。这套机制已经退役,真实密钥不再进入沙箱。《智能体、框架与沙箱》和《搭建一套 2026 技术栈》也曾说密钥以短时效的受限令牌抵达智能体,这默认了每个凭据都能按次签发,而一个静态的第三方 API key 做不到。
2026 年 6 月 29 日至 7 月 5 日
新增八章、三节,并把全书各部分的事实对着一手资料核到 2026 年年中。新增内容补的是本书一直欠着的几处空白,其中最大的一处,是模型代码与加速器之间的那层软件。
新增
- 导论部分新增《此前的那套基础设施》。在语言模型写出第一段话之前的十五年里,机器学习早已在行星尺度上驱动着世界的推荐流、搜索结果与广告竞价。本章问的是:生成式技术栈从这位「老住户」那里继承了什么,哪些没能复用,两者如今又在哪里合流;同时也划出本书的主题边界。
- 基础设施部分新增《软件基座:框架与自动微分》与《编译器、内核与 CUDA 护城河》两章,讲的是本书此前一直默认存在的那一层。前一章解释为什么一个程序的梯度只花费程序本身的一个小常数倍,以及计算图编译器与即时执行之间十年的争论最后如何收场;后一章顺着被捕获的计算图往下走到设备代码,那里搬运字节比对字节做算术更贵,并追问硅片上沉积的十九年软件,对想与 NVIDIA 竞争的人意味着什么。
- 安全部分新增《机密推理:可信执行与私密服务》。企业把提示词发给托管模型时,「我们不会用你的数据训练」是一句写在合同里、机器里没有任何东西强制执行的承诺。本章讲硬件证明能替它执行到什么程度、开销多大,以及这道硬件边界仍然守不住什么。
- 智能体部分新增两章。《计算机使用:把图形界面当作动作空间》解释一个推理头头是道的智能体为什么仍会点不中提交按钮,以及一次界面动作与一次 API 调用之间的差价。《个性化与用户记忆》讲产品对用户的记忆究竟住在哪里、已上线的系统为什么都选了同一处,以及为什么比起模型质量,记忆正在成为助手市场的转换成本。
- 生态部分新增两章。《模型作为一件制品:格式、分发与供应链》把模型当作一个必须序列化、签名、下载、加载的文件,讲这条链上的各种攻击,包括藏在权重里、任何扫描器都抓不到的后门。《智能体经济:身份、委托与机器支付》讲持有凭证的一方变成软件之后会发生什么。
- 三节新内容进入既有章节:《法律、监管与政策》补上第三方保障层(ISO 42001、NIST 风险框架、评测厂商与 AI 保险);《算力市场与单位经济》补上资本层(折旧年限之争、以 GPU 抵押的债务、厂商之间的循环交易);《多模态模型的服务》补上扩散与视频生成的服务成本模型。
调整
- 全书各部分都对着 2026 年年中的一手资料重核了一遍,数字、模型名与仍在争论中的问题都换成了今年的版本。《基准及其困境》补入一项外部审计的结论:Humanity's Last Exam 的纯文本化学与生物题里,约 29% 的标准答案与同行评议文献相抵触,而维护方自己的复核给出的数字是 18%;同章还补上了关于未公开的私下刷榜的争议。《选择模型》的供应商表更新到 2026 年 7 月,并记下 Fable 5 与 Mythos 5 在停供三周后恢复。本书原先留作未决的争论,凡是证据已经收口的也随之收口:把预填充与解码拆到不同硬件上,如今是默认做法,而不再是一场活着的争论。
- 一位刚接触机器学习的软件工程师不认识的术语,如今在正文里第一次出现时就有一句白话解释,不再只挂在术语表上;这一遍覆盖了全书大部分章节,中英文同步。扩展律与扩散两章重写了入口的坡度。《智能体架构》里那个「什么仍有争议」的方框曾丢掉格式、渲染成了普通标题,现在重新是一个方框。
更正
- 《全栈一览》原先给稠密与稀疏两种设计各算一笔全生命周期的算力账,并画出一个交叉点,说过了这个点稀疏设计才更便宜。这个交叉点不存在。训练与服务两笔账都随激活参数量走,所以混合专家设计(例中是 DeepSeek-V3)在任何服务量下都更便宜。它付出的代价不是算力而是显存:全部 671B 参数都要常驻,才能让每个词元激活它的 37B。
- 《多模态模型的服务》里那段 KV 缓存的计算漏掉了分组查询注意力的除数,把一张图片所占的缓存高估了约四倍。
- 《算力前沿:带宽,而非 FLOPs》把 GDPval 在 2025 年 9 月的结果(47.6%)读作「接近专家水平但尚未达到」。这个判断没能站住:到 2026 年年中,最好的模型在盲评比较中赢下或打平约七成任务。真正未决的问题不再是模型能否在评分上追平专家,而是一次赢下的比较在评分室之外还值多少。
- 中文版《训练与微调实践》把 Tinker 说成「把自己的分布式 GPU 租出去」的场合,方向说反了:训练循环仍要自己写,分布式 GPU 是向对方租来的。
2026 年 6 月 22 日至 28 日
本周新增十八章,推理、后训练、评测与生态这四部分都大幅扩写。站点也上线了账号:读者可以登录、对整页或选中的段落发表评论、写只有自己可见的笔记,并给章节加书签。
新增
- 「推理与测试时算力」从三章扩到七章:《作为搜索的结构化推理》把一条思维链当成搜索问题来处理,《程序、求解器与符号工作》讲把某一步交给不会算错的工具,《验证器与过程监督》问中间步骤由谁来查,《推理数据与蒸馏》讲推理轨迹从哪里来。
- 「后训练」新增《行为规格与偏好数据》,讲在收集比较数据之前先把模型该是什么样子写下来;《可验证奖励与推理迁移》,讲拿机器可判定的答案当训练信号;《安全调优与指令层级》,讲系统提示与用户指令冲突时谁说了算。
- 「评测」新增《统计可靠性》,讲一个基准分差要大到什么程度才值得相信;另有《人类评测与评分准则》《事实性、Grounding 与引用支持》,以及《运营评测与治理》,讲系统上线之后该量什么。
- 「生态与经济」新增《AI 价值链》,讲这套技术栈的利润究竟沉在哪一层;《采用与生产率》,讲落地证据到底显示了什么;《数据权利与合规经济》,讲训练数据在权利被定价之后是什么成本。
- 另有四章单独成篇:《中段训练:退火、领域桥接与上下文扩展》讲预训练与后训练之间的那一遍;《验证前沿:能力之后的证明、监督与信任》讲输出已经超出人工核查能力之后还能不能信任它;《人机界面与监督回路》讲人在运行中的系统里坐在哪个位置;《运营契约:SLO、成本、事故与多租户》讲一套技术栈被共享之后承诺什么。
调整
- 每一部分现在都以一页小结收尾。原先压在部分开篇末尾的那段回顾移到了这里,并改写成能接住下一部分的连贯文字。
- 图、示意图与交互图里读不清的地方都重画了:压在曲线上的标签和图例挪开,图中文字可以选中复制,中文标签不再被单元格切掉,深色模式下的图中文字也不再是几乎看不见的颜色。
- 两种语言都做了一遍文字打磨。术语在第一次出现的地方就用平实的话解释,而不是只留一条术语表链接;跨章的符号也统一了,n 个独立步骤的任务,成功概率现在处处写作
p^n,不再这一章写p^t、下一章写p^n。
更正
- 书中现在会说明哪些示例出自作者本人的产品。前言新增一条说明,点出 latere.ai 这一套(Lux、Cella、Topos、Wallfacer、Lectio)出自作者本人;《搭建一套 2026 技术栈》也不再把自托管的 Python 代理当作默认网关:吞吐测试显示它在智能体负载下会饱和,默认因此换成编译型网关,而中立选项与作者自己的那一个在这项基准上打平,那个延迟数字也只在低负载下成立。
- 《扩展律与算力分配》把拟合用的损失形式
L = E + A/N^α + B/D^β记在 Kaplan 等人名下,而他们的拟合里根本没有不可约项E。这一形式来自 Rosenfeld 等人与 Chinchilla。同一章还为 Chinchilla 复现研究的分歧列了几条具体成因(在优化器里对损失取平均而非求和、一个取整的指数、凭眼睛选定的拟合窗口),复现论文并没有这些主张,该段已删去。 - 《非自回归与扩散语言模型》里,掩码扩散的训练目标印错了符号。照原样写出的权重
α'_t/(1-α_t)是负的,正文却称它是交叉熵的正加权平均。正确的权重是-α'_t/(1-α_t)。 - 另有两处小修:《边缘与端侧部署》说 MobileLLM-350M 比 LLaMA-2 7B 小四十倍,实际是二十倍;《多智能体系统》把「辩论可以回答 PSPACE 问题」这一结果记在 Brown-Cohen 等人名下,它属于 Irving、Christiano 与 Amodei。
2026 年 6 月 19 日至 21 日
本书这一周从零开始,6 月 21 日打出第一个版本 v0.0.1。三天里立起了整条主干:十二个部分、六十七章,中英文各成一册,外加承载它们的阅读器,以及第一轮图示、可运行代码与参考文献。
新增
- 全书本身,十二个部分,从入门定位一路走到实践与运营。它只沿一条线索展开,即一项能力的生命周期:从原始算力开始,到一个已部署、受治理的行为为止。每一层要追问的,是这个部件为什么长成这个样子,而不只是它做了什么。中英两册章节一一对应。
- 生成式与多模态架构,这一部分讲的是下一个词预测之外的东西:扩散与流匹配、非自回归与扩散语言模型、语音与实时语音,以及多模态模型:融合与生成。
- 另有四章补上主干的缺口。借来的思想:AI 向其他科学借了什么,把压缩、奖励信号与热力学各自追回它们的来处;训练智能体去行动,讲怎么把模型训练成去做事,而不是去答题;嵌入与表示学习,讲文本如何变成一个值得拿来比较的向量;边缘与端侧部署,讲没有数据中心时模型怎么跑。
- 二十六个可交互图示,以及能在页面里直接运行的 Python 代码块,其中包括注意力热力图、分页注意力的显存分配器、失衡后坍缩的路由器、RLHF 与 DPO 与 R1 三套配方的分步演示,还有一个算自建服务在哪一点上比调 API 更划算的计算器。
- 一份 121 条的术语表,每个术语从它在章内第一次出现的位置链过去;覆盖全书的全文搜索,用 Cmd+K 打开;以及每章末尾的延伸阅读,由该章自己的参考文献生成,并说明每份工作为什么在这里。
调整
- 全书重排为十一个编号部分加入门定位,章节地址不再带编号。这样一来,阅读顺序变化时,一章仍然保住自己的链接。重排之前的地址会跳转到新地址。
- 站点换到了专为本书写的阅读器:顶栏固定,导航与目录可折叠,有阅读进度、明暗主题,以及调配色、字号与正文字体的设置面板。本书只在网页上读,因为可运行代码块与可交互图示进不了静态文件,所以没有 PDF 和 EPUB。
- 中文一册是按中文重写的,而不是照着英文逐句搬过来,因此多数章节在中文这边的读感与此前不同。
更正
- 中文的 RLHF 与奖励建模一章先说三件事,随后列了四件。开头已改成与下文一致。
- 训练模型推理一章曾说,多个基于验证器的配方都缩小或去掉了 RLHF 用作缰绳的 KL 惩罚项。这话说过了头:只有 DAPO 去掉了它。正文已如实改写,并写明它转而依靠什么。
- 超越文本:多模态、世界模型与具身的开篇,写得像读者已经在另一章见过数据墙,而重排之后那一章要往后七个部分才出现。数据墙现在就在第一次用到它的地方讲清楚。领域地图与如何阅读本书在同一次重排后仍按九个部分描述全书,现已改为实际的结构。
- 参考文献有三处问题。「The Era of Experience」的链接因空格未编码而一直打不开。若干被引工作列出了无法与原文核对的共同作者,这些名单已收窄到能核实的姓名,其余记为「等」。基础设施几章里有六条中文简介是译写或臆造的,并非源出处所写,已经删除。
评论
登录后评论