AI 基建
0%
更新记录

更新记录

作者Changkun Ou
阅读时长约 12 分钟

本页记录读者能够看到的改动,便于判断是否需要重读某一章、核对一项更正或查看新增内容。每项更正都会说明原来的问题是什么,以及后来改成了什么。没有读者可见改动的周不会列出;版本标签归入实际发布的那一周。

2026 年 8 月 4 日至 8 日

英文版重写已经推进到尾声。整个过程每次只处理一个完整单元,一章完成重写、测试、渲染和审阅之后,才开始下一章。

调整

  • 英文重写从《行为规格与偏好数据》继续推进,覆盖余下所有技术章节、《实践与运营》小结以及尾声。新版解释会区分机制与主张,交代适用范围、证据、失败行为和运营交接,并说明每章与相邻层次的关系。重复的小结、缺少依据的绝对说法和生硬的过渡句已经删除。
  • 每个完成的单元都新增了章节专属的回归测试,用来保护核心论点、固定标题、公式、图示、引用和章节交接。提交之前,还会在正式阅读器中检查桌面端和移动端的实际页面。

更正

  • 重写过程中发现并修复了多处既有交互内容的无障碍问题。算力预算图和智能体训练图现在会说明坐标轴与系统维度;KV 缓存计算器、分页注意力图、注意力热力图、流程分步器、Graphviz 图和可运行编辑器都有可用的标签。分步器换行后不会留下悬空箭头,窄屏下的控制项也会保持在一起。
  • 量化图原来的对比会造成误解,现已改正。验证前沿图的图例曾在窄屏上重叠或难以辨认,现在能在移动端正文栏内清楚显示。

2026 年 7 月 27 日至 8 月 3 日

网站向读者公开了项目的开源协作方式,修复了网址处理,并开始全面改写英文版以提高表达清晰度。

新增

  • 新增「如何参与」页面,说明哪些问题报告最有帮助、如何提出修改,以及许可协议允许哪些用途。每章末尾现在都有两个入口,一个用于报告问题,另一个用于编辑该章的源文件。

调整

  • 顶栏和侧栏都加入了源码仓库链接。打开前言时,目录上方的相关链接也会保持可见。
  • 英文重写的第一阶段覆盖入门定位、基座模型的形成、生成式与多模态架构,以及《监督微调与参数高效微调》。每章完成后都会新增专项内容回归测试,并检查正式页面的渲染结果,再继续处理下一章。

更正

  • 页面过去既能通过带斜杠的网址访问,也能通过不带斜杠的网址访问,但相对图片与章节链接只在其中一种形式下有效。现在每页只有一个规范网址,另一种形式会在返回页面之前重定向到该地址。

2026 年 7 月 20 日至 26 日

一轮一手资料审计带来了 51 项经过核实的更正。原有十一章的基础设施部分也拆成了两个部分。本周发布 v0.2.0。

新增

  • 《法律、监管与政策》新增前沿安全框架一节,说明开发者如何设置能力阈值、用哪些评测检查阈值、超过阈值后启用哪些防护措施、各家在 2026 年公布的框架有何差异,以及 Anthropic 在达到阈值后如何实施 ASL-3。
  • 《RAG 与检索》新增授权阶段,比较把访问控制清单写入索引和在查询时应用授权过滤两种方案,核算各自成本,并说明为何只在检索后过滤可能让有权限的用户仍然拿不到足够结果。

调整

  • 第九部分拆为「基础设施与算力」和「前沿与极限」。前者从《加速器与网络》到《规模越大,越会失效的机器》,后者包含《学习在哪里遇到极限》《能力地平线及其测量》和《验证前沿:能力之后的证明、监督与信任》。「生态与经济」成为第十一部分,「实践与运营」成为第十二部分。三章移动后的旧地址仍可通过重定向访问。
  • 十二个技术术语重新在首次出现时获得了白话解释,包括强化学习语境中的策略、思维链、留出集、模型裁判、提示注入、叠加、注意力汇和交叉熵。《验证器与过程监督》和《框架与自动微分》会先定义符号,再展示公式。《非确定系统的可靠性》统一负责定义质量服务水平指标,《运营契约》改为引用该定义,不再重复。
  • 中文阅读器的侧栏链接已经本地化,各部分开篇引文会显示在原定的引用面板中,嵌套循环图的标签也不再重叠。

更正

  • 《分词》曾把 fertility 定义为每个词元包含的字符数。它实际表示一个词平均会被切分成多少个词元,原定义正好是倒数,也使后续论证方向相反。
  • 《超越稠密 Transformer》的一处图注曾说 KV 缓存和注意力的单步成本随序列长度平方增长。两者的单步成本都是线性的,只有完整序列上的注意力总计算量是平方级。
  • 《更快的解码》曾把 DeepSeek-V3 多词元预测的接受率写成 80%,技术报告给出的范围是 85% 至 90%。
  • 《选择模型》仍把 GPT-5.5 写成 OpenAI 旗舰,并推荐它处理智能体编码。表格和选型器现在使用 GPT-5.6 Sol、Terra 与 Luna,其中 Sol 标为旗舰。长上下文价格门槛也从误写的 270K 输入词元改为 272K。
  • 《AI 价值链》曾把 87% 降至 79% 描述为约四个百分点,实际差值是八个百分点,并由表中的基础设施层与应用层共同承接。
  • 《造出这块硅》曾用同一篇 TrendForce 文章支持 CoWoS 产能、交期和需求增长十一倍等说法,但文章并未提供产能数据。产能陈述现在引用真正包含对应数字且带日期的来源,缺少依据的交期说法已经删除。NVIDIA 的份额也改用已报道的 2026 至 2027 年订单占比和 2025 年 CoWoS-L 份额来描述,不再使用无来源的产能估算。
  • 参考文献摘要过去会在第一个百分号处截断,影响 232 个参考文献字段。百分号现在能够完整保留。六个失效的引用链接已经替换,其中两项的作者与年份信息也一并更正。

2026 年 7 月 6 日至 12 日

阅读器采用了新的视觉系统。评测章节和沙箱凭据模型也按 2026 年年中实际使用的模型 API 与密钥处理机制完成对齐。本周发布 v0.1.0。

新增

  • 《安全与授权》把出口替换作为一种独立凭据机制来讲解。沙箱只保存不透明占位符,终止 TLS 的代理只会在允许的目标地址上把它替换为真实密钥。交互分步器比较了三代设计,数据路径图则展示了最终流向。

调整

  • 阅读器改用浮动顶栏、半透明侧栏与抽屉、独立正文面板和圆形阅读进度。侧栏条目会响应指针操作,正文面板滚动时不再使用高开销的模糊效果。
  • 《运行框架》《评测智能体与能力》《模型裁判与偏好排名》《把人类评测写成测量协议》和《运营评测与治理》围绕同一原则重新组织:分数属于完整评测设置,而不是某个模型名称。各章现在会记录服务路由、运行框架版本、镜像标签、配置与实测推理强度、提示词哈希、裁判身份和评分规则哈希。微小差异在通过适当统计检验之前仍被视为噪声。
  • 评测与编排示例不再引用已经停用的 agon 产品,改为描述 Latere 的 Adversarial Review 能力。评论服务失效时,章节也不会再显示空白页,而是保留正文并显示零条评论。

更正

  • 本书曾把调用方设置 budget_tokens 描述为请求推理深度的现行方式,但相关模型 API 已不再接受该请求格式。正文现在说明模型会在推理强度上限内自适应思考,即使使用最高档位,简单请求也可能只消耗很少推理词元。
  • 《集成技术栈》曾声称所有供应商都接受 OpenAI 请求格式。现在该章区分三种不兼容的接口方言,把网关明确写成可能丢失信息的翻译层,并说明 OpenAI 推理档位只有通过 Responses API 才能与工具结合使用。
  • 《工具生态》曾说 Cella 会在命令需要时把真实密钥注入沙箱,但该机制已经停用。真实密钥现在留在沙箱外,并在出口处替换。相关章节也不再假设所有第三方凭据都能换成短期令牌,因为静态 API 密钥并不总能按请求签发。

2026 年 6 月 29 日至 7 月 5 日

本周新增八章和三个章节内小节,重点补足模型代码与加速器之间的软件层,并依据截至 2026 年年中的一手资料复核其余内容。

新增

  • 《此前的那套基础设施》说明生成式系统从大规模排序、推荐和经典机器学习系统继承了什么、哪些条件已经改变,以及本书如何划定讨论边界。
  • 《框架与自动微分》解释反向模式自动微分、即时执行和计算图捕获。《编译器与内核》接着把计算图追踪到设备代码,说明为什么数据搬运会主导许多内核,并分析长期积累的软件生态如何影响加速器竞争。
  • 《机密推理》把合同中「不使用提示词训练」的承诺与硬件强制执行的控制区分开,讨论远程证明、性能成本和可信执行边界的局限。
  • 《计算机使用》讨论视觉定位、动作可靠性和屏幕交互成本。《个性化与用户记忆》说明用户状态为何位于基础模型之外,以及它如何影响产品迁移和用户控制。
  • 《模型作为一件制品》把权重视为需要序列化、签名、分发、验证和加载的文件,并覆盖供应链攻击与权重后门。《智能体经济》讨论软件持有并使用凭据时的身份、委托权限与支付问题。
  • 《法律、监管与政策》新增 ISO 42001、NIST 风险框架、第三方评测和保险等保障机制。《算力市场与单位经济性》新增折旧、GPU 抵押债务和厂商循环交易等资本问题。《多模态模型的服务》新增扩散与视频生成的成本模型。

调整

  • 全书各部分重新对照一手资料。《把基准写成测量契约》补充 Humanity's Last Exam 外部审计与维护方复核之间的分歧,以及未披露私下榜单测试的争议。《选择模型》更新到 2026 年 7 月,并记录 Fable 5 与 Mythos 5 停用三周后恢复。推理部分不再把预填充与解码分离部署写成未决设想,而是写为已经投入使用的方案。
  • 面向刚接触机器学习的软件工程师,技术术语现在会在第一次使用时就近解释。《扩展律与算力分配》和《扩散与流匹配》的开篇也更容易进入。《智能体架构》中「尚存争议」的内容重新显示为提示框,不再被渲染成普通标题。

更正

  • 《全栈一览》曾画出一个服务量交叉点,声称超过该点后混合专家模型才比稠密模型便宜。这个交叉点并不存在:训练与服务计算量都取决于激活参数。示例中的稀疏模型在所有展示的服务量下都使用更少计算,但必须让全部 671B 参数常驻,才能让每个词元激活其中 37B。
  • 《多模态模型的服务》计算 KV 缓存时漏掉了分组查询注意力的除数,因此把单张图片所需缓存高估了约四倍。现已加入该除数。
  • 《算力前沿》曾把 GDPval 在 2025 年 9 月的 47.6% 结果解释为接近但尚未达到专家水平。到 2026 年年中,领先模型已在约七成盲评专家比较中获胜或打平。正文现在把这一评分结果与实际部署中的价值证据分开讨论。
  • 中文版《训练与微调实践》把 Tinker 的关系写反了。用户需要自行编写训练循环,并从服务方租用分布式 GPU,而不是把自己的 GPU 租给服务方。

2026 年 6 月 22 日至 28 日

本周新增十八章,扩展了推理、后训练、评测、基础设施与经济内容。阅读器也加入用户账户、评论、选段讨论、私人笔记和书签。

新增

  • 「推理与测试时算力」从三章扩展到七章。《将结构化推理视为搜索》把推理建模为搜索过程,《程序、求解器与符号化工具》区分执行成功与任务正确,《验证器与过程监督》讨论中间检查,《推理数据与蒸馏》说明推理轨迹如何产生和复用。
  • 后训练部分新增《行为规格与偏好数据》《可验证奖励与推理迁移》和《安全调优与指令层级》,分别讨论在收集比较数据前定义预期行为、从机器可检验结果中学习,以及如何解决不同指令来源之间的冲突。
  • 评测部分新增《把统计可靠性写成决策契约》《把人类评测写成测量协议》《事实性、有据性与证据》和《运营评测与治理》,把基准不确定性、人工判断、来源支持与生产发布决策连接起来。
  • 生态与经济部分新增《AI 价值链》《采用与生产率》和《数据权利与合规经济》,分析价值分布、生产率主张所需的实地证据,以及数据权利如何改变数据成本。
  • 另有四章补齐其他内容:《中段训练》讨论预训练与后训练之间的阶段,《验证前沿》讨论人工核验成本过高的主张,《人机界面与监督回路》把人的权限放进运行系统,《运营契约》定义基础设施共享后必须维持的承诺。

调整

  • 每个部分现在都以小结结束。原来附在部分开篇的回顾内容移到小结,并改写为通向下一部分的论证交接。
  • 标签重叠、图例遮挡数据、中文文字被截断或深色模式下难以辨认的图示和交互内容都已修复。图中文字现在可以选中和复制。
  • 中英文版都完成一轮措辞与符号统一。技术术语会在首次需要时解释,n 个独立步骤全部成功的概率也统一写成 p^n,不再与 p^t 混用。

更正

  • 前言现在披露 Lux、Cella、Topos、Wallfacer 和 Lectio 是作者的产品。《集成技术栈》也不再默认推荐自托管 Python 代理,因为吞吐测试显示它会在智能体负载下饱和。默认方案改为编译型网关,延迟结论限定在低负载范围内。
  • 《扩展律与算力分配》曾把 L = E + A/N^α + B/D^β 归于 Kaplan 等人,但他们的拟合没有不可约损失项 E。出处现已改为 Rosenfeld 等人和 Chinchilla。对 Chinchilla 复现实验差异所作的无依据解释也已经删除。
  • 《非自回归与扩散语言模型》把掩码扩散权重的符号写错了。正的交叉熵权重应为 -α'_t/(1-α_t),而不是 α'_t/(1-α_t)
  • 《边缘与端侧部署》曾说 MobileLLM-350M 的参数量比 LLaMA-2 7B 小四十倍,实际是二十倍。《多智能体系统》曾把 PSPACE 辩论结果归给 Brown-Cohen 等人,正确作者是 Irving、Christiano 和 Amodei。

2026 年 6 月 19 日至 21 日

项目于 6 月 19 日启动,并在 6 月 21 日发布 v0.0.1。三天内建立了中英文各六十七章、共十二个部分的初始结构,同时上线阅读器、首批图示、可运行代码和参考文献。

新增

  • 初版结构沿着一项能力的生命周期,从算力与数据一直讲到训练、服务、编排、评测、治理和运营。中英文版采用相同的章节结构。
  • 「生成式与多模态架构」把《扩散与流匹配》《非自回归与扩散语言模型》《语音与实时语音》和《多模态模型:融合与生成》集中到同一部分。
  • 《借来的思想》追溯压缩、奖励信号和热力学等概念的来源领域。《训练智能体去行动》讨论如何学习影响环境。《嵌入与表示学习》解释可比较的向量表示。《边缘与端侧部署》讨论没有数据中心时的运行方式。
  • 初版包含二十六个交互图和可运行 Python 单元,包括注意力热力图、分页注意力分配器、失衡路由器、RLHF、DPO 与 R1 的分步流程,以及自托管成本计算器。
  • 阅读器包含 121 个术语,术语首次出现时会链接到术语表;全文搜索可通过 Cmd+K 打开;每章还会根据本地参考文献生成延伸阅读,并简要说明每项来源的相关性。

调整

  • 全书重组为入门定位加十一个编号部分,章节网址不再包含编号,因此章节移动后仍能保留原地址。重组前的网址通过重定向继续有效。
  • 专用网页阅读器取代了早期展示方式,提供固定顶栏、可折叠导航与目录、阅读进度、明暗主题,以及配色、字号和正文字体设置。由于可运行单元和交互图无法保留在静态格式中,本书继续只提供网页版,不提供 PDF 或 EPUB。
  • 中文版改为按中文表达习惯重写,不再逐句照搬英文。

更正

  • 中文版《RLHF 与奖励建模》的开篇曾说将讨论三件事,后文实际列出四件,现已统一。
  • 《训练模型学会推理》曾声称多种基于验证器的方法都缩小或去除了 RLHF 的 KL 惩罚项,实际只有 DAPO 去掉了这项惩罚。正文现在说明这一适用范围及其替代机制。
  • 《超越文本》的开篇曾假设读者已经了解数据墙,但重组后相关章节位于后面七个部分。该概念现在会在首次出现时解释。《领域地图与如何阅读本书》在同一次重组后仍把全书写成九个部分,也已改为实际结构。
  • 参考文献修复了三类问题:「The Era of Experience」网址中的空格未编码;部分作者名单无法从原文核实;基础设施章节的六条中文简介并非来源原文。链接和作者信息已经更正,无法核实的姓名改为「等」,不实简介已经删除。

评论

登录后评论