AI 基建
0%
第六部分 · 编排

第六部分 · 编排:智能体、检索与上下文

作者Changkun Ou
阅读时长约 1 分钟

「推理轨迹帮助模型形成、跟踪并更新行动计划。」

Shunyu Yao 等,"ReAct: Synergizing Reasoning and Acting in Language Models"

模型能被服务之后,任务很快就不再只是一次回答。它要读文件、记忆、检索、调用工具、等待结果、修订自身状态,有时还要与其他智能体协调。第六部分讨论的,就是当工作单位从 completion 变成 task 之后,模型周围必须具备的系统机制。

第 37 章 从训练角度讲行动:奖励落在一条轨迹上,而不是一个答案上:一条轨迹就是智能体一步步行动、跑完一整轮的完整过程。第 38 章第 41 章 讲执行循环以及支撑它的运行框架。中间几章处理状态和知识:第 39 章 区分会话日志、工作区和长期记忆,第 40 章 接着讲比任何任务都活得久的那种记忆,也就是产品对用户的记忆,以及它牵动的市场、隐私与谄媚问题;第 42 章 把动作空间扩展到屏幕本身,让智能体操作为人眼与人手设计的软件。第 44 章第 45 章 讲检索、嵌入、排序和外部文本的不可信,第 43 章 讨论多个智能体什么时候能把分歧变成信号,什么时候只是把同一种错误复制几遍。第 46 章 作为本部分的收尾,把上下文窗口当成一块需要预算、摆放、压缩与递归的编程界面。

这一部分不急于给出一个整洁的智能体定义。它更关心谁拥有下一步决策,状态存在哪里,工具调用能做什么,哪些记忆会在崩溃后留下,系统又在哪里能被打断。智能体的能力,最后总要落实到这些编排细节上。

评论

登录后评论