- 简介
- 目录大纲
- 最新文档
思考题参考答案
思考题参考答案 本文件汇总全书十章思考题的参考答案提纲。思考题多为开放性问题,答案不唯一。参考答案为 AI 生成,人工略作审校,仅供读者对照启发之用。建议读者使用 LLM 结合书稿内容进一步讨论这些问题。 第一章 AI Agent 入门 1. (★★) 如果你只能给一个 Agent 系统增加一项能力——更强的模型、更丰富的上下文、还是更多的工具——你会选哪个?在什么条件下你的选择会改变? ...……
1024wiki - 2026年8月10日 21:47
后记
后记:回到 Agent = LLM + 上下文 + 工具 本书开篇提出了一个公式:Agent = LLM + 上下文 + 工具。全书十章,都在这三个词里展开。 第一章建立公式的三层理解——实现层、直觉层、学术层,并给出从工作流到自主 Agent 的编排光谱。随后的章节沿“构建—评估与进化—交互与协作”逐步展开。 构建 Agent(第二至五章)。 上下文工程决定 Agent 在一次任务中看到...……
1024wiki - 2026年8月10日 21:46
引言
引言 2025 年 8 月至 10 月,我在图灵《AI Agent 实战营》上进行了一系列技术讲座。讲座的初衷很简单:把 AI Agent 的设计从 “感觉驱动” 变成 “原则驱动”:不只是教大家跑通一个 Demo,而是深入理解 Agent 为什么要这样设计,每一个架构决策背后的取舍是什么。这本书正是从那些讲座的讲稿和实验中整理、扩展而来的。 值得一提的是,这本书从最初的想法到最终成书,本身...……
1024wiki - 2026年8月10日 21:44
第十章 多 Agent 协作
多 Agent 协作 在 OpenAI 曾提出的 AI 能力五等级描述(Level 1 对话者、Level 2 思考者(Reasoners)、Level 3 智能体、Level 4 创新者、Level 5 组织 Organizations)中,多 Agent 协作常被类比为通向第五级的路径之一——需要说明的是,此处 Organizations 指的是“AI 能完成整个组织的工作”这一能力级别...……
1024wiki - 2026年8月10日 21:39
第九章 多模态与实时交互
多模态与实时交互 如果把模型的能力做一个面向应用的粗略划分,大致可以从三个方面来观察:理解、生成和交互。 理解回答的是“模型能否看懂并想明白”,包括理解文字、语音、图像和视频,以及在这些信息之上进行推理、判断与规划。 生成回答的是“模型能否把想法表达出来”,它可以生成文本和代码,也可以生成图像、视频、语音乃至动作。 交互回答的则是另一个问题:模型能否在持续变化的环境中,在合适的时机接收信息...……
1024wiki - 2026年8月10日 21:34