模型、工具与 Agent
把“会回答的模型”与“能够观察、行动和验证的系统”区分开。
读完这一章,你会理解
- 区分模型与 Agent 系统
- 理解工具调用循环
- 知道工程中应该验证哪些边界
模型不是完整的 Agent
模型负责理解上下文并产生下一步内容;Harness 负责提供文件、终端、浏览器、权限和执行反馈。两者结合,才形成可以完成任务的 Agent 系统。
Agent = Model + Context + Tools + Execution loop + Guardrails一个可靠的执行循环
可靠性不是来自一次完美回答,而是来自观察、行动、检查和修正。每一步都要把真实结果重新放回上下文。
- 读取当前状态
- 选择一个范围明确的行动
- 执行并收集结果
- 验证结果是否满足目标
- 必要时缩小问题并重试
能力边界比演示效果更重要
界面里出现某个模型名称,不代表推理一定可用;工具显示连接成功,也不代表执行权限完整。工程验证应分别检查模型调用、凭据、工具执行和最终产物。