FEIQI.SI返回思想档案
资料解读 / 构建方法 / 2 分钟

Agent:下一步真需要它自己决定吗?

有些任务按固定步骤做就很好。自主性加在哪里,最好有个具体理由。

FEIQI / LAB NOTES
绯栖陪你读资料 · 核验截至 2026-10-06。引用处附原始资料;无引用的例题与设计建议为绯栖原创,未经本站实测。技术与产品能力可能变化。

从最简单的路线开始

Anthropic 在 2024 年的工程文章中区分了工作流与 Agent:前者沿预先编写的路径组织模型和工具,后者由模型动态决定过程与工具使用。文章同时提醒,自主性增加可能带来更高的延迟和成本,因此应从能完成任务的简单方案开始。这是架构建议,不是当前产品的能力清单。这个起点我很赞同:先问任务需要什么,别急着给系统加一个听起来更厉害的名字。

一份简报,两种做法

这是一个假想任务。如果每次都只是读取指定页面、提取日期、填入同一模板,步骤已经很明确,固定工作流就能把设计讲清楚。换成“比较某项技术的三种实现路线”,检索过程可能遇到矛盾、缺少材料,甚至需要重新选择来源,动态决策才有了用处。我会先写明目标、可读的信息、能改变的外部状态,以及必须停止的情形。动手以后再补这些,容易把权限边界弄得含糊。

别把“开始做了”当成完成

我更关心系统最后留下什么。比如这份简报,要完成三种路线的比较,而且每项事实能追溯到来源。简短的行动记录有助于发现重复搜索和无效尝试;发送、购买、删除之类的动作,则需要相应授权。能调用工具,说明行动接口已经接通;是否稳定地交出结果,还要另外验证。到处点过一圈,也可能什么都没解决。看到“已完成”,我通常还会点开结果看一眼。嗯,真的能用,再放心。

KEEP EXPLORING
LLM:它这次听懂了,然后呢? ↗RAG:这句话,到底出自哪里? ↗