Anthropic 回应 Opus 5.5 中途停止

AI 驱动中国 柳深 709次阅读
分享 微 Q 信
AI摘要
由 AI 生成 · 仅供参考

Anthropic 发布提示词指南,说明 Opus 5.5 在无人值守 Agent 任务中常因主动汇报进度返回 end_turn,被旧程序误判为完成而中途停止,并给出任务拆解、自动续跑、完成标准校验、人工复查及 API 迁移等处理建议。

驱动中国9月26日消息,Anthropic 针对 Opus 5.5 在无人值守 Agent 任务中中途停止的问题发布提示词指南,指出模型主动汇报进度后返回 end_turn,而沿用旧逻辑的 Agent 程序将纯文本回合结束误判为任务完成,导致工作未继续。

Opus 5.5 发布后,开发者发现模型在长任务中会主动同步进度,但部分汇报发出后不再调用工具。以代码库迁移为例,模型可能汇报已完成三个接口迁移,并说明将处理剩余两个端点及测试,随后停止。Anthropic 在指南开篇列出无人值守 Agent 汇报完进度后停在半路的情况,并给出四类常见原因:输出长篇总结并口头说明下一步但未调用工具;询问是否继续处理后等待用户回复;列出无需用户决策即可推进的事项并请求确认;认为当前回合字数或阶段完成度达到阈值而停止。

官方认为,纯文本回合结束应视为进度汇报,不能作为任务完成凭证。Opus 5.5 宣传中强调沟通更主动、总结更清楚,这些特性在旧有无人值守流程中会被误读为结束信号,因此模型并非停止工作,而是程序按旧规则判定任务结束。

指南建议将大任务拆成细项,由待办工具或文本维护,并让模型边执行边勾选。若回合结束时清单仍有未完成项且模型未说明阻塞原因,应用应自动发送消息要求继续。官方示例要求模型处理剩余两个端点迁移并更新测试,如被卡住则说明原因。同时,应预先设定完成标准,每次回合结束交由更小模型检查,未达标时将原因作为下一条消息要求返工;同一任务自动续跑两三次仍无进展时强制人工复查,避免 API 额度空耗。

系统提示词方面,官方建议明确排除上述四种停止方式,同时限定允许停止的条件,例如缺少用户输入无法推进,或触及受保护核心资源。

迁移层面,从 Opus 5 切换至 Opus 5.5 涉及四处 API 改动。未修改的旧请求可能被拒绝并返回 400 错误。指南列出的改动包括:若将 thinking 设为 disabled 或手工指定 budget_tokens,请求会被拒绝;官方建议不传 thinking 字段,或设为 adaptive,由 effort 参数控制思考深度。tool_choice 设为 any 或指定单一 tool 也会返回 400,官方建议设为 auto。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com。
本文价值 ★★★★★ 4 2 人已评
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
✎ 我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友