返回AI资讯
Claude Opus 4.8 发布:长任务代理能力继续加码

Claude Opus 4.8 发布:长任务代理能力继续加码

AI资讯 Admin 280 次浏览

2026 年 5 月 28 日,Anthropic 发布 Claude Opus 4.8。相比一次普通模型迭代,这次更像是把 Claude 往“能接长任务的工作代理”上再推一步:模型今天可用,常规价格不变,同时 Claude Code、claude.ai 和 API 都拿到配套更新。

官方说 Opus 4.8 在编码、代理任务和专业工作上都有提升,并强调它比上一代更少“明明没做好却装作完成”。这点不花哨,但对企业和开发者很关键。长任务里最麻烦的不是模型偶尔答错,而是它在证据不足时继续往下编,把问题带进后续流程。

最该看的不是分数,是配套能力

Claude Code 新增的 dynamic workflows 处于研究预览,可以让 Claude 规划任务、并行运行大量子代理,再验证输出后汇报。官方给的方向包括大规模代码迁移、补测试、修复跨模块问题。这个能力目前面向 Enterprise、Team 和 Max 计划,更像是给高强度开发场景的实验入口。

claude.ai 和 Cowork 则加入努力程度控制。用户可以选择让 Claude 多想一点,换取更稳的答案;也可以降低努力程度,节省速率限制并获得更快回复。对普通用户来说,这比抽象的模型参数更直观,因为同一个问题并不总值得花最高成本处理。

API 更新透露了代理化方向

Messages API 现在允许在 messages 数组里加入 system 条目。开发者可以在任务中途更新权限、token 预算或环境说明,而不必打断缓存或硬塞进用户消息。这个变化很细,但对长时间运行的 Agent 很实用:真实工作流里,规则、上下文和权限经常会变化。

Opus 4.8 也把 fast mode 重新定价,官方称速度可到 2.5 倍,费用比上一代 fast mode 低三倍。它释放的信号是:Anthropic 不只在拼最强模型,也在补“能长期跑、能控成本、能被团队纳入流程”的产品层。

谁应该现在尝试

如果你主要用 Claude 写短文、做日常问答,升级感可能不会特别夸张。真正适合第一时间测试的是 AI 编程团队、法务/金融文档分析团队,以及正在做内部 Agent 的企业。重点不是让它替你做最终决策,而是观察它在长会话、工具调用、代码修改和自我纠错上的稳定性有没有提升。

信息来源

官方来源:Anthropic Claude Opus 4.8 发布公告

推荐工具

更多