Claude Opus 4.8 发布了:更会判断,也更适合长任务
Anthropic 发布 Claude Opus 4.8,价格不变,重点提升判断、诚实性、长任务执行,以及 Claude Code 的动态工作流。

Anthropic 发布了 Claude Opus 4.8 。它是在 Opus 4.7 基础上的升级,价格保持不变,重点放在真实工作里的稳定性:判断更清楚,更愿意承认不确定,也能独立工作更久。
第一,Opus 4.8 在编码、 Agent 能力、推理和知识工作任务上都有提升。早期测试者的反馈集中在“判断力”:它会问更合适的问题,会在计划不稳时提出异议,也会在大改动前先建立足够信心。
第二,诚实性变好了。 Anthropic 提到,模型过去容易在证据不足时过早声称自己有进展。 Opus 4.8 更倾向于标出不确定性,也更少放过自己代码里的缺陷。评测显示,它让代码缺陷未被指出的概率大约降到前代的四分之一。
第三,Claude Code 新增 dynamic workflows,仍是研究预览。面对很大的任务时,Claude 可以先制定计划,再在一个会话里启动数百个并行子 Agent,最后验证结果再汇报。官方举的例子是跨数十万行代码的大规模迁移。
第四,Opus 4.8 支持 fast mode 。同一个模型,速度约为 2.5 倍;相比之前,fast mode 价格降到三分之一。 Claude Code 里可以用 /fast 开启,API 侧需要申请。
另外,claude.ai 和 Cowork 加入 effort control,用户可以选择 Claude 在一次回答里投入多少“思考”。高 effort 更慢、消耗更多,但质量更好;低 effort 响应更快,也更省额度。 Messages API 也允许在 messages 数组里插入 system 条目,方便开发者在任务中途更新权限、预算或环境上下文。
这次更新的信号很清楚:Claude 正在从“回答问题的模型”,继续往“能长时间执行复杂工作的系统”走。对开发者来说,跑分之外更该看三个方向:更会判断、更能自检、更适合多步骤长任务。
Opus 4.8 已经全量可用。普通价格仍是每百万输入 token 5 美元、输出 token 25 美元。开发者可通过 Claude API 使用 claude-opus-4-8。