Claude Opus 5发布:半价追赶Fable 5,真正变化在“会自检”
阅读约 2 分钟
导语
Anthropic正式发布Claude Opus 5后,外界最直观的感受是:它正在以更低价格逼近甚至反超Fable 5。但如果只把它理解成“更便宜的高分模型”,反而会错过这次升级的重点。素材中多个开发者实测和官方案例显示,Opus 5的变化不只在生成代码更快、更漂亮,而在于它更愿意搭建验证流程、拆解任务,并在复杂工程中自己检查自己。
核心要点
- 价格没有上调,性能明显前移。 Opus 5延续每百万token输入5美元、输出25美元的定价,约为Fable 5的一半;在Frontier-Bench v0.1中拿到43.3%,高于Fable 5的33.7%,也超过上一代Opus 4.8的21.1%。
- 复杂代码与可视化任务表现突出。 网友用它生成Rocket League克隆、滑雪场景、Minecraft复刻、历史街区HTML单文件演示、阿波罗点火场景等,反馈集中在物理、结构和交互完整度上。
- “自检”能力成为亮点。 在波音747浏览器3D重建测试中,Opus 5不仅生成模型,还写测量脚本,从渲染结果提取轮廓并核对翼展、轴距、扫掠角等指标。官方案例中,它也会为FreeCAD建模任务自建视觉管道。
- 系统提示词被大幅精简。 Anthropic称,为适配Opus 5、Fable 5这一代模型,Claude Code系统提示词删掉超过80%,编码评测成绩未下降。过去依赖硬规则的“默认不写注释”,被改成匹配项目风格的弹性原则。
意义与影响
Opus 5的真正信号,是模型正在从“按提示生成结果”走向“围绕目标组织过程”。当模型能判断何时调用工具、何时保存记忆、何时搭建测试环境,开发者需要写的系统提示词和流程约束就会减少。
这对编码AI尤其关键。未来竞争不只是谁能一次性写出更炫的网页或游戏,而是谁能在真实工程里发现验证缺口、补齐测试闭环,并用可量化指标证明结果可靠。Opus 5仍需更多独立复测,但从素材中的案例看,它已经把大模型竞赛从“生成能力”进一步推向“工程自治能力”。
来源:量子位
评论
正在确认登录状态……
正在加载评论……