返回文章列表
模型发布

Claude Opus 5发布:半价追赶Fable 5,真正变化在“会自检”

阅读约 2 分钟

导语

Anthropic正式发布Claude Opus 5后,外界最直观的感受是:它正在以更低价格逼近甚至反超Fable 5。但如果只把它理解成“更便宜的高分模型”,反而会错过这次升级的重点。素材中多个开发者实测和官方案例显示,Opus 5的变化不只在生成代码更快、更漂亮,而在于它更愿意搭建验证流程、拆解任务,并在复杂工程中自己检查自己。

核心要点

  • 价格没有上调,性能明显前移。 Opus 5延续每百万token输入5美元、输出25美元的定价,约为Fable 5的一半;在Frontier-Bench v0.1中拿到43.3%,高于Fable 5的33.7%,也超过上一代Opus 4.8的21.1%。
  • 复杂代码与可视化任务表现突出。 网友用它生成Rocket League克隆、滑雪场景、Minecraft复刻、历史街区HTML单文件演示、阿波罗点火场景等,反馈集中在物理、结构和交互完整度上。
  • “自检”能力成为亮点。 在波音747浏览器3D重建测试中,Opus 5不仅生成模型,还写测量脚本,从渲染结果提取轮廓并核对翼展、轴距、扫掠角等指标。官方案例中,它也会为FreeCAD建模任务自建视觉管道。
  • 系统提示词被大幅精简。 Anthropic称,为适配Opus 5、Fable 5这一代模型,Claude Code系统提示词删掉超过80%,编码评测成绩未下降。过去依赖硬规则的“默认不写注释”,被改成匹配项目风格的弹性原则。

意义与影响

Opus 5的真正信号,是模型正在从“按提示生成结果”走向“围绕目标组织过程”。当模型能判断何时调用工具、何时保存记忆、何时搭建测试环境,开发者需要写的系统提示词和流程约束就会减少。

这对编码AI尤其关键。未来竞争不只是谁能一次性写出更炫的网页或游戏,而是谁能在真实工程里发现验证缺口、补齐测试闭环,并用可量化指标证明结果可靠。Opus 5仍需更多独立复测,但从素材中的案例看,它已经把大模型竞赛从“生成能力”进一步推向“工程自治能力”。

来源:量子位

评论

正在确认登录状态……

正在加载评论……

相关文章

CCTest · Blog
Claude Opus 5 发布:主打高性价比的前沿编码与知识工作模型
模型发布
cctest.ai
模型发布

Claude Opus 5 发布:主打高性价比的前沿编码与知识工作模型

Anthropic 发布 Claude Opus 5,将其定位为接近 Claude Fable 5 智能水平、但成本约为一半的日常主力模型。它在编码、自动化、知识工作和部分科学任务上展示了明显提升,但相关数据主要来自官方评测与早期客户反馈。

阅读全文