返回文章列表
模型发布

Anthropic发布Claude Fable 5.1:更便宜,也更少误拦截

阅读约 3 分钟

导语

Anthropic发布了Claude Fable 5.1,同时推出面向Project Glasswing参与者的Mythos 5.1。按照公司说法,新版本不只是一次性能更新,也是在回应用户对价格、数据留存和安全拦截过于严格的长期抱怨。不过,目前关于实际效果和成本的主要信息仍来自Anthropic及早期用户反馈,尚需更广泛的独立测试验证。

核心要点

  • 价格下调是主要卖点。 Anthropic称,Fable 5.1的常规使用成本约比Fable 5低25%;对于需要多轮调用、持续读取已处理数据的复杂代理任务,最高可便宜45%。降价的重要原因,是降低了缓存数据的收费。对运行编码代理、文档分析和长流程自动化的团队来说,这可能比单纯提升基准分数更有吸引力。
  • 性能强调“更会处理上下文”。 Every CEO Dan Shipper称,它是团队使用过的最强编码模型之一,并且速度更快、令牌效率更高。Box CEO Aaron Levie则表示,在相同测试中,Fable 5.1发现了Fable 5遗漏的数据细微差异和歧义。这些评价说明升级重点可能在实际工作流中的理解与执行,而不仅是公开榜单。
  • Mythos 5.1主打推理效率。 早期观察称,Mythos 5.1在低推理设置下,基准表现可接近前代最高推理设置。不过该模型目前只向Project Glasswing参与者开放,外部用户还无法全面检验这一说法。
  • 安全边界变得更细。 Anthropic表示,Fable 5.1对安全策略进行了更精确的调整,处理基础生物学问题时不易出现误拦截;但Mythos 5.1在生物学限制方面与上一代相同。网络安全方面,Fable 5.1现在可以用于识别软件漏洞,但渗透测试、漏洞利用生成和基于二进制的漏洞扫描等任务,仍可能被转交给Opus系列模型。
  • 企业隐私方案尚未落地。 Enterprise Frontier Safeguards计划在秋季晚些时候开始推出。Anthropic称,该方案会把数据存储在客户自己的云服务器上,而不是Anthropic的服务器,以回应企业对数据留存的担忧。

意义与影响

Fable 5.1的变化显示,模型竞争正从“谁的基准分数更高”转向“谁能以更低成本稳定完成一整套任务”。缓存数据降价尤其适合代理型应用,因为代理通常需要反复读取相同背景信息,并进行多轮工具调用。若Anthropic的价格说法在真实业务中成立,开发者可能更愿意把长流程编码、研究和数据处理交给模型。

但这次更新也保留了明显的条件限制。45%的降幅针对复杂代理任务,并不等同于所有请求都能获得相同节省;早期用户评价也不能替代独立评测。与此同时,安全策略“更少误拦截”与“放宽高风险网络安全能力”并不是一回事。企业最终是否采用,还要看实际延迟、稳定性、合规安排和秋季隐私方案的具体执行。

总体而言,Anthropic试图同时修补商业成本和产品摩擦两块短板。Fable 5.1能否成为代理应用的更优选项,关键将取决于价格优势能否覆盖真实工作流,以及更灵活的安全策略能否保持足够的风险控制。

来源:The Verge AI

评论

正在确认登录状态……

正在加载评论……

相关文章