Anthropic、Claude Fable 5.1を発表:エージェント利用を最大45%値下げ
導入
AnthropicはClaude Fable 5.1を公開し、Project Glasswingの参加者向けにMythos 5.1も提供し始めました。同社は今回の更新を性能向上だけでなく、価格、データ保持、過剰な安全ブロックへの不満に応える取り組みと位置付けています。ただし、発売時点の評価はAnthropicの説明や一部の早期利用者の感想が中心であり、幅広い独立検証はこれからです。
主なポイント
- 通常料金は約25%低下。 Anthropicによると、Fable 5.1は通常利用で約25%安く、複雑なエージェント処理では最大45%安くなります。すでに処理・保存されたキャッシュデータの料金を下げたことが大きな要因です。同じ文脈を繰り返し参照し、多数のツールを呼び出すエージェントには影響が大きい可能性があります。
- 実務での理解力を訴求。 EveryのDan Shipper氏は、チームが使った中で最も強いコーディングモデルだと評価し、速度とトークン効率も向上したと述べました。BoxのAaron Levie氏も、同一テストでFable 5が見逃したデータ上の細かな違いや曖昧さを、Fable 5.1のエージェントが捉えたと説明しています。いずれも初期評価であり、独立した比較試験とは異なります。
- Mythosは推論効率を強調。 初期の観察では、Mythos 5.1は低い推論設定でも、旧モデルの最大設定に近いベンチマーク結果を示したとされています。ただし現時点ではProject Glasswing参加者限定で、一般利用者による確認はできません。
- 安全策を細分化。 Fable 5.1は、基本的な生物学の質問を不必要に拒否しにくくなったとAnthropicは説明しています。一方、Mythos 5.1の生物学分野の制限は従来と同じです。Fable 5.1ではソフトウェアの脆弱性特定が可能になりましたが、侵入テスト、エクスプロイト生成、バイナリベースの脆弱性スキャンなどはOpus系モデルへ回される場合があります。
- 企業向けプライバシー機能は今後提供。 Enterprise Frontier Safeguardsは秋の後半から段階的に展開される予定です。顧客データをAnthropic側ではなく顧客自身のクラウドサーバーに保存し、データ保持への懸念に対応します。
意味と影響
今回の発表は、AIモデルの競争軸がベンチマークの点数だけでなく、長い業務をどの程度安定した費用で完了できるかへ移っていることを示します。エージェントは同じ指示や文書を繰り返し読み、複数回のツール呼び出しを行うため、キャッシュされた文脈の料金は実運用コストに直結します。価格低下が実際のワークロードでも確認できれば、コーディング、調査、文書処理を自動化する企業にとって導入理由になり得ます。
ただし、最大45%の値下げは複雑なエージェント処理を対象とした説明であり、すべてのリクエストに当てはまるわけではありません。初期ユーザーの評価だけでは、品質、遅延、安定性、総費用を判断できません。また、誤拒否が減ることは、高リスクのサイバー機能が全面的に解禁されたことを意味しません。企業は、秋に予定されるクラウド保存機能の具体的な条件も確認する必要があります。
AnthropicはFable 5.1で、価格と使い勝手という二つの課題を同時に改善しようとしています。最終的な評価は、価格優位が本番環境でも維持されるか、そして柔軟になった安全策がリスク管理を損なわず機能するかにかかっています。
出典:The Verge AI
コメント
ログイン状態を確認中…
コメントを読み込み中…