記事一覧へ戻る
モデルリリース

Google、Gemini 3.8 Flashを発表:推論強化の一方でコスト増の可能性

読了目安 3 分

Googleは、前モデルの公開から数週間でGemini 3.8 Flashを投入した。今回の強調点は、単純な高速化や単価の引き下げではない。複雑な課題に対してより多くの推論ステップを実行し、必要に応じて外部ツールを何度も呼び出すことで、回答や作業の完成度を高める設計だ。

主なポイント

  • トークン単価は同じでも、総額は増え得る:導入時の価格は入力100万トークン当たり0.75ドル、出力100万トークン当たり3.75ドルで、Gemini 3.7 Flashと同じ。ただしGoogleは、高い努力レベルでは性能向上のためにより多くのトークンを使う可能性があると説明している。
  • 複雑なエージェント処理を重視:Googleは、ソフトウェアエンジニアリングと自律型AIエージェントで大幅な改善があるとしている。DeepSWE v1.1、Vals Finance Agent V2、Harveyの法律エージェント評価で、前世代や他の主要モデルを上回ったという。
  • 比較すべきはAPI単価だけではない:Artificial Analysisの初期分析では、同程度の知能水準では安価なモデルと評価された一方、1タスク当たりの出力トークンやエージェント評価でのターン数が増えていると指摘された。単価が据え置きでも、処理1件の費用が同じとは限らない。
  • 安全対策も同時に強化:化学・生物・放射性物質・核関連のリスクや、サイバー攻撃への悪用を想定した保護機能が盛り込まれた。Gemini 3.8 Flash Cyberは、政府と信頼できるパートナー向けのFairwind Programで提供される。

この発表の意味

Flashシリーズはこれまで、速度とコスト効率を重視する選択肢として位置づけられてきた。3.8 Flashはその枠組みを広げ、比較的低いトークン単価を維持しながら、難しい課題では計算量とツール操作を増やす方向に進んでいる。コード作成、調査分析、専門文書の処理では、こうした余分なステップが結果の安定性につながる可能性がある。

一方、開発者が管理すべき指標は、入出力単価だけではない。総トークン数、ツール呼び出し回数、レイテンシー、エージェントのターン数が、実際の運用費を左右する。支出を予測しやすくしたい場合は、トークン使用量を抑えやすいGemini 3.7 Flashを継続利用できる。追加の推論コストを許容できる用途では、3.8 Flashがエージェント型アプリに適するだろう。

Cyber版の提供範囲も、Googleが高性能モデルとアクセス制御をセットで展開していることを示す。今後の評価では、ベンチマークの順位だけでなく、性能、料金、速度、安全性を実運用でどう両立するかが重要になる。

出典:The Verge AI

コメント

ログイン状態を確認中…

コメントを読み込み中…

関連記事

CCTest · Blog
Anthropic、Claude Fable 5.1を発表:エージェント利用を最大45%値下げ
モデルリリース
cctest.ai
モデルリリース

Anthropic、Claude Fable 5.1を発表:エージェント利用を最大45%値下げ

Anthropicは、Claude Fable 5.1について、通常利用で約25%、複雑なエージェント処理では最大45%安くなると説明しています。安全策や企業向けデータ保持の方針も見直されました。

続きを読む
CCTest · Blog
テンセント混元、770Bパラメータと100万コンテキストのHy4 previewを公開
モデルリリース
cctest.ai
モデルリリース

テンセント混元、770Bパラメータと100万コンテキストのHy4 previewを公開

テンセント混元が、総パラメータ770B、アクティブパラメータ4.9B、コンテキスト長100万のHy4 previewを発表した。複数のプラットフォームで公開され、ゲームエンジンやMCPとの連携を含むエージェント用途も示されている。

続きを読む
CCTest · Blog
阿里のDAMO LiON、肝臓の見逃し病変15例をAIで発見
モデルリリース
cctest.ai
モデルリリース

阿里のDAMO LiON、肝臓の見逃し病変15例をAIで発見

阿里巴巴の達摩院などが、造影CTから小さな肝臓の悪性病変を見つけるAIモデルDAMO LiONを開発しました。2か月間の実臨床試験で、初回読影では見逃されていた悪性腫瘍15例の発見を支援したとされています。

続きを読む