記事とガイド

Claude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ

全 795 件の記事

CCTest · Blog
Black Forest LabsがFlux3を発表、音声と映像の同期生成を重視したマルチモーダルモデル
マルチモーダル
cctest.ai
マルチモーダル

Black Forest LabsがFlux3を発表、音声と映像の同期生成を重視したマルチモーダルモデル

ドイツのAIスタートアップBlack Forest Labsが、マルチモーダル基盤モデルFlux3を発表した。Self-Flowアーキテクチャを採用し、画像、動画、音声、アクションを統合的に扱うことを目指すモデルとされている。

続きを読む
CCTest · Blog
ActiveVision:マルチモーダルAIに「能動的観察」を問う新ベンチマーク
モデル評価
cctest.ai
モデル評価

ActiveVision:マルチモーダルAIに「能動的観察」を問う新ベンチマーク

ActiveVision は、マルチモーダル大規模言語モデルが一度見て答えるだけでなく、観察・推論・再観察を繰り返せるかを測るベンチマークです。論文では、人間との大きな性能差が報告されています。

続きを読む
CCTest · Blog
Self Gradient Forcing:長尺動画生成の「記憶の書き込み」を訓練する
視覚・動画
cctest.ai
視覚・動画

Self Gradient Forcing:長尺動画生成の「記憶の書き込み」を訓練する

Self Gradient Forcing は、自回帰型動画拡散モデルで見落とされがちな履歴コンテキストの勾配不足に焦点を当てる手法です。未来フレームの損失を、過去に生成した潜在表現をより有用な KV メモリへ書き込む学習信号として使います。

続きを読む
CCTest · Blog
米国の「AI Kill Switch Act」案、危険なAIを政府が停止命令できる仕組みに
政策・規制
cctest.ai
政策・規制

米国の「AI Kill Switch Act」案、危険なAIを政府が停止命令できる仕組みに

米国で提案された「AI Kill Switch Act」は、一定の高リスクAIシステムに対し、国土安全保障省が減速、機能制限、停止を命じられるようにする法案だ。対象は大規模なAI企業と、巨額の計算資源を用いるシステムに絞られている。

続きを読む
CCTest · Blog
PyTorch Helion、TPU バックエンドで異種ハードウェア向けカーネル開発を前進
フレームワーク・ツール
cctest.ai

PyTorch Helion、TPU バックエンドで異種ハードウェア向けカーネル開発を前進

PyTorch Blog は、Helion が TPU 向けに Pallas へコンパイルする新バックエンドを備えたことを紹介した。Flash Attention の例では、自動チューニングされたパイプライン生成が TPU 性能を引き出す鍵として示されている。

続きを読む
CCTest · Blog
RunwayのMedia Router、生成メディア競争を「モデル運用」へ押し出す
推論・デプロイ
cctest.ai
推論・デプロイ

RunwayのMedia Router、生成メディア競争を「モデル運用」へ押し出す

Runwayは、画像・動画・音声生成モデルをリクエストごとに自動選択するMedia Routerを発表した。品質、速度、コストを軸にルーティングする仕組みで、生成メディア市場が単一モデル競争から基盤レイヤー競争へ移りつつあることを示している。

続きを読む
CCTest · Blog
OpenAI、米国の成人ユーザー全員に ChatGPT Health を開放
プロダクト・アプリ
cctest.ai

OpenAI、米国の成人ユーザー全員に ChatGPT Health を開放

OpenAI は、ChatGPT Health を米国の18歳以上のログインユーザー全員に提供する。Apple Health や MyFitnessPal、病院システムのデータ連携が可能になる一方、医療助言としての安全性は引き続き焦点だ。

続きを読む
CCTest · Blog
AIインフラ投資が急膨張、Googleの四半期フリーキャッシュフローが初のマイナスに
ビジネス・資金調達
cctest.ai

AIインフラ投資が急膨張、Googleの四半期フリーキャッシュフローが初のマイナスに

Googleは2026年第2四半期も巨額の売上を計上したが、AIインフラへの投資がそれを上回る勢いで増加した。上場以来初めて、四半期ベースのフリーキャッシュフローがマイナスとなった。

続きを読む
CCTest · Blog
Gemini、月間9.5億ユーザー突破:GoogleのAI助手が10億規模へ接近
プロダクト・アプリ
cctest.ai

Gemini、月間9.5億ユーザー突破:GoogleのAI助手が10億規模へ接近

Googleは2026年第2四半期の決算説明会で、Geminiの月間ユーザー数が9.5億人を超えたと明らかにした。AIアシスタントの競争は、モデル性能だけでなく、配信力、エコシステム、日常利用の定着をめぐる段階に入っている。

続きを読む
CCTest · Blog
GAMUT:長文生成の「事実の網羅性」を測る新ベンチマーク
モデル評価
cctest.ai
モデル評価

GAMUT:長文生成の「事実の網羅性」を測る新ベンチマーク

GAMUT は、長文回答が正しいだけでなく、必要な事実を十分に含んでいるかを評価するためのベンチマークです。二層のメタルーブリックにより、開放的な生成タスクの複雑な採点を機械評価へ落とし込みます。

続きを読む
CCTest · Blog
Masked Visual Actions:動画モデルをロボット向け世界モデルへ近づける視覚的インターフェース
世界モデル
cctest.ai
世界モデル

Masked Visual Actions:動画モデルをロボット向け世界モデルへ近づける視覚的インターフェース

Masked Visual Actions は、動画内の一部だけ見える軌跡として行動を表す手法です。ロボットの動きを与えれば場面の反応を予測し、望む物体運動を与えればそれに合うロボット動作を生成することを狙います。

続きを読む
CCTest · Blog
逐語起こしを制御可能にするASR研究:転写ポリシーを潜在変数として扱う
音声・オーディオ
cctest.ai
音声・オーディオ

逐語起こしを制御可能にするASR研究:転写ポリシーを潜在変数として扱う

nyra labs の論文は、現代のASRが逐語転写と意図転写を混在したまま学習し、出力や評価、単語レベルの時刻情報を不安定にしていると指摘する。タスクトークンと cross-attention 微調整により、転写スタイルを明示的に制御する方法を提案している。

続きを読む
CCTest · Blog
SAT:古い rollout に応じて信頼領域を調整し、非同期強化学習を安定化
強化学習
cctest.ai
強化学習

SAT:古い rollout に応じて信頼領域を調整し、非同期強化学習を安定化

非同期強化学習はスループットを高める一方、rollout と学習時点の方策がずれるという問題を抱える。SAT はサンプルの陳腐化度に応じて PPO 風のクリップ区間を調整し、高リスクな更新をより保守的に扱う。

続きを読む
CCTest · Blog
HPD-Parsing:文書解析を階層型並列デコードへ移す試み
マルチモーダル
cctest.ai
マルチモーダル

HPD-Parsing:文書解析を階層型並列デコードへ移す試み

PaddleOCR チームの HPD-Parsing は、VLM ベース文書解析に残る「ページ全体を逐次生成する」ボトルネックに焦点を当てる。レイアウトの全体把握とブロック単位の並列解析を分けることで、高いスループットを示した。

続きを読む
CCTest · Blog
DataFlow-Harness:コードエージェントを編集可能なデータパイプライン構築者へ
AIエージェント
cctest.ai
AIエージェント

DataFlow-Harness:コードエージェントを編集可能なデータパイプライン構築者へ

DataFlow-Harness は、自然言語の指示と永続的なデータパイプライン成果物の間にあるギャップを埋めようとする研究です。LLM に自由なスクリプトを書かせるのではなく、プラットフォーム固有の DAG を段階的に構築させます。

続きを読む
CCTest · Blog
AgentDebugX:LLMエージェントの失敗を観測から修復までつなぐ
AIエージェント
cctest.ai
AIエージェント

AgentDebugX:LLMエージェントの失敗を観測から修復までつなぐ

AgentDebugX は、LLM エージェントの失敗を検出・原因特定・修復・再実行のループで扱うオープンソースフレームワークです。エラーが表面化したステップと、実際の原因ステップが異なるという問題に焦点を当てています。

続きを読む