記事とガイド

Claude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ

全 795 件の記事

CCTest · Blog
Masked Diffusion LMはAgent強化学習向けの新しいテキスト世界モデルになるか
世界モデル
cctest.ai
世界モデル

Masked Diffusion LMはAgent強化学習向けの新しいテキスト世界モデルになるか

この論文は、Masked Diffusion Language Modelsをテキストベースの世界モデルとして用いることで、自回帰モデルの左から右への生成バイアスを緩和できると主張している。工具スキーマ、過去の対話、期待される結果などのグローバルな制約を保ちやすい点が焦点だ。

続きを読む
CCTest · Blog
GigaChat Audio:長時間音声を時間付きで理解するオープンLLM
音声・オーディオ
cctest.ai
音声・オーディオ

GigaChat Audio:長時間音声を時間付きで理解するオープンLLM

長い録音で「何が起きたか」だけでなく「いつ起きたか」まで答えることを目指した音声LLMです。最大120分の入力に対して、明示的なタイムスタンプ付きで応答できます。 周期的な時間マーカーを音声トークンと交互に入れ、合成データで学習させる設計が特徴です。

続きを読む
CCTest · Blog
TOPLはオフポリシー後学習を「トークンごとの判定」に変える
大規模言語モデル
cctest.ai
大規模言語モデル

TOPLはオフポリシー後学習を「トークンごとの判定」に変える

本論文は、オフポリシー生成をそのまま模倣するのではなく、各トークンが正しいかどうかを学習するTOPLを提案する。要約と翻訳の両方で、分布ずれに対する頑健性が示された。

続きを読む
CCTest · Blog
TimeLens2:動画MLLMに「根拠がいつ起きたか」を示させる
視覚・動画
cctest.ai
視覚・動画

TimeLens2:動画MLLMに「根拠がいつ起きたか」を示させる

TimeLens2 は、動画の時間的グラウンディングを可変数の区間集合として扱い、モデルが出来事だけでなく根拠となる時間帯も示せるようにする研究です。2B、4B、8B の各モデルは Qwen3-VL バックボーンから大きな改善を示しています。

続きを読む
CCTest · Blog
LLMは結合分子を“夢見る”のか:3D-Fitが測る創薬向け空間推論
AI科学研究
cctest.ai
AI科学研究

LLMは結合分子を“夢見る”のか:3D-Fitが測る創薬向け空間推論

3D-Fitは、構造ベース創薬において汎用LLMが三次元の空間制約を満たすリガンドを生成できるかを評価する新しいベンチマークです。結果は有望さを示す一方、専用拡散モデルとの差も明確にしています。

続きを読む
CCTest · Blog
EvolvingWorld:キャラクターと世界が共進化する文学世界フレームワーク
世界モデル
cctest.ai
世界モデル

EvolvingWorld:キャラクターと世界が共進化する文学世界フレームワーク

EvolvingWorldは、単発の会話生成ではなく、物語の進行に合わせて人物と世界の状態が更新され続ける仕組みを提案する。静的な人物模倣から、長期的な整合性を重視する方向へ踏み出した研究だ。

続きを読む
CCTest · Blog
ReflectWorld-MM、動画記憶を「フレーム」から「実体」へ
メモリ・コンテキスト
cctest.ai

ReflectWorld-MM、動画記憶を「フレーム」から「実体」へ

ReflectWorld-MM は、連続する動画の中で誰が何度現れ、何が変わったのかを、実体単位で記憶することを狙った研究です。動画を切り出して保存する発想から、世界の出来事を整理して覚える発想へと移っています。

続きを読む
CCTest · Blog
DiffGI:薄い殻状 3D 生成を可微分なジオメトリ画像で扱う
拡散モデル
cctest.ai
拡散モデル

DiffGI:薄い殻状 3D 生成を可微分なジオメトリ画像で扱う

DiffGI は、衣服のような薄い殻状・非多様体の 3D 形状を、従来の体積表現ではなく表面中心の 2D ジオメトリ画像として扱う手法です。連続 2D TSDF と可微分 Marching Squares により、2D 潜在空間と 3D 表面損失を直接つなげます。

続きを読む
CCTest · Blog
人間中心から Agentic Code Review へ:AI はレビューを速くするが、品質向上は限定的
コーディングAI
cctest.ai
コーディングAI

人間中心から Agentic Code Review へ:AI はレビューを速くするが、品質向上は限定的

207 件の GitHub プロジェクトと 102 万件のレビュー済み Pull Request を分析した研究は、AI Agent の参加がレビュー判断を速める一方で、品質改善には一貫した効果が見られないと報告している。

続きを読む
CCTest · Blog
CPO:エントロピーを超える正しさ認識型 RLVR の提案
強化学習
cctest.ai
強化学習

CPO:エントロピーを超える正しさ認識型 RLVR の提案

この論文は、RLVR におけるエントロピー中心の advantage shaping の限界を指摘し、Contrastive Policy Optimization(CPO)を提案している。参照誘導生成と通常生成の token レベルの分布差を使い、より正しさに近い学習信号を作る点が特徴だ。

続きを読む
CCTest · Blog
RecGPT-V3:推薦システムを「履歴の再生」から「記憶する意図理解」へ
メモリ・コンテキスト
cctest.ai

RecGPT-V3:推薦システムを「履歴の再生」から「記憶する意図理解」へ

RecGPT-V3 は、ユーザー記憶、Semantic IDs による商品 grounding、潜在トークンによる効率的推論を組み合わせた産業向け LLM 推薦システムです。淘宝の「Guess What You Like」フィードで、GMV +3.97% と serving リソース消費 52.4% 削減が報告されています。

続きを読む
CCTest · Blog
TokaMark が示す核融合診断 AI の弱点:センサー故障時の頑健性を体系評価
AI科学研究
cctest.ai
AI科学研究

TokaMark が示す核融合診断 AI の弱点:センサー故障時の頑健性を体系評価

この研究は、プラズマ診断モデルをクリーンな入力だけでなく、現実的なセンサー故障条件で評価する。特に破壊現象に近いタイミングの信号劣化が、系列モデルに大きな影響を与えることが示された。

続きを読む