記事とガイド

Claude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ

全 811 件の記事

CCTest · Blog
雲天励飛の推論チップ構想、焦点はピーク性能からTokenコストへ
計算資源・チップ
cctest.ai
計算資源・チップ

雲天励飛の推論チップ構想、焦点はピーク性能からTokenコストへ

雲天励飛は、Prefill、Decode、Decode段階のFFNに最適化した3種類のDeepVerse推論チップ計画を示した。狙いは単体チップの性能競争ではなく、異種混在クラスタによるToken生成コストの低減にある。

続きを読む
CCTest · Blog
ロボットはなぜ「人の作業動画」を見始めたのか:Riemann-1.0の示す方向性
ロボティクス・フィジカルAI
cctest.ai

ロボットはなぜ「人の作業動画」を見始めたのか:Riemann-1.0の示す方向性

黎曼動力が発表した Riemann-1.0 は、RoboCasa-365 で 62.6% の成功率を記録した。注目点はスコアだけではなく、人間の一人称作業動画を大量に使い、ロボット動作へ接続する学習手法にある。

続きを読む
CCTest · Blog
Kimi新モデルが示した、オープンAIと地政学リスクの交差点
オープンソース
cctest.ai
オープンソース

Kimi新モデルが示した、オープンAIと地政学リスクの交差点

Moonshot AIの新しいKimiモデルは、中国発のオープンウェイトAIをめぐる議論を再燃させた。焦点は性能だけでなく、開放された高性能モデルを誰が信頼し、誰が規制するのかに移っている。

続きを読む
CCTest · Blog
Kimi K3 がモデル広場に登場:Agent 向けの大型オープンモデル
AIエージェント
cctest.ai
AIエージェント

Kimi K3 がモデル広場に登場:Agent 向けの大型オープンモデル

Kimi K3 は公開直後にモデル広場へ掲載され、注目を集めました。話題の中心は、巨大なパラメータ数だけでなく、コーディングや長時間タスク、検索、表計算、フロントエンドまで広くこなす点です。

続きを読む
CCTest · Blog
AIエージェント時代、クラウド請求アラートはなぜ間に合わないのか
AIセーフティ
cctest.ai
AIセーフティ

AIエージェント時代、クラウド請求アラートはなぜ間に合わないのか

AWS の複数事例は、AI エージェントや生成 AI 用の認証情報が暴走・漏えいした場合、請求データの反映前に高額費用が発生し得ることを示している。従来型の予算アラートだけでは、API 速度の消費を止めにくい。

続きを読む
CCTest · Blog
TTCD:各トークンに異なる「時間」を持たせる連続拡散型言語モデル
拡散モデル
cctest.ai
拡散モデル

TTCD:各トークンに異なる「時間」を持たせる連続拡散型言語モデル

Token Time Continuous Diffusion(TTCD)は、連続空間で動作し、トークンごとに異なる生成時間を導入する拡散型言語モデルです。高速生成時の品質低下を抑え、条件付き生成での改善を狙います。

続きを読む
CCTest · Blog
DeepLoop:ループ型 Transformer の深さ拡張を安定化する手法
大規模言語モデル
cctest.ai
大規模言語モデル

DeepLoop:ループ型 Transformer の深さ拡張を安定化する手法

DeepLoop は、同じ Transformer ブロックを繰り返し使うと残差スケーリングの前提が変わる点に注目した研究です。名目上の層数だけでなく、パラメータが何度訪問されるかを考慮した設計を提案しています。

続きを読む
CCTest · Blog
KV Cache を“接ぎ木”する:凍結小型モデルに検証済み知識を再利用させる手法
メモリ・コンテキスト
cctest.ai

KV Cache を“接ぎ木”する:凍結小型モデルに検証済み知識を再利用させる手法

新しい論文は、検証済みの知識をバイト単位で一致する KV Cache 状態として保存し、後の推論に接ぎ木する方法を提案している。繰り返し問題では大きな効率化を示す一方、再現性と能力向上の解釈には注意が必要だ。

続きを読む
CCTest · Blog
VideoChat3:汎用動画理解に向けた完全オープンな動画 MLLM
視覚・動画
cctest.ai
視覚・動画

VideoChat3:汎用動画理解に向けた完全オープンな動画 MLLM

VideoChat3 は、オープンソース動画 MLLM の課題である汎化性能、計算コスト、公開範囲の不十分さに取り組むモデルです。4B パラメータ規模で、一般動画、長尺動画、ストリーミング動画を横断する理解能力を狙います。

続きを読む
CCTest · Blog
UniVR:視覚空間で推論・物理・計画を統合的に学ぶ試み
世界モデル
cctest.ai
世界モデル

UniVR:視覚空間で推論・物理・計画を統合的に学ぶ試み

UniVR は、画像テキスト対に頼らず、純粋な視覚デモから複雑な推論、物理ダイナミクス、長期計画を同時に学ぶことを目指す研究です。中核には VR-GRPO と、純視覚評価のための VR-X ベンチマークがあります。

続きを読む
CCTest · Blog
LongStraw:固定 GPU 予算で 200 万 Token 超の長文脈 RL を実行
強化学習
cctest.ai
強化学習

LongStraw:固定 GPU 予算で 200 万 Token 超の長文脈 RL を実行

LongStraw は、百万 token 級の推論能力と短い文脈に留まりがちな RL 後学習のギャップを埋めようとする実行スタックです。共有プロンプトを勾配なしで処理し、応答分岐を再実行することでメモリ負荷を抑えます。

続きを読む
CCTest · Blog
GRASP:Agentic RAGに検索粒度の判断を学習させる
RAG・検索
cctest.ai
RAG・検索

GRASP:Agentic RAGに検索粒度の判断を学習させる

GRASPは、Agentic RAGが「いつ検索するか」「どの検索手段を使うか」「どこまで文脈を読むか」を学習するための強化学習フレームワークです。意味検索、キーワード検索、段落読解を組み合わせ、多段推論での証拠取得と回答品質の向上を狙います。

続きを読む
CCTest · Blog
Databricks、評価額1880億ドルへ:データ企業のAI転身が資本を呼び込む
ビジネス・資金調達
cctest.ai

Databricks、評価額1880億ドルへ:データ企業のAI転身が資本を呼び込む

Databricksは新たな資金調達で評価額1880億ドルに達したと発表し、データ分析企業からエンタープライズAI基盤企業への転身をさらに印象づけた。加えて、オープンウェイトモデルを使ったコーディングAIのコスト評価も同社のAI戦略を補強している。

続きを読む
CCTest · Blog
Zoom名を「録音しないで」に変える小技が映すAI議事録時代の違和感
プロダクト・アプリ
cctest.ai

Zoom名を「録音しないで」に変える小技が映すAI議事録時代の違和感

Zoomの表示名に「録音・文字起こしに同意しない」と書く小さな抵抗が、AIノートアプリ普及後の大きな問題を象徴している。会議だけでなく雑談やデートまで記録される時代に、同意と信頼の境界が揺れている。

続きを読む
CCTest · Blog
Agility Robotics、テスラの近くに訓練拠点 人型ロボットは実用段階へ
ロボティクス・フィジカルAI
cctest.ai

Agility Robotics、テスラの近くに訓練拠点 人型ロボットは実用段階へ

Agility Robotics はカリフォルニア州 Fremont に 6 万平方フィートの訓練施設を開設し、Digit の製造・物流現場への展開を加速する。テスラ Optimus の大きな構想に対し、同社はすでに収益を生む実運用を前面に出している。

続きを読む