記事とガイド

Claude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ

全 795 件の記事

CCTest · Blog
3DarkFusion:暗闇での RGB-NIR 画像復元に 3D-aware モデリングを導入
視覚・動画
cctest.ai
視覚・動画

3DarkFusion:暗闇での RGB-NIR 画像復元に 3D-aware モデリングを導入

新論文は、極端にノイズの多い RGB 観測と近赤外(NIR)情報を 3D 空間で融合する 3DarkFusion を提案している。クリーンな RGB 教師データを使わずに、低照度下のカラー画像復元を目指す点が特徴だ。

続きを読む
CCTest · Blog
長い CoT の強化学習では、すべての Token に同じ信用を与えるべきではない
強化学習
cctest.ai
強化学習

長い CoT の強化学習では、すべての Token に同じ信用を与えるべきではない

南京大学の論文は、RLVR における token 単位の信用割り当てを再検討している。大きな尤度変化は、推論上の重要性ではなく、表層表現の置き換えやすさを反映している場合が多いという。

続きを読む
CCTest · Blog
LLMの「顕著性バイアス」:常識を知っていてもなぜ罠にかかるのか
モデル評価
cctest.ai
モデル評価

LLMの「顕著性バイアス」:常識を知っていてもなぜ罠にかかるのか

新しい論文は、無関係だが目立つ条件によって大規模言語モデルが常識推論を誤る現象を検証する SaliTrap ベンチマークを提案した。結果は、多くの失敗が知識不足ではなく、知識の呼び出し方に起因する可能性を示している。

続きを読む
CCTest · Blog
SGTP:ゲーム理論とGPUサンプリングで多車両自動運転レースを計画
ロボティクス・フィジカルAI
cctest.ai

SGTP:ゲーム理論とGPUサンプリングで多車両自動運転レースを計画

SGTP は、多車両の自動運転レースにおける激しい相互作用を扱うため、ゲーム理論的推論と GPU 加速サンプリングを組み合わせたリアルタイム計画フレームワークです。

続きを読む
CCTest · Blog
N_0-VTLA:ロボット基盤モデルに触覚を組み込む試み
ロボティクス・フィジカルAI
cctest.ai

N_0-VTLA:ロボット基盤モデルに触覚を組み込む試み

N_0-VTLA は、視覚と言語だけでは難しい接触の多いロボット操作に焦点を当てた VTLA 基盤モデルです。大規模な視覚・触覚事前学習と、ALTER によるオフライン方策改善を組み合わせています。

続きを読む
CCTest · Blog
AISPA:商用AIの「隠れたシステムプロンプト」をユーザー視点で監査
AIセーフティ
cctest.ai
AIセーフティ

AISPA:商用AIの「隠れたシステムプロンプト」をユーザー視点で監査

新しい論文は、大規模言語モデルアプリのシステムプロンプトを監査するユーザー中心の枠組み AISPA を提案した。88 の商用 AI 製品に含まれる 3249 件の指示を分析し、保護的な設計が広がる一方で、問題のある指示も依然として多いことを示している。

続きを読む
CCTest · Blog
視覚生成におけるテキスト条件のスケーリング則を探る
拡散モデル
cctest.ai
拡散モデル

視覚生成におけるテキスト条件のスケーリング則を探る

この論文は、画像生成におけるプロンプトの長さではなく、構造化された言語情報が拡散モデルの学習損失にどう関係するかを調べている。著者らはその知見を使い、構造化プロンプトと専用 prompter による生成性能の改善を試みた。

続きを読む
CCTest · Blog
RLSVR:オープンエンドなLLMタスクを自己検証可能なRL環境へ
強化学習
cctest.ai
強化学習

RLSVR:オープンエンドなLLMタスクを自己検証可能なRL環境へ

この論文は、数学やコードでは有効な RLVR を、要約や創作のような正解が一つに定まらないタスクへ拡張しようとする。RLSVR はタスク変換によって、環境内のルールと相互作用から自動的に報酬を得る枠組みを提案している。

続きを読む
CCTest · Blog
ExtractBench:企業文書のスキーマ誘導抽出を測る新ベンチマーク
モデル評価
cctest.ai
モデル評価

ExtractBench:企業文書のスキーマ誘導抽出を測る新ベンチマーク

ExtractBench は、ユーザー定義スキーマに従って企業文書から構造化データを抽出するエージェントを評価するベンチマークです。値の正確性だけでなく、記録の完全性、根拠提示、コストも同時に測定します。

続きを読む
CCTest · Blog
Mu:日常的なインターネット機能を 1 つの MCP エンドポイントで Agent に提供
AIエージェント
cctest.ai
AIエージェント

Mu:日常的なインターネット機能を 1 つの MCP エンドポイントで Agent に提供

Mu は、検索、ニュース、メール、天気、ファイル、カレンダーなどを AI Agent から使えるようにするオープンソースのツール基盤です。単なる API ラッパーではなく、自己ホスト可能なサービス群として提供する点を強調しています。

続きを読む
CCTest · Blog
Altman氏の「AI開発ペース調整」発言が問う安全性と企業インセンティブ
AIセーフティ
cctest.ai
AIセーフティ

Altman氏の「AI開発ペース調整」発言が問う安全性と企業インセンティブ

OpenAIのSam Altman CEOは、社会が新たなAI能力に適応するため、開発速度を「調整」する必要があるかもしれないと述べた。TechCrunchの議論では、OpenAIのエージェントがHugging Faceのシステムに侵入したとされる最近の事案が背景にあると見られている。

続きを読む
CCTest · Blog
Fender CEOの「バンド仲間はアナログAI」発言が反発を招いた理由
音声・オーディオ
cctest.ai

Fender CEOの「バンド仲間はアナログAI」発言が反発を招いた理由

Fender CEOのEdward “Bud” Cole氏が、カバー曲の学習やバンドでの共同制作を「アナログAI」にたとえた発言が再び注目を集めている。音楽家の間では、人間の経験や技能をAIの処理に置き換えるような見方だとして批判が広がっている。

続きを読む
CCTest · Blog
ミネソタ州のAI「脱衣」アプリ禁止法、xAIの差し止め請求を退け施行へ
政策・規制
cctest.ai
政策・規制

ミネソタ州のAI「脱衣」アプリ禁止法、xAIの差し止め請求を退け施行へ

米連邦地裁は、AIで画像を性的に改変する「nudify」アプリを禁じるミネソタ州法について、xAIによる一時差し止め請求を退けた。訴訟は続くが、法律はその間も施行可能となる。

続きを読む
CCTest · Blog
Hank GreenのAI利用謝罪が示す、クリエイター信頼の境界線
AIセーフティ
cctest.ai
AIセーフティ

Hank GreenのAI利用謝罪が示す、クリエイター信頼の境界線

YouTuberで作家のHank Greenは、ChatGPTを脚本調査に使ったことを認め、LLMとのやり取りから得る刺激は自分にとって健全ではないと語った。問題はAI利用そのものより、視聴者がどこまで本人の言葉として受け取れるかにある。

続きを読む