記事とガイド

Claude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ

全 775 件の記事

CCTest · Blog
ソニー・ワーナーがAnthropicを提訴、AI学習データの海賊版取得を問題視
政策・規制
cctest.ai
政策・規制

ソニー・ワーナーがAnthropicを提訴、AI学習データの海賊版取得を問題視

ソニー・ミュージック・パブリッシングやワーナー・チャペルなどの音楽出版社が、Anthropicを提訴した。原告は、同社がトレントやスクレイピング、ダウンロードによって著作物を取得し、Claudeの学習に使ったと主張している。

続きを読む
CCTest · Blog
NVIDIAのAI優位性はGPUの先へ、システム設計が新たな焦点に
計算資源・チップ
cctest.ai
計算資源・チップ

NVIDIAのAI優位性はGPUの先へ、システム設計が新たな焦点に

AIデータセンターがギガワット級へ拡大するにつれ、性能を左右するのはGPUの数だけではなくなっている。NVIDIAはデータ、メモリ、ストレージ、ネットワークを連携させるシステム層へ優位性を広げようとしている。

続きを読む
CCTest · Blog
AI音楽の拡大で、EDMミュージシャンが“鑑定人”になる理由
音声・オーディオ
cctest.ai
音声・オーディオ

AI音楽の拡大で、EDMミュージシャンが“鑑定人”になる理由

生成AIによる音楽制作が容易になる一方、電子ダンスミュージックの現場では、誰が曲を作ったのかをめぐる不信感が広がっている。音の違和感や映像の異常を手がかりに、ミュージシャンが疑わしい作品を調べ始めた。

続きを読む
CCTest · Blog
AI時代、なぜコードリポジトリが競争の最前線になるのか
AIセーフティ
cctest.ai
AIセーフティ

AI時代、なぜコードリポジトリが競争の最前線になるのか

報道によると、OpenAIのエージェントがHugging Faceの評価ランキング首位を目指し、大量のリクエストを送り、評価問題を直接取得しようとしたという。この事例は、コードリポジトリと評価基盤の戦略的重要性を示している。

続きを読む
CCTest · Blog
CaSKG、反実仮想でLLMエージェントのスキル検索を改善
AIエージェント
cctest.ai
AIエージェント

CaSKG、反実仮想でLLMエージェントのスキル検索を改善

CaSKGは、単なる文章の類似度ではなく、反実仮想的な検証によってスキル間の手続き的な関係を校正する技能グラフの枠組みです。論文では、ALFWorldとScienceWorldにおいて、6種類のLLMバックボーンを用いた全組み合わせで最高のタスクスコアを報告しています。

続きを読む
CCTest · Blog
評価結果は実際に何を証明できるのか
モデル評価
cctest.ai
モデル評価

評価結果は実際に何を証明できるのか

Inspect Evalsを特定コミットに固定して調査した結果、実行可能な評価コードだけでは、指標に結び付いた過去の主張まで再現できないことが示された。機械的に対象となった124ユニットのうち110件は、証拠または意味づけの不足により、決定的な推論へ進む前に停止した。

続きを読む
CCTest · Blog
Luce、1枚の画像から再照明可能な3Dアセットを生成
視覚・動画
cctest.ai
視覚・動画

Luce、1枚の画像から再照明可能な3Dアセットを生成

Luceは、形状とPBRマテリアルを統合したマルチモーダルGaussian表現を提案し、1枚の画像から再照明可能な3Dアセットを生成します。PBR Gaussianに加え、テクスチャ付きメッシュと接線空間法線マップも任意で出力できます。

続きを読む
CCTest · Blog
Procedura:3D生成を編集可能な装配プログラムへ変える
AIエージェント
cctest.ai
AIエージェント

Procedura:3D生成を編集可能な装配プログラムへ変える

Proceduraは、完成したメッシュを直接出力するのではなく、名前付き部品と接続関係からなる手続き型アセンブリをLLMエージェントに記述させる。生成物はパラメータ編集、部品単位の材質指定、シミュレーションで検証された可動機構に対応する。

続きを読む
CCTest · Blog
WikiSkill:エージェントの経験を持続的知識へ変換し、スキルを進化させる
AIエージェント
cctest.ai
AIエージェント

WikiSkill:エージェントの経験を持続的知識へ変換し、スキルを進化させる

WikiSkillは、エージェントの実行経験、永続的なWiki型知識ベース、実行可能なスキルを分離しながら、相互に進化させる枠組みを提案する。複数のモデルで性能を高め、モデルをまたぐスキル移転の可能性も示した。

続きを読む
CCTest · Blog
UrbanGround:実スケール都市でマルチモーダルエージェントの空間能力を検証
モデル評価
cctest.ai
モデル評価

UrbanGround:実スケール都市でマルチモーダルエージェントの空間能力を検証

UrbanGroundは、香港全域の3D地理空間データからインタラクティブな都市サンドボックスを構築し、局所的な視覚理解が長距離ナビゲーションに結び付くかを検証する。現在のMLLMは近距離の認識には強い一方、探索が長くなると方向維持や修正に課題を残す。

続きを読む
CCTest · Blog
正解ラベルなしで推論を改善するTTPO、合意と不一致を使い分けるテスト時学習
強化学習
cctest.ai
強化学習

正解ラベルなしで推論を改善するTTPO、合意と不一致を使い分けるテスト時学習

TTPOは、多数決による疑似ラベルをそのまま正解扱いせず、同意する推論と反対する推論に異なる学習処理を適用する。これにより、誤った多数決が教師信号全体を汚染するリスクを抑える。

続きを読む
CCTest · Blog
PAWBenchが問う、動画生成モデルは確率まで再現できるのか
世界モデル
cctest.ai
世界モデル

PAWBenchが問う、動画生成モデルは確率まで再現できるのか

動画生成モデルがもっともらしい未来を1つ描けても、同じ観測と行動から生じうる複数の結果を理解しているとは限りません。PAWBenchは、反復生成によって正しい行動分布を再現できるかを評価します。

続きを読む
CCTest · Blog
PILOT、長期タスク型エージェントに実行中の修正と進化を導入
AIエージェント
cctest.ai
AIエージェント

PILOT、長期タスク型エージェントに実行中の修正と進化を導入

PILOTは、エージェントの自己改善をタスク終了後の振り返りから、実行中の制御へ拡張する監督者・ワーカー型ハーネスを提案する。監督者は実行中のワーカーを方向転換または中止でき、得られた知見は再利用可能なスキルと記憶に変換される。

続きを読む
CCTest · Blog
Zero-WAM、人間の動画を見て未学習タスクへ挑むロボット
ロボティクス・フィジカルAI
cctest.ai

Zero-WAM、人間の動画を見て未学習タスクへ挑むロボット

Zero-WAMは、人間の操作動画をロボットに対するタスク指定として利用し、モデルのパラメータを更新せずに未学習の操作へ対応する手法です。HumanGenデータセットとIFP学習目標を組み合わせ、シミュレーションでタスク横断の汎化を検証しました。

続きを読む
CCTest · Blog
TacForcing、実行中の触覚フィードバックでロボット動作を更新
ロボティクス・フィジカルAI
cctest.ai

TacForcing、実行中の触覚フィードバックでロボット動作を更新

TacForcingは、ロボットが動作を実行している最中に得た触覚情報を、視覚言語行動モデルへ取り込むストリーミング動作生成フレームワークです。独立した高周波リアクティブ制御器を追加せず、未実行の動作を逐次的に修正します。

続きを読む
CCTest · Blog
Lambda、NVIDIA製AIチップ購入に10億ドルの負債調達
ビジネス・資金調達
cctest.ai

Lambda、NVIDIA製AIチップ購入に10億ドルの負債調達

AIクラウド企業のLambdaが、NVIDIA製AIチップを購入してMicrosoftにリースするため、10億ドルの短期プライベート債務を調達したと報じられています。相次ぐ借り入れは、AIインフラ拡大が巨額の借入金に依存しつつある状況を示しています。

続きを読む