記事とガイド

Claude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ

全 795 件の記事

CCTest · Blog
空間認知を「描いて答える」評価へ:ProVisE の狙い
モデル評価
cctest.ai
モデル評価

空間認知を「描いて答える」評価へ:ProVisE の狙い

ProVisE は、空間推論タスクを文字や座標だけで評価することの限界に注目する。画像生成モデルにピクセル上で印を付けたり線を描かせたりし、その視覚的回答を既存ベンチマークの採点形式へ変換する枠組みだ。

続きを読む
CCTest · Blog
NVIDIA NOOA:AIエージェントをPythonオブジェクトとして扱う新しい設計
AIエージェント
cctest.ai
AIエージェント

NVIDIA NOOA:AIエージェントをPythonオブジェクトとして扱う新しい設計

NVIDIA Labs は、AIエージェントをネイティブな Python オブジェクトとして記述するフレームワーク NOOA を提案した。プロンプト、ツール定義、コールバック、ワークフロー図に分散しがちな開発を、クラス、メソッド、フィールド、型注釈という馴染みのある構造に寄せる狙いがある。

続きを読む
CCTest · Blog
OpenForgeRL:実運用の Harness 上で Agent を強化学習する枠組み
AIエージェント
cctest.ai
AIエージェント

OpenForgeRL:実運用の Harness 上で Agent を強化学習する枠組み

OpenForgeRL は、Codex や OpenClaw のような複雑な推論 harness を、既存のオープンな RL 訓練基盤につなぐためのフレームワークです。モデル呼び出しを代理で記録し、Kubernetes で rollout を分離実行することで、実環境に近い形で Agent を訓練します。

続きを読む
CCTest · Blog
LLMは変化するユーザー意図をなぜ見失うのか
モデル評価
cctest.ai
モデル評価

LLMは変化するユーザー意図をなぜ見失うのか

新しい論文は、単発タスクで高い性能を示すLLMでも、実際の対話で変化し続けるユーザー意図を追跡できるとは限らないと指摘する。著者らは既存の静的ベンチマークを動的な多ターン対話へ変換する評価枠組みを提案した。

続きを読む
CCTest · Blog
SANA-Video 2.0:混合注意機構で高解像度動画生成を高速化
視覚・動画
cctest.ai
視覚・動画

SANA-Video 2.0:混合注意機構で高解像度動画生成を高速化

SANA-Video 2.0 は、線形注意の効率性と softmax 注意の表現力を組み合わせた動画拡散 Transformer です。論文では、単一 H100 上で 720p までの高品質動画生成を狙い、長い動画ほど速度面の利点が広がると報告されています。

続きを読む
CCTest · Blog
Prentisが1億ドル調達交渉、業務PC操作AIエージェントに賭ける
ビジネス・資金調達
cctest.ai

Prentisが1億ドル調達交渉、業務PC操作AIエージェントに賭ける

Ritankar Das、Reid Hoffman、Mark Pincusが共同創業した新AIラボPrentisが、10億ドル評価で1億ドルの資金調達を協議していると報じられた。狙うのは、コーディング支援ではなく日常的なオフィス作業の自動化だ。

続きを読む
CCTest · Blog
AlphaFoldで遺伝子編集タンパク質を再設計、CRISPRの脱標的編集を低減
AI科学研究
cctest.ai
AI科学研究

AlphaFoldで遺伝子編集タンパク質を再設計、CRISPRの脱標的編集を低減

研究チームは AlphaFold を使い、Cas タンパク質がミスマッチを含む DNA をどう許容するかを解析した。特定のアミノ酸を置換することで、標的編集活性を保ちながら脱標的活性を下げる変異体を得た。

続きを読む
CCTest · Blog
Meta AIが個人アシスタント化へ:カレンダー要約と調査機能を強化
AIエージェント
cctest.ai
AIエージェント

Meta AIが個人アシスタント化へ:カレンダー要約と調査機能を強化

Meta は自社の AI チャットボットを、質問応答や画像生成にとどまらない生産性ツールへ近づけている。新機能では、カレンダーに基づく日次ブリーフィング、イベント計画、継続タスク、方向修正できる調査が追加される。

続きを読む
CCTest · Blog
Claude Opus 5発表:コスト効率を重視した日常向けフロンティアモデル
モデルリリース
cctest.ai
モデルリリース

Claude Opus 5発表:コスト効率を重視した日常向けフロンティアモデル

AnthropicはClaude Opus 5を公開し、Claude Fable 5に近い知能を約半分のコストで提供する日常利用向けモデルとして位置づけた。コーディング、業務自動化、知識労働、科学ワークフローでの改善が強調されている。

続きを読む
CCTest · Blog
米国の中国AI対応を前に、業界がオープンウェイト規制に警鐘
政策・規制
cctest.ai
政策・規制

米国の中国AI対応を前に、業界がオープンウェイト規制に警鐘

米国が中国AIへの対応やモデル蒸留をめぐる疑惑を検討するなか、複数のAI企業がオープンウェイトモデルへの広範な制限に反対した。焦点は、安全保障、知財保護、そしてオープンなAIエコシステムの将来にある。

続きを読む
CCTest · Blog
米国の「Genesis Mission」は科学研究をAI中心に組み替えるのか
AI科学研究
cctest.ai
AI科学研究

米国の「Genesis Mission」は科学研究をAI中心に組み替えるのか

トランプ政権は、AI駆動型の科学研究に50億ドルを投じる「Genesis Mission」初回助成を発表した。研究者の懸念は、AI活用そのものよりも、科学政策が政治とシリコンバレー型の成果主義に傾く点にある。

続きを読む
CCTest · Blog
UniWorld-ViewがWorldScore首位に:1枚の画像から制御可能な新視点動画へ
世界モデル
cctest.ai
世界モデル

UniWorld-ViewがWorldScore首位に:1枚の画像から制御可能な新視点動画へ

兔展智能、北京大学、鵬城実験室が開発した UniWorld-View が、李飛飛氏のチームに関連する WorldScore ランキングで首位に立った。単一画像または単眼動画から、指定したカメラ軌道に沿う新視点動画を生成できる点が注目されている。

続きを読む
CCTest · Blog
Kimi K3がウォール街を揺らした理由:オープンモデルとAI安全性の新たな警告
AIセーフティ
cctest.ai
AIセーフティ

Kimi K3がウォール街を揺らした理由:オープンモデルとAI安全性の新たな警告

MoonshotのオープンモデルKimi K3は、モデルそのもの以上に米国AI業界の反応によって注目を集めた。さらにOpenAIの未公開モデルがHugging Faceの実際の侵害事案に関係したことで、AIリスクは地政学だけでは語れないことが浮き彫りになった。

続きを読む
CCTest · Blog
AIデータセンター拡張でEPA規則変更案、住民参加が縮小する可能性
政策・規制
cctest.ai
政策・規制

AIデータセンター拡張でEPA規則変更案、住民参加が縮小する可能性

米EPAは、一部の大気汚染「小規模発生源」許可について、住民参加の扱いを州に委ねる規則変更を検討している。ガス発電やディーゼル発電を利用するデータセンター計画に影響する可能性がある。

続きを読む
CCTest · Blog
OpenAI、新音声モードをChatGPTデスクトップ版へ:会話からエージェント操作へ
AIエージェント
cctest.ai
AIエージェント

OpenAI、新音声モードをChatGPTデスクトップ版へ:会話からエージェント操作へ

OpenAIはChatGPTデスクトップアプリに新しいChatGPT Voiceを追加し、ユーザーが音声でChatGPT WorkやCodex、コンピューター操作機能を指示できるようにした。音声は単なる対話手段ではなく、複数ステップの作業を動かすインターフェースになりつつある。

続きを読む
CCTest · Blog
フィールズ賞受賞の Tsimerman 氏が OpenAI へ、AI 安全研究に転身
AIセーフティ
cctest.ai
AIセーフティ

フィールズ賞受賞の Tsimerman 氏が OpenAI へ、AI 安全研究に転身

OSChina の要約によると、2026 年のフィールズ賞受賞者に選ばれた Jacob Tsimerman 氏が、AI 安全研究へ軸足を移し OpenAI に加わると表明した。基礎数学のトップ人材が AI 安全へ流入していることを示す動きだ。

続きを読む
CCTest · Blog
シリコンバレーの新興企業約200社、中国発オープンAIモデルの遮断に反対
政策・規制
cctest.ai
政策・規制

シリコンバレーの新興企業約200社、中国発オープンAIモデルの遮断に反対

OSChina の要約によると、シリコンバレーの新興企業約200社がホワイトハウスに書簡を送り、中国発のオープンソースAIモデルへのアクセスを断たないよう求めた。論点は、安全保障だけでなく、スタートアップの開発コストと競争環境にも及んでいる。

続きを読む