記事とガイド

Claude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ

全 791 件の記事

CCTest · Blog
阿里のDAMO LiON、肝臓の見逃し病変15例をAIで発見
モデルリリース
cctest.ai
モデルリリース

阿里のDAMO LiON、肝臓の見逃し病変15例をAIで発見

阿里巴巴の達摩院などが、造影CTから小さな肝臓の悪性病変を見つけるAIモデルDAMO LiONを開発しました。2か月間の実臨床試験で、初回読影では見逃されていた悪性腫瘍15例の発見を支援したとされています。

続きを読む
CCTest · Blog
若者の言葉は理解できても、心の危機を見逃す対話AI
AIセーフティ
cctest.ai
AIセーフティ

若者の言葉は理解できても、心の危機を見逃す対話AI

新たなベンチマーク研究は、対話モデルが Generation Alpha の語彙を一定程度理解できる一方、臨床的なリスク判断では大きく精度を落とすことを示した。皮肉、過小評価、意味の急な変化が、危機のサインを隠してしまう。

続きを読む
CCTest · Blog
Nexus、ツール仕様の再読み込みを避けるエージェント推論
推論・デプロイ
cctest.ai
推論・デプロイ

Nexus、ツール仕様の再読み込みを避けるエージェント推論

Nexus は、MCP エージェントが毎ターンすべてのツールスキーマを再エンコードする問題を、検索ベースのルーティングによって切り離す。KV キャッシュの連結も試すが、RoPE の位置ずれが適用範囲を制限する。

続きを読む
CCTest · Blog
ハイブリッド思考型MLLMは正解だけでなく応答品質も問われる
モデル評価
cctest.ai
モデル評価

ハイブリッド思考型MLLMは正解だけでなく応答品質も問われる

新しい研究は、ハイブリッド思考型マルチモーダルモデルにおいて、思考モードと非思考モードの応答行動に大きな差があると指摘した。PatternEvalとPatternRLにより、正答率だけでは捉えにくい失敗を評価・低減する。

続きを読む
CCTest · Blog
InfinityEdit、固定動画から無限ストリーム編集へ
視覚・動画
cctest.ai
視覚・動画

InfinityEdit、固定動画から無限ストリーム編集へ

InfinityEdit は、完成済みの短い動画を逐次書き換えるのではなく、編集指示を受けながら未来の映像セグメントを生成する手法です。履歴、時間的因果性、編集テキストを扱う軽量アダプターによって、ストリーミング動画生成への編集機能の追加を目指します。

続きを読む
CCTest · Blog
CLEAR:モデルの有用性を保つ動的なLLM安全アライメント
AIセーフティ
cctest.ai
AIセーフティ

CLEAR:モデルの有用性を保つ動的なLLM安全アライメント

イリノイ大学の研究チームは、安全用LoRAの適用強度を隠れ状態から連続的に調整するCLEARを提案した。Llama-3-8B-Instructでは、HarmBenchの攻撃成功率を大きく下げながら、通常タスクの性能低下を抑えたと報告している。

続きを読む
CCTest · Blog
Llama-Mobile、2.7ビット量子化で視覚言語モデルのモバイル展開を目指す
推論・デプロイ
cctest.ai
推論・デプロイ

Llama-Mobile、2.7ビット量子化で視覚言語モデルのモバイル展開を目指す

Llama-Mobileは、限られたメモリと計算資源しか持たない端末向けに、視覚言語モデルを量子化するフレームワークを提案します。モデル自身が生成したデータとArm CPUでの実行を意識した2.7ビット形式により、Llama 3.2 11B Vision Instructを3.7 GBまで圧縮し、標準的な視覚質問応答で高い性能を維持しました。

続きを読む
CCTest · Blog
AWSがDogwoodをオープンソース化、AIエージェントのツール呼び出しに時系列ポリシー
AIエージェント
cctest.ai
AIエージェント

AWSがDogwoodをオープンソース化、AIエージェントのツール呼び出しに時系列ポリシー

AWSは、AIエージェントの過去の実行履歴を参照できるポリシー言語Dogwoodを公開した。単一リクエストの認可だけでは扱いにくいワークフローや並行実行を対象にする。

続きを読む
CCTest · Blog
Flock Safetyに監視批判、CEOがプライバシーと安全の「妥協」を訴え
政策・規制
cctest.ai
政策・規制

Flock Safetyに監視批判、CEOがプライバシーと安全の「妥協」を訴え

監視技術企業Flock Safetyは、カメラやドローン、自動ナンバープレート認識システムの悪用懸念をめぐり、世論と政治家から批判を受けている。CEOは公共の安全とプライバシーの両立が必要だと主張する。

続きを読む
CCTest · Blog
著作権付き書籍でAIを学習させるのは合法か?複雑な法的論点
政策・規制
cctest.ai
政策・規制

著作権付き書籍でAIを学習させるのは合法か?複雑な法的論点

AIモデルが著作権で保護された書籍を学習に使えるかどうかは、単純な合法・違法の二択ではない。最近の訴訟は、学習行為そのもの、データの入手経路、そしてAI製品が権利者の市場と競合するかを分けて判断しようとしている。

続きを読む
CCTest · Blog
DynamoDBのネイティブベクトル検索は専用DBを置き換えるのか
RAG・検索
cctest.ai
RAG・検索

DynamoDBのネイティブベクトル検索は専用DBを置き換えるのか

Amazon DynamoDBがネイティブのベクトル検索に対応し、埋め込みベクトルと業務データを同じテーブルに保存できるようになった。AIアプリの構成は簡素化できるが、専用ベクトルデータベースが直ちに不要になるわけではない。

続きを読む
CCTest · Blog
ローカル27Bモデルが複雑なリバースエンジニアリングを完遂
AIセーフティ
cctest.ai
AIセーフティ

ローカル27Bモデルが複雑なリバースエンジニアリングを完遂

XDAの編集者は、Qwen 3.8 27Bに商用アプリのライセンス認証を完全オフラインで分析させた。モデルは隠された検証情報を復元し、最初の誤りを自力で修正したうえで、動作する概念実証まで作成した。

続きを読む
CCTest · Blog
ハーバードの699ドル起業講座、講師のAIアバターでピッチを添削
AI教育
cctest.ai
AI教育

ハーバードの699ドル起業講座、講師のAIアバターでピッチを添削

ハーバード・ビジネス・スクールのHBS Foundryは、HeyGenで作成した講師のAIアバターを、模擬ピッチや取締役会の練習に活用している。チャットボットよりも誘導性の高い学習体験を目指す試みだ。

続きを読む
CCTest · Blog
DeepMind卒業生のInherent、小型モデルでAI科学者を目指す
AI科学研究
cctest.ai
AI科学研究

DeepMind卒業生のInherent、小型モデルでAI科学者を目指す

ロンドンのスタートアップInherentは、研究論文の結果を自律的に再現する課題で、FaradayがAnthropicやOpenAIの大規模モデルを上回ったと発表した。注目点は勝敗だけでなく、AIに研究判断を学習させようとしている点にある。

続きを読む