AI週報:モデル料金が分化、計算資源の高騰とロボット実装が焦点に
今週のAI業界では、モデル性能だけでなく、料金設計、計算資源の配分、ハードウェアコスト、現場で測定できる成果が競争の焦点になった。
続きを読むClaude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ
全 791 件の記事
今週のAI業界では、モデル性能だけでなく、料金設計、計算資源の配分、ハードウェアコスト、現場で測定できる成果が競争の焦点になった。
続きを読む阿里巴巴の達摩院などが、造影CTから小さな肝臓の悪性病変を見つけるAIモデルDAMO LiONを開発しました。2か月間の実臨床試験で、初回読影では見逃されていた悪性腫瘍15例の発見を支援したとされています。
続きを読む新たなベンチマーク研究は、対話モデルが Generation Alpha の語彙を一定程度理解できる一方、臨床的なリスク判断では大きく精度を落とすことを示した。皮肉、過小評価、意味の急な変化が、危機のサインを隠してしまう。
続きを読むLLMエージェントは、自然なレビューや整合的な評価を大量に生成できる。TH-GNNは、投稿内容だけでなく、ユーザー間の構造と行動の時間的な連携も組み合わせて攻撃を見つける。
続きを読むNexus は、MCP エージェントが毎ターンすべてのツールスキーマを再エンコードする問題を、検索ベースのルーティングによって切り離す。KV キャッシュの連結も試すが、RoPE の位置ずれが適用範囲を制限する。
続きを読む新しい研究は、ハイブリッド思考型マルチモーダルモデルにおいて、思考モードと非思考モードの応答行動に大きな差があると指摘した。PatternEvalとPatternRLにより、正答率だけでは捉えにくい失敗を評価・低減する。
続きを読むInfinityEdit は、完成済みの短い動画を逐次書き換えるのではなく、編集指示を受けながら未来の映像セグメントを生成する手法です。履歴、時間的因果性、編集テキストを扱う軽量アダプターによって、ストリーミング動画生成への編集機能の追加を目指します。
続きを読むイリノイ大学の研究チームは、安全用LoRAの適用強度を隠れ状態から連続的に調整するCLEARを提案した。Llama-3-8B-Instructでは、HarmBenchの攻撃成功率を大きく下げながら、通常タスクの性能低下を抑えたと報告している。
続きを読むLlama-Mobileは、限られたメモリと計算資源しか持たない端末向けに、視覚言語モデルを量子化するフレームワークを提案します。モデル自身が生成したデータとArm CPUでの実行を意識した2.7ビット形式により、Llama 3.2 11B Vision Instructを3.7 GBまで圧縮し、標準的な視覚質問応答で高い性能を維持しました。
続きを読むAIワークフローエンジンFlowLong 1.2.6が公開され、ノードを使わない条件実行、終了済みプロセスの復元、起票者へ戻して審査待ちにする機能が追加されました。
続きを読むOpenRouterで無料公開されたOx Alphaが注目を集めているが、開発・運営元は匿名のままだ。Z.aiのGLMや未発表のMicrosoft MAIではないかという説が出ているものの、確証はない。
続きを読むLinkdazeは、複数のカレンダー、家事、食事計画、買い物リストを家庭向けのタッチスクリーンに集約する。主要機能に月額サブスクリプションを求めない点も特徴だ。
続きを読むAWSは、AIエージェントの過去の実行履歴を参照できるポリシー言語Dogwoodを公開した。単一リクエストの認可だけでは扱いにくいワークフローや並行実行を対象にする。
続きを読む監視技術企業Flock Safetyは、カメラやドローン、自動ナンバープレート認識システムの悪用懸念をめぐり、世論と政治家から批判を受けている。CEOは公共の安全とプライバシーの両立が必要だと主張する。
続きを読むAIモデルが著作権で保護された書籍を学習に使えるかどうかは、単純な合法・違法の二択ではない。最近の訴訟は、学習行為そのもの、データの入手経路、そしてAI製品が権利者の市場と競合するかを分けて判断しようとしている。
続きを読むAmazon DynamoDBがネイティブのベクトル検索に対応し、埋め込みベクトルと業務データを同じテーブルに保存できるようになった。AIアプリの構成は簡素化できるが、専用ベクトルデータベースが直ちに不要になるわけではない。
続きを読むXDAの編集者は、Qwen 3.8 27Bに商用アプリのライセンス認証を完全オフラインで分析させた。モデルは隠された検証情報を復元し、最初の誤りを自力で修正したうえで、動作する概念実証まで作成した。
続きを読むvLLMの実践ガイドは、ROCm環境のAMD Instinct GPUで投機的デコーディングを使う方法を解説しています。ネイティブMTP、EAGLE-3、DFlash、DSparkを比較し、実際の効果は受理率とワークロードに左右されると説明します。
続きを読むハーバード・ビジネス・スクールのHBS Foundryは、HeyGenで作成した講師のAIアバターを、模擬ピッチや取締役会の練習に活用している。チャットボットよりも誘導性の高い学習体験を目指す試みだ。
続きを読むロンドンのスタートアップInherentは、研究論文の結果を自律的に再現する課題で、FaradayがAnthropicやOpenAIの大規模モデルを上回ったと発表した。注目点は勝敗だけでなく、AIに研究判断を学習させようとしている点にある。
続きを読む同じモデルの重みでも、GPU、量子化、推論ランタイム、注意機構のカーネルが違えば出力は変わり得ます。性能低下の原因はモデルではなく、推論スタックにあるのかもしれません。
続きを読む