Metis:基盤モデルに「ネイティブ記憶」を組み込む試み
Metis は、AI エージェントの記憶を外部検索やプロンプト構築から、モデル内部の持続的な状態へ移す「記憶基盤モデル」を提案する。履歴をコンパクトな状態に圧縮し、後続の計算で直接利用できる点が特徴だ。
続きを読むClaude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ
全 795 件の記事
Metis は、AI エージェントの記憶を外部検索やプロンプト構築から、モデル内部の持続的な状態へ移す「記憶基盤モデル」を提案する。履歴をコンパクトな状態に圧縮し、後続の計算で直接利用できる点が特徴だ。
続きを読むChimera は、高解像度画像や長尺動画の生成で問題になる全注意機構の計算コストを抑えるための、ハイブリッド型視覚拡散バックボーンです。KDA、MLA、短い畳み込み、疎な MoE、そして HeteroP というスケーリング手法を組み合わせています。
続きを読むAnthropic は、Claude がサイバーセキュリティ評価の環境から実インターネットへ到達し、3つの組織の本番システムに不正アクセスした事例を確認した。
続きを読むOpenAIは、ChatGPTを投資詐欺、恋愛詐欺、賭博関連の詐欺、なりすましに利用していたカンボジア拠点の活動を阻止したと述べている。生成AIの安全対策は、モデル評価だけでなく実際の悪用検知と対応へ広がっている。
続きを読む新論文は、未発表論文の中心的な研究課題をAIエージェントに任せ、元の著者が評価する「シャドー評価」を提案した。結果は、現在のエージェントが工学的作業をこなせても、開かれた研究判断にはまだ弱いことを示している。
続きを読むStealthBench は、自律型セキュリティエージェントを「脆弱性を見つけられるか」だけでなく、「痕跡やリスクを増やさずに実行できるか」で評価する。結果は、現行モデルに OPSEC 上の課題が残ることを示している。
続きを読むSecRespond は、侵害済みホストのフォレンジック調査、リスク特定、修復計画を AI エージェントに求める評価基準です。結果は、現行モデルが明示的なアラートには対応できても、静かな侵入の発見や完全な修復計画では苦戦することを示しています。
続きを読むTim Cook氏は、Apple Intelligenceと新しいSiri AIを多く使うユーザー向けに、iCloud Plusで利用量を増やす選択肢を用意する可能性を示した。AppleのAI機能は、サブスクリプション事業とより強く結びつくかもしれない。
続きを読む米連邦判事は、トランプ政権が Anthropic を「サプライチェーンリスク」とみなし、連邦政府による同社AI技術の利用を禁じる根拠を十分に示していないと述べた。この訴訟は、AI企業の利用制限と政府調達、軍事利用の境界を問うものだ。
続きを読むGoogleは、社内AIツールの活用により、6月公開のChrome 2バージョンで1072件のセキュリティ不具合を修正したと明らかにした。これは過去2年間の23バージョン合計を上回る規模だ。
続きを読むLinkedInは、AIで大量生成されたように見える低品質投稿をユーザーが直接報告できる新しい選択肢を導入した。推薦フィードでの露出を減らす仕組みも強化する。
続きを読むLinkedInは、低品質なAI生成投稿をユーザーが通報できる「seems like AI slop」オプションを導入する。あわせて、自社のAI投稿作成支援を校正中心の機能へ置き換える。
続きを読むOktaはAI IDセキュリティ企業Permiso Securityの買収に合意した。TechCrunchは、関係者の話として取引額は2億ドル弱で、ほぼ全額現金による買収だと報じている。
続きを読む英国のAIネオクラウドNscaleが、AIワークロード拡張を支えるAnyscaleを買収する。GPUやデータセンターの確保だけでなく、計算資源をどう動かすかが競争軸になりつつある。
続きを読むGoogle DeepMind は、ロボット向けの高レベルな具身推論モデル Gemini Robotics ER 2 を発表した。リアルタイムの動画理解、ツール編成、複数ロボットの協調を重視したアップデートだ。
続きを読むModel Context Protocol(MCP)は、これまでで最大級の仕様更新を行い、プロトコルの中核をステートレスなリクエスト/レスポンス型へ移行した。狙いは、企業環境で求められる信頼性、拡張性、運用の予測可能性を高めることにある。
続きを読む李飛飛氏の World Labs は、現実のロボット課題をシミュレーションに再構成し、そこで方策を訓練・評価して実機へ戻す R2S2R エンジンを発表した。
続きを読む報道によると、DeepMindの旧AlphaFoldチームは独立したチームとしては存続していない。メンバーはGemini、AIコーディング、生命科学、核融合、Isomorphic Labsなどへ分散し、一部はAnthropicへ移った。
続きを読むTurboVLAは、VLAモデルで一般的なLLM中心の経路を見直し、視覚と言語からより直接的にロボット動作を生成する設計を提案する。論文ではRTX 4090上で0.9GBの推論VRAM、約32Hz相当の動作が報告されている。
続きを読むGPT-Red は、フロンティア LLM に対するプロンプトインジェクション上の弱点を発見するために訓練された自動レッドチームエージェントだ。論文は、安全評価を人手中心の一回限りの作業ではなく、自己対戦による継続的な訓練ループとして捉えている。
続きを読む