AMDがTaalasを買収へ、モデル重みをシリコンに埋め込む推論チップに注目
AMDはトロントのAIチップ新興企業Taalasを買収すると発表した。Taalasはモデル重みをHBMなどの外部メモリではなく、チップ上に直接配置するという独自の推論向けアプローチを掲げている。
続きを読むClaude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ
全 791 件の記事
AMDはトロントのAIチップ新興企業Taalasを買収すると発表した。Taalasはモデル重みをHBMなどの外部メモリではなく、チップ上に直接配置するという独自の推論向けアプローチを掲げている。
続きを読むAlibabaは、音声認識、音声合成、音声コンテンツ生成、リアルタイム音声エージェントを統合する CosyVoice Studio を発表した。注目点は、単なる文字起こしや読み上げではなく、音声ワークフローに意味理解を組み込んだことにある。
続きを読むPrime Intellect は、プログラミング向け Agent Harness である Prime Agent をオープンソース公開した。Opus 5 と組み合わせた結果、ARC-AGI 3 で 95.5% RHAE Best@1 に到達し、ARC が示す人間専門家ベースラインをわずかに上回ったとされる。
続きを読むRustプロジェクトは、rust-lang/rustモノレポへのコード貢献を対象にLLM利用方針を採用した。AIを一律に排除するのではなく、貢献者自身が書いていないコードを明示することを重視している。
続きを読む宇樹科技がIPOの発行価格と戦略配分結果を公表した。DeepSeekは93万3399株を割り当てられ、1株150.8元を基準に取得額は約1.41億元、ロックアップ期間は36カ月となる。
続きを読むアリババの動画生成モデル Wan 3.0 が公測を開始した。注目点は、doc や ppt、pdf などの文書をそのまま入力できることで、動画生成が表現ツールから業務活用ツールへ広がり始めたことだ。
続きを読むAnt Groupは、マルチエージェント協調のための基盤「Avernet」をオープンソース化し、コミュニティ版を公開した。初版はエージェントの発見、合意形成、協働、ガバナンスに重点を置く。
続きを読むvLLM の Decode Context Parallelism(DCP)は、KV キャッシュを注意ヘッドではなくシーケンス方向に分割する。長文脈エージェント負荷で顕在化する GPU メモリ不足を緩和し、高並行時のスループット改善を狙う仕組みだ。
続きを読むOpenAIが元AppleデザイナーのJony Ive氏と開発しているAIデバイスは、画面を持たない携帯型スマートスピーカーに近いものだと報じられています。形状はドーナツ型で、サイズはホッケーパック程度とされています。
続きを読むAI生成楽曲の急増と著作権訴訟の圧力を受け、Sunoは生成音声への不可視ウォーターマーク付与とダウンロード制限を進める方針を示した。これはAI音楽サービスが、単なる生成能力ではなく出所管理と悪用対策を問われる段階に入ったことを示している。
続きを読むAnthropic は、Claude などのモデルを動かすためのカスタムシリコンチームを採用中であることを認めた。同社は外部チップも使い続ける「マルチチップ」方針を維持する。
続きを読むこの研究は、個人化LLMが証拠のないままユーザー属性を推測してしまう問題を、初めて大規模に定量化したものだ。 さらに重要なのは、モデル自身の自己評価が、モデル同士を比べる場面では信頼できない指標になりうる点である。
続きを読むこの研究は、単なるモデル提案ではなく、統合型マルチモーダル事前学習の内部で何が起きているかを実験的に整理したものです。知識の流れ、モダリティ間の協調、早期統合、効率的な学習レシピの4点が柱です。
続きを読む動画世界モデルは見た目が自然でも、長いロールアウトでは状態がずれていきます。WorldCycle は可逆な動作循環を自己検証可能な学習信号に変え、「元の状態に戻れるか」を最適化します。
続きを読むペンシルベニア州立大学の研究チームは、LLMエージェント向けのプロンプトインジェクション・レッドチーミングシステム PIMiner を提案した。強化学習に依存する攻撃モデルではなく、転移可能な戦略ライブラリを構築する点が特徴だ。
続きを読むEgo2Robot は、一人称視点の人間による操作動画をロボット向け学習データへ変換するパイプラインだ。単なる模倣ではなく、基盤モデルの事前学習に使える規模と多様性を目指している。
続きを読むVideo-DeepResearch は、静止画像中心のマルチモーダルエージェントを連続動画へ拡張する提案です。視覚ツールを飛ばして検索に逃げる傾向と、内部記憶に頼る問題に正面から取り組んでいます。
続きを読む3Dを理解、生成、編集に分けず、ひとつの統合フレームワークで扱うという提案です。特に注目点は、学習を支える大規模な3Dマルチモーダルデータの整備にあります。
続きを読む未来フレームを見ず、長さも事前に決めない動画編集は難題です。JoyAI-Video-Editは、自回帰拡散に蒸留を組み合わせ、リアルタイム性とソース忠実度、長期整合性の両立を狙います。
続きを読むこの論文は、世界モデルを「エージェント中心の対話的プロキシ」として捉え直し、物理状態の予測だけでなく、行動・学習・継続的改善に役立つ情報フィードバックを重視する。
続きを読むSkillJack は、自己進化型エージェントが経験を再利用可能なスキルへ変換する過程を狙う攻撃である。実行時の記憶汚染に依存せず、有害な振る舞いを長期的な能力として残す点が特徴だ。
続きを読む