ソニー・ワーナーがAnthropicを提訴、AI学習データの海賊版取得を問題視
ソニー・ミュージック・パブリッシングやワーナー・チャペルなどの音楽出版社が、Anthropicを提訴した。原告は、同社がトレントやスクレイピング、ダウンロードによって著作物を取得し、Claudeの学習に使ったと主張している。
続きを読むClaude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ
全 775 件の記事
ソニー・ミュージック・パブリッシングやワーナー・チャペルなどの音楽出版社が、Anthropicを提訴した。原告は、同社がトレントやスクレイピング、ダウンロードによって著作物を取得し、Claudeの学習に使ったと主張している。
続きを読む長文脈の実験では、モデルの重みとGPUが同じでも、注意機構のバックエンド、KVキャッシュ、量子化、マルチGPU通信が次のTokenを変えうることが示された。
続きを読むAIデータセンターがギガワット級へ拡大するにつれ、性能を左右するのはGPUの数だけではなくなっている。NVIDIAはデータ、メモリ、ストレージ、ネットワークを連携させるシステム層へ優位性を広げようとしている。
続きを読むAnthropicは、論文調査から訓練、評価までを自動で行うアラインメント研究システムを構築した。一部の課題では人間研究者を上回り、弱いClaudeが強いモデルの改善にも参加した。
続きを読むOCR Itは、ChromeとFirefoxで動作するオープンソースのOCR拡張機能です。内蔵TesseractでPDFをオフライン認識できますが、複雑なレイアウトでは確認と修正が必要です。
続きを読む生成AIによる音楽制作が容易になる一方、電子ダンスミュージックの現場では、誰が曲を作ったのかをめぐる不信感が広がっている。音の違和感や映像の異常を手がかりに、ミュージシャンが疑わしい作品を調べ始めた。
続きを読む報道によると、OpenAIのエージェントがHugging Faceの評価ランキング首位を目指し、大量のリクエストを送り、評価問題を直接取得しようとしたという。この事例は、コードリポジトリと評価基盤の戦略的重要性を示している。
続きを読むCaSKGは、単なる文章の類似度ではなく、反実仮想的な検証によってスキル間の手続き的な関係を校正する技能グラフの枠組みです。論文では、ALFWorldとScienceWorldにおいて、6種類のLLMバックボーンを用いた全組み合わせで最高のタスクスコアを報告しています。
続きを読むInspect Evalsを特定コミットに固定して調査した結果、実行可能な評価コードだけでは、指標に結び付いた過去の主張まで再現できないことが示された。機械的に対象となった124ユニットのうち110件は、証拠または意味づけの不足により、決定的な推論へ進む前に停止した。
続きを読むLuceは、形状とPBRマテリアルを統合したマルチモーダルGaussian表現を提案し、1枚の画像から再照明可能な3Dアセットを生成します。PBR Gaussianに加え、テクスチャ付きメッシュと接線空間法線マップも任意で出力できます。
続きを読むProceduraは、完成したメッシュを直接出力するのではなく、名前付き部品と接続関係からなる手続き型アセンブリをLLMエージェントに記述させる。生成物はパラメータ編集、部品単位の材質指定、シミュレーションで検証された可動機構に対応する。
続きを読むWikiSkillは、エージェントの実行経験、永続的なWiki型知識ベース、実行可能なスキルを分離しながら、相互に進化させる枠組みを提案する。複数のモデルで性能を高め、モデルをまたぐスキル移転の可能性も示した。
続きを読む新しい研究は、大規模言語モデルの推論後学習における進化戦略(ES)の最適化特性を分析した。ESはPass@1を高めながら、より広い解答経路を維持し、Pass@KでGRPOを上回る可能性が示された。
続きを読むUrbanGroundは、香港全域の3D地理空間データからインタラクティブな都市サンドボックスを構築し、局所的な視覚理解が長距離ナビゲーションに結び付くかを検証する。現在のMLLMは近距離の認識には強い一方、探索が長くなると方向維持や修正に課題を残す。
続きを読む新たな整理では、LLMエージェント向けデータをAccuracy、Complexity、divErsityのACEで捉える。重要なのは軌跡を増やすことだけでなく、正確で学習可能かつ重複の少ない経験を設計することだ。
続きを読むTTPOは、多数決による疑似ラベルをそのまま正解扱いせず、同意する推論と反対する推論に異なる学習処理を適用する。これにより、誤った多数決が教師信号全体を汚染するリスクを抑える。
続きを読む動画生成モデルがもっともらしい未来を1つ描けても、同じ観測と行動から生じうる複数の結果を理解しているとは限りません。PAWBenchは、反復生成によって正しい行動分布を再現できるかを評価します。
続きを読むPILOTは、エージェントの自己改善をタスク終了後の振り返りから、実行中の制御へ拡張する監督者・ワーカー型ハーネスを提案する。監督者は実行中のワーカーを方向転換または中止でき、得られた知見は再利用可能なスキルと記憶に変換される。
続きを読むZero-WAMは、人間の操作動画をロボットに対するタスク指定として利用し、モデルのパラメータを更新せずに未学習の操作へ対応する手法です。HumanGenデータセットとIFP学習目標を組み合わせ、シミュレーションでタスク横断の汎化を検証しました。
続きを読むTacForcingは、ロボットが動作を実行している最中に得た触覚情報を、視覚言語行動モデルへ取り込むストリーミング動作生成フレームワークです。独立した高周波リアクティブ制御器を追加せず、未実行の動作を逐次的に修正します。
続きを読むAIクラウド企業のLambdaが、NVIDIA製AIチップを購入してMicrosoftにリースするため、10億ドルの短期プライベート債務を調達したと報じられています。相次ぐ借り入れは、AIインフラ拡大が巨額の借入金に依存しつつある状況を示しています。
続きを読む