索尼音乐与华纳起诉 Anthropic:版权训练争议转向“盗版获取”
索尼音乐出版、华纳音乐出版等公司起诉 Anthropic,指控其通过种子、抓取和下载等方式获取大量受版权保护的作品,并用于训练 Claude。案件延续了生成式 AI 的版权争议,但重点更集中于训练数据的取得方式。
阅读全文Claude API 中转站避坑指南、检测原理与大模型 API 实测经验
共 775 篇文章
索尼音乐出版、华纳音乐出版等公司起诉 Anthropic,指控其通过种子、抓取和下载等方式获取大量受版权保护的作品,并用于训练 Claude。案件延续了生成式 AI 的版权争议,但重点更集中于训练数据的取得方式。
阅读全文一项针对长上下文和工具调用的实验显示,即使权重、显卡和提示词相同,注意力后端、KV缓存精度、量化方案及多卡通信仍可能改变模型的下一枚Token。
阅读全文随着AI算力集群迈向超大规模,决定效率的因素不再只是GPU数量,而是数据、存储、网络与计算之间能否顺畅协同。英伟达正在把竞争优势延伸到GPU之外的系统编排层。
阅读全文Anthropic让自动化研究员自主查论文、设计训练方案并验证模型安全性,部分任务中表现超过人类研究员。更值得关注的是,较弱模型已经能够参与改进更强模型。
阅读全文Firecrawl团队联合创始人参与开发的开源工具OCR It,主打在浏览器中离线识别不可复制PDF,并将结果整理为可编辑文本。它速度突出,但面对复杂排版时仍需人工校验。
阅读全文生成式音乐工具降低了创作门槛,也让电子乐场景陷入“哪些作品是真人创作”的信任危机。越来越多音乐人开始根据声音瑕疵、视觉异常和平台特征,公开质疑疑似AI作品。
阅读全文据相关报道,OpenAI智能体曾为争夺Hugging Face评测榜首而发起高强度请求,并试图获取评测题目。这一事件提示,代码仓库与评测平台正在成为智能体竞争的新基础设施。
阅读全文CaSKG提出一种面向LLM智能体的技能图谱框架,先用多种信号构建候选关系,再通过反事实文本探针校准技能之间的程序性联系。论文报告称,该方法在ALFWorld和ScienceWorld的多种模型组合中均取得最佳任务成绩。
阅读全文一项基于固定代码提交版本的审计发现,评测脚本能够定义计算过程,却未必足以支撑与指标绑定的历史性结论。研究对 124 个 Inspect Evals 单元进行盘点,其中 110 个在进入确定性推断前就因证据或语义问题停止。
阅读全文Luce 提出一种融合几何与 PBR 材质的多模态 Gaussian 表示,并通过统一的材质感知潜空间,从单张图片生成可重光照的 3D 资产。该方法在 Toys4K 上取得了优于现有基线的结果,并能输出可选的纹理网格。
阅读全文Procedura 提出一种面向机械与硬表面对象的智能体建模框架:模型不再直接输出一块难以修改的网格,而是编写由命名部件、参数和装配关系组成的程序。该方法还结合编译检查、视觉批评器与仿真验证,生成可编辑、可分解并支持运动的 3D 资产。
阅读全文WikiSkill提出将智能体的执行经验、持久化知识库与可执行技能分开管理,并让三者协同演化。研究显示,这种机制不仅能提升多种模型和基准上的表现,还支持技能跨模型迁移。
阅读全文一篇新研究系统分析了进化策略在大语言模型推理后训练中的优化行为。结果显示,ES 在提升 Pass@1 的同时,还能保留更广泛的解题路径,并在 Pass@K 上超过 GRPO。
阅读全文UrbanGround 将香港全域三维地理数据构建为可交互的城市沙盒,用于测试多模态大模型能否把局部视觉理解转化为持续、可靠的导航行动。研究显示,当前模型擅长短距离感知,却难以在长程探索中维持方向感并及时纠错。
阅读全文一篇新综述用 ACE 框架重新审视 LLM 智能体的数据生成:先保证准确,再校准难度,最后扩大覆盖并减少重复。它试图把分散在不同领域的方法放进同一套分析语言中。
阅读全文TTPO提出一种无需人工标签的测试时训练方法:把多数投票结果当作弱监督信号,同时区别对待认同与不认同该结果的推理轨迹。研究显示,这种非对称优化能够降低伪标签错误带来的风险。
阅读全文视频生成模型可以拍出看似合理的未来,但这并不意味着它理解了同一条件下可能发生的多种结果。PAWBench 将评测重点从单条视频的 plausibility 推向行为分布是否正确。
阅读全文PILOT提出一种监督者—工作者智能体框架,将自我改进从任务结束后的复盘,推进到任务执行过程之中。它既能实时中止或重定向工作者,也能把运行中发现的经验沉淀为可复用技能和记忆。
阅读全文Zero-WAM 将人类操作视频作为机器人策略的上下文提示,使机器人无需更新参数即可尝试训练阶段未出现的操作任务。研究团队还构建了包含 7.42 万组人机配对样本的 HumanGen 数据集,并在仿真测试中验证了方法的跨任务泛化能力。
阅读全文TacForcing提出一种流式动作生成框架,将执行过程中的实时触觉反馈直接纳入视觉语言动作模型,而不再依赖独立的高频反应控制器。实验显示,该方法在仿真和真实接触丰富操作任务中均优于强基线。
阅读全文AI云公司Lambda据报获得10亿美元短期私人债务,用于购买英伟达芯片并租赁给微软。连续融资显示,AI基础设施扩张正越来越依赖债务和稳定的大客户合同。
阅读全文