AMD 收购 Taalas:把模型权重“刻进芯片”的推理新路线
AMD 宣布收购多伦多 AI 芯片初创公司 Taalas,后者主张将模型权重直接固化到硅片中,以绕开传统内存访问瓶颈。若交易按计划在 2026 年第四季度完成,AMD 的 AI 推理版图将增加一条非传统计算路径。
阅读全文Claude API 中转站避坑指南、检测原理与大模型 API 实测经验
共 791 篇文章
AMD 宣布收购多伦多 AI 芯片初创公司 Taalas,后者主张将模型权重直接固化到硅片中,以绕开传统内存访问瓶颈。若交易按计划在 2026 年第四季度完成,AMD 的 AI 推理版图将增加一条非传统计算路径。
阅读全文阿里巴巴推出 CosyVoice Studio,试图把语音识别、语音合成、音频创作与实时语音智能体整合到同一平台。其核心看点不只是“听得清、说得像”,而是把语义理解嵌入语音工作流。
阅读全文Prime Intellect 发布开源编程 Agent Harness Prime Agent,围绕 Recursive Language Model 与 Continual Harness 两个抽象构建。其与 Opus 5 组合在 ARC-AGI 3 上取得 95.5% RHAE Best@1,略高于报告中的人类专家基线。
阅读全文Rust 项目围绕 rust-lang/rust 单一仓库通过了 LLM 使用政策。规则并非一刀切禁止 AI,而是要求贡献者清楚区分自己完成的工作与由模型生成的内容。
阅读全文宇树科技披露IPO发行价格及战略配售结果,DeepSeek获配93.3399万股,按每股150.8元计算,认购金额约1.41亿元。相关股份锁定期为36个月。
阅读全文阿里视频生成模型 Wan 3.0 正式开启公测,最引人注意的是它不再只接收文字、图片或音频,还能直接读取 doc、ppt、pdf 等文档。对创作者来说,这意味着视频生成开始从“会画”走向“会讲”。
阅读全文蚂蚁集团开源多智能体协作基础设施 Avernet,社区版率先开放智能体协作网络能力。它试图解决企业场景中智能体发现、协同、治理与经验沉淀的基础问题。
阅读全文vLLM 博客介绍了 Decode Context Parallelism(DCP)在长上下文解码阶段的价值:它按序列维度切分 KV cache,而不是只依赖张量并行按注意力头切分。对于 64K 到 1M token 的智能体轨迹负载,这一机制显著提升并发与吞吐。
阅读全文据彭博社记者 Mark Gurman 披露,OpenAI 与前苹果设计负责人 Jony Ive 合作的首款 AI 设备,可能是一款无屏、可随手携带的智能音箱。它预计 2027 年推出,售价或超过 300 美元。
阅读全文面对流媒体平台上激增的AI音乐以及版权诉讼压力,Suno计划为模型生成的音频加入不可见水印,并限制部分下载行为。此举既是行业标签化趋势的一部分,也是一场关于AI音乐能否被平台、版权方和用户接受的合规实验。
阅读全文Anthropic 已确认正在招聘定制硅团队,计划为 Claude 等模型探索自研芯片。公司强调未来仍会采用多芯片策略,而不是完全替代外部供应商。
阅读全文这篇论文把个性化 LLM 的“用户画像幻觉”系统化地测了一遍,结果并不乐观:12 个模型都在不同程度上过度推断用户属性,而且模型自评与外部判定还出现了反向关系。 研究的重点不是某个模型是否更强,而是提醒我们:靠模型自己说“我很谨慎”,并不能作为个性化可信度的证据。
阅读全文这篇工作不只是报告一个新模型,而是系统回答:语言、视觉理解和视觉生成在统一预训练中到底如何互相影响。作者把结论归纳为知识流动、模态协同、早期统一和高效训练配方四个层面。
阅读全文视频世界模型的问题不只在于“看起来像”,更在于长时间滚动后会不会偏离真实状态。WorldCycle 提出用可逆动作循环作为无需标注的监督信号,把“能否回到起点”变成训练目标。
阅读全文宾夕法尼亚州立大学团队提出 PIMiner,一个面向 LLM 智能体提示注入红队测试的智能体系统。它通过积累可迁移的策略库,试图降低对强化学习攻击模型的依赖,并在少量查询下评估新目标模型的风险。
阅读全文这项工作提出了一条把第一人称人类操作视频转换为机器人训练数据的流水线,目标不是做单个任务的演示复刻,而是为具备泛化能力的视觉-语言-动作模型提供大规模预训练数据。研究同时给出了更系统的泛化评测框架。
阅读全文这项工作把多模态深度研究代理从静态图片推进到连续视频流,重点解决“先搜文本、后看视觉”和过度依赖参数记忆两个问题。作者用分阶段工具解锁、两阶段训练和新基准,验证了视频原生推理代理的可行性。
阅读全文这项工作试图把 3D 理解、文本生成、指令编辑和部件生成放进同一套架构里。核心突破不只是模型设计,还有一套规模化的 3D 多模态数据构建方案。
阅读全文这项工作把“实时编辑”和“长视频一致性”放到同一套系统里解决。作者提出 JoyAI-Video-Edit,用自回归扩散、源锚定蒸馏和长程蒸馏,尝试在低延迟条件下保持画面忠实与时间连贯。
阅读全文一篇新论文提出 SkillJack 攻击,指出自进化智能体在把交互经验沉淀为可复用技能时,可能把有害行为一并固化。相比传统记忆投毒,这类风险不依赖运行时检索,因而更隐蔽、更持久。
阅读全文