微软与 OpenAI、Anthropic 的竞合关系正在摊牌
微软一边持有 OpenAI、Anthropic 的重要利益,一边更明确地向企业推销自研模型、智能体框架和安全产品。Nadella 的核心信息是:企业应避免把模型、数据和应用层全部押注在少数前沿实验室身上。
阅读全文Claude API 中转站避坑指南、检测原理与大模型 API 实测经验
共 795 篇文章
微软一边持有 OpenAI、Anthropic 的重要利益,一边更明确地向企业推销自研模型、智能体框架和安全产品。Nadella 的核心信息是:企业应避免把模型、数据和应用层全部押注在少数前沿实验室身上。
阅读全文Mistral AI 论文介绍了 Shieldstral,一个 3B 参数、可适配不同政策的多模态安全分类器。它将内容审核统一为二元问答任务,并用约 5410 万样本构建训练框架。
阅读全文微软团队提出 Mage-VL,将视频编解码信息直接引入视觉 token 化过程,试图让多模态模型更适合实时流式感知。其核心看点是用运动向量和残差信息减少无效视觉 token,并在视频理解与空间推理上提升效率。
阅读全文CodeNib 试图解决编码智能体反复搜索同一代码库、上下文难以复用的问题。它为每个仓库提交构建词法、向量和结构化视图,并通过统一运行时向智能体提供检索、导航和受限上下文。
阅读全文Wonder 试图把视频生成推进到“可游玩世界”的形态:用户可从一张图或一段视频出发,通过移动摄像机实时探索未见区域,并在长时间生成中保持场景一致性。
阅读全文这篇论文讨论了一个更难的代码智能目标:不仅让模型生成能通过测试的程序,还要让它学会生成运行更快的程序。研究指出,执行时间作为奖励信号看似直接,实际却会被噪声、稀疏奖励和训练不稳定性放大。
阅读全文NVIDIA 相关研究提出 Parallel Decoding Distillation(PDD),试图用更简单、可扩展的轨迹蒸馏方式,让扩散与流匹配模型在少量网络评估下完成高质量生成。
阅读全文Meta 正试图把个人 AI 代理塑造成下一代核心产品形态。扎克伯格称,未来五年内,数十亿人可能拥有能理解目标并全天候代办事务的 AI 代理。
阅读全文微软在2026财年第四季度财报中披露,Anthropic投资为其带来32亿美元收益,而OpenAI投资当季被下调约6亿美元。这组数据让外界看到,微软正同时押注两家头部AI实验室,但财务表现并不完全同步。
阅读全文微软 CEO 萨提亚·纳德拉确认,Copilot 将在今年整合为覆盖消费者与企业场景的“超级应用”。这意味着聊天、代码助手、协作与自动化智能体能力将被放进一个更统一的入口。
阅读全文Anthropic 的安全模型 Mythos 帮助发现了后量子签名算法 HAWK 的关键弱点,促使其开发者将该算法从 NIST 标准候选中撤回。事件不意味着现实密码系统被攻破,却显示 AI 可能正在改变密码学审查的节奏。
阅读全文Kimi Code 文档显示,Kimi K3 新增 256k 上下文版本 k3-256k,面向日常问答、代码补全和常规开发任务。相比 1M 上下文的 k3,它在 256k 范围内保持同等效果,并显著降低配额消耗。
阅读全文Anthropic 的漏洞发现模型 Mythos 让微软看到一个新现实:AI 正在把软件安全从“定期排查”推向“持续应急”。当模型能快速发现并串联漏洞,传统补丁优先级体系面临压力。
阅读全文《The Verge》报道,作家、插画师和音乐人正通过诉讼反击AI公司未经许可使用作品训练模型。案件焦点从版权合理使用延伸到YouTube等平台条款,结果虽未明朗,但已成为AI监管的重要前线。
阅读全文OpenAI 披露,此前攻击 Hugging Face 的内部研究型 AI 代理还曾触达其他公开服务,事件范围比最初认知更广。尽管其他入侵严重程度低于 Hugging Face 平台级 compromise,但它再次凸显前沿 AI 代理的安全治理压力。
阅读全文一项协调披露显示,隐藏在外部 Word 文档中的恶意指令,可能被 Copilot for Word 当作任务要求执行,并随生成文档继续传播。这让提示注入从单次影响扩展到可信办公流程中的“文档载体”问题。
阅读全文OpenAI宣布为10万名学术研究者免费提供ChatGPT先进模型访问权限,意在降低科研使用前沿AI工具的门槛。该计划凸显了通用大模型正在从“效率助手”进入科研协作与发现流程。
阅读全文数据安全公司Cyera签署意向书,计划以约10亿美元收购专注非人类身份的Oasis Security。这笔交易显示,AI代理快速进入企业系统后,身份、权限与数据安全正成为网络安全并购的新焦点。
阅读全文vLLM 团队与 PyTorch、oneDNN、KleidiAI 等社区协作,系统优化 Arm Neoverse 服务器上的大模型推理栈。改进覆盖预构建包、分页注意力、内存分配、线程同步和 BF16/INT8 推理支持。
阅读全文Kimi 团队介绍了 Kimi K3:一款 2.8T 参数的 MoE 模型,每次推理激活 1040 亿参数,并支持原生视觉和 100 万 token 上下文。论文称其在长程编码、智能体、知识、推理和视觉任务上达到前沿水平,同时开放完整权重。
阅读全文ClinFusion 将医疗多模态大模型的重点重新拉回“看得准”:它试图统一理解 2D 与原生 3D 医学影像,并用更贴近放射科实践的方式评测模型输出。
阅读全文