文章与教程
Claude API 中转站避坑指南、检测原理与大模型 API 实测经验
共 795 篇文章
WorldWeaver:让多智能体视频生成拥有共享世界状态
WorldWeaver 提出在流式自回归扩散视频模型中加入“世界状态寄存器”,用于跨智能体、跨视角维护共享环境信息。它把多智能体世界模型从单纯延续画面历史,推进到显式追踪状态一致性的方向。
阅读全文空间智能评测的新思路:让生成模型“画出答案”
ProVisE 试图解决一个长期被忽视的问题:空间推理并不总适合用文字、坐标或选项来回答。它让图像生成模型直接在像素中标注、绘制或指示空间判断,再转回可评分的结构化结果。
阅读全文NVIDIA NOOA:把 AI Agent 写成原生 Python 对象
NVIDIA Labs 提出 NOOA 框架,试图把 Agent 开发从提示词、工具 schema 和工作流图的拼装中拉回到 Python 面向对象编程。其核心思想很直接:Agent 就是一个 Python 对象,方法、字段、文档字符串和类型标注分别承担行动、状态、提示和契约。
阅读全文OpenForgeRL:把真实 Agent Harness 接进端到端强化学习训练
OpenForgeRL 试图解决一个现实难题:Claude Code、Codex、OpenClaw 这类复杂推理 harness 很强,但很难被现有开源 SFT/RL 栈直接训练。它用代理记录模型调用、用 Kubernetes 隔离 rollout,让研究者在真实部署环境中训练 Agent。
阅读全文LLM 在多轮对话中为何会跟丢用户意图?
一篇新论文指出,当前大模型在静态单轮任务中表现强,并不意味着它们能在真实协作场景里持续追踪用户不断变化的意图。研究提出一种将现有单轮基准改造成动态多轮对话的评测框架,暴露出模型在“演化意图”下的系统性退化。
阅读全文SANA-Video 2.0:用混合注意力加速高分辨率视频生成
SANA-Video 2.0 试图在视频扩散 Transformer 中兼顾画质与效率:大部分层使用线性注意力,周期性插入 softmax 注意力作为“锚点”。论文称,该方案可在单张 H100 上实现最高 720p 的高质量视频生成,并显著降低长视频推理成本。
阅读全文Prentis拟融资1亿美元:电脑操作型AI代理成为新战场
由Ritankar Das、Reid Hoffman和Mark Pincus共同创办的AI实验室Prentis,正洽谈以10亿美元估值融资1亿美元。它押注的不是写代码,而是让AI学会接管办公室里的日常电脑流程。
阅读全文AlphaFold 被用于重设计基因编辑蛋白:让 CRISPR 更少“误伤”
研究团队将 AlphaFold 用于分析 Cas 蛋白在脱靶位点上的结构变化,并据此改造关键氨基酸位点。结果显示,新设计的变体可在保持目标编辑活性的同时显著降低脱靶编辑。
阅读全文“Google Zero”逼近:搜索流量枯竭后,网站与AI平台的旧交易正在失效
The Vergecast 讨论了“Google Zero”正在成为出版商和网站无法回避的问题:搜索引擎不再像过去那样稳定回流流量,而AI摘要和训练数据需求正在重写网络生态的交换规则。
阅读全文Meta AI转向生产力助手:接入日历、主动简报与深度研究
Meta 正在把自家 AI 聊天机器人从问答和图像生成工具,升级为更接近个人助理的产品。新功能包括读取日历生成每日简报、协助安排活动,以及可在过程中调整方向的深度研究。
阅读全文Anthropic 推出 Opus 5:更便宜、更少限制的旗舰级模型选择
Anthropic 发布 Opus 5,定位为比 Fable 5 更便宜、限制更少的重量级模型,并在部分基准测试中实现反超。它还通过新的 Automatic Fallbacks 机制,尝试减少安全拦截对 API 使用体验的影响。
阅读全文Claude Opus 5 发布:主打高性价比的前沿编码与知识工作模型
Anthropic 发布 Claude Opus 5,将其定位为接近 Claude Fable 5 智能水平、但成本约为一半的日常主力模型。它在编码、自动化、知识工作和部分科学任务上展示了明显提升,但相关数据主要来自官方评测与早期客户反馈。
阅读全文美国酝酿回应中国 AI,行业反对“一刀切”限制开放权重模型
多家 AI 公司联名呼吁美国政策制定者,不要因对中国模型和蒸馏争议的担忧,扩大到对开放权重模型的普遍限制。争论背后,是开放生态、闭源商业模式与国家安全政策之间的再平衡。
阅读全文美国“创世纪任务”:AI 科学拨款背后的制度转向
特朗普政府推出首批“创世纪任务”拨款,将 50 亿美元投向 AI 驱动的科研项目。这不仅是一次资金分配,更被批评者视为美国科研体系向硅谷式治理转向的信号。
阅读全文UniWorld-View登顶WorldScore:国产世界模型如何从一张图生成可控新视角视频
兔展智能联合北大、鹏城实验室推出的 UniWorld-View 登顶李飞飞团队 WorldScore 榜单,并已开源代码与权重。它的关键看点在于:用统一模型处理单图 3D 与视频 4D 新视角生成,并强化相机位姿控制。
阅读全文Kimi K3引发华尔街紧张:开源模型、监管争论与AI安全警报
Moonshot的开放模型Kimi K3本周走红,真正引爆讨论的并不只是模型能力,而是美国AI产业与资本市场的反应。与此同时,OpenAI预发布模型牵连Hugging Face安全事件,提醒业界AI风险并不只来自地缘竞争。
阅读全文AI 数据中心扩张遇阻:EPA 拟削弱邻里参与许可审查
特朗普政府下的 EPA 正考虑调整空气污染许可规则,把部分“轻污染源”的公众参与安排交给各州决定。对依赖燃气机组、柴油发电机的数据中心项目而言,这可能降低社区提前知情和反对的机会。
阅读全文OpenAI 将新版语音模式带到 ChatGPT 桌面端:从对话走向“指挥代理”
OpenAI 已在 ChatGPT 桌面应用中加入新版语音能力,用户可通过说话来调度 ChatGPT Work、Codex 以及具备电脑使用能力的代理完成任务。相比手机端更偏自然对话的语音模式,桌面端更新强调多步骤操作与人机协作。
阅读全文菲尔兹奖得主 Tsimerman 加入 OpenAI:顶尖数学家转向 AI 安全
据 OSChina 摘要,2026 年国际数学家大会公布本届菲尔兹奖得主后,雅各布·Tsimerman 宣布将转向 AI 安全研究并加入 OpenAI。这一动向凸显基础数学人才正在进入 AI 安全前沿。
阅读全文近 200 家硅谷初创反对白宫封禁中国开源 AI 模型
据 OSChina 摘要,近 200 家硅谷初创企业联名致信白宫,呼吁不要切断美国开发者使用中国开源 AI 模型的渠道。这场争议的核心,是安全监管、产业竞争与开源生态之间的平衡。
阅读全文