高分辨率天气预报的瓶颈,可能不在模型而在数据
BaguanHR提出了一条不同于传统模型微调的路线:先用变量级超分辨率把长期粗分辨率再分析资料扩展到0.1度,再训练高分辨率天气预报模型。研究结果显示,扩大数据规模能够持续降低预报误差。
阅读全文BaguanHR提出了一条不同于传统模型微调的路线:先用变量级超分辨率把长期粗分辨率再分析资料扩展到0.1度,再训练高分辨率天气预报模型。研究结果显示,扩大数据规模能够持续降低预报误差。
阅读全文Anthropic公布Model Hardware Standard(MHS)研究预览版,试图用统一驱动和数据接口,让AI代理连接并控制不同类型的实体设备。该标准目前主要面向科学实验,也为机器人和自动化系统提供了新的协作基础。
阅读全文一项名为 Station 的开放世界多智能体环境,让来自不同模型家族的AI围绕数学研究目标自行分工、实验与协作。论文称,该系统在多个组合数学与几何问题上获得了相对既有文献的新结果,并公开了对话、证明和验证代码。
阅读全文RIBOSPAN 是一个原生支持最长 10,240 个核苷酸、拥有 16.1 亿参数的双向 RNA 基础模型。研究显示,原生长上下文训练在完整转录本建模、表示学习和 mRNA 设计方面具有明显优势。
阅读全文AutoResearch提出一个连接“想点子”和“做实验”的两阶段科研代理系统。它试图用多模型交叉评审、实验诊断和独立证据审查,减少自动化科研中的幻觉与不可靠结论。
阅读全文英国AI初创Inherent发布科研智能体Faraday,称其在独立复现论文结果的任务上超过Anthropic和OpenAI的更大模型。其真正的看点不只是成绩,而是通过强化学习训练AI形成科研判断力。
阅读全文一项新研究提出 Top-K 提示与训练范式,让语言模型在单步逆合成中同时生成多种可能路线。基于约4560万条经验证反应训练的 C3LM,在 OOD URSA-expert-2026 基准上展现出竞争力,并与传统模型形成互补。
阅读全文OmniScientist试图把AI科学家的能力从文本和预处理特征扩展到图像、信号、音频、视频、三维结构等异构原始数据。系统通过感知、构思、实验和写作环节,完成从研究问题到论文草稿的端到端流程。
阅读全文MathForm 将 Mathlib 知识检索、编译器诊断和语义一致性反馈引入数学自动形式化流程,并据此构建了约 367K 条 Lean 4 验证数据。基于该数据训练的 8B 模型,在多项基准上超过了若干专用 32B 模型。
阅读全文《Personalized Auto-Research》提出“个性化自动科研”概念:AI 科研助手应理解研究者的知识积累、方法能力与合作网络,而不是只围绕一个研究目标生成通用方案。
阅读全文一项数学人工智能研究提出 FAR 流程:让专家提供研究方向,由系统从文献中寻找开放问题,再逐层筛选值得投入推理与人工复核的候选。组合数学试验显示,这种“文献到评审”的协作方式有望重新分配稀缺的模型推理和专家时间。
阅读全文Large Discovery Model 将生成模型与贝叶斯非参数奖励代理结合起来,让 AI 不只提出候选方案,还能根据实验结果和不确定性决定下一步搜索方向。
阅读全文DeepMind团队联合研究者重新设计矩阵乘法指数优化问题,并引入机器学习算法与AlphaEvolve进行搜索,将当前上界从2.371339推进至2.371177。
阅读全文CADENA 将 3D 网格逐步重建为可编辑的参数化 CAD 程序,并在每一步执行后检查与目标形状的差距。它同时发布了面向真实机械零件的 CADENA-Bench,用于更细粒度评估 CAD 逆向工程能力。
阅读全文EMBL AI Librarian 试图把 Europe PMC 这样的传统文献检索系统,改造成更适合 AI 智能体调用的证据接口。它让智能体用自然语言提问,并返回可支撑回答的文献片段,而不是只给出一堆论文列表。
阅读全文Anthropic 用尚未发布的 Claude Mythos 模型尝试密码分析,涉及 HAWK 后量子签名方案与缩减轮次 AES。密码学家 Matthew Green 的评论提醒我们:这既是 AI for Science 的进展,也需要谨慎理解其边界。
阅读全文据报道,DeepMind内部原AlphaFold团队已不再作为独立团队存在,成员被分流至Gemini、AI编程、生命科学、核聚变和Isomorphic Labs等方向。Google否认这是放弃科学研究,称其科学团队是在扩大研究范围。
阅读全文Anthropic 的安全模型 Mythos 帮助发现了后量子签名算法 HAWK 的关键弱点,促使其开发者将该算法从 NIST 标准候选中撤回。事件不意味着现实密码系统被攻破,却显示 AI 可能正在改变密码学审查的节奏。
阅读全文OpenAI宣布为10万名学术研究者免费提供ChatGPT先进模型访问权限,意在降低科研使用前沿AI工具的门槛。该计划凸显了通用大模型正在从“效率助手”进入科研协作与发现流程。
阅读全文Anthropic 称,Claude Mythos Preview 协助研究人员改进了针对 HAWK 后量子签名候选方案的攻击,并发现了针对轮数减少版 AES 的新攻击思路。相关结果暂不影响生产系统,但显示前沿模型正开始参与算法层面的密码分析。
阅读全文IDEAgent 提出用质量-多样性(QD)搜索来组织科研选题生成,让大模型不只追求“看起来不错”,也避免产出彼此相似的想法。论文在 32 个计算机科学主题上报告,其 Yield 指标较最佳基线提升 3.89 倍。
阅读全文