GigaBrain-0.7:用三系统架构推动具身模型跨机器人泛化
GigaBrain-0.7试图把理解、预测与行动统一到一个具身基础模型中,并通过三系统架构引入面向行动前模拟和评估的世界模型。论文称,该模型在超过3.7万小时异构具身数据上预训练,面向多种机器人展现出更强的任务适应性。
阅读全文Claude API 中转站避坑指南、检测原理与大模型 API 实测经验
共 775 篇文章
GigaBrain-0.7试图把理解、预测与行动统一到一个具身基础模型中,并通过三系统架构引入面向行动前模拟和评估的世界模型。论文称,该模型在超过3.7万小时异构具身数据上预训练,面向多种机器人展现出更强的任务适应性。
阅读全文AutoSaddler 将智能体执行框架优化转化为离线学习问题,通过诊断失败轨迹、生成结构化补丁并验证更新效果,减少人工调试成本。实验显示,该方法在多个长程任务基准上带来稳定性能提升。
阅读全文CyberFactory 提出了一套开源流程,将现实世界的漏洞信息重建为可执行任务,并通过工具交互和差分验证生成训练轨迹。基于这些数据训练的 OpenAegis,在 CyberGym 测试中显著超过其基础模型。
阅读全文SecOPD 将提示注入防御从整段输出评估推进到逐令牌反馈。论文称,该方法让 Qwen3.6-27B 在 PISmith 自适应攻击上的成功率从 94.0% 降至 9.0%。
阅读全文LAION 发布 LAION-BVD,汇集约 8000 万个视频、总时长达 1000 万小时,并覆盖视频、音频与图像三类训练信号。研究显示,基于场景切分和合成描述构建的数据,能够支持多种跨模态任务。
阅读全文一篇综述重新审视智能眼镜:它们的价值不只在于拍摄和显示,而在于能否把感知、记忆、交互与行动连接成可靠闭环。真正的难点,是在能耗、隐私和安全约束下持续工作。
阅读全文一项名为 Station 的开放世界多智能体环境,让来自不同模型家族的AI围绕数学研究目标自行分工、实验与协作。论文称,该系统在多个组合数学与几何问题上获得了相对既有文献的新结果,并公开了对话、证明和验证代码。
阅读全文据知情人士透露,机器人初创公司Generalist在8VC领投的新一轮追加融资后,估值达到30亿美元。该笔近2亿美元资金是其今年6月宣布的4亿美元B轮延伸融资,使本轮总额增至约6亿美元。
阅读全文OpenAI前数据中心负责人Chris Malone离职,此前公司已调整基础设施部门的汇报关系。随着多名高管在2026年相继离开,OpenAI的数据中心扩张、组织稳定性与潜在上市计划再次受到关注。
阅读全文EchoWM提出一种可进入式全模态世界模型,用户持续改变观察轨迹时,系统能够同步生成720p视频、环境音、音乐与语音。其核心是把离散指令和连续姿态统一到共享的相对6自由度轨迹中,并兼顾第一人称与第三人称场景。
阅读全文Prime Agent 是一个面向长程评测与编码代理工作流的开源 harness。它通过持久化 REPL、跨轨迹记忆和递归子代理,减少基础设施故障对模型能力评估的干扰。
阅读全文MobilePA-Bench 提出一个面向移动规划智能体的交互式评测环境,重点考察工具调用、长程规划、记忆、技能与子智能体协作。研究显示,现有前沿大模型在严格工具顺序、权限限制和运行时错误下仍不够可靠。
阅读全文Thinkingbox 将智能体评测从“答对或调用对工具”推进到真实业务流程的最终状态验证。其基准显示,模型偶尔完成任务与稳定完成任务之间仍存在明显差距。
阅读全文GameXpert-Bench 将游戏编码智能体置于完整开发周期中评测,覆盖生成、修复与多轮优化三个阶段。结果显示,智能体擅长实现明确需求,却仍不善于主动发现缺陷、验证运行行为和避免回归。
阅读全文一项针对语音问答的研究发现,实体图链接与迭代式查询改写虽然能提升多跳 RAG 的绝对效果,却可能放大上游语音识别错误。真正脆弱的环节,往往不是生成,而是被识别错误污染的查询实体。
阅读全文TileMix 将注意力矩阵划分为硬件友好的分数瓦片,并在同一个融合内核中为不同瓦片选择 FP16 或 INT8。它不裁剪 token 连接,在提升预填充效率的同时,试图弥补统一 INT8 带来的长上下文质量损失。
阅读全文一项 EMNLP 2026 Findings 研究发现,搜索增强型大模型会受到被篡改网页的影响,甚至推荐并不存在的商品。推理模式和现有防御机制也未能可靠解决这一问题。
阅读全文一项针对检索增强问答系统的研究发现,即使模型、提示词和生成控制项保持不变,扩充语料索引仍可能让系统给出不同答案。研究提出“快照兼容性审计”,用于区分真正的索引影响与模型自身的随机波动。
阅读全文RIBOSPAN 是一个原生支持最长 10,240 个核苷酸、拥有 16.1 亿参数的双向 RNA 基础模型。研究显示,原生长上下文训练在完整转录本建模、表示学习和 mRNA 设计方面具有明显优势。
阅读全文WorldToken 将每个决策时刻的多视角图像、本体感知和任务条件融合为一个世界令牌,再用因果 Transformer 建模时间序列。实验显示,目标域数据和较长历史上下文对模仿学习表现尤其重要。
阅读全文ReWorld 将短期动作控制与长期场景记忆分开训练,并在推理时通过有限 KV 缓存和基于位姿的地标检索控制计算量。论文还通过统一动作尺度、回环轨迹和蒸馏技术,让同一模型兼顾高质量生成与实时交互。
阅读全文