腾讯混元发布 Hy4 preview:770B 参数模型迈向 Agent 化应用
阅读约 2 分钟
腾讯混元近日发布 Hy4 preview,一款面向生产力场景的开源大模型。按照发布信息,该模型总参数规模为 770B,激活参数为 4.9B,上下文长度达到 1M。官方称,Hy4 preview 在代码、办公、科学等任务上处于开源模型第一梯队。
核心要点
- 超大总参数与较低激活规模:Hy4 preview 的总参数为 770B,但每次推理激活参数为 4.9B。这样的设计将模型容量与实际计算过程区分开来,重点在于让模型保留较大的知识和能力空间,同时控制单次运行所需的资源。
- 长上下文能力:1M 上下文长度为处理大体量代码、文档和连续任务提供了基础。不过,实际效果仍取决于推理部署、检索策略以及模型在长文本中的信息保持能力,不能仅凭上下文上限判断使用体验。
- 开源与多渠道提供:模型已发布至 Hugging Face、GitHub、ModelScope 和 Gitcode,并上线腾讯云 TokenHub 与 OpenRouter。开发者可以根据部署能力和使用方式选择本地研究、平台调用或服务集成。
- 从模型到 Agent:本次发布的变化并不局限于参数和架构。Hy4 preview 还展示了模型与游戏引擎、MCP 等外部工具或运行环境结合的方向,强调模型在具体工作流中执行任务,而不仅是生成文本。
意义与影响
Hy4 preview 的价值,一方面在于把长上下文、大规模参数和开源分发放在同一个产品中,另一方面在于强化“模型即 Agent”的产品思路。对开发者来说,接入游戏引擎或 MCP,意味着模型可以更自然地进入已有软件和工具链,承担调用工具、处理信息与推进任务等环节。
不过,目前公开信息主要来自发布摘要,尚不足以独立核验其“开源模型第一梯队”的定位,也缺少完整评测、许可证细节、硬件要求和不同部署方式下的成本数据。因此,实际选型时仍应结合公开权重、接口限制、评测方法和应用场景进行验证。总体看,Hy4 preview 体现了国产大模型竞争从单纯比拼参数,转向同时比拼上下文、开放生态与 Agent 落地能力。
来源:OSChina
评论
正在确认登录状态……
正在加载评论……