返回文章列表
模型发布

腾讯混元发布 Hy4 preview:770B 参数模型迈向 Agent 化应用

阅读约 2 分钟

腾讯混元近日发布 Hy4 preview,一款面向生产力场景的开源大模型。按照发布信息,该模型总参数规模为 770B,激活参数为 4.9B,上下文长度达到 1M。官方称,Hy4 preview 在代码、办公、科学等任务上处于开源模型第一梯队。

核心要点

  • 超大总参数与较低激活规模:Hy4 preview 的总参数为 770B,但每次推理激活参数为 4.9B。这样的设计将模型容量与实际计算过程区分开来,重点在于让模型保留较大的知识和能力空间,同时控制单次运行所需的资源。
  • 长上下文能力:1M 上下文长度为处理大体量代码、文档和连续任务提供了基础。不过,实际效果仍取决于推理部署、检索策略以及模型在长文本中的信息保持能力,不能仅凭上下文上限判断使用体验。
  • 开源与多渠道提供:模型已发布至 Hugging Face、GitHub、ModelScope 和 Gitcode,并上线腾讯云 TokenHub 与 OpenRouter。开发者可以根据部署能力和使用方式选择本地研究、平台调用或服务集成。
  • 从模型到 Agent:本次发布的变化并不局限于参数和架构。Hy4 preview 还展示了模型与游戏引擎、MCP 等外部工具或运行环境结合的方向,强调模型在具体工作流中执行任务,而不仅是生成文本。

意义与影响

Hy4 preview 的价值,一方面在于把长上下文、大规模参数和开源分发放在同一个产品中,另一方面在于强化“模型即 Agent”的产品思路。对开发者来说,接入游戏引擎或 MCP,意味着模型可以更自然地进入已有软件和工具链,承担调用工具、处理信息与推进任务等环节。

不过,目前公开信息主要来自发布摘要,尚不足以独立核验其“开源模型第一梯队”的定位,也缺少完整评测、许可证细节、硬件要求和不同部署方式下的成本数据。因此,实际选型时仍应结合公开权重、接口限制、评测方法和应用场景进行验证。总体看,Hy4 preview 体现了国产大模型竞争从单纯比拼参数,转向同时比拼上下文、开放生态与 Agent 落地能力。

来源:OSChina

评论

正在确认登录状态……

正在加载评论……

相关文章