返回文章列表
政策与监管

美国指控六家中国AI公司大规模蒸馏前沿模型

阅读约 3 分钟

美国政府正把大型语言模型的“蒸馏”问题,从企业间的技术争议提升为国家安全与产业政策议题。美国国家安全局、网络安全与基础设施安全局以及联邦调查局联合发布声明,指控 DeepSeek、Moonshot AI、阿里巴巴、MiniMax、StepFun 和 Z.AI 自2024年底以来,持续从美国前沿模型中提取能力。声明称,这些行动“很可能”在中国政府知情的情况下进行,但目前公开材料主要呈现为美国机构的指控,而非经过司法程序确认的结论。

核心要点

  • 被指针对多家美国模型提供商。 相关机构称,目标模型包括 Claude、GPT、Gemini 和 Grok 的不同版本。DeepSeek被指同时关注多类模型能力,Moonshot AI则被指通过切换不同模型,学习微调、强化学习、软件工程和数学能力;其他几家公司被指更集中地复制特定模型的能力。
  • 攻击重点是规模化调用。 美国机构称,相关团队可能批量购买或共享高级订阅,利用大量虚假账号和代理网络绕过地域限制,再对模型发起数千至数百万次相似查询。这些查询可用于构建合成训练数据,降低重新训练前沿模型所需的时间和成本。
  • 提示注入被视为重要手段。 指控称,攻击者会设计越狱提示,诱导模型披露隐藏的逐步推理过程,或要求模型解释生成答案时使用的内部方法。素材未提供独立技术审计结果,因此这些细节仍应视为官方说法。
  • 美国企业被要求加强防御。 建议措施包括强化身份验证、监测异常账号和网络、识别订阅与使用量不匹配的账户,并在企业账户中更严格地追踪实际使用者。

最具争议的应对方案

美国机构建议,当系统识别出疑似蒸馏活动时,可以改变回答方式,例如保留结论但调整推理路径、降低推理深度,或在不告知用户的情况下把账号转接到能力较弱的模型。这样做的目标,是降低攻击者从回答中提取高价值训练数据的效率。

不过,模型降级很难做到完全精准。中国企业可能通过自动化质量检测,在短时间内发现模型能力变化;而美国企业若误判,也可能让正常用户突然得到更短、更弱或功能受限的回答。科研人员、第三方评测者和企业客户尤其可能受到影响。美国机构也承认,安全措施可能牺牲预测精度、商业可用性和用户体验,并要求企业在安全与服务质量之间进行权衡。

影响与未决问题

这场争议反映出前沿模型竞争正在从单纯的算力和算法比拼,扩展到接口访问控制、账号治理、数据溯源和跨企业协作。对模型公司而言,API不再只是商业服务入口,也可能成为竞争对手收集能力样本的渠道;对用户而言,更严格的身份核验和隐性模型切换则会带来隐私、透明度与可解释性问题。

美国方面希望企业和盟友共享攻击样本及异常行为信息,以避免各自把孤立事件当作普通服务故障处理。与此同时,相关中国公司和被指遭到调用的美国模型提供商尚未在素材所述时间点作出回应。因此,哪些行为确属未经授权的系统性蒸馏、是否存在政府协同,以及建议措施的实际效果,仍有待更多证据和独立核验。

来源:Ars Technica AI

评论

正在确认登录状态……

正在加载评论……

相关文章

CCTest · Blog
马萨诸塞州收紧数据中心规则:超25MW项目须匹配100%清洁电力
政策与监管
cctest.ai
政策与监管

马萨诸塞州收紧数据中心规则:超25MW项目须匹配100%清洁电力

马萨诸塞州州长莫拉·希利发布行政命令,要求峰值需求超过25兆瓦的数据中心自行解决电力来源,并以清洁能源满足全部用电需求。该州也暂停数据中心销售税豁免申请,成为近期第三个收紧数据中心建设的州。

阅读全文
CCTest · Blog
Anthropic版权和解金分配引争议:作者质疑出版商与代理机构越界申领
政策与监管
cctest.ai
政策与监管

Anthropic版权和解金分配引争议:作者质疑出版商与代理机构越界申领

Anthropic一项15亿美元版权集体诉讼和解进入付款阶段后,多名作者发现出版商甚至文学代理机构正在对相关作品提出分成要求。争议核心在于版权回转记录混乱,以及部分申领比例可能超过合同约定。

阅读全文