正文
发布时间
12 分钟前源站更新
12 分钟前首次抓取
12 分钟前发布时间
2026/03/25 04:5812 分钟前源站更新
2026/03/25 04:5812 分钟前首次抓取
2026/03/25 04:5812 分钟前发布时间
12 分钟前源站更新
12 分钟前首次抓取
12 分钟前用于追踪这条内容的来源与记录标识。
Source
原始链接
发布时间
2026/03/25 04:5812 分钟前源站更新
2026/03/25 04:5812 分钟前首次抓取
2026/03/25 04:5812 分钟前发布时间
12 分钟前源站更新
12 分钟前首次抓取
12 分钟前用于追踪这条内容的来源与记录标识。
Source
原始链接
Why Distillation Is a Growing Worry for US AI Companies
美国的人工智能公司已花费数千亿美元开发先进的聊天机器人,押注于能从客户那里赚取足够收入以证明投资合理。这种方式面临被以低成本构建竞争性 AI 系统的对手破坏的风险。
美国安全机构 9 月 8 日指责包括 DeepSeek 和 Kimi 制造商月之暗面(Moonshot AI)在内的中国竞争对手,利用所谓的蒸馏技术不当借用领先的美国 AI 模型。根据美国国家安全局、联邦调查局和网络安全与基础设施安全局发布的联合声明,这些中国公司至少自 2024 年以来,就“以工业规模”获取并提取美国 AI 模型的信息来训练自己的系统。该声明为美国公司 Anthropic PBC 和 OpenAI 此前提出的蒸馏指控增添了分量。中国商务部称这些指控“毫无根据”。
蒸馏是 AI 实验室常用的一种方法,即利用另一个模型的输出来训练一个大语言模型。开发者向一个更大、能力更强的“教师”模型提交一系列提示,其响应被用来训练一个较小的“学生”模型,以复制教师模型的许多能力。
由此产生的模型可以执行原模型的许多相同功能,但所需成本和计算能力只是从头开发并运行类似系统的一小部分。知识并非直接从一模型转移到另一模型,而是学生模型根据其查询结果学习模仿教师模型的行为。
当公司在自己的模型上使用蒸馏,或外部开发者使用蒸馏来构建非竞争性技术时,蒸馏被认为是可接受的。这种方法被称为授权蒸馏,允许公司和研究人员将大型模型压缩成更小、更高效、针对特定任务优化的模型。衍生模型通常缺乏原模型的全部能力,但运行更快,开发和运营成本更低。
第三方可能会利用蒸馏,在未经参考模型所有者许可的情况下复制专有 AI 模型的能力。这种做法引发了法律、经济和安全方面的担忧。
美国领先的 AI 公司表示,未经授权的蒸馏使其业务面临风险。包括 DeepSeek 在内的许多中国实验室已开发出开放权重模型,这意味着底层 AI 系统的部分组件对用户公开,可自由下载并在自己的平台上运行。
相比之下,美国最大的 AI 公司一直保持其模型的专有性,押注客户会付费使用其产品,以便他们能收回在数据中心和其他基础设施上花费的数千亿美元。他们辩称,如果竞争对手能以一小部分成本复制其模型,并以低价或免费提供,就可能侵蚀其销售额。美国官员估计,未经授权的蒸馏每年给美国企业造成数十亿美元损失。
美国 AI 公司还表示,未经授权的蒸馏存在安全风险。他们警告说,外国对手可能利用这项技术开发出剥离了护栏的 AI 模型,这些护栏旨在阻止人们将平台用于非法或危险目的,例如制造致命病原体或进行自动化的大规模计算机黑客攻击。
证据往往是间接的,目前很难毫无疑义地证明竞争对手的模型是通过蒸馏开发的。
Anthropic 在 2 月份表示,中国的三家领先 AI 开发商试图“非法提取”其模型的结果。该公司称,这些公司使用欺诈性账户生成了超过 1600 万次交互,它能够根据互联网协议地址和元数据信息定位这些账户。它补充说,行业合作伙伴“在其平台上观察到了相同的参与者和行为”。
据知情人士透露及彭博新闻社看到的副本,Anthropic 在 6 月致多位美国参议员和白宫官员的信中称,阿里巴巴集团控股有限公司涉嫌进行的蒸馏操作在 4 月至 6 月期间通过近 2.5 万个欺诈性账户与其 Claude 聊天机器人进行了 2880 万次交互。
美国顶级 AI 公司正采取措施打击他们所谓的“蒸馏攻击”,包括更广泛地分享关于模型输出被未经授权提取的信息,并努力阻止可疑用户访问其系统。
华盛顿的立法者和特朗普政府正在关注硅谷的担忧。4 月,白宫表示将与业界合作,确定如何遏制蒸馏并追究恶意行为者的责任。众议院共和党人也呼吁美国对以工业规模进行蒸馏以构建竞争性系统的中国实体实施制裁。
中国商务部在对美国安全机构关于蒸馏的指控作出回应时表示,中方愿与美方就人工智能进行讨论。但商务部表示,如果美方以打击模型蒸馏为借口,采取行动压制中国 AI 公司,中方将采取反制措施。中方在声明中指责美国寻求对人工智能行业的垄断。
为什么中国价格实惠的人工智能令硅谷担忧?
什么是 Moonshot AI?它为何引起关注?
中国计划如何为 AI 时代构建骨干?
发布时间
29 天前
2026-09-09 19:53:02 UTC
源站更新
29 天前
2026-09-09 19:53:02 UTC
首次抓取
29 天前
2026-09-09 19:55:29 UTC
美国安全机构 9 月 8 日指控中国企业利用“蒸馏”技术大规模窃取美国 AI 模型信息以训练自家系统,中国商务部称指控毫无根据。蒸馏技术能以低成本和算力复制大型模型能力,引发美国 AI 企业的法律与安全担忧。
美国国家安全局、联邦调查局和网络安全与基础设施安全局 9 月 8 日联合声明,指控包括 DeepSeek 和 Kimi 开发者月之暗面在内的中国竞争对手,自 2024 年起至少以“工业规模”访问并从美国 AI 模型中提取信息,用于训练自己的系统。声明称这种做法属于不正当的“搭便车”行为,并支持了美国公司 Anthropic 和 OpenAI 之前提出的蒸馏相关指控。中国商务部回应称这些指控“毫无根据”。
蒸馏是一种 AI 实验室常用的方法:开发者向一个更大、能力更强的“教师”模型提交一系列提示词,然后使用其输出来训练一个更小的“学生”模型,使其能复制“教师”的许多能力。得到的模型能以远低于从零开发同级别系统所需的成本和算力实现类似功能,但知识并非直接转移,而是通过查询结果“模仿”教师行为。当企业将蒸馏用于自家模型或非竞争性技术时,被视为可接受;这种方法可将大模型压缩为针对性更强、运行更快的小模型。
争议源于第三方未经许可利用蒸馏复制专有 AI 模型的能力。美国主流 AI 公司认为,未经授权的蒸馏损害其商业模式。许多中国实验室如 DeepSeek 发布开放权重模型,用户可免费下载和运行;而美国大模型公司以专有模式运营,期望通过收费收回数千亿美元投资。美国官员估计,未经授权的蒸馏每年使美国企业损失数十亿美元收入。此外,美国公司警告说,外国对手可能借此开发去除安全护栏的 AI,从而用于制造致命病原体或进行大规模自动化网络攻击等非法活动。
检测蒸馏攻击往往依靠间接证据。Anthropic 在 2 月表示,三家中国 AI 开发商通过欺诈账户非法提取其模型结果,涉及超过 1600 万次交互,并可通过 IP 地址和元数据追踪。另一封 6 月信件显示,阿里巴巴据称在 4 月至 6 月间利用近 2.5 万个欺诈账户与 Claude 进行了 2880 万次交互。为应对“蒸馏攻击”,美国 AI 公司正加强信息共享并阻止可疑用户。白宫和众议院共和党人也表达了关切或要求制裁。中国商务部表示愿与美方讨论 AI 问题,但若美国以打击蒸馏为借口压制中国 AI 企业,中方将采取反制措施,并指美国试图垄断 AI 产业。
US security agencies accused Chinese rivals including DeepSeek and Moonshot AI of industrial-scale model distillation from American AI systems; China denies it. Distillation lets models be trained cheaply from another model's outputs, raising economic and security concerns.
用于追踪这条内容的来源与记录标识。