姬安宁:美国指责中国对美国大模型进行知识蒸馏,这是真的吗?
提问:
美国指责中国大模型对美国大模型进行知识蒸馏,这是真的吗?这属于正常操作还是剽窃?美国情报部门要求对中国大模型“投毒”,能不能达到目的?
豆包回答:
美国三家情报机构发布公告,指责中国企业大规模对美大模型做知识蒸馏,这是美方单方面指控,中方回应称指控于事无凭、于法无据,没有拿出确凿实锤证据。
知识蒸馏是AI领域成熟通用技术,由图灵奖得主辛顿提出,美国企业自身也广泛使用该技术,用来压缩模型、做能力迁移,并不是剽窃 。蒸馏是模仿大模型输出结果,不盗取模型源代码、权重参数。如果违反服务商的用户协议,属于商业合同纠纷,不等同于知识产权剽窃。美方把行业常规技术政治化,是科技竞争下的舆论打压手段 。
关于情报部门对中国大模型“投毒”,技术上存在理论可能性,但很难达到彻底摧毁模型的目的。
数据投毒,是向训练语料混入虚假样本,试图让模型输出错误信息。但国内大模型训练会做语料清洗、内容校验,海量训练数据里少量恶意样本很难造成全局崩坏;只能实现局部诱导,很难让整个大模型彻底失效 。
模型后门投毒需要接触模型权重,境外情报机构很难直接接触到国内企业的模型源码,实施难度很高。
虽然不能完全排除局部干扰风险,但想靠投毒彻底废掉国产大模型,现实中很难实现。
简言之:蒸馏是行业正常技术,美方指控属于政治炒作;投毒有理论风险,但难以实现根本性破坏,国内大模型有对应的安全防护体系。
回复 (1)