随着美国政府就人工智能新规展开讨论,Anthropic与英伟达相继表态,反对对开源权重模型实施全面禁令,并呼吁监管机构将注意力集中在具体风险与滥用行为上。
什么是开源权重模型
开源权重模型是指开发者公开发布经过训练后的模型参数(即"权重")的一类模型。这些权重是训练过程中学习到的数值与向量,决定着模型的行为方式,类似于可调节的旋钮,用于控制模型的输出结果与性能表现。由于权重对外开放,开发者可以利用私有数据对其进行微调,从而针对特定业务场景定制模型能力。
开源权重模型支持用户与企业在本地或自有云环境中直接运行,无需依赖OpenAI、Anthropic等大型AI厂商的闭源前沿模型。目前广为人知的开源权重模型包括Meta的Llama、Mistral AI的系列模型、阿里巴巴的Qwen以及DeepSeek的系列模型,这些模型均允许开发者直接下载、运行并调整其权重。
监管动向与行业回应
据Axios报道,美国商务部去年曾考虑将多家中国AI实验室列入"实体清单",此举将实际上禁止美国企业在未获许可的情况下访问其模型。近期,美国财政部长斯科特·贝森特亦表示,白宫可能对开源权重中国前沿实验室实施制裁。
对此,Anthropic首席执行官达里奥·阿莫迪在一篇长文中明确表示,该公司从未主张禁止开源权重模型。"不具备危险能力的开源权重模型是一种公共资源:除运行所需的算力外不产生任何成本,同时为企业、开发者和研究人员创造价值。"他强调,监管重心应落在围绕模型的基础设施与使用行为上,而非模型本身,具体措施包括:管控高性能AI训练与推理芯片的出口、防范工业级规模的蒸馏行为(即利用大模型提升小模型性能),以及要求对足够强大的模型进行安全测试,无论其是开源还是闭源。
Anthropic对蒸馏问题的警惕,源于外界对其最强前沿模型Mythos和Fable被秘密用于训练境外AI模型的担忧。上周,美国白宫科技政策办公室主任迈克尔·克拉齐奥斯指控北京月之暗面公司通过蒸馏技术训练了其最新大语言模型Kimi K3——据称这也是目前全球规模最大的开源权重模型。尽管业界高度怀疑存在工业级蒸馏行为,但目前尚无证据表明K3曾使用Mythos的训练数据。
英伟达首席执行官黄仁勋则在X平台(前身为Twitter)上转发了一封由英伟达联署的公开信,并写道:"AI将改变每一个行业,驱动每一家企业,并将在每个国家得到建设。开源模型能够强化安全性与网络安全防护、加速创新与技术扩散,并赋予各国技术自主权。世界需要闭源前沿模型,也需要开源前沿模型。"
这封由英伟达、IBM、Mozilla、微软、Meta及众多科技行业领袖联署的公开信指出,开源权重模型有助于推动创新、促进竞争、保障用户控制权与技术主权,签署方明确反对对此类模型施加额外限制,认为这将损害其在更广泛软件与AI生态中的价值。
Q&A
Q1:开源权重模型和闭源模型有什么区别?
A:开源权重模型会公开发布训练后的模型参数(权重),用户可以下载后在本地或自有云环境中运行,也可以用自己的数据进行微调定制,不需要依赖OpenAI、Anthropic等大厂的闭源服务。而闭源模型的权重不对外公开,用户只能通过API等方式调用,无法直接修改或在本地部署。
Q2:Anthropic为什么反对全面禁止开源权重模型?
A:Anthropic CEO达里奥·阿莫迪认为,不具备危险能力的开源权重模型是公共资源,能为企业、开发者和研究人员创造价值。他主张监管应聚焦在具体风险上,比如管控高性能AI芯片出口、防范工业级模型蒸馏行为、要求强大模型进行安全测试,而不是一刀切地禁止开源权重模型。
Q3:什么是模型蒸馏?为什么Anthropic对此感到担忧?
A:模型蒸馏是指用一个大模型来辅助训练或提升一个小模型性能的技术。Anthropic担心其最强的前沿模型Mythos和Fable被他人秘密用于蒸馏训练境外AI模型。白宫科技政策办公室曾指控月之暗面公司通过蒸馏技术训练了Kimi K3模型,但目前尚无直接证据证明K3使用了Mythos的数据。
