Anthropic回应开源AI争议:安全优先于开放
2026-07-28
围绕开放权重AI模型的争论,正在从技术路线之争逐渐演变为产业治理问题。
Anthropic CEO Dario Amodei近日回应相关争议时表示,公司从未主张全面禁止开放模型。此前,包括OpenAI、Google和SpaceX等企业在内的一批公司参与了支持开放模型的联署,而Anthropic成为主要前沿模型企业中唯一没有加入的一方,这也让外界对其立场产生更多讨论。
Amodei试图重新定义Anthropic的位置:不是反对开放,而是反对在缺乏安全边界的情况下推动高度能力模型完全开放。
在他的表述中,开放权重模型确实拥有明显优势。它可以降低企业和开发者使用AI的成本,推动更多团队参与模型创新,也允许客户在自己的环境中部署模型,而无需完全依赖云端服务。
对于一些能力有限、不具备明显风险的模型,Amodei甚至认为可以将其视为“公共产品”。
问题出现在模型能力提升之后。
开放权重意味着模型参数被公开,一旦流出,开发者、企业甚至恶意使用者都可以基于这些权重进行修改。相比传统软件漏洞,AI模型的特殊之处在于,安全限制可能通过调整训练方式或后处理机制被移除,而且公开后的模型很难重新收回。
Amodei认为,开放模型并不天然带来更高安全性。在某些情况下,攻击者可能获得与防御者相近甚至更强的能力,这使得AI安全评估面临新的挑战。
这也是Anthropic与部分支持开源路线企业之间的核心分歧。
OpenAI、Google等公司支持开放生态,背后有推动开发者社区、扩大技术影响力的考虑。尤其是在大模型竞争进入生态争夺阶段后,开放策略能够帮助企业吸引更多开发者和应用伙伴。
但Anthropic更加关注前沿模型可能带来的系统性风险。
为此,该公司提出了三项替代方案。第一,限制先进芯片和制造设备流向中国,以控制高性能AI基础设施扩散速度;第二,打击工业规模模型蒸馏行为,避免高能力模型被快速复制;第三,要求达到一定能力水平的AI模型,无论采用开放还是闭源方式发布,都必须接受网络攻击、生物风险以及模型对齐测试。
这实际上提出了另一种监管思路:监管对象不应该只是模型的开放方式,而应该是模型本身的能力等级。
过去的软件行业习惯通过许可证、代码权限和平台控制来管理风险,但AI模型正在改变这一逻辑。一个模型一旦拥有较强推理、编程或自动化能力,风险可能来自其复制、部署和扩散速度。
当然,Anthropic的观点也面临质疑。开放模型支持者认为,透明和广泛参与本身也是安全机制之一。更多研究者能够查看、测试和改进模型,有助于发现隐藏问题。如果过度限制开放,可能导致AI能力集中在少数大型公司手中。
这场争论并没有简单答案。
未来AI产业可能不会走向完全开放或完全封闭,而是在模型能力、部署方式和风险等级之间建立新的分层规则。对于Anthropic而言,坚持安全审查并不只是技术选择,也是在快速增长的AI市场中塑造自身品牌定位的一部分。
随着前沿模型能力继续提升,如何平衡创新速度与风险控制,将成为整个行业绕不开的问题。
