AI消息速览

Anthropic 对开放权重模型的立场

事件日期 2026-07-27 · 产业观察 · 已接受

事件日期2026-07-27
信息日期2026-07-27
入库日期2026-07-28
通道产业观察
状态已接受
来源Anthropic 博客

知识卡片:Anthropic 对开放权重模型的立场

一句话结论:Anthropic CEO Dario Amodei 明确声明公司从未主张全面禁止开放权重模型,而是主张通过芯片出口管制、打击工业规模蒸馏和强制安全测试来应对国家安全风险,反对保护主义禁令。

事件概述

2026 年 7 月 27 日,Anthropic CEO Dario Amodei 发布公开声明,回应近期围绕中国开放权重模型以及部分美国官员考虑禁止美国企业使用中国开放权重模型的讨论。声明澄清 Anthropic 的立场,并解释其核心关切与应对措施。

方法/产品要点

  • 开放权重模型的价值:没有危险能力的开放权重模型是公共产品,除运行所需算力外不产生额外成本,为商业、开发者和研究者提供价值。
  • 不主张禁令:Anthropic 从未主张禁止开放权重模型,保护主义禁令无法解决最深层的国家安全担忧。
  • 两大担忧场景
    1. 主要担忧:威权政府(尤其中国共产党)构建比美国更强大的 AI 模型,用于获取永久军事优势或实施深度镇压。模型是否开放权重不关键,最危险的可能是秘密训练、仅供解放军和国家安全部使用的模型。
    2. 次要担忧:强大 AI 模型被滥用实施网络攻击或生物攻击,存在严重对齐问题。开放权重模型因难以施加护栏和监控,风险高于封闭模型,但禁止美国企业使用无法阻止恶意行为者。
  • 支持的三项措施
    1. 芯片出口管制:不向中国出售强大芯片或芯片制造设备,打击走私,利用缩放定律限制中国模型能力提升。这是阻止威胁 #1 最直接有效的途径,也有助于威胁 #2。
    2. 打击工业规模蒸馏:蒸馏比从头训练更高效,使中国在芯片数量受限下仍能逼近美国前沿。需政策干预遏制此类行为,但全面禁止开放权重模型不是正确对策。
    3. 强制安全测试:所有足够强大的模型(无论开源或闭源)在发布前应经过网络安全、生物安全和对齐风险测试。测试需全球化,可能获得中国合作。开放模型的风险应通过测试确定,而非预先假设。

主要结果或产业意义

  • 澄清了 Anthropic 与部分科技公司签署支持开放权重的公开信之间的分歧:Amodei 同意信中的部分观点(促进 AI 经济普及、增强竞争、用户控制权),但不同意“开放权重必然有利于安全”的论断,认为攻击者与防御者的结构性优势需要基于实证测试,不可预先假定。
  • 提出生物安全领域存在强“攻击者-防御者不对称”:足够能力的模型可能用广泛可得材料快速武器化大流行级病毒,而防御需要数年。
  • 确认 Anthropic 自身也在通过识别和封禁利用其模型进行蒸馏的账户来打击工业规模蒸馏,但仅靠企业实践无法彻底解决问题,需要政策介入。

为什么重要

  • 在关于开放权重模型监管的激烈辩论中,Anthropic 作为领先的 AI 安全公司提供了不同于“全面支持开源”或“全面禁止开源”的第三条路线:聚焦能力源头(芯片、蒸馏)和结果导向的安全测试,而非针对模型发布形式。
  • 直接回应了“Anthropic 主张禁止开源以保护商业利益”的指控,维护公司声誉并推动理性讨论。
  • 与已有相关卡片(公众提问倡议、Public First Action 捐赠)形成脉络:Anthropic 持续通过政策倡导和公开沟通影响 AI 治理框架,此卡片提供了其在开源权重核心议题上的具体政策立场。

局限与不确定性

  • 芯片出口管制的有效性取决于执行力度和走私渠道的堵截效果,中国国内芯片生产能力及替代路径需进一步评估。
  • 全球性安全测试要求中国同意参与,Amodei 认为可能实现,但具体可行性待核实。
  • 文中提及“开放权重模型可能增加风险”但未量化,风险差异程度需实证数据支持。
  • 对于“蒸馏无法使中国获得等同或超越美国的能力”这一论断,随技术发展可能变化,需持续跟踪。
  • 生物安全中攻击者优势的具体程度、AI 能力何时会突破现有安全边界仍需进一步研究。

可用于图书/PPT/简报的角度

  • 政策对比视角:对比“全面禁止开源”“全面允许开源”“以能力源头和安全测试为核心”三种路线,以 Anthropic 立场作为平衡监管与创新的典型案例。
  • 地缘科技视角:芯片出口管制作为 AI 地缘竞争的核心手段,结合缩放定律解释为什么管制芯片比管制模型更有效。
  • 安全测试机制的全球治理:从自愿测试到强制测试、从国内到全球,探讨 AI 安全标准的国际协调可行性,尤其是中美合作窗口。
  • 开源的意外风险:用生物攻击的“攻击者-防御者不对称”论证开放权重在特定能力阈值下可能带来的不可逆风险。

原始材料

  • URL: https://www.anthropic.com/news/position-open-weights-models
  • Fetched title: Our position on open-weights models
  • Fetched description: Anthropic CEO Dario Amodei on open-weights models
  • 英文关键词:open-weights models, AI safety, chip export controls, distillation, mandatory safety testing, Anthropic, Dario Amodei