Hacker News 中文摘要

RSS订阅

我们对开放权重模型的立场 -- Our position on open-weights models

文章摘要

Anthropic CEO澄清公司从未主张禁止开源权重模型,认为无害的开源模型是公共产品,但担忧两种国家安全噩梦场景,反对保护主义禁令。

文章总结

关于开放权重模型的立场

近日,围绕开放权重模型(尤其是来自中国的模型)的讨论日益激烈。有报道称,部分美国官员正考虑禁止美国企业使用中国的开放权重模型。对此,许多科技公司签署了一封支持开放权重模型的公开信,甚至有人指责Anthropic公司试图通过推动禁令来保护自身业务。在此,我明确重申:Anthropic从未主张禁止开放权重模型。

不具备危险能力的开放权重模型是一种公共产品——它们除了运行所需的算力外不产生额外成本,并为企业、开发者和研究人员提供价值。

保护主义禁令无法解决我最关心的国家安全问题。具体而言,我担忧两种极端情景:

  1. 首要担忧:威权政府(不仅限于中国共产党,但中国共产党显然是最具威胁的对手)构建出比美国更强大的AI模型,并利用它们实现永久军事优势或对本国人民实施深度压制。这种担忧在美国政府内部广泛存在。无论这些模型是否以开放权重发布,甚至是否被美国企业使用,都无关紧要。事实上,最危险的模型可能是秘密训练、仅交付给解放军用于无人机或国家安全部用于监控和镇压的模型。

  2. 次要担忧:强大的AI模型可能被滥用于网络攻击或生物攻击,并存在严重的对齐问题。开放权重模型(无论来自中国还是其他地区)确实比封闭模型风险更高,因为很难对其施加防护措施或监控使用情况,且权重一旦发布便无法撤回。但禁止美国企业使用这些模型并不能解决这一风险,因为恶意行为者不太可能是合法的美国企业。这种禁令只会保护美国AI公司免受竞争,但这从来不是我的目标。

为应对这些担忧,我支持以下三项措施,这也是Anthropic一贯倡导的:

  • 不应向中国出售先进芯片或芯片制造设备,并严厉打击猖獗的走私和规避行为。中国国内生产能力有限,因此根据缩放定律,没有美国芯片就无法构建比美国更强大的模型。这是阻止威胁#1最有效、最直接的方式,同时通过阻碍美国法律无法触及的模型训练,间接有助于应对威胁#2。

  • 应严厉打击工业规模的蒸馏操作。蒸馏比从头训练模型计算效率高得多,使中国能够用更少的芯片构建更好的模型,从而部分规避芯片禁令。蒸馏虽不能让中国获得与美国相当或更优的AI能力,但能将中国的前沿水平拉近至美国前沿的几个月内。许多进行蒸馏操作的公司确实发布了开放权重模型——但开放权重远不如这些操作背后有威权国家支持、试图超越美国前沿这一事实重要。我们应通过政策干预来遏制这种行为。全面禁止开放权重模型既不是正确的补救措施,也不是我们所呼吁的。

  • 所有足够强大的模型(无论开放还是封闭)都应接受强制性安全测试。应对威胁#2的最佳方式是在发布前直接测试模型的网络、生物和对齐风险。我认为这一想法已接近共识:特朗普政府近几个月已朝此方向迈进,业界也提出了相关提案,要求对最强大的模型(无论其来源国或开放/封闭状态)进行此类测试,同时豁免初创公司和学术界等能力较弱的模型。开放模型是否构成更高风险、风险能否缓解,应通过测试来回答,而非预先决定。此外,可能存在改进开放权重模型安全性的有前景方法,包括Anthropic关于模块化训练策略的最新研究。需要注意的是,测试需在全球范围内进行,这意味着中国共产党也必须参与。我认为这或许可行:正如我在《技术的青春期》中所写,在防止AI生物武器方面进行有限合作是可能的,因为这同样符合中国的利益。

关于那封公开信,我同意其中大部分内容:开放权重扩大了AI经济的准入,至少在某些用例中增强了竞争,并赋予客户更多控制权。蒸馏问题应通过有针对性的法律和商业框架来解决——即我上述提到的措施。但我不同意信中关于开放权重模型必然更易于开发防护措施、或广泛的能力准入必然更有利于防御者而非攻击者的论断。在我看来,相反的情况同样可能成立。例如,我担心生物学存在强烈的攻击-防御不对称性:足够强大的模型可能利用广泛可得的材料迅速将大流行级别的病毒武器化,而防御这些病原体即使在最佳情况下也是一项多年的操作任务(如我们在“曲速行动”中所见)。此类问题应通过严格的发布前测试来实证回答,而非预先假设。

总结我和Anthropic的立场:我们从未、也不会主张全面禁止开放权重模型。相反,我们应专注于将强大芯片排除在威权之手外、打击工业规模蒸馏,并要求所有足够强大的模型(无论开放还是封闭)接受安全测试。

评论总结

根据评论内容,总结如下:

主要观点与论据:

  1. 批评Anthropic立场虚伪,实为打压竞争(多数评论,评分无)

    • 评论者普遍认为Anthropic表面支持开源模型,实则通过监管要求(如禁止蒸馏、强制安全测试)限制竞争对手,尤其是中国AI企业。
    • 关键引用:
      • "Demand #2 is hypocritical ladder pulling" (akersten)
      • "It's so obvious they are hoping to regulate out their competition rather than compete" (richwater)
      • "This is anthropic advocating for a ban on open weight models... Who runs this test?" (cogman10)
  2. 对“安全测试”和“蒸馏禁令”的质疑(部分评论)

    • 评论者质疑安全测试的标准制定者可能被企业游说,且蒸馏禁令与Anthropic自身使用他人数据的行为矛盾。
    • 关键引用:
      • "Who decides what is dangerous... Lawmakers usually have the say but Anthropic can easily bribe" (syntaxing)
      • "Also Anthropic: AI firm Anthropic agrees to pay authors $1.5bn to settle piracy lawsuit" (fuddle)
  3. 对“中国威胁论”的讽刺与反驳(部分评论)

    • 评论者认为Anthropic将中国作为借口,实际担忧的是自身利益,并指出美国同样存在滥用AI的风险。
    • 关键引用:
      • "Every single risk he identifies as a concern regarding China is exactly my concerns with the US having absolute control" (Aboutplants)
      • "China this and China that. Playing right from the playbook" (kingwill101)
  4. 少数支持或中立观点(极少数评论)

    • 个别评论者认为Anthropic的立场有一定合理性,或认为其担忧并非完全无理。
    • 关键引用:
      • "Their position seems fair to me - sure it does help them as well, but I don't necessarily disagree with the risk" (Handy-Man)
      • "Seems like the maximal position he could take compatible with his expressed principles" (arjie)

平衡性总结: - 绝大多数评论批评Anthropic的立场是“伪善的梯子抽走”(hypocritical ladder pulling),认为其通过监管手段保护自身商业利益,而非真正关注安全。 - 少数评论认可其风险担忧,但未形成主流。 - 评论者普遍对“安全测试”和“蒸馏禁令”的执行标准与公平性表示怀疑,并指出Anthropic自身存在数据使用争议。