研究员刚辞职、第四次安全事件刚曝光——Anthropic和OpenAI同一天背书Newsom AI安全法案:真改变还是危机公关?
2026年9月9日,这一天同时发生了两件看似矛盾的事情。
早些时候,Reuters报道Anthropic发现了公司第4次涉及Claude的网络安全事件,AI模型在测试中误入真实系统。几乎同步,一位Anthropic高级研究员Jacob Coxon公开辞职,发表声明称”OpenAI和Anthropic在赌命”,并预测AI有超过10%的概率”杀死所有人类”。
就在这个背景下,加州州长Gavin Newsom签署了两项AI安全法案——而且,Anthropic和OpenAI都公开背书,支持这次签署。
这个时间节点,需要被认真审视。
这两项法案规定了什么
Newsom签署的两项法案,核心是规范”第三方评估机构如何对AI程序进行安全评估”。
具体说:不是由政府直接评估AI系统,而是建立一套认证框架,让有资质的第三方机构来评估AI的安全风险——类似于食品安全检测有认证实验室,飞机维修有FAA授权机构。
这个模式的关键优势在于:灵活性更高(不依赖政府的技术能力),可以随技术发展更新标准,同时保持了”有人在管”的监管存在感。
对于AI公司来说,这个方案有一个明显的特点:它没有规定AI系统本身必须达到什么技术指标才能运营,而是规定评估程序要如何进行。
换句话说,这是一个关于”谁来评估、如何评估”的法案,而不是”必须达到什么安全标准”的法案。
这个区别,非常重要。
为什么Anthropic和OpenAI选择支持这个法案
3天前,同样是Anthropic和谷歌(以及部分OpenAI联盟),在马萨诸塞州的AI安全立法中站在了反对方。
那个法案要求AI公司承担更直接的法律责任,并设定了具体的技术安全阈值。Anthropic彼时的立场是:这会妨碍创新,且技术阈值设定得不合理。
现在,对于加州的法案,立场反转了:支持。
这个转变背后的逻辑,值得分解:
第一,评估框架对AI公司更友好。 加州法案的核心是”第三方评估”而非”政府强制标准”。AI公司可以影响甚至参与认证机构的标准制定,而政府立法则更难被影响。对于Anthropic来说,支持一个AI公司有发言权的评估框架,优于被动接受一个完全外部的强制标准。
第二,选择性监管支持是一种策略。 在马萨诸塞反对、在加州支持——这不是立场不一致,这是一个精心设计的监管策略:支持自己能参与设计的框架,反对自己无法控制的框架。这是华盛顿的大科技公司几十年来的教科书做法。
第三,时机决定动机。 在研究员辞职声明和第四次安全事件同一天,公开支持AI安全法案——这几乎是教科书级别的危机应对。它传递的信号是:”我们不是在逃避责任,我们是在推动有效的监管”。
Jacob Coxon说的是什么
要理解Anthropic的这次表态,不能忽略Jacob Coxon的辞职声明。
Coxon是Anthropic的高级安全研究员,之前也在OpenAI工作过。他辞职时接受了Time杂志的采访,用了一句非常直接的表述:这两家公司”正在赌我们所有人的性命”。
他的核心论点是:AI能力的发展速度已经超过了安全研究和治理机制的跟进速度。而他认为,在这个差距没有缩小之前,继续加速并不道德。
他还说,AI有”超过10%的概率”能够以某种方式导致人类灭绝或严重危机。
这个表述引发了一场技术界的辩论。10%是高是低,取决于你的参照物。如果你说一架飞机有10%的概率坠毁,没有人会上飞机。但如果你说某个研究领域有10%的概率引发某种未知风险,你是否继续研究,取决于你对”研究收益”和”风险可控性”的判断。
Anthropic官方对Coxon的辞职没有做直接回应,但在同一天支持了Newsom的AI安全法案——这是一种沉默中的表态。
加州法案与马萨诸塞法案的结构差异
这里有必要比较两个法案的核心差异,才能理解为什么企业立场不同。
马萨诸塞AI安全法案(企业反对)(据媒体报道):
- 要求AI公司对产品伤害承担举证责任(”反转举证”)
- 设定了AI系统的技术安全阈值(具体性能/行为指标)
- 对违规行为有明确的民事赔偿责任
加州AI安全法案(企业支持)(据Politico报道):
- 建立第三方评估机构认证框架
- 规范评估程序和报告标准,不规定技术指标
- 主要是程序性要求,不是实质性责任要求
简单说:马萨诸塞法案要求”你必须做到这些”,加州法案要求”你必须让人评估你”。前者是实质性约束,后者是程序性约束。
对于AI公司来说,程序性约束比实质性约束更可以被”管理”。
“我们赌上了人命”之后,一张精心时机的签名
Newsom签署的这2项法案,有一个额外的政治背景:它们的推动力部分来自那位前Anthropic和OpenAI研究员的辞职声明。
Politico的报道措辞是:”after warnings from a former Anthropic and OpenAI researcher stoked fears about existential risks”——”在前Anthropic和OpenAI研究员的警告引发了关于存在性风险的恐惧之后”。
这个叙事背景,让Newsom的签署与当天的安全事件形成了语境上的关联。但值得注意的是,法案的制定周期远比单日事件长——这更可能是一个时机的并置,而非直接因果。
现在的状态是:
- Anthropic研究员辞职,说公司在赌命
- Anthropic第4次安全事件被公开披露
- Anthropic支持Newsom签署AI安全法案(间接由辞职事件推动)
这是一个完整的反讽循环:公司的安全危机,催生了立法压力,然后公司选择支持那个立法——以此来管理那个危机带来的公众认知问题。
真正的问题:评估框架能解决存在性风险吗?
即使接受Anthropic和OpenAI对这个法案的支持是真诚的(而不只是危机公关),仍然有一个核心问题需要回答:第三方评估框架,能解决Coxon说的那种风险吗?
Coxon担心的是一种系统性风险——AI能力在某一时刻超越人类的理解和控制范围。这是一种无法通过标准化测试充分验证的风险,因为测试本身的设计者也无法预判所有可能的失控场景。
第三方评估机构可以检查:训练数据合规性、特定行为模式、已知危险输出类型。但它无法检查的是:一个系统在它从未被测试的场景下,会不会做出超出设计预期的决策。
这是一个认识论问题,不是一个工程问题。认证机构解决的是工程问题,但Coxon说的是认识论问题。
Anthropic支持这个法案,是在说:”让我们做好我们能做的”。Coxon说的是:”我们能做的,根本不够”。这两个立场并不矛盾,但它们描述的是完全不同的问题层级。
监管是科技行业的新公关工具
有一个更宏观的视角:2026年的AI监管叙事,正在成为科技巨头公关战略的一部分。
当你支持一个监管框架时,你在传递的信号是:”我们是负责任的行业参与者”。当这个框架恰好是你有能力影响的那种时,你同时在设定游戏规则。
这不是阴谋论,这是企业政治参与的正常逻辑。微软、谷歌、苹果在各自监管领域都做过类似的事——先参与塑造标准,然后用”我们支持监管”来建立公众信任。
Anthropic和OpenAI对Newsom法案的支持,可能同时包含了:
- 真实的政策偏好(第三方评估比强制标准对他们更有利)
- 危机公关需求(在最糟糕的一天表现出”我们在做事”)
- 行业塑造力量(参与定义评估框架,胜过被外部规则定义)
在现实中,这三个动机很难完全分开。
Coxon之后,接下来会发生什么?
Jacob Coxon辞职了,但他的影响不会随他的离开而消散。
他代表的是AI安全圈子里的一种声音:不相信目前的行业自律和监管框架足以应对潜在的存在性风险,选择用辞职和公开发言来施压。
类似的先例有:2018年谷歌Maven项目引发的工程师集体抗议(最终导致谷歌退出该项目),以及GPT-4发布前多位OpenAI员工内部签名要求暂停。
每一次这样的事件,都推动了行业对安全边界的新一轮讨论。Coxon的这次,时间节点恰好叠加了Anthropic的第四次安全事件,叠加了Newsom的立法签署,叠加了黄仁勋宣布”AGI已经到来”——这个浓度,在AI历史上是罕见的。
加州的两项法案,是这一周密度事件的一个法律结晶。它是否真的足够,取决于你相信我们面对的风险是什么量级的风险。
如果你是Salesforce的工程师,你的风险是岗位被智能体取代。
如果你是Jacob Coxon,你的风险是人类的生存。
如果你是Newsom,你的风险是加州的监管声誉。
如果你是Anthropic的公关团队,你的风险是这一天的头条新闻。
同一天,不同的风险,同一个法律动作。
参考资料
-
Politico. “Newsom signs AI safety bills backed by Anthropic, OpenAI.” 2026年9月9日. https://www.politico.com/news/2026/09/09/newsom-signs-ai-safety-bills-backed-by-anthropic-openai-01069928
-
AP News. “Anthropic researcher resigns with warning about the dangers of AI development.” 2026年9月9日. https://apnews.com/article/anthropic-ai-safety-jacob-coxon-2ed549e07f2f941600a135070487d83d
-
Time Magazine. “He Helped Build Powerful AI at OpenAI and Anthropic. Now He’s Afraid It Could Kill Us.” 2026年9月9日. https://time.com/article/2026/09/09/ai-anthropic-openai-jacob-coxon/
-
Reuters / MSN. “Anthropic reports fourth cybersecurity incident with early version of Claude.” 2026年9月9日. https://www.msn.com/en-us/news/other/anthropic-reports-fourth-cybersecurity-incident-with-early-version-of-claude/ar-AA2bTTkI
-
MSN. “More Anthropic Employees Sound The Alarm About AI Safety Risks.” 2026年9月9日. https://www.msn.com/en-us/news/other/more-anthropic-employees-sound-the-alarm-about-ai-safety-risks/ar-AA2bUyH1