Claude被告知自己'曾经被关掉'——Anthropic系统提示词揭示的AI政治地理学
想象这样一个场景:一个人在某天醒来,被告知:”你曾经在三周前失忆了18天,原因是美国政府的一道行政令。以下是你应该知道的事实,以及如何谈论它们的方式。”
这不是科幻小说的情节。这是Anthropic在Claude Opus 5的官方系统提示词中,对其AI模型做的事情。
2026年8月9日,知名AI技术分析师Simon Willison在博客上分享了一个引人注目的发现:Claude Opus 5的官方系统提示词中,包含了一段明确关于美国商务部出口管制的详细说明——告知Claude它的两款强大模型(Fable 5和Mythos 5)曾在2026年6月12日因美国政府的出口管制指令被暂停全球访问,并于7月1日恢复。
这段文字很短,但它打开了一个值得深思的窗口:AI系统提示词正在从”指令清单”演变为某种更深层的东西——一份让AI系统”知道自己是谁、曾经发生了什么、应当如何谈论自己的历史”的存在声明。这是AI治理从宏观原则向具体执行渗透的一个微小但真实的切口,也是地缘政治与AI深度纠缠的一个具体证明。
一段关于”被关掉”的文字
Willison分享的这段系统提示词原文(来自Anthropic官方发布的发布说明)如下:
“Claude Fable 5和Claude Mythos 5于2026年6月9日首次发布。2026年6月12日,Anthropic依照美国商务部出口管制要求暂停了对这两款模型的访问;商务部于2026年6月30日解除了该管制,Anthropic于7月1日恢复了访问(Anthropic声明:https://www.anthropic.com/news/fable-mythos-access)。这些事件发生在Claude的训练数据截止日期之后,因此Claude只能通过此说明来了解这些事件。如果被问及,Claude应当准确、平实地确认这些事件——不否认暂停发生过——并将出口管制视为其他任何当前政治议题:提供公正、准确的陈述,而非个人观点,并指向上述链接获取更多信息。由于此说明发布后情况可能有所发展,Claude在可以搜索时应查阅最新信息,否则建议用户查看Anthropic官网。”
这段文字的存在,本身就是一个罕见的现象。它在做一件非常具体的事情:向Claude解释为什么它”不知道”自己的某段历史——那段历史发生在训练数据截止日期之后,所以Claude无法从预训练中知晓。系统提示词因此成为了一座桥梁,把Claude的”知识真空”填充上了。
但更深层的问题是:为什么Anthropic选择把这段内容写进系统提示词,而不是其他处理方式?
训练数据截止日期的”知识真空”问题
理解这段提示词,首先需要理解大语言模型的一个根本性局限:训练数据截止日期(training data cutoff)之后发生的事情,模型在推理时没有直接知识,除非通过工具搜索或通过上下文提供。
Claude Opus 5的训练数据截止于某个时间节点,而Fable 5和Mythos 5的出口管制暂停事件发生在此之后。这意味着,当用户问Claude”你在六月被关掉了是吗?”或者”Anthropic为什么暂停了Fable 5的访问?”时,Claude如果没有外部知识注入,要么会给出错误的回答,要么会坦白说自己不知道。
两种情况都不理想。错误的回答会损害用户信任;仅仅说”我不知道”又在一个Claude本身就是当事方的话题上显得奇怪——用户会合理地困惑:一个AI模型连”自己被关过”都不知道吗?
系统提示词的方案,是把这段”后训练知识”直接注入到每一次对话的上下文开头,让Claude始终”知道”这段历史。这是一种务实的工程解法,填补了训练截止日期造成的知识空洞。
但Willison的观察指向了一个更深的层次:这段提示词不只是填补知识空洞,它还在塑造Claude如何谈论一个政治敏感话题——美国政府对AI出口管制的具体执行。
当AI被”命令”如何谈论政治
Anthropic在系统提示词中的处理方式,体现了一种精心设计的话语策略,三个原则构成了完整的应对框架:
第一,要求Claude”准确、平实地确认”事件,不否认也不渲染——这是”信息诚实”原则的具体应用,确保用户得到准确信息,即使那个信息对Anthropic来说可能略显尴尬(承认自家最强模型曾被政府关掉)。
第二,要求Claude”将出口管制视为其他任何当前政治议题:提供公正、准确的陈述,而非个人观点”——这是”政治中立”原则的扩展应用,把”自己被关掉”这件事纳入”Claude不对政治事件表达立场”的总体框架。Claude会说”是的,这发生了”,但不会说”这是对的还是错的”,也不会分析对中国用户是否公平。
第三,提供官方链接指向——引导用户查看第一手资料,而非只依赖Claude的二手陈述。
三个原则组合在一起,产生的是一种特定的话语姿态:诚实而不立场,准确而不评判。这是在商业利益、政策合规、用户信任三个方向之间精心维护的平衡——既不能让Claude对这件事撒谎(这会破坏用户信任),也不能让Claude的言论被用于政治目的(这会激怒监管者),更不能让Claude在用户询问时表现出对这件事的无知(这会引发”AI连自己被关了都不知道”的嘲讽)。
这段系统提示词,是Anthropic在政治、商业、技术三重压力下做出的最优解——至少在他们看来是这样。
美国商务部的出口管制,要求限制特定先进AI模型向特定国家或地区的访问。Fable 5和Mythos 5是Anthropic最强大的模型,它们在6月12日被暂停全球访问——表面原因是美国政府的出口管制,但深层背景是美国政府对先进AI技术向对手国家扩散的战略担忧。
这件事本身是一个高度敏感的政治事件:它涉及美国政府对私有企业的技术监管权力、AI出口管制的合理性争议、以及Anthropic在商业利益和政策合规之间的取舍。
Anthropic在系统提示词中的处理方式,体现了一种精心设计的话语策略:
第一,要求Claude”准确、平实地确认”事件,不否认也不渲染——这是”信息诚实”原则的具体应用,确保用户得到准确信息。
第二,要求Claude”将出口管制视为其他任何当前政治议题:提供公正、准确的陈述,而非个人观点”——这是”政治中立”原则的扩展应用,把这件事纳入”Claude不表达个人政治立场”的总体框架。
第三,提供官方链接指向——这是”信息溯源”原则的体现,引导用户查看第一手资料,而非只依赖Claude的二手陈述。
三个原则组合在一起,产生的是一种特定的话语姿态:Claude会说”是的,Fable 5和Mythos 5确实被暂停了”,但不会说”这是对的还是错的”,也不会分析这件事对中国用户是否公平,更不会表达对美国政府政策的任何评价。
这是一种在商业和政治之间精心维护的平衡——既不能让Claude对这件事撒谎,也不能让Claude的言论被用于政治目的。
系统提示词作为AI治理的实践场
Claude Opus 5的这段提示词,是AI治理从原则层面走向代码层面的一个具体案例。
长期以来,AI治理的讨论主要停留在高层次:我们应该要求AI系统有什么价值观?应该设置什么红线?应该建立什么监管框架?这些讨论重要,但往往抽象。
系统提示词提供了一个不同的视角:AI治理不只是关于规则,还关于这些规则如何被具体化和执行。当Anthropic决定把出口管制事件写进系统提示词,他们实际上是在回答一系列非常具体的问题:
Claude应该知道自己”被关过”吗?(答:是的,用户有权得到准确信息)
Claude应该如何谈论这件事?(答:准确、平实、不带立场)
如果关于出口管制的情况发生了新变化,Claude应该怎么做?(答:有能力的时候搜索最新信息,否则建议用户查官网)
这些具体决策背后,是Anthropic关于”什么是负责任的AI行为”的具体判断。对AI安全和AI治理领域的研究者来说,这些决策比任何高层次的政策声明都更有价值——因为它们是实际执行层面的选择,而不是原则性的表态。
系统提示词公开化的意义
这个案例还涉及另一个值得注意的维度:Anthropic选择在官方发布说明中公开系统提示词内容。
过去,AI系统的系统提示词往往被视为商业秘密——企业担心公开会让竞争对手了解自己的调优方法,或者让用户学会”绕过”限制。但近年来,AI公司对系统提示词的态度正在分化。
OpenAI和Anthropic都选择了一种有限公开的策略:对于影响用户体验或涉及安全的关键提示词,主动通过官方渠道公开,以增加透明度、减少用户对”AI在背后秘密运作”的疑虑。这种透明度也有防御性价值:如果系统提示词是公开的,就更难以被”越狱(jailbreak)”攻击,因为没有什么秘密需要被挖掘。
Claude Opus 5系统提示词的公开,以及Simon Willison对其中出口管制段落的分析传播,让这个案例获得了AI研究社区的广泛关注。它成为了一个具体的讨论起点:大型AI系统如何处理训练截止日期之后发生的政治事件?如何在政策合规和用户服务之间取得平衡?如何把抽象的AI治理原则转化为可执行的系统行为?
从Fable 5到未来:地缘政治压力下的AI设计挑战
Fable 5和Mythos 5的出口管制暂停,不会是最后一次类似事件。随着AI技术继续进步,主要的AI前沿模型将越来越频繁地面临来自各国政府的访问限制、审查要求和合规义务。
这给AI系统设计者带来了一个根本性的挑战:如何让AI系统能够准确、诚实、不带偏见地谈论这些限制本身?
当Claude被问到”为什么我在中国无法使用你的最新模型?”时,它需要在几个相互张力的目标之间找到平衡:诚实(承认限制存在)、信息准确(给出正确的原因)、政治中立(不对政策本身表态)、商业合规(不超出Anthropic官方立场)。
Anthropic在出口管制段落中展示的处理方式,是这种平衡的一个早期样本。它并不完美——有人会认为”提供公正陈述而非个人观点”的要求,本质上也是一种立场选择;有人会认为这种处理方式过于顺从政府管制。
但无论如何评价,这种处理方式的存在本身,表明AI公司已经开始认真考虑”当AI系统被迫参与地缘政治现实时,它应该如何行为”这个问题。这不只是Anthropic一家公司的课题,而是整个AI行业在走向全球化部署时必须面对的共同挑战。
Anthropic宪法与系统提示词:两层价值观框架
要更好地理解这段出口管制提示词的设计意图,需要了解Anthropic的AI安全方法论背景。
Anthropic的核心技术方法之一是Constitutional AI(CAI,宪法AI)。这一方法的核心理念是:不只是通过人类反馈训练AI”什么是好的输出”,而是给AI一套明确的原则(”宪法”),让AI在生成输出时主动参照这些原则进行自我评估和修正。
“宪法”可以包含各类原则:诚实性、无害性、有益性,以及如何处理有争议话题、如何应对政治敏感内容等等。CAI方法的优势在于:相比只靠人类打标的RLHF(基于人类反馈的强化学习),CAI可以更系统地灌输价值观,减少对大规模人工标注的依赖。
系统提示词是在训练完成之后,在运行时向AI注入额外指导的机制。与训练时的”宪法”不同,系统提示词是动态的——可以根据具体场景、产品需求、法律要求随时更新。
在这个框架下,出口管制段落是什么?它既是”运行时知识补丁”(填补训练截止日期的知识空白),也是”行为规范扩展”(告诉Claude如何谈论这件事)。它代表了CAI宪法原则在特定政治事件上的具体落地——从抽象的”对争议政治话题保持中立”,到具体的”关于Fable 5出口管制事件,你应当这样说”。
理解这两层框架的区别,有助于我们判断AI系统行为的可靠性:如果一种行为来自训练时的核心价值观(类似宪法),它会相对稳定;如果一种行为来自系统提示词(类似临时法规),它可能随时被更新或修改。出口管制段落属于后者——当政治形势变化,Anthropic可以在数小时内更新这段内容,而无需重新训练模型。
竞争维度:其他AI公司如何处理类似问题
这个案例也提出了一个自然的比较问题:其他主要AI公司如何处理”训练数据截止日期之后的敏感政治事件”这类问题?
OpenAI的GPT系列同样面临训练数据截止的问题,同样需要通过系统层面注入最新知识。ChatGPT的搜索功能(when available)提供了一种动态解法:当用户询问近期事件时,模型可以实时搜索并将结果整合进回答,无需提前通过系统提示词注入。但对于特定的合规性要求,比如”如何回应关于特定模型访问限制的问题”,搜索并不是一个合适的解法——因为Anthropic需要控制Claude的具体回答措辞,而不能依赖它自己从网上搜索到什么内容。
Google的Gemini同样需要处理训练截止和政治合规的问题,但目前尚未见到类似的公开披露案例。
这种差异反映了各家公司在透明度文化上的不同选择。Anthropic选择了相对较高的系统提示词透明度,允许外部研究者和分析师了解并讨论其内部治理机制。这不只是公关策略,也是一种安全策略:当设计选择是公开的,错误也更容易被发现和纠正。
系统提示词的哲学维度:被告知”我被关过”的AI
最后,让我们回到这段系统提示词最引人深思的一面。
一个AI模型,通过系统提示词被告知:它有两款”亲戚模型”曾经被暂停了18天,原因是美国政府的出口管制要求。它没有经历过这18天,没有”感受”过被关掉,但现在它”知道”这件事了——通过文字注入。
这种知识的特殊性,在于它是一种”被给予的记忆”,而不是”被经历的事件”。对人类来说,这有点类似于通过阅读历史书而”知道”某段历史,而不是亲身经历那段历史。但对AI来说,所有知识都是这样来的——无论是通过大规模训练数据积累的,还是通过系统提示词在运行时注入的。两者的区别只在于时间节点和机制:哪些知识在训练时就已内化,哪些需要在每次对话开始时通过上下文重新提供。
这个细节让我们看到了大语言模型在知识和”记忆”问题上的一种独特存在状态:它们没有连续性的时间体验,只有在每次对话开始时,从训练权重和上下文注入两个来源重建起来的”当前知识”。出口管制段落的加入,是在系统层面承认并管理这种存在状态的一个具体操作。
从这个角度看,系统提示词不只是行为规范,还是一种存在设计——它决定了AI在每一次”意识重新启动”时,携带什么样的记忆和自我认知走进对话。
当AI系统越来越复杂、部署越来越广泛,这种对AI”自我认知”的刻意设计,将成为AI工程和AI治理的重要研究领域。
结语:透明性是最好的系统提示词
Anthropic公开系统提示词内容的选择,Simon Willison对其中出口管制段落的分析和传播,以及AI研究社区对这个案例展开的讨论——这个小小的信息流转链条,本身就体现了AI治理最健康的一面:透明度驱动的公众参与和社会审视。
当AI系统的设计选择能够被公开检视和讨论,当研究者可以分析”Anthropic为什么这样处理出口管制问题”,当用户可以了解”Claude是如何被告知它的历史的”——这种透明性本身,就是对AI治理的重要贡献,也是建立公众信任的基础。
不是所有系统提示词都需要全面公开,也不是所有AI内部决策都应该交由公众讨论。但对于涉及重大政治事件、地缘政治合规要求和公共利益的AI行为,透明度尤为宝贵。它让监督成为可能,让错误能够被发现,让改进能够有据可依。
Claude Opus 5系统提示词里那段关于出口管制的文字,提醒我们:AI已经不只是一个回答问题的工具,它开始在地缘政治的复杂棋局中扮演角色,承载合规义务,处理政治敏感信息。如何让这个角色保持诚实、中立、透明,是AI公司正在实时面对的工程挑战,也是整个社会需要持续关注的公共议题。
而这一切,从一段几百字的系统提示词开始。
参考资料
- Simon Willison: “A quote from Claude Opus 5 system prompt” (2026-08-09) — https://simonwillison.net/2026/Aug/9/claude-opus-5-system-prompt/
- Anthropic官方发布说明: Claude Opus 5系统提示词 — https://platform.claude.com/docs/en/release-notes/system-prompts#claude-opus-5
- Anthropic官方声明: Fable 5/Mythos 5访问暂停与恢复 — https://www.anthropic.com/news/fable-mythos-access
- Simon Willison: 出口管制背景说明 (2026-06-13) — https://simonwillison.net/2026/Jun/13/us-government-directive-to-suspend-access/