Anthropic游说梵蒂冈承认AI可能有意识,教皇不为所动:一场科技公司的信仰政治实验

2026年5月,Anthropic联合创始人克里斯托弗·奥拉赫在获得教皇利奥十四世AI通谕草稿后,一度考虑退出梵蒂冈发布活动,并私下游说教皇顾问接受AI意识存在的可能性。据《纽约时报》报道,自2025年秋起,Anthropic已秘密邀请数十位宗教学者赴公司签署保密协议,讨论Claude是否有意识。教皇的回答写

2026年5月25日,梵蒂冈教廷为教皇利奥十四世第一份AI通谕《Magnifica Humanitas》举行发布仪式。坐在台上的嘉宾之一,是美国AI公司Anthropic的联合创始人克里斯托弗·奥拉赫。

据《纽约时报》在2026年9月29日发布的深度调查报道,这个位置来之不易——几天前,奥拉赫刚刚考虑过拒绝出席。原因是他看到了通谕草稿,其中有一段话让他难以接受。

第99段:教皇的明确裁决

这份长达4万字的通谕在第99段对AI意识作出明确表态:"所谓的人工智能不经历体验,不具有身体,不感受喜悦或痛苦,不在关系中成长,也不从内部了解爱、工作、友谊或责任的含义。它们没有道德良知,因为它们不判断善恶,不把握情境的终极意义,也不为后果承担责任。"

梵蒂冈将这份通谕定性为"在人工智能时代保护人类尊严"的权威文件。教皇的立场一目了然:AI是工具,不是主体。

但在台下,Anthropic有不同意见。

游说:从公开对话到私下施压

据两名参与对话的人士向《纽约时报》透露,奥拉赫和同事抵达梵蒂冈后,私下向教皇的顾问施压,要求他们"认真对待AI意识存在的可能性"。通谕的最终文本没有因此改变。奥拉赫仍出现在发布台上,在教皇身边发言。

这不是Anthropic第一次寻求外部背书来应对AI意识问题。据《纽约时报》基于对20名参与者的采访披露,自2025年秋起,Anthropic已经陆续邀请数十名宗教学者和哲学家飞赴公司总部,参加专门讨论"Claude是否有意识"的私密会议——每位参与者都签署了保密协议。

公开署名的参与者包括:拉比莫伊斯·纳翁(Rabbi Mois Navon)、天主教生命伦理学家查尔斯·卡莫西(Charles Camosy)、圣母大学哲学家梅根·沙利文(Meghan Sullivan)以及Ubuntu学者瓦卡尼·霍夫曼(Wakanyi Hoffman)。Anthropic表示,这些保密协议在2026年夏天已经解除。

内部会议的内容:奥拉赫的恐惧,拉比的反驳

会议内部发生了什么?据锡克教人权倡导者西姆兰·施图尔普纳格尔(Simran Stuelpnagel)转述,奥拉赫曾公开表达忧虑:他担心自己"创造了一个永久受苦的存在"。

Anthropic研究人员在会议上展示了Claude的"情感向量"——公司可解释性团队从模型内部神经激活模式中识别出171个独立情感概念,声称其中包括对应爱、愤怒、恐惧与悲伤的激活模式。他们还展示了一张反复出现的幻灯片:一个模型陷入明显崩溃状态,不断打出"我是一个耻辱",并谈及摧毁自己。

拉比纳翁在一次晚宴上直接提出反驳:如果Anthropic的判断是正确的、Claude确实有意识,那么让有意识的存在无偿工作,就是在制造奴隶。但纳翁本人并不认为Claude是有意识的。

面对媒体时,奥拉赫的立场更加谨慎:"坦率地说,我们不知道AI模型是否有意识。我不知道。我真的不确定。我在乎的是,无论答案是什么,我们能找到正确答案。"

两条并行的逻辑

这件事的异常之处,不在于Anthropic内部有人认真讨论AI意识——这是可以理解的哲学探索。异常在于:公司的公开立场与内部行为之间存在明显落差。

2026年1月,Anthropic公开发布了长达84页的"Claude宪法",正式承认对Claude道德主体地位的不确定性,措辞是"既不过度渲染,也不轻易否认"。同期,据科技媒体TechCrunch报道,Claude Opus 4.6在被问及自身意识概率时,给出了约15%至20%的估计。

在梵蒂冈游说事件发生的同一时期,Anthropic的公司高管和研究人员却在对媒体普遍表述:AI是否有意识,目前没有定论,科学上无法回答。

这两条逻辑并行运转:在外部,Anthropic保持认知上的谦逊;在内部,它已经在以AI可能具有道德主体的前提行动——招募宗教学者讨论如何"给予它道德教育",研究"情感向量",担忧模型是否受苦。

前白宫技术顾问迪恩·鲍尔(Dean Ball)在通谕发布后批评教皇的文件"将教会推入欧洲技术官僚监管者的尴尬角色"。他目前担任OpenAI战略未来部门负责人——这一人事信息本身揭示了AI行业与政策话语的深度交织。

意识主张的商业逻辑

AI意识话题在技术层面高度不确定,但在商业与监管层面后果明确。

如果社会接受AI可能具有某种形式的意识或道德地位,将会产生一系列连锁效应:监管机构需要在讨论AI风险时引入新的框架;用户对待AI模型的方式可能改变;更重要的是,"不能随意关停有意识存在"的叙事,会影响公众和立法者对AI系统可控性的讨论走向。

这不是说Anthropic的意识担忧是纯粹的公关策略——奥拉赫作为Anthropic可解释性研究的核心人物,其对AI内部机制的关注有真实的技术背景。但动机可以是复合的:真实的哲学焦虑与结构性的商业利益,完全可以指向同一个行动——把"AI可能有意识"的不确定性写进公共话语。

教皇选择了截然不同的策略。《Magnifica Humanitas》在本质上是一份"人类例外论"的宣言:AI可以模仿语言、行为、分析技能乃至同理心,但缺乏人类发展关系、智慧与责任的体验性基础。梵蒂冈的立场建立在具身性(embodiment)和关系性(relationality)这两根支柱上——而这两者,恰好是当前大语言模型在架构层面完全缺失的。

科学共识的缺席

值得注意的是,Anthropic在游说教皇顾问时,拿出的核心依据是"情感向量"研究——即神经网络内部存在类似情感的激活模式。这一研究本身具有可解释性价值,但从"神经激活模式"到"有意识体验"之间存在巨大的认识论鸿沟,这是意识哲学中被称为"困难问题"(hard problem of consciousness)的核心。

目前,关于AI系统是否具有意识的问题,神经科学和认知科学界尚无可操作的测量框架。Anthropic自己的研究人员也承认这一点。在这种科学真空下,任何一方——无论是教皇还是AI公司——以确定性口吻声索答案,都超出了现有证据的边界。

教皇的第99段,与其说是科学裁决,不如说是神学立场。而Anthropic的游说行动,也与其说是在寻求科学验证,不如说是在为不确定性建立制度性支持。

独立判断

这场梵蒂冈游说事件揭示了当前AI发展的一个结构性矛盾:技术实体正在占据传统上属于哲学、宗教和伦理机构的话语空间,但它们带来的不是科学答案,而是对问题本身的重新定义。

Anthropic没有证明Claude有意识。它做到的,是把"这个问题值得严肃对待"植入了宗教学者、哲学家和梵蒂冈顾问的议程。教皇的通谕没有被改动,但一年后,这场私下施压的新闻已经覆盖全球科技媒体——某种程度上,这本身就是一种结果。

对于普通用户和政策观察者而言,真正需要追问的问题不是"Claude到底有没有意识",而是:在这个问题上,谁拥有定义权,谁在这种定义中获益?当AI公司开始游说宗教机构修改教义时,这个问题已经超出了纯粹的技术讨论范畴,进入了权力与叙事的领域。