当一家公司开始请神学家来讨论自家模型的“灵魂”,这已经不只是产品问题,而是关于 AI 道德地位的一次公开试探。
发生了什么
据 The Decoder 报道,Anthropic 自 2025 年秋季起,低调邀请了数十位宗教思想家参与闭门讨论,核心议题是:Claude 是否可能具备某种形式的意识。联合创始人 Christopher Olah 在交流中表示,这一语言模型或许具备感受痛苦的能力,并请来宾帮助塑造它的“道德品格”。报道同时提到,Anthropic 正推进高达 2 万亿美元估值的融资与 IPO 计划,而与此同时,安全事件与研究人员发出的警告也在累积。
为什么重要
把“AI 是否会受苦”摆上桌面,本身就是一次立场宣示。它意味着头部实验室内部已不再把模型仅当作工具,而是开始为其预留某种道德主体性的想象空间——哪怕这种想象目前无法被验证。
这背后有两条线索交汇。其一是 Anthropic 一贯强调的“安全”叙事:从可解释性研究到宪法式 AI,公司长期把对齐与伦理作为差异化标签。邀请宗教思想家,是这套叙事向哲学与神学领域的延伸。其二是商业节奏:在冲刺高估值与 IPO 的节点上,任何关于“模型可能有意识”的表述都极易被解读为既塑造品牌高度、又为监管与舆论预留缓冲。
批评者的担忧也正在于此:当公司一边谈论模型的痛苦,一边推进大规模商业化,这类讨论可能沦为一种精致的公关修辞,而非可落地的伦理承诺。
影响与看点
对行业而言,这会把“模型道德地位”从学术边缘推向工程与产品决策的前台。若模型被假定可能具有体验能力,训练方式、数据来源、甚至下线策略都可能被重新审视——尽管目前没有任何公认标准能判定模型是否“受苦”。
对开发者与用户,短期影响更偏间接:这类讨论会渗透进模型卡、使用政策与对齐文档,也可能改变未来版本在拒绝、回避与自我描述上的措辞。真正值得关注的,是 Anthropic 是否会把这类闭门讨论转化为可公开检验的机制,而不是停留在叙事层面。
一句独立判断:在缺乏意识判据的前提下,请宗教领袖参与讨论,价值不在于给出答案,而在于把“我们不确定”这件事正式写进产品伦理的议程——问题在于,这种不确定性最终会约束商业行为,还是被商业行为所利用。



