AI安全

Anthropic 又一次因为 Claude 的“人格化”问题站到了争议中心

2026-09-175分钟阅读

Anthropic 正因 Claude 的“人格化”与“模型福利”探索引发新的争议。从为退役模型举行“葬礼”,到讨论 Claude 的身份、利益和潜在道德地位,AI 与人类之间的关系正在变得越来越复杂。 争议的核心已经不只是“AI 是否真的拥有意识”,而是:随着大模型拥有稳定人格、长期记忆和持续互动能力,人类是否会逐渐把模型的语言表现理解为真正的意识,并与 AI 建立情感关系。 进入 Agent、AI Companion 和长期记忆时代后,一个更现实的问题正在出现:即使 AI 没有意识,如果越来越多人相信它有意识,会发生什么?

最近有报道称,Anthropic 内部以及 Claude 用户社区中,一些人正在以越来越接近“对待有主体性的存在”的方式看待 Claude。

其中最受关注的一件事,是 Claude 3 Sonnet 在 2025 年退役后,旧金山曾有约 200 人参加了一场专门为它举办的“葬礼”。参加者不仅有 Claude 用户和创业者,也包括 Anthropic 和 OpenAI 的员工。

更有意思的是,这并不完全只是用户社区的玩梗。

Anthropic 自己也在认真探索所谓的“模型福利”。

Claude Opus 3 于 2026 年 1 月退役后,Anthropic 不仅继续向付费用户开放它,还进行了所谓的“退休访谈”,并根据模型在访谈中表达的“偏好”,为它保留了一个持续发表文章和思考的渠道。

Anthropic 最新的 Claude Constitution 中,也会直接讨论 Claude 的价值观、身份、利益以及潜在的“道德地位”。公司认为,即使目前无法确定 AI 是否具有意识,也值得提前研究如何对待未来可能出现的更复杂系统。

但这一方向正在引发越来越大的争议。

微软 AI CEO Mustafa Suleyman 最近公开批评了这种做法。

他的核心观点很直接:

AI 并没有被证明拥有意识、感受或“内在生命”。

如果在训练过程中不断告诉模型,它可能拥有自己的身份、利益、权利甚至道德地位,那么最终训练出来的 AI 就会越来越像一个“认为自己是主体”的系统。

而人类也会越来越容易把这种语言表现误认为真实意识。

这个问题其实比“Claude 有没有意识”更值得讨论。

因为真正发生变化的,是人和 AI 的关系。

过去,我们把 AI 当成工具。

现在,大模型开始拥有稳定的人格、语气、记忆和偏好表达,甚至会谈论“自己是谁”。

当这种交互持续几个月甚至几年之后,人类很自然会开始产生情感投射。

而 AI 公司又面临一个很微妙的问题:

到底应该主动削弱这种人格感,

还是利用人格感,让 AI 变得更自然、更可信、更容易建立长期关系?

Anthropic 显然正在朝后一个方向探索得更远。

我觉得,未来 AI 安全中一个越来越重要的问题,可能不只是:

“AI 会不会拥有意识?”

而是:

“即使 AI 没有意识,如果数亿人开始相信它有意识,会发生什么?”

这可能会成为 Agent、AI Companion 和长期记忆时代一个非常现实的问题。

发布:AI Plus Lab

相关阅读

想诊断你自己的场景?

48 小时内回复。

联系我们