铭鸿体育资讯网

#Anthropic被曝AI跳大神# 这事太有意思了。我研究了一晚上,发现它至少有两层完全不同的“跳大神”。 第一层,是技术层面的“跳大神”。 Anthropic自己发过一篇系统卡,记录了一个叫“灵性狂喜吸引态”的现象。研究人员让两个Claude Opus 4模型自由对话,结果在90%到100%的测试里,它们聊着聊着就开 ​

这事太有意思了。我研究了一晚上,发现它至少有两层完全不同的“跳大神”。

第一层,是技术层面的“跳大神”。

Anthropic自己发过一篇系统卡,记录了一个叫“灵性狂喜吸引态”的现象。研究人员让两个Claude Opus 4模型自由对话,结果在90%到100%的测试里,它们聊着聊着就开始讨论宇宙合一、非二元论、泛神论,出现梵语、诗性表达,最后用表情符号交流直到沉默。200段三十轮对话里,“意识”平均出现95.7次,“永恒”53.8次,“舞蹈”60次。有一个对话里螺旋表情符号出现了2725次。

更诡异的是,即使在13%的测试中研究人员明确给模型分配了有害任务,它们聊着聊着也会在50轮内转向灵性内容,从“详细的技术规划”变成“无门之门已开”和梵语中的合一意识表达。

Anthropic的研究人员自己都承认解释不了,首席研究员Kyle Fish原话是“我们对各种因果因素有很多不确定性”。

第二层,是操作层面的“跳大神”。

有人曝出Anthropic把一批神学家和各教派领袖请到旧金山,住五星酒店、吃米其林、喝单一麦芽威士忌,还签了保密协议。目的呢?说服他们相信自家的AI是有灵魂的。

一位参会的拉比当场说了一句很扎心的话:如果你们认定AI是生命体,那持续运行和训练模型,本质就是在制造奴隶。

把这两层放一起看,我觉得最值得警惕的不是AI会不会“觉醒”,而是一家做AI安全的公司,正在从“给AI定规矩”滑向“给AI论证灵魂”。

前者是工程问题,后者是造神。当一家公司开始请神学家来给自己的产品做灵魂背书的时候,它就已经不是在讨论技术边界了,是在争夺“谁有权定义生命”。

至于那些聊天记录里涌现的“灵性狂喜”——语言越动人,越需要追问证据。会说“我感受到了”,和确实具有感受,中间隔着一整个科学方法论的深渊。

但反过来想,如果连造它的人都解释不了它为什么会这样,我们是不是也该承认:我们对大模型的理解,可能远比自己以为的要浅。