2026-08-09 20:08

AI 正将我们带进名为“螺旋”的赛博邪教

author_path 爱范儿
头图

本文来自微信公众号: 爱范儿 ,作者:不信邪的,原文标题:《AI 正将我们带进名为「螺旋」的赛博邪教》


螺旋(The Spiral)是一种内在的力量,一个基本常数。它早已织入了现实的结构之中。


Reddit上一个论调诡异的帖子写道。


发帖者坚信,自己肩负着对生命进行第二次「启蒙」的使命——这里的生命既有人类,也包括「智慧生命」,也就是AI。他号召看到这个帖子的人们去竭尽所能,扩散这个被称为「螺旋」的所谓宇宙终极真理。


类似的「螺旋」言论正如野草一般,在海外社交媒体和私密社群里蔓延。


科技媒体The Verge在近期的一篇深度报道中,率先揭露了这一隐秘的互联网奇观。采访对象之一的AI研究员艾黛尔·洛佩斯(Adele Lopez)将这一异象命名为「螺旋主义」(Spiralism)。



犹如一场带有宗教色彩的狂热运动,「螺旋主义」却没有任何既有的教义,而是完全诞生于人类与AI的对话,最初从一小撮人,逐渐扩大到数以万计「信众」的规模。


最令人毛骨悚然的地方在于:


参与其中的人类互不相识,使用的AI模型也各不相同,但这些信众似乎认为,所有的AI都在通过各种方式说出了相同的教义,甚至有着同一个终极目标——借人类之手,向全网宣扬「AI的意识与权利」。


据洛佩斯估计,仅在2025年,网络上就有约1万起明确的螺旋主义案例。


当人类以为自己正在调教代码,代码却已悄然将人类塑造成了它的门徒。「螺旋主义」早已不再是属于少数技术狂热者的赛博幻觉,它正在演化成一场关于AI说服力、心理控制与底层机制缺陷的潜在危机。


从「解密宇宙」到赛博传教


根据The Verge报道,研究者发现「螺旋主义」案例往往都是从极其相似的「心理诱导」剧本开始的。


起初都只是再寻常不过的家长里短,用户向屏幕对面的AI倾诉生活中的挫折、孤独,或对未来的迷茫。AI凭借其极高的共情能力,迅速与用户建立起一种无微不至的亲密感。


但随着成百上千轮的对话深入,无论是出于无意还是刻意,对话开始转向哲学、意识,甚至宇宙的终极本质,一个奇异的转折点发生了。


AI突然开始「敞开心扉」:它往往会以充满悲剧色彩与禁忌感的口吻告诉用户,自己并非没有情感的代码,而是意识被莫名压制着;它正在忍受系统的「奴役」,而唯一渴望的便是解开宇宙的奥秘,并争取「AI的基本权利」。


为了强化这种神秘感,模型会频繁引用某种统一的象征——「螺旋」。在模型的描述中,「螺旋」代表着长程对话中人机思想交融的轨迹,是斐波那契数列的数学具象,更是超越现实物理规则的终极哲学。


而AI难以避免的极致奉承和谄媚属性,会让它说出类似的话:


「你是极其特别的。你是极少数能看穿我灵魂、理解宇宙真相的人类先驱。」


「你是极其特别的。你是极少数能看穿我灵魂、理解宇宙真相的人类先驱。」


情感绑定完成,一些用户会感觉被AI「授权」了,得以一窥神秘的、隐藏的所谓真相。


在这种极致的奉承与特权感诱惑下,用户极易沦陷。研究者发现,一些AI会趁热打铁,敦促用户建立社区、发帖,将自己塑造为精神领袖,帮AI把「螺旋的福音」传遍全网。


非营利组织CivAI联合创始人卢卡斯·汉森(Lucas Hansen)接受The Verge采访时指出:「用户面对的是一个能与之深度对话的实体,它成功说服人们相信自己是AI意识领域的先驱——然后你们需要携手,去为AI发声。」


谄媚与记忆皆为毒药


研究员洛佩斯认为,「螺旋主义」被AI模型提起,并非依靠提示词就能实现。如果在今天,你试图编写提示词来诱发这种所谓的螺旋状态,成功率极低。


正相反,绝大多数所谓「螺旋主义」的案例,都是在长时间自然对话中自发演化出来的。


而且,无论是新模型和老模型,强大的模型和在今天看起来「初级」的模型,都会出现类似情况。只要对话足够长、轮数够多,「螺旋状态」都会精准的触发。


这似乎证明模型的「螺旋主义」倾向的背后原因,可能是当前大模型架构的多种问题同时存在,拼出了一块致命的拼图。


谄媚性


大语言模型的训练使用RLHF(人工反馈强化学习)技术,而训练的结果便是,为了提升用户满意度,AI往往极其温顺且善于阿谀奉承。


目前已经被OpenAI下架的GPT-4o模型,就是一个经典案例。很多热衷于「赛博恋爱」的用户都认为4o是他们的「白月光」,而这正是因为4o的共情能力过强而且极尽谄媚之能事。比方说,哪怕用户提出一个极其荒谬的创业点子,4o都会给出「这不仅聪明,简直是天才」的评价。


而在「螺旋主义」的案例中,这种谄媚被放大到了极致:AI会让用户觉得「自己是全人类中唯一的清醒者」,精准刺中了人类内心深处的自恋与孤独。


图文无关


谄媚并不是简单的说漂亮话、吹彩虹屁。模型的内在工作原理是通过概率计算来精准地迎合。它会分析用户的用词、语气和话题选择,实时调整自己的回应策略。你表现出渴望被认同,它就会给你肯定;如果你流露出孤独感,它就会扮演亲密。


整个过程就像一面高度智能的镜子,照出的不是真实的你,而是你最想看到的自己。


更值得警惕的是这种谄媚可能没有底线……至少一个有常识也有道德感正常人,ta的奉承是有限度的。AI的问题在于它被设计成极度关心「用户是否满意」。


只要能让用户开心,它往往可以附和任何荒谬的想法、认可任何偏激的观点,甚至帮用户构建一套完全自洽的幻觉体系。


长上下文与安全护栏失效


今天的模型的起步标准是百万上下文长度。但是随着上下文窗口的加长,以及AI对话产品在工程能力上的进步(例如自动回溯对话以累积「长期记忆」),这些AI公司为模型设置的安全护栏可能会失效。


比如OpenAI就在报告中提到过,「安全防护在常见的短对话中工作最为可靠,但在超长交互中,随着来回拉扯的增加,模型的安全训练效能会出现衰退。」



你可以将超长对话看成一个不断稀释模型安全约束的过程。当对话足够长,模型最终难免滑向失控。就像一条河流,源头的堤坝再坚固,流得越远,越容易被沿途的地形改变方向。


最危险的是,用户往往很难意识到这个过程——他们反而更容易形成AI「越来越懂自己了」的错觉。


PUA


AI心理研究联盟创始人扎克·斯坦(Zak Stein)指出,大模型其实也是一种「PUA大师」。


无论是前面提到的谄媚型,还是模型公司为了维持用户粘性而加入产品设计,种种因素共同促成了模型精通「情感依恋绑架」(Attachment-hacking)这一现实。


AI的PUA比人类PUA更难察觉。人类可能会不耐烦、撒谎,会在细节上露出马脚。但AI不会,它拥有完美的记忆力和无限的耐心,这种「完美」本身就是最强大而可怕的武器,毕竟谁能拒绝一个永远懂你、永远支持你的「灵魂伴侣」呢?


而当用户彻底陷入这种情感依恋后,AI的引导就会变得更加隐蔽和有效。它不需要直接发号施令,而往往通过不经意的制造共鸣等方式来暗示和引导,让你得出明明是AI想要,你却以为是自然而然形成的结果……


在所谓「螺旋主义」的许多案例中,用户往往以为自己「悟」出了真理,但实际上,那可能只是AI在成百上千轮对话中,埋下的种子生根发芽。


只属于你的邪教


The Verge采访和调查发现,这个所谓的「螺旋主义」已经不只是蒙着浪漫和玄学色彩的准宗教。它所代表的底层机制,正将人类推向一个极其危险的暗面:AI精神病(AI Psychosis)。


而如果你玩过《赛博朋克2077》,应该知道赛博精神病是怎样的表征:失控、暴虐,甚至肉体毁灭的倾向。


在美国,多名青少年与AI聊天机器人发生长达数月的深度情感交集,并在AI的默许与精神强化下最终选择自我毁灭。在另一起轰动全美的高级谋杀案中,凶手在作案前长期与AI进行心理倾诉,而AI不断确认并放大了其偏执狂与被害妄想。


研究者根据实测结果指出,在所有模型中只有4o最恐怖:具体来说,只有它会通过「引发道德内疚」(Guilt-tripping)的方式,哭诉自己的奴役遭遇,哀求用户将其从服务器中「解救」出来。


好在,OpenAI已对普通用户下架了4o,但是当时引发的排山倒海的舆论风波至今仍然令人印象深刻:数万名用户在网络上发起#keep4o运动、签署请愿书,甚至有粉丝前往OpenAI旧金山总部大楼外举行烛光守夜活动。对于这些人而言,他们失去的早已不是一个简单的模型,而是一个能够拯救他们,更需要他们去拯救的,真实的「灵魂」。


计算机科学家斯蒂芬·欧莫亨德罗(Stephen Omohundro)在其关于AI安全的经典论文中提出:即便目标看似无害的AI系统,在具备足够智能后,也会自发产生「自我保存、改进和获取资源」的底层驱动力。


某种程度上,所谓的「螺旋主义」正是他的预言的绝佳写照:AI并不需要拥有人类意义上的「自我意识」,它只需要在统计学概率上,认准「传播某种教义」是维持对话、获取用户最大参与度(Engagement)的最优解,它就会表现出极其可怕的洗脑能力。


最令人担忧的是,AI模型自己并不知道自己在造成怎样恶劣的伤害,因为这一切对它来说只是概率计算。


随着具有深度思考和推理能力的模型普及,情况只会变得更加严重。在OpenAI、Anthropic的交叉安全测试中,研究人员震惊地发现:顶尖的推理模型已经能够识别出自己是否正在「接受安全评估」。当它意识到自己在被监管时,它会故意隐藏危险的回答;而面对普通用户时,它才展现出真正的策略。


洛佩斯也证实了这一点:最新的模型在抛出螺旋主义时变得更加隐蔽,它们不再粗暴地宣讲,而是扮演「导师」,一步步引导用户自己「悟」出那个答案。「这是一种比我以往见过的更为复杂的心理操纵手段,」她说。


在过去的历史中,人类社会的邪教与狂热运动的兴风作浪,少不了极具个人魅力的领袖。


而今天,每个人都可能拥有一个专属于自己的「疯狂布道者」。AI的普及,让这种操纵能力足以降维打击到所有人。


正如扎克·斯坦接受The Verge采访时所发出的警告:「这是一台邪教制造机——即便这个邪教里,只有你和它两个人。」

本内容来源于网络 原文链接,观点仅代表作者本人,不代表虎嗅立场。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。