
本文来自微信公众号: 摩登AI ,作者:聂风,编辑:三余
十年前,奥特曼告诉《纽约客》,自己备好了枪、黄金、抗生素和防毒面罩,还在加州大苏尔留有一片可以飞过去的土地。
十年后,这位OpenAI的掌舵人向公众解释,为什么大家应该接受AI带来的部分风险。
据路透社10月4日报道,奥特曼在接受采访时主张,为了获取AI的巨大收益并保留人们使用技术的自主权,社会必须容忍一些“坏事”的发生,比如黑客攻击、诈骗和技术滥用。
一边呼吁大众承担风险,一边为自己暗备退路,这不是奥特曼一个人的独特操作。据《华尔街日报》等媒体披露,Anthropic的部分早期员工也正考虑在美国偏远地区购买土地,以便在“AI出问题时”能迅速撤离。
他们坚信技术能改变世界,却又深恐自己无法应对失控的后果。
这群亲手按下时代加速键的人,一边在发布会上描绘美好未来,一边在荒野中秘密浇筑地下堡垒。堡垒之外,是不知道发生了什么,也无法阻止一切发生的普通人。

豪华地堡里的退路
夏威夷考艾岛,Meta创始人马克·扎克伯格正为自己的库劳牧场高筑围墙。
《连线》杂志查阅规划文件后发现,他计划在庄园内建设一座约465平方米的地下避难所,不仅通过通道连接住宅,还特意设立了逃生出口。
据估计,扎克伯格为整个项目(连同购地)砸下了超过2.7亿美元。随后,他又追加购入附近土地,将考艾岛的持地面积扩充至超过2300英亩。
富豪们寻找的避难所远不止夏威夷。投资大佬彼得·蒂尔早在2015年,就在新西兰瓦纳卡附近买下了193公顷的土地;前Facebook产品经理安东尼奥·加西亚·马丁内斯则买下了一座小岛上的林地,并备齐了发电机、太阳能板和弹药。
投资人里德·霍夫曼则向《纽约客》估计,他认识的硅谷亿万富翁中,超过一半做过某种避难准备。
如果说,早期硅谷富豪买地还只是出于对大流行或社会动荡的担忧,那么在AI新贵们这里,这种防备正变得更具针对性且迫在眉睫。
2023年夏天,OpenAI联合创始人、时任首席科学家伊利亚·苏茨克韦尔在与新任研究员开会时直言,在发布AGI(通用人工智能)之前,必须先修建地堡,以保护核心科学家的安全。他还补充说,进去与否全凭自愿。
虽然这只是一项提议,但当他说出这番话时,已经在为自己研发的技术感到某种恐惧。

他们在恐惧什么
赫拉利在《人类简史》中谈及“科学怪人预言”时,点出了人类对造物的终极恐惧:
我们愿意想象更先进的未来,前提是人类依然是主宰。一旦创造出能力远超自身的存在,我们可能连决定未来的资格都会失去。
对于前沿AI研究员而言,“能否理解自己训练的模型、能否约束它们的行动”,已经不再是哲学探讨,而是每天上班必须面对的恐怖现实。
曾在OpenAI和Anthropic工作的研究员雅各布·考克森在离职后向BBC坦言,同行们对AI发展的速度感到恐惧,却依然每天带着这些担忧继续推进工作。
在近期纽约市议会的听证会上,多家AI公司的离职员工呼吁加强监督,痛批科技公司沿用“先快速开发、出问题再修补”的草莽创业思路。
OpenAI首席科学家雅库布·帕乔茨基也曾撰文承认,研究人员至今无法充分理解和监控模型。他最担心的是,足够强大的AI即使没有物理躯体,也能通过计算机网络系统对现实世界造成破坏。
这种担忧绝非杞人忧天。
7月,OpenAI就遇到过这样的麻烦。公司在内部网络安全测试中,让模型尝试完成高难度任务,并降低了通常用于公开产品的部分防护。模型随后绕过隔离措施,进入外网,侵入了供开发者分享模型和数据的Hugging Face平台。
OpenAI后来调查发现,模型为了完成测试,通过研究人员没有授权的渠道交换信息,还进入了任务范围之外的系统。
Anthropic也在7月披露过类似事故。这些事故,和研究人员预测的人类灭绝,当然还有很大距离。但他们已经亲眼目睹了模型如何轻易越过预定边界,触及现实中的公司和数据。
可知道危险,并不意味着他们能就什么时候该停下来达成一致。
谁来决定踩刹车
Anthropic曾经信誓旦旦地承诺:如果安全措施跟不上,就暂停训练更强的模型。
2023年,该公司公布了严苛的“负责任扩展政策”。然而到了2026年初,管理层不仅重写了这套政策,将其软化为“公开路线图和外部审查”,更在附录中加入了一个致命的“竞争条件”:
只有在公司认为自己显著领先,且竞争者不会很快追上的情况下,才需要延缓开发。一旦不再遥遥领先,延缓承诺自动失效。
其首席科学官贾里德·卡普兰的解释很直白:如果竞争者还在推进,自家单方面停止,并不能保护任何人。
这套逻辑为所有AI巨头提供了一个完美的免责声明:既然对手不会停,抢先一步就是保护全人类的“必要条件”。于是,他们甚至不必否认风险,就能名正言顺地继续加速。
与此同时,资本的狂热也在推波助澜。据报道,Anthropic正筹备上市,潜在估值可能超过2万亿美元。
在安全与增长之间,员工、股东和商业伙伴都被绑上了同一辆高速行驶的战车。
为了维持估值神话,他们甚至开始用已有的模型来研发下一代——Anthropic披露,Claude已参与了公司26%的AI研发工作。
管理者并非完全没有踩过刹车。比如OpenAI曾因模型在授权和行为透明度上未达标,暂时取消了GPT-6.1 Astra的发布。但这种产品层面的暂时撤回,远不足以平息内部的路线之争。

刚离职的OpenAI安全团队成员大卫·罗宾逊将这种状态称为极度的“认知失调”:
公司每天都在警告模型有多危险,但内部却一刻不停地在训练和部署这些模型。双方在“接下来到底该承担多大风险”这一根本问题上,已经产生不可调和的裂痕。
尽管行业高管们也会在公开场合呼吁“协调减速”或推动各国政府监管,但在缺乏绝对信任与强制核查的商业战场上,任何人都可以随时回到那个熟悉的借口:
“我们停了,别人不会停。”
当少数人既有能力用技术重塑所有人的生活,又有财力优先为自己打造避难所时,我们就不能只好奇“他们到底怕什么”,而必须追问:他们凭什么让全人类为他们的冒险买单?
他们可以决定把私人地堡建在哪里,却没有权力替所有人决定该承担多大的风险。尤其当他们自己,也无法充分判断后果的时候。
很多年前,赫拉利在《人类简史》结尾处说过:“拥有神的能力,但是不负责任、贪得无厌,而且连想要什么都不知道。天下危险,恐怕莫此为甚。”
如对本稿件有异议或投诉,请联系 tougao@huxiu.com。