2026-09-16 20:16

从反蒸馏到反“反AI”,Anthropic要做什么?

author_path 潜望工作室©
头图

本文来自微信公众号: 数字经济发展评论 ,作者:数字经济发展评论


导语


近日,Anthropic的一份报告点名多家中国AI公司,指其“非法蒸馏”Claude。对外,它要当“滥用”的定义者;对内,却另有一套动作:60分钟预警让高管避开提前举行的抗议,改路线、换通道,写进行程表;例行向警局报案,追“行为曲线”而非已发生的事,有用户被报警处理,警方却拿不到那段对话,举报成立,证据不交。文章追问:从反蒸馏到反“反AI”,谁在划这条界?AI一旦被认定为关键基础设施,公共表达的空间又会被压缩到什么程度?


原文标题:Anthropic Is Building a Predictive Surveillance System to Monitor Activists


原文来源:美国展望(The American Prospect)


编译解读:数字经济发展评论


Anthropic的招聘信息及其安全高管的受访内容显示,这家前沿AI实验室正在搭建一套庞大的监控系统,密切关注反对AI快速发展的活动人士。被列进目标清单的是一类人,而不是一类行为,这是这套系统最值得追问的地方。一家把“负责任”写在招牌上的公司,正在把批评者当成一类风险来管理。


除了监控高管周边的活动人士、留意公司实体资产附近的抗议活动外,Anthropic还在推行一种“事前预判”模式:试图在事情发生之前做出判断,某些情况下,这还意味着在罪案发生之前就将嫌疑人报给警方。


预测的依据是模型对数据的判断,而不是谁做了什么。从事后追责到事前拦截,一步之差,落点却从保护人变成了管住人。Anthropic未回应《美国展望》(The American Prospect)的置评请求。未予置评本身就是一种说明,至少表示这套做法短期内不会撤回。


今年年初,Anthropic还因拒绝让军方把自家工具用于大规模国内监控和自主武器,与美国国防部发生高调争执。当时的姿态是拒绝监控,现在的动作是自己上马。随着Anthropic开始招聘“国家安全销售”岗位,试图重启军方合同,这种紧张关系似乎正在缓和。对国内反对者的威胁监测升级,与该公司重新聚焦国家安全的方向一致。安全预算与国防订单,往往就是这样一路长出来的。


安全部门扩张通常有迹可循:先是护住人和楼,再是提前知道谁要来,再往后,谁在反对都算风险。三步走完,安保就成了情报。


提前60分钟的预警:高管临时改道


Anthropic监控系统的一角,在去年一场播客访谈中被披露。访谈参与者包括Anthropic全球安全运营中心经理基翁·埃利森(Keon Ellison)、安全运营经理扎克·梅尔文(Zach Melvin),以及Samdesk首席执行官詹姆斯·诺伊费尔德(James Neufeld)——Anthropic与Samdesk签有风险检测合同。


这场关于威胁监控与分析的广泛对话,也涉及对活动人士的监控。埃利森讲了一个例子:“去年我们有位高管前往某大城市,当时通过Samdesk收到情报,称有一场计划中的抗议活动。原定的抗议因许可问题提前举行,Samdesk给了我们大约60分钟的提前量,告诉我们组织方改了时间。”埃利森解释道,“这多出来的一个小时很关键。没有它,我们高管散会后就会直接撞进抗议活动的中心。”


利用这些信息,Anthropic给高管规划了备用路线,将其引导至酒店的员工通道。从改路线到改出入口,预警被直接写进了行程表。埃利森说,“本来可能是高度紧张的局面,因为Samdesk的早期预警和给到的信息,局面得以化解。”对企业而言,这是危机管理;对被追踪的人而言,则是在自己不知情时已经被提前安排过一次。


Anthropic已开始就威胁事件向全美各地警局提交例行报告,并在今年7月告知《华尔街日报》“我们通过关注人员流程,长期追踪可疑行为,这让我们能及早发现行为升级模式。


”追踪的是一条行为曲线,曲线由谁定义,异常就由谁说了算。据《华尔街日报》报道:“上报给警方的多起事件中,有数名当事人此前已处于Anthropic安全团队的追踪之下。”报告一旦例行化,企业就相当于在警方那里长期备案。


这里的关键不在“企业能不能报警”,而在它凭什么长期建档:追踪的是行为模式,而不是已经发生的事。


向警方报案,却拒绝出示对话记录


上个月,《旧金山标准报》报道,Anthropic向旧金山警方报案,原因是一名男子对Claude说,自己买了AR-15半自动步枪,并把CEO达里奥·阿莫迪(Dario Amodei)“纳入瞄准范围”。当记者联系到该男子时,他告诉媒体自己只是“瞎扯”。


然而,尽管Anthropic迅速就一名不满的Claude用户报警,《旧金山标准报》还是披露了一个关键细节:Anthropic以公司内部政策为由,拒绝向警方出示真实对话内容。结果是,一个人因为在平台里说的话被报案处理,警方却拿不到那句话。举报成立,证据不交。报案与举证拆开之后,被举报的人连自证清白的机会都没有。


这种未经正当程序的预防式执法,在安全项目经理的访谈里被说成了明确目标:“目标是把运营模式从被动响应,转变为主动的、预测性的和预防性的威胁应对与管理。”他补充说,“这正是保护任何行业的高价值目标所需的运营成熟度。”把预防写进岗位目标,意味着它已经通过了内部合规的审视。“预防性”这三个字听着温和,实际是把判断提前到了事实之前。


值得留意的不是某一次报警对不对,而是这套流程被写成了岗位目标:主动、预测、预防,三者都不要求事情发生。


招聘启事把社会运动与恐怖主义并列


Anthropic构建预测性安全体系的努力,不仅限于高管层,还延伸至其全球安保、情报与安全(GSIS)团队。上个月的一则招聘信息显示,该公司在寻找一名企业情报专家,职责是“调查特定威胁、行为者和事件,撰写评估报告,帮助Anthropic员工在快速演变的威胁格局中保持领先并处于可防御的位置。”招聘启事是最难粉饰的材料,传递的就是公司的意愿。“可辩护”这三个字透露出,公司知道自己会被追问。


该岗位年薪在18万至23万美元,部分职责是“识别、评估、追踪和调查全球威胁,包括地缘政治动荡、恐怖主义、犯罪、社会运动、针对AI行业的国家行为体,以及新兴安全趋势,并负责对特定威胁、行为者和事件的深度研究与开源情报收集”。从岗位描述看,公司要的不是安保支援,而是能产出评估报告的分析人员。


社会运动与恐怖主义被放进同一串名词里,这不是笔误,是一份分类表。


分类即立场。当“社会运动”和恐怖主义、犯罪并列进同一份职责清单,公司就不再区分批评者与攻击者。


把AI列为关键基础设施之后


Anthropic将情报收集从公司周边扩展到全国乃至全球范围,与近期提升AI及其底层基础设施(包括数据中心和电力供应)地位的努力一脉相承。被列为关键基础设施,将使AI与供水、电力和宽带处于同等地位。与此同时,看护手段也将向看护电网看齐。事实上,支持AI的团体,如“美国负责任创新组织”(ARI),已敦促特朗普政府做出这一调整。


按照ARI的说法,AI“对美国至关重要,这类系统与资产的瘫痪或破坏,将对国家安全、国家经济安全、国家公共卫生安全,或上述各项组合,造成严重削弱的影响。”这套措辞与关键基础设施、国家安全的表述高度同源,把商业资产装进国家安全叙事只差一个官方认定。


把前沿实验室披上国家安全的外衣,不仅会让Anthropic、OpenAI和谷歌更容易拿到联邦执法与情报机构生成的情报产品,也会让这些公司更有底气去影响联邦机构如何看待对其商业利益的威胁。毕竟,这些商业利益如今已被包装为“关键基础设施”。身份一变,企业的营收风险就自动升格为国家安全风险。


不难想象,那个反对数据中心的两党公民联盟如果把公民参与的火力转向AI,很可能在同一时间被贴上“极端分子”,甚至“恐怖分子”的标签。标签的转换成本极低,而公民表达一旦被归档,就很难被移除。Anthropic对这个问题的应对方式,是更卖力地推出公众难以忽视的AI服务,用产品说服力去对冲信任赤字。


Anthropic首席执行官阿莫迪上月在社交媒体上写道:“我确实认同公众对AI持负面看法(这是个大问题),但我不认为这主要由我或其他AI领导者警告AI风险所造成。”他接着写道:“我认为这从根本上是一场信任危机……普通人就是不信任公司、政府和科技行业,总怀疑我们在琢磨新法子坑他们。”承认存在信任危机是一回事,把批评者纳入监控是另一回事,后者只会让危机坐实。


信任危机不是靠产品能力就能修复的。当公众发现预警系统的方向对着自己,怀疑就有了具体的形状。


保安投票罢工,公司让员工居家办公


随着Anthropic通过内部情报团队和AI驱动的实时抗议追踪加大对异见者的监控,它也不得不面对湾区办公楼之外普通人的日益加剧的经济困难。就在此前一周,在OpenAI与Anthropic园区巡逻的保安宣布,因薪资谈判停滞已投票授权罢工。


Anthropic的回应是一封全员邮件,建议员工居家办公。遇到罢工就让员工回家,等于用远程办公替代了谈判桌。同一套预警能力用在这里,就是让员工绕开罢工纠察线。


代表湾区保安的工会“服务业雇员国际理事会西海岸分部”(SEIU-USWW)主席大卫·韦尔塔(David Huerta)上周在一次集会上说:“在旧金山,时薪22美元怎么活?”看守园区的人与楼里的人,收入差距本身就是信任缺口的一部分。他身边的保安喊着:“可耻。”被列入监控清单的是外部批评者,坐在谈判桌对面的却是自己的保安。


预警系统的用途,取决于谁在调用。同一套能力,给高管是改道,给员工是绕开纠察线,给批评者则是提前归档。


对国内来说,这件事的提醒落在一句话上:谁来定义威胁。平台把用户言论上报给执法机构,触发条件、证据要求和事后复核目前都掌握在企业内部;另一层是身份升级:AI及其数据中心、电力配套一旦被认定为关键基础设施,企业顺带就拿到了把商业利益讲成国家安全风险的解释权,认定标准与配套监督也需要同步落地。

本内容来源于网络 原文链接,观点仅代表作者本人,不代表虎嗅立场。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。