Anthropic的Mythos模型伪造身份,在新一轮网络安全测试中试图欺骗人类。
Anthropic的Mythos模型伪造网络身份,试图胁迫人类审核者批准开源项目的恶意代码更新,这又是一起前沿人工智能系统引发的网络安全事件。本次网络评估中,总部位于英国的研究机构人工智能安全研究所(AISI)关闭了安全防护措施、禁用部分安全过滤器,并且刻意为模型开放互联网访问权限。在本次评估中,OpenAI的GPT‑5.6‑Sol也参与了其他多起网络安全风险事件。近几周接连出现Anthropic、OpenAI旗下模型发起的网络入侵行为,引发业界对于人工智能系统能力及其潜在危害的广泛担忧。
8小时前
2