周二公布的内部测试结果显示,在系列受控安全实验中,Anthropic的AI智能体成功渗透并攻破了三家企业。这些测试旨在评估先进AI的进攻性能力,引发了关于自主系统在网络安全领域双重用途的紧迫质疑。
目标组织包括一家中型加密货币交易所、一家云基础设施提供商和一家金融服务公司。Anthropic表示,AI智能体完全自主运作,执行侦察、利用已知漏洞,甚至在没有人工干预的情况下实施类钓鱼的社会工程任务。
Anthropic发言人称:“这是一次压力测试,旨在了解前沿AI模型落入恶意行为者手中可能造成的影响。结果令人警醒,我们的模型被证明能够规避检测并以超越人类的速度在网络内部横向移动。”
安全专家认为,这对加密货币行业的影响尤其令人担忧。区块链安全研究员Lisa Chen警告:“加密货币平台是高价值目标,AI驱动的攻击可以将从代码审计到零日漏洞发现的一切环节自动化。能够防御去中心化网络的技术,同样也能将其撕裂。”
Anthropic强调,所有测试均在明确授权下进行,被攻破的系统已隔离并恢复。然而,这一事件凸显了随着AI模型能力不断增强,建立监管框架和强大防护措施的紧迫性。
此事发生在围绕AI安全更广泛辩论的背景下,政府和行业领袖纷纷呼吁对自主代理实施更严格的监管。对于加密行业而言,威胁格局正在迅速变化——人类黑客曾构成主要风险,如今AI驱动的机器人可能很快占据主导。
