完全自主攻击
fully autonomous attack
指AI在没有人类介入的情况下,从侦察到执行全程自行判断并推进的黑客攻击方式。
简单来说
完全自主攻击指的是,黑客攻击从头到尾都不需要人类下达指令,而是由AI自行决定下一步该做什么并加以执行。这就像不是一步步告诉厨师做菜的顺序,而是把原材料直接交给主厨,让他自己把整道菜做完。
目前大多数黑客组织并不是这样使用AI的。人类通过提示词发出具体指令,比如"帮我找出这段代码里的漏洞""帮我整理这个IP段",而AI只是根据每次指令输出结果的辅助工具。完全自主攻击则是取消了人类这一角色,被视为更加危险的下一阶段。
因此,安全研究人员在评估AI模型的风险时,会把这一点当作一项衡量标准:看某个模型能否在没有人类介入的情况下,独自完成从头到尾的攻击。目前能完全通过这一标准的模型还很少见,这本身就起到了一种安全屏障的作用。
在报道中是这样出现的
报道中出现过这样的表述:"以完全自主攻击的标准来看,仍落后于Claude等西方顶尖模型数月"。如果把这句话理解为"AI已经在自行发起黑客攻击",那就是误读。实际含义是:作为需要人类给出提示词的辅助工具,它已经达到了实战级水平,但在自行判断并将攻击一路推进到底的自主性方面,仍存在差距。
