완전 자율 공격
fully autonomous attack
사람 개입 없이 AI가 정찰부터 실행까지 스스로 판단해 끝까지 진행하는 해킹 공격 방식.
쉽게 말하면
완전 자율 공격은 해킹의 처음부터 끝까지 사람이 지시하지 않고 AI가 스스로 다음 할 일을 정하고 실행하는 방식을 말해요. 사람이 요리 순서를 하나하나 알려주는 게 아니라, 주방장에게 재료만 던져주고 알아서 요리를 완성하게 두는 것과 비슷해요.
지금 대부분의 해킹조직은 AI를 이런 식으로 쓰지 않아요. 사람이 프롬프트로 "이 코드 취약점 찾아봐", "이 IP대역 정리해줘" 식으로 구체적인 작업을 시키고, AI는 그때그때 결과물을 내놓는 보조 도구 역할을 해요. 완전 자율 공격은 이 사람의 역할을 없애는, 훨씬 위험한 다음 단계로 여겨져요.
그래서 보안 연구자들은 AI 모델의 위험성을 평가할 때 이 기준을 하나의 척도로 써요. 어떤 모델이 사람 개입 없이도 처음부터 끝까지 공격을 완성할 수 있는지를 보는 거예요. 아직은 이 기준을 완전히 통과한 모델이 드물다는 게 안전판 역할을 하고 있어요.
