증류 공격
Distillation Attack
경쟁사의 성능 좋은 AI 모델에 질문을 대량으로 던져 그 답변을 자기 모델 훈련 재료로 몰래 빼가는 행위.
쉽게 말하면
증류 공격은 다른 회사가 만든 뛰어난 AI 모델에 수많은 질문을 던지고 그 답변을 모아, 그 데이터로 자기 회사의 더 싸고 작은 모델을 훈련시키는 행위예요.
비유하면 이렇습니다. 전교 1등에게 계속 문제를 물어보고 답을 받아 적은 다음, 그 답 모음집으로 다른 학생을 가르치는 거예요. 원래 모델을 만든 회사는 자기가 오랜 시간과 큰 비용을 들여 키운 '실력'을 남이 거의 공짜로 베껴 간다고 보기 때문에, 이런 행위를 막으려고 계정 확인을 강화하고 접근을 차단해요.
문제는 이걸 막으려는 쪽과 뚫으려는 쪽 사이에 우회 시장이 생긴다는 점이에요. 정상적인 경로로는 접근이 막힌 지역이나 조직이 대리 서버(중간에서 요청을 대신 전달해 주는 우회 통로)를 거쳐 몰래 접속하고, 여기서 얻은 답변을 자기 모델 개선에 쓰는 식이죠. 회사 입장에서는 서비스 약관 위반이자 지식재산을 빼가는 보안 문제로 취급돼 '공격'이라는 이름이 붙어요.
