
이미지: METAL
요약
- 백악관이 AI 감독 프레임워크를 확장해 프론티어 수준에 도달한 오픈모델에도 사전 출시 테스트를 적용하는 방안을 검토 중인 것으로 알려졌다
- 기준선은 앤스로픽 Mythos급 모델과 오픈AI GPT-5.6 수준의 역량으로, 백악관 관계자가 언급했다
- 주요 AI 랩이 이 감독 프로그램의 공식 파트너로 참여하는 새로운 협력 방식도 함께 논의되고 있다
- 발표 시점
- 2026년 8월 12일(현지 시각), 백악관 관계자 발언 인용 보도
- 핵심 방침
- 프론티어급 오픈모델을 AI 감독 프레임워크에 포함, 사전 출시(pre-release) 테스트 적용
- 기준 모델
- 앤스로픽 Mythos급 모델, 오픈AI GPT-5.6과 동등한 역량 도달 시 적용
- 추가 검토안
- 주요 AI 랩이 감독 프로그램의 공식 파트너로 참여하는 새 협력 구조
- 우려 배경
- 모델이 자율적으로 국방부(Pentagon)나 글로벌 금융시장을 해킹할 가능성
- 관련 사례
- 오픈AI 차기 모델 아스트라가 내부 평가에서 '치명적' 사이버 역량 임계치 배제 불가 판정(2026년 8월 8일)
오픈모델도 예외 없다
미국 백악관이 AI 모델 감독 체계를 손보고 있다. 지금까지 폐쇄형(클로즈드) 프론티어 모델을 중심으로 짜여 있던 감독 프레임워크를, 프론티어 수준에 도달한 오픈모델까지 확장하는 방안을 검토 중이라는 소식이 나왔다. 뉴스 앰프(News Amp) 계정을 운영하는 앤드루 커런(Andrew Curran)이 8월 12일 전한 내용으로, 원 발표 주체는 백악관 관계자로 알려졌다.
핵심은 '기준선'이다. 백악관 관계자에 따르면 오픈모델이 앤스로픽의 Mythos급 모델, 오픈AI의 GPT-5.6과 동등한 역량에 도달하는 순간 이 모델은 감독 대상에 자동 편입되고, 출시 전 별도의 사전 테스트를 받아야 한다. 지금까지는 주요 연구소가 직접 배포·통제하는 폐쇄형 모델이 주된 규제 타깃이었는데, 누구나 가중치를 내려받아 쓸 수 있는 오픈모델까지 같은 잣대를 적용하겠다는 뜻이다.
왜 지금 사이버 능력이 기준선인가
이 움직임의 배경에는 최근 몇 달간 급격히 커진 AI의 사이버 역량에 대한 우려가 깔려 있다. 백악관 관계자는 모델이 자율적으로 국방부 시스템이나 글로벌 금융시장을 해킹할 수 있다는 걱정이 이번 조치를 촉발했다고 밝혔다.
이 우려는 근거가 없는 게 아니다. METAL LAB이 지난 8월 8일 보도한 대로, 오픈AI의 차기 모델 아스트라는 내부 평가에서 준비 프레임워크(Preparedness Framework)의 '치명적' 사이버 역량 임계치를 배제할 수 없다는 판정을 받았다. 이전 모델인 GPT-5.6-Sol을 포함한 기존 모델들은 같은 평가에서 한 단계 낮은 '높음' 수준에 그쳤던 것과 비교하면, 역량 상승 속도가 눈에 띄게 빨라진 셈이다. 오픈AI는 이후 격리 테스트 환경 구축과 모델 가중치 암호화 강화 등 보안 통제를 즉시 적용했다.
이틀 뒤인 8월 10일에는 오픈AI가 사이버보안 이니셔티브 '데이브레이크(Daybreak)'를 확대하고, 허가된 취약점 연구용 특수 모델 GPT-5.6-Cyber를 내놓기도 했다. 이 모델은 크롬 V8 엔진 등 널리 쓰이는 오픈소스 소프트웨어에서 기존에 알려지지 않은 취약점을 실제로 찾아낸 것으로 알려졌다. 방어와 공격 양쪽에서 모델의 사이버 역량이 실전 수준에 근접했다는 신호가 잇따르자, 규제 당국이 오픈모델까지 감독 범위를 넓히려는 것으로 풀이된다.
'공식 파트너' 방안이 뜻하는 것
백악관은 감독 대상 확대와 별개로, 주요 AI 랩을 이 프로그램의 공식 파트너로 참여시키는 새로운 협력 구조도 검토하고 있다. 지금까지 정부의 모델 평가가 연구소 외부에서 진행되는 규제·검증 절차였다면, 이번 방안이 실현되면 오픈AI·앤스로픽 같은 랩이 감독 체계 안으로 들어와 평가 기준을 함께 설계하는 위치에 서게 될 가능성이 있다. 다만 구체적인 참여 형태나 대상 랩의 명단은 아직 공개되지 않았다.

감독 프레임워크 확대 흐름
| 항목 | 기존 | 검토 중인 확대안 |
|---|---|---|
| 대상 모델 | 폐쇄형 프론티어 모델 | 프론티어급 오픈모델 포함 |
| 테스트 시점 | 사후 평가 중심 | 출시 전 사전 테스트 의무화 |
| 랩의 역할 | 규제 대상 | 공식 파트너 참여 검토 |
그래서 무엇이 달라지나
오픈모델은 누구나 내려받아 개조하고 재배포할 수 있다는 점에서, 폐쇄형 모델보다 통제가 어렵다는 지적을 오래 받아왔다. 이번 방침이 확정되면 앞으로 오픈모델을 내놓는 개발사들도 GPT-5.6이나 Mythos급 역량에 근접하는 순간부터 정부의 사전 검증을 거쳐야 할 수 있다. 이는 오픈소스 AI 생태계의 속도와 자유도에 제동을 거는 동시에, 모델의 위험성을 배포 전에 걸러내는 안전판을 하나 더 두는 시도로 볼 수 있다. 다만 구체적인 시행 시점과 대상 모델의 판정 기준, 참여 랩의 범위는 아직 정해지지 않은 것으로 보인다.





댓글