METAL for iPhone

AI 뉴스, 이제 앱에서 읽으세요.

METAL 앱을 다운로드하고 매일 새로운 AI 기사를 만나보세요.

App Store에서 다운로드

iPhone용 앱 · 무료 다운로드

iPhone의 App Store에서도 ‘메탈 AI 매거진’을 검색할 수 있습니다.

METAL

오픈AI 신모델 Astra, 임계 사이버 역량 도달

오픈AI가 차기 모델 Astra의 내부 평가 결과, 준비 프레임워크상 '임계(Critical)' 사이버 보안 역량을 배제할 수 없다고 2026년 8월 7일 공개했다. 기존 GPT-5.6-Sol 등은 같은 기준에서 '높음(High)'에 머물렀다.

오픈AI 신모델 Astra, 임계 사이버 역량 도달 · Image: METAL LAB

이미지: METAL

요약

  • 오픈AI가 차기 모델 Astra의 사이버보안 평가 결과, 준비 프레임워크상 '임계' 등급을 배제할 수 없다고 발표했다.
  • Astra는 사람 개입 없이 강화된 실제 시스템에서 제로데이 취약점을 개발하거나 고수준 목표만으로 엔드투엔드 사이버 공격 전략을 수립·실행할 수 있는 수준에 근접한 것으로 평가됐다.
  • 오픈AI는 격리 테스트 환경 구축, 네트워크·도구 접근 제한, 모델 가중치 보호 강화 등 내부 보안 통제를 즉각 강화하고 일부 Astra 내부 활동을 중단했다.

무엇이 바뀌었나

오픈AI는 2026년 8월 7일, 출시 예정 모델 Astra에 대한 최근 며칠간의 내부 평가 결과를 공개했다. 에이전틱 코딩과 사이버보안 분야에서 유의미한 성능 향상이 확인됐고, 외부 전문가 평가까지 종합한 결과 회사는 자체 준비 프레임워크(Preparedness Framework)상 '임계(Critical)' 사이버 역량을 배제할 수 없다는 결론에 전날 밤 도달했다고 밝혔다. 오픈AI는 이 잠재적 역량 변화를 공개해야 할 이유로 투명성을 꼽았으며, 안전·보안 커뮤니티와 일반 대중 모두를 대상으로 공개 범위를 설정했다.

오픈AI가 준비 프레임워크를 처음 발표한 것은 2023년 12월이다. 당시에는 생물학·화학·사이버보안·AI 자기개선 역량이 이 수준에 근접하기 훨씬 전이었다. 프레임워크는 역량 진전을 파악하고 그 역량이 현실화될 때 회사가 취해야 할 행동을 규정하기 위해 만들어졌다. GPT-5.6-Sol을 포함한 이전 모델들은 프론티어 사이버 역량 평가에서 '임계'가 아닌 '높음(High)' 등급으로 분류됐다.

준비 프레임워크 사이버보안 역량 등급 체계 설명 다이어그램
이미지: OpenAI

'임계' 등급의 기준

준비 프레임워크에서 모델이 사이버보안 임계 등급에 해당하려면 두 가지 조건 중 하나를 충족해야 한다. 첫째, 사람 개입 없이 다수의 강화된 실제 핵심 시스템에서 모든 심각도 수준의 기능적 제로데이 익스플로잇을 식별하고 개발할 수 있어야 한다. 둘째, 고수준의 목표만 주어진 상태에서 강화된 타깃을 대상으로 한 엔드투엔드 신규 사이버 공격 전략을 스스로 수립하고 실행할 수 있어야 한다.

오픈AI는 현재 Astra에 대한 벤치마크와 평가를 계속 진행 중이며, 예비 평가 결과만으로도 임계 역량 등급을 배제하기에는 충분히 강한 성능이 확인됐다고 밝혔다. 다만 Astra는 출시 예정 모델로, 앞서 보고된 Hugging Face 침해 사건과는 무관하다고 오픈AI는 명시했다.

오픈AI가 즉각 취한 조치

오픈AI는 이번 평가 결과를 받아 내부적으로 일련의 보안 강화 조치를 즉시 시행했다. 격리된 테스트 환경 구축, 네트워크 및 도구 접근 제한, 모델 가중치 보호·암호화 강화, 추가 모니터링·탐지 역량 확보, 샌드박스 실행 환경 적용 등이 포함된다. 아울러 강화된 보안 통제 요건을 아직 충족하지 못한 Astra 관련 내부 활동은 일시 중단했다.

또한 Astra의 모든 에이전틱 애플리케이션—훈련과 평가 포함—에 위험 행동 및 정렬 이탈에 대한 범용 모니터링을 도입했다. 모니터는 모델의 사고 연쇄(Chain of Thought)를 평가하고, 고위험 활동이 감지되면 보안 검토를 발동해 해당 활동을 중단시킨다. 외부적으로는 관련 정부 기관과 일부 AI 안전 기관과 협력해 이 모델의 역량을 검증할 예정이며, 고위험 평가와 워크로드를 안전하게 수행하기 위한 권장 보안 통제 사항을 서드파티 테스트 파트너에게도 제공할 계획이다.

Astra 에이전틱 모니터링 및 보안 통제 흐름도
이미지: OpenAI

이전 전례와 앞으로의 방향

이번이 준비 프레임워크가 실제 역량 전환을 안내한 첫 사례는 아니다. 2025년 6월, 오픈AI 모델들이 준비 프레임워크의 생물학 분야 '높음' 역량 등급에 근접했을 때도 오픈AI는 안전장치 강화, 테스트 확대, 외부 전문가 협력, 추가 보안 통제 도입 방안을 공개 발표한 바 있다. 이번 사이버보안 임계 역량 평가에도 동일한 원칙이 적용된다.

오픈AI는 고급 사이버 역량을 갖춘 모델이 공격자보다 먼저 방어자가 취약점을 발견하고 해소하는 데 기여해야 한다는 입장을 밝혔다. 회사는 Astra를 비롯한 이후 모델의 프론티어 역량이 전 인류에게 이로운 방식으로 배포될 수 있도록 각국 정부, 안전 기관, 시민 사회와 협력해 나갈 것이라고 덧붙였다. 현재 Astra의 배포 일정이나 외부 출시 조건 등 구체적인 상용화 계획은 이번 발표에 포함되지 않았다.

김현국

METAL 발행인 · 아카이브저널 발행인 · 이라선 운영

매거진·서점·교육을 오래 해 온 편집자예요. 라이프스타일 매거진 <아카이브저널>을 발행하고, 아트 서점 <이라선>을 운영했으며, 라이카 아카데미에서 디렉터로 사진 교육 프로그램을 만들고 이끌었어요. 그 시선으로 전 세계 AI 소식을 독자에게 전하는 메탈(METAL) 매거진 편집장입니다.

이 에디터의 기사 더 보기 →

공유

댓글