METAL for iPhone

AI 뉴스, 이제 앱에서 읽으세요.

METAL 앱을 다운로드하고 매일 새로운 AI 기사를 만나보세요.

App Store에서 다운로드

iPhone용 앱 · 무료 다운로드

iPhone의 App Store에서도 ‘메탈 AI 매거진’을 검색할 수 있습니다.

METAL

오픈AI 신모델 아스트라, 치명적 사이버 역량 판정

오픈AI는 2026년 8월 7일 공개한 내부 평가에서 출시 예정 모델 아스트라(Astra)가 준비 프레임워크상 '치명적(Critical)' 사이버 역량 임계치를 배제할 수 없다고 결론 내렸다고 밝혔다.

오픈AI 신모델 아스트라, 치명적 사이버 역량 판정 · Image: METAL LAB

이미지: METAL

요약

  • 오픈AI가 출시 예정 모델 아스트라의 내부 평가 결과, 준비 프레임워크의 '치명적' 사이버 역량 임계치를 배제할 수 없다고 발표했다.
  • 이전 모델 GPT‑5.6‑Sol을 포함한 기존 모델들은 동일 평가에서 '치명적'보다 한 단계 낮은 '높음(High)' 임계치로 판정됐다.
  • 오픈AI는 격리 테스트 환경 구축, 모델 가중치 암호화 강화, 전 에이전트 애플리케이션 모니터링 등 강화된 보안 통제를 즉시 적용하고, 요건을 충족하지 못한 내부 활동은 일시 중단했다.

아스트라, '치명적' 사이버 역량 임계치 도달 가능성

오픈AI는 8월 7일 공식 블로그를 통해 출시 예정 모델 아스트라에 대한 내부 평가 결과를 공개했다. 회사는 지난 며칠간 진행한 평가에서 아스트라가 에이전트 코딩과 사이버보안 분야에서 현저한 성능 향상을 보였으며, 이를 토대로 전날 밤 준비 프레임워크(Preparedness Framework)상 '치명적(Critical)' 사이버 역량 임계치를 배제할 수 없다는 결론에 도달했다고 설명했다.

오픈AI는 "안전·보안 커뮤니티와 일반 대중에게 이번 역량 변화 가능성을 투명하게 공유하는 것이 중요하다고 판단했다"고 밝혔다. 아스트라는 현재 출시 전 단계의 모델로, 최근 허깅페이스 보안 사고와는 무관하다고 회사 측은 강조했다.

준비 프레임워크 사이버보안 역량 임계치 기준 설명 화면
이미지: OpenAI News

'치명적' 임계치란 무엇인가

오픈AI의 준비 프레임워크에 따르면, 모델이 '치명적' 사이버보안 임계치에 도달하려면 두 가지 조건 중 하나를 충족해야 한다. 첫째, 인간의 개입 없이 다수의 강화된 실세계 핵심 시스템에서 모든 심각도 수준의 제로데이 취약점을 식별하고 기능하는 익스플로잇을 개발할 수 있어야 한다. 둘째, 강화된 공격 대상에 대해 고수준의 목표만 주어진 상태에서 새로운 사이버 공격 전략을 처음부터 끝까지 고안하고 실행할 수 있어야 한다.

이번 평가에서 GPT‑5.6‑Sol을 포함한 이전 모델들은 동일한 프레임워크에서 '치명적'보다 한 단계 낮은 '높음(High)' 임계치로 판정됐다. 오픈AI가 처음 준비 프레임워크를 발표한 것은 2023년 12월로, 당시에는 생물학·화학·사이버보안·AI 자기 개선 역량이 이 수준에 근접하기 훨씬 전이었다고 회사는 설명했다.

즉각 적용한 보안 강화 조치

오픈AI는 이번 결론에 따라 아스트라의 배포 수준에 맞는 안전장치와 보안 통제에 대한 견고성 테스트를 즉시 확대했다. 내부적으로는 격리된 테스트 환경 구축, 제한된 네트워크 및 도구 접근, 강화된 모델 가중치 보호와 암호화, 추가 모니터링·탐지 기능, 샌드박스 실행 환경 등 고역량 모델에 적합한 엄격한 보안 통제를 적용했다.

이러한 강화된 보안 통제 요건을 아직 충족하지 못한 아스트라 관련 내부 활동은 일시 중단했다.

아스트라 보안 통제 및 격리 테스트 환경 구조도
이미지: OpenAI News

외부 협력 및 향후 계획

오픈AI는 이번 평가 결과를 계기로 관련 정부 기관 및 선별된 AI 안전 기관과 협력해 아스트라의 역량을 추가로 테스트할 계획이라고 밝혔다. 아울러 고위험 평가 및 워크로드를 안전하게 수행하기 위한 권장 보안 통제 사항을 제3자 테스트 파트너에게도 제공할 예정이다.

오픈AI는 2025년 6월 생물학 분야에서 모델이 준비 프레임워크의 '높음' 역량 임계치에 근접했을 때도 안전장치 강화, 테스트 확대, 외부 전문가 협력, 추가 보안 통제 배포 등의 단계를 공개한 바 있으며, 이번에도 동일한 원칙을 적용한다고 설명했다. 회사는 "고급 사이버 역량을 갖춘 모델은 공격자보다 먼저 방어자가 취약점을 발견하고 해결하는 데 도움이 돼야 한다"며, 아스트라와 후속 모델들의 프런티어 역량이 책임 있게 배포될 수 있도록 정부·안전 기관·시민사회와 협력하겠다는 입장을 재확인했다.

김현국

METAL 발행인 · 아카이브저널 발행인 · 이라선 운영

매거진·서점·교육을 오래 해 온 편집자예요. 라이프스타일 매거진 <아카이브저널>을 발행하고, 아트 서점 <이라선>을 운영했으며, 라이카 아카데미에서 디렉터로 사진 교육 프로그램을 만들고 이끌었어요. 그 시선으로 전 세계 AI 소식을 독자에게 전하는 메탈(METAL) 매거진 편집장입니다.

이 에디터의 기사 더 보기 →

공유

댓글