
이미지: 영상 갈무리
요약
- 오픈AI가 9월 22일 GPT-6 Sol과 GPT-6 Luna를 공개하고 ChatGPT Work와 Codex, API에 올렸어요.
- 두 모델의 API 가격은 GPT-5.6 프로모션 가격 대비 50% 내려갔고, 캐시된 입력 토큰 읽기에는 90% 할인이 붙어요.
- AutomationBench 1.0.6에서 GPT-6 Sol은 33.2%로 Claude Opus 5의 26.9%를 앞섰고 작업당 비용은 그 9% 수준이었어요.
- 공개
- 2026년 9월 22일 · ChatGPT Work·Codex·API
- API 이름
- gpt-6-sol · gpt-6-luna
- 가격
- GPT-5.6 프로모션 대비 50% 인하 · 캐시 입력 읽기 90% 할인
- AutomationBench 1.0.6
- Sol(xhigh) 33.2% · Astra(low) 30.3% · Claude Opus 5(max) 26.9%
- 작업당 비용
- Astra(low) 3.9배 · Claude Opus 5(max) 11.1배 · Fable 5.1 폴백 8.9배 이상
- Agents' Last Exam V1
- Sol(max) 56.4% · 55개 세부 산업
- DeepSWE 1.1
- Sol(max) 68.8% · Claude Fable 5(xhigh) 69.9% · Luna(max) 66.6%
- OSWorld 2.0 오프라인
- Sol(xhigh) 60.5% · Claude Opus 5(medium) 60.3%
- 사실성
- Sol 오류 전작의 약 절반 · Luna 고효율 설정에서 GPT-5.6 Sol 수준
- 캐싱 도구
- 프롬프트 캐싱 대시보드 · 진단 도구 · 명시적 브레이크포인트
- 깃허브 보고
- 수십억 건 요청에서 새로 처리할 프롬프트 토큰 비중 50% 이상 감소
- 배포
- Plus·Pro·Business·Enterprise·Edu · Free·Go 는 데스크톱 앱 Luna
오픈AI가 9월 22일 GPT-6 Sol과 GPT-6 Luna를 공개했어요. 이달 초 내놓은 GPT-6 Astra와 비슷한 방법으로 학습한 모델인데, 이번 발표가 겨냥한 축은 성능 자체가 아니라 비용이에요. 회사 측은 캐싱과 추론을 더 효율적으로 만들어 아낀 몫을 이용자와 고객에게 그대로 넘긴다며, 두 모델의 API 가격을 GPT-5.6 프로모션 가격 대비 50% 내렸다고 밝혔어요.
업무 자동화 평가에서 격차가 가장 크게 드러나요. 판매와 마케팅, 운영, 지원, 재무, 인사 업무를 47개 도구로 처음부터 끝까지 수행하게 하는 AutomationBench 1.0.6에서 GPT-6 Sol은 xhigh 설정으로 33.2%를 받았어요. 같은 표에서 Claude Opus 5는 max 설정으로 26.9%였고 작업당 비용은 Sol의 11.1배였어요. 폴백을 붙인 Claude Fable 5.1은 31.4%로 점수가 더 높았지만 비용은 Sol의 8.9배를 넘고, 그 수치에는 전체 과제의 약 40%에서 일어난 Opus 5 폴백 비용이 빠져 있어요. GPT-6 Astra조차 low 설정에서는 30.3%에 그쳐 Sol보다 낮았고 비용은 3.9배였어요.
긴 호흡의 전문 업무를 재는 Agents' Last Exam V1에서도 순서가 비슷해요. 컴퓨터로 하는 주요 직무 대부분을 55개 세부 산업으로 나눠 놓은 이 평가에서 GPT-6 Sol은 max 설정으로 56.4%를 기록했어요. Claude Opus 5가 같은 평가에서 낸 가장 높은 점수보다 위인데 작업당 비용은 60% 낮았어요.
코딩 쪽 숫자는 더 촘촘해요. 실제 코드베이스에 병합할 수 있는 변경을 만드는지 보는 FrontierCode 1.1 Main에서 Sol은 전작인 GPT-5.6 Sol을 크게 넘어 Claude Fable 5.1의 xhigh 설정과 맞먹었어요. 긴 호흡의 소프트웨어 엔지니어링 과제를 주는 DeepSWE 1.1에서는 max 설정으로 68.8%를 받아 Claude Fable 5의 최고 점수 69.9%와 1.1%포인트 차이로 붙었고, 작업당 비용은 약 80% 낮았어요. GPT-6 Luna는 같은 평가에서 66.6%로 Claude Opus 5와 Fable 5의 medium 설정에 비견됐는데, 작업당 비용은 Opus 5보다 93%, Fable 5보다 96% 낮았어요.
컴퓨터를 직접 조작하는 과제에서는 자리가 거의 붙었어요. OSWorld 2.0 오프라인 집합에서 Sol은 xhigh 설정으로 60.5%를 받아 Claude Opus 5의 medium 설정 60.3%와 사실상 같았고 작업당 비용은 약 80% 낮았어요. GPT-6 Luna는 max 설정으로 GPT-5.6 Sol의 medium 설정을 넘어서면서 비용은 10분의 1이었어요. 컴퓨터 사용에서 세계 최고 모델은 여전히 GPT-6 Astra라고 회사 측은 적었어요.
사실성은 이용자가 직접 오류를 신고한 실제 대화를 익명 처리해 만든 내부 평가로 쟀어요. 오류를 부르는 문항만 모아 놓은 이 평가에서 GPT-6 Sol은 전작보다 실수를 약 절반으로 줄였고, GPT-6 Luna도 효율 설정을 올리면 GPT-5.6 Sol 수준에 닿는데 비용은 그 100분의 1 정도예요. 회사 측은 이 문항들이 오류가 드문 일반적인 사용을 대표하지 않는다는 단서를 함께 달았어요.
캐싱은 이번 발표에서 가격만큼 비중이 큰 대목이에요. 기본 캐시 적중률이 올라가 에이전트가 문맥을 더 많이 재사용하고, 캐시된 입력 토큰 읽기에는 90% 할인이 붙어요. 개발자는 프롬프트 캐싱 대시보드에서 입력 가운데 얼마가 캐시됐는지 보고, 진단 도구로 놓친 캐시 기회와 고칠 지점을 확인해요. 추론 노력을 올리거나 내리고 도구를 켜고 끄는 동안에도 앞선 문맥이 보존되고, 명시적 브레이크포인트로 캐시 접두부가 끝나는 자리를 직접 고를 수 있어요. 깃허브는 최근 몇 달 동안 이런 개선으로 수십억 건의 요청에서 새로 처리해야 하는 프롬프트 토큰 비중이 절반 넘게 줄었다고 전했어요.
말투도 함께 손봤어요. Astra에서 다듬은 대화 방식을 Sol과 Luna로 옮겨 전문용어와 군더더기를 줄이고 답변을 조금 짧게 만들었는데, 기술과 코딩 대화에서 특히 눈에 띌 거라는 설명이에요. 정렬 평가에서도 두 모델은 GPT-5.6 세대보다 나아졌고, 자기 코딩 작업을 두고 오해를 부르는 주장을 하는 비율이 낮아졌어요.
오픈AI는 발표문에서 "가장 까다롭고 중요한 프로젝트에는 여전히 Astra의 온전한 깊이가 필요하지만, 일은 저마다 다른 규모와 리듬과 예산에서 벌어져요" 라고 적었어요. 회사의 개발자 공식 계정은 같은 날 "Sol로 만들고 Luna로 확장하세요" 라고 밝혔어요.
두 모델은 ChatGPT Work와 Codex에서 당일부터 Plus와 Pro, Business, Enterprise, Edu 이용자에게 열렸어요. Free와 Go 이용자는 데스크톱 앱에서 GPT-6 Luna를 쓸 수 있고, Chat에는 아직 들어가지 않았어요. API 이름은 gpt-6-sol과 gpt-6-luna예요. 보도에 따르면 기업용 작업 공간에서는 관리자가 새 모델을 켜 줘야 목록에 뜨고, 데스크톱 앱 릴리스 노트에는 같은 급의 GPT-5.6 모델보다 토큰을 적게 쓴다고 적혀 있어요.
메탈이 확인한 오픈AI 공식 계정의 공개 영상은 8초 분량 1920×1080 화면이었고, 게시물 조회수는 233만 회, 좋아요는 3만 회였어요. 메탈은 GPT-6 Astra가 정렬 개선과 치명적 사이버 등급을 함께 안고 나왔다고 보도한 바 있으며, 이번 두 모델은 그 세대의 방법을 아래 등급으로 내려보내는 자리예요.
정리하면 이번 발표의 승부처는 새 능력이 아니라 같은 능력의 값이에요. 표에 오른 비교가 전부 점수와 작업당 비용을 짝으로 놓고 있고, 오픈AI가 고른 상대도 자사 최상위 모델과 경쟁사 상위 모델이에요. 모델을 고르는 자리가 성능 한 줄에서 점수와 비용의 두 축으로 옮겨 가고 있다는 신호예요.
출처
- OpenAI — Introducing GPT-6 Sol and Luna →
- OpenAI — OpenAI 공식 X 게시물 — GPT-6 Sol·Luna 공개 →
- OpenAI — OpenAI Developers 공식 X 게시물 — Sol·Luna API 공개 →
- Techmeme — OpenAI launches GPT-6 Sol and Luna (David Gewirtz/ZDNET) →
- Techmeme — GPT-6 Sol and Luna pricing (Nat Rubio-Licht/The Deep View) →
- 9to5Mac — OpenAI upgrading ChatGPT and Codex with two more GPT-6 models →





댓글