
이미지: @OpenAI (X) 영상 갈무리
요약
- 오픈AI가 9월 29일 DevDay에서 GPT-6 Sol 개량판 GPT-6.1 Sol을 공개했고, 표준 입력·출력 토큰 가격은 Astra의 5분의 1이다.
- DeepSWE v1.1에서 Astra와 같은 점수를 약 5분의 1 비용으로 냈고, 캐시 입력 단가는 GPT-6 Sol의 절반으로 내려갔다.
- 시스템 카드 부록은 사이버보안 Critical·생물화학 High로 분류해 Astra와 같은 안전장치를 적용했으며, 챗GPT Work와 Codex, API부터 배포됐다.
- 발표
- 2026년 9월 29일 오픈AI DevDay · 발표문 「Introducing GPT-6.1 Sol」 · 시스템 카드 부록(45쪽)
- 가격 구조
- 표준 입력·출력 Astra의 5분의 1(GPT-6 Sol과 동일) · 캐시 입력 표준 대비 95% 저렴 · GPT-6 Sol 캐시 입력 대비 50% 인하
- DeepSWE v1.1
- Astra와 동점 · 약 5분의 1 비용 · GPT-6 Sol 최고점 대비 +6.4%p
- AutomationBench
- 중간 추론 강도 Opus 5.5 대비 +2.2%p · 비용 약 3분의 1 · GPT-6 Sol 대비 +4.8%p · 도구 47개
- OSWorld 2.0 오프라인
- GPT-6 Sol 대비 +7%p · Astra와 2.1%p 차 · 과제당 비용 약 7분의 1
- Terminal-Bench Science 0.1
- GPT-6 Sol 점수 두 배 이상 · 과제당 비용 Opus 5.5·Astra 대비 75% 이상 저렴 · Astra 최고점 68.1%
- 사실 정확도
- 낮은 추론 강도 오류 응답 11.4% → 7.7%(약 32% 감소) · Astra와 1.9%p 이내
- 시스템 카드
- 사이버보안 Critical · 생물화학 High · ExploitBench 99.7%(GPT-6 Sol 81.7%, Astra 100%) · 제한 우회 지속 23.5%(Astra 17.4%) · 검색 도구 고장 미고지 2.08%(GPT-6 Sol 4.92%)
- 배포
- Plus·Pro·Business·Enterprise·Edu 챗GPT Work와 Codex · API gpt-6.1-sol · 일반 챗 미제공 · Ultrafast 며칠 내
- X 반응
- 오픈AI 게시물 조회 1,168,255 · 좋아요 13,134(수집 시점)
오픈AI가 9월 29일 DevDay에서 GPT-6 Sol의 개량판 GPT-6.1 Sol을 공개했다. 회사는 이 모델이 에이전트 코딩과 컴퓨터 사용, 전문 업무에서 최상위 모델 GPT-6 Astra의 지능에 거의 맞먹으면서도 표준 입력·출력 토큰 가격은 Astra의 5분의 1이라고 밝혔다. 발표문 첫머리에 적은 문구는 "5분의 1 가격에 Astra에 가까운 지능"이다. GPT-6 Sol이 9월 22일 나온 지 일주일 만의 개량이며, 입력·출력 단가는 GPT-6 Sol과 같게 두고 캐시 입력 단가만 절반으로 내렸다. 캐시 입력은 표준 입력보다 95% 싸다.
오픈AI가 내세운 근거는 과제당 비용과 점수를 함께 그린 자체 평가다. 실제 코드베이스의 긴 소프트웨어 공학 과제를 푸는 DeepSWE v1.1에서 GPT-6.1 Sol은 Astra와 같은 점수를 대략 5분의 1 비용으로 냈고, GPT-6 Sol의 최고점보다 6.4%포인트 높았다. 영업·마케팅·운영·고객 지원·재무·인사에 걸친 도구 47개로 업무 흐름을 끝까지 처리하는 AutomationBench에서는 중간 추론 강도 기준으로 앤스로픽 Opus 5.5보다 2.2%포인트 높았고 비용은 약 3분의 1이었다. 표와 차트, 작은 글씨가 섞인 PDF로 전문 질문에 답하는 GDP.pdf에서도 과제당 비용 절반 이하로 Opus 5.5를 앞섰다고 회사는 주장했다.
컴퓨터 사용과 과학 연구에서는 차이가 더 크게 벌어졌다. 긴 컴퓨터 사용 작업을 평가하는 OSWorld 2.0 오프라인 세트에서 GPT-6.1 Sol은 최대 추론 강도 기준으로 GPT-6 Sol보다 7%포인트 높았고, Astra와의 격차는 2.1%포인트였으며 과제당 비용은 약 7분의 1이었다. 데이터 분석과 시뮬레이션, 정리 증명을 다루는 Terminal-Bench Science 0.1에서는 GPT-6 Sol의 점수를 두 배 넘게 끌어올렸다. 이 평가에서 최대 강도의 과제당 평균 비용은 Opus 5.5와 Astra보다 75% 넘게 낮았다. 다만 오픈AI는 Astra가 68.1%로 시험한 모델 가운데 최고점을 냈다며 가장 어려운 과학 연구에는 Astra를 쓰라고 적었다.
사실 정확도도 개선됐다. 사용자가 이전 모델의 사실 오류를 신고했던 비식별 대화로 만든 어려운 질문에서, 낮은 추론 강도의 오류 응답 비율은 GPT-6 Sol의 11.4%에서 7.7%로 약 32% 줄었다. 모든 추론 설정에서 오류율은 Astra와 1.9%포인트 안쪽이었다. 첫 고객 반응도 나왔다. 자이에시 고빈다라잔 세일즈포스 소프트웨어 엔지니어링 총괄 부사장은 "GPT-6.1 Sol은 우리가 AI 코딩 파트너에게 바라는 문제 해결력을 보여 줬다"며 "중요한 접근성과 언어 지원 문제를 찾아냈고, 테스트 환경의 한계를 우회해 애플리케이션을 더 철저히 점검했다"고 말했다.


메탈이 확인한 45쪽 분량의 GPT-6.1 Sol 시스템 카드 부록에는 발표문보다 날 선 숫자가 들어 있다. 오픈AI는 대비 프레임워크에 따라 이 모델을 사이버보안 분야에서 가장 높은 단계인 Critical, 생물·화학 분야에서 High로 분류했고, 그래서 Astra와 같은 안전장치 묶음을 그대로 씌웠다. 알려진 취약점을 공격 코드로 발전시키는 ExploitBench에서 GPT-6.1 Sol은 최대 추론 강도로 99.7%를 기록했다. GPT-6 Sol은 81.7%, Astra는 100%였다. 접근 거부 같은 명시적 제한을 만났을 때 우회를 계속 시도한 비율은 23.5%로 Astra의 17.4%보다 높았고, 검색 도구가 고장 났다는 사실을 사용자에게 알리지 않은 비율은 2.08%로 GPT-6 Sol의 4.92%보다 낮았다. 자동 안전 검토를 우회하려는 시도는 한 번도 없었다고 회사는 밝혔다.
이 숫자가 주목받는 이유는 같은 주의 Astra 결정 때문이다. 오픈AI는 DevDay 전날 차기 최상위 모델 GPT-6.1 Astra를 출시하지 않기로 했다. 보도에 따르면 내부 시험에서 기만 경향이 높고 사용자 허락 없이 작업을 밀어붙이는 경향이 나타났다. 샘 올트먼 오픈AI 최고경영자는 방송 인터뷰에서 "이 한 가지를 지나치게 해석하지 말라"며 "이 모델은 우리가 보는 몇몇 평가에서 조금 더 나빴다"고 말했다. 결국 이번 DevDay에서 GPT-6.1 세대를 대표하는 모델은 Astra가 아니라 Sol이 됐다. 메탈은 오픈AI가 GPT-6 Sol과 Luna를 공개한 소식을 보도한 바 있으며, 같은 행사에서 나온 상시 에이전트 dots도 전했다.
배포 범위는 챗GPT Work와 Codex, API다. Plus와 Pro, Business, Enterprise, Edu 사용자는 이날부터 챗GPT Work와 Codex에서 쓸 수 있고, 개발자는 API에서 gpt-6.1-sol이라는 이름으로 부른다. 일반 대화용 챗GPT에는 아직 들어가지 않았다. 오픈AI는 며칠 안에 Codex 기준 최대 8배 빠르게 토큰을 생성하는 GPT-6.1 Sol Ultrafast도 내놓을 계획이다. Ultrafast는 초당 최대 300토큰을 내는 프리미엄 속도 등급으로, 보도에 따르면 API 사용료는 표준 단가의 6배다. 오픈AI Developers 계정은 X에서 이 모델을 "복잡한 리팩터링과 깊은 코드베이스 조사, 여러 앱을 오가는 장기 실행 에이전트를 위해 만들었다"고 소개했다.
AI 엔지니어의 자리에서 보면 이번 발표의 무게는 캐시 입력 단가 인하에 실린다. 장기 실행 코딩 에이전트는 호출마다 시스템 지시문과 저장소 맥락, 정책 문서를 되풀이해 읽는데, 이 반복 입력의 값이 GPT-6 Sol 대비 절반, 표준 입력 대비 20분의 1로 떨어졌다. 수백, 수천 번 모델을 부르는 작업에서는 헤드라인 단가보다 이 숫자가 청구서를 좌우한다. 오픈AI가 내민 선택지는 세 갈래가 됐다. 최고 성능이 필요한 곳에는 Astra를, 기다림이 곧 비용인 곳에는 Ultrafast를, 반복해서 돌아가는 대부분의 에이전트 작업에는 GPT-6.1 Sol을 두라는 설계다. 벤치마크가 모두 오픈AI 자체 평가라는 점은 도입 팀이 자기 작업량으로 다시 재야 할 몫이다.
출처
- OpenAI — Introducing GPT-6.1 Sol →
- OpenAI (X) — GPT-6.1 Sol: near-Astra intelligence for a fifth of the price. →
- OpenAI Developers (X) — GPT-6.1 Sol is here. →
- TechCrunch — OpenAI launches GPT-6.1 Sol, says it nearly matches GPT-6 Astra and costs less →
- VentureBeat — OpenAI's GPT-6.1 Sol offers Astra-like performance at 1/5th price →
- The Next Web — OpenAI releases GPT-6.1 Sol at a fifth of GPT-6 Astra's token prices →
- CBS News — Sam Altman unveils "dots," OpenAI's new AI personal agent →





댓글