
이미지: @OpenAI (X) 영상 갈무리
요약
- 오픈AI가 9월 29일 데브데이 2026에서 프리미엄 속도 등급 Ultrafast를 출시했고, Codex에서 최대 8배, API에서 최대 6배 빠른 초당 최대 300토큰을 낸다.
- 첫 모델은 GPT-6 Astra이며 API 단가는 표준의 6배이고, 챗GPT Work와 Codex에서는 Plus의 25배 한도를 주는 새 요금제 Pro 500과 Enterprise에서 쓴다.
- 8월 프리뷰의 초당 750토큰보다 느리지만 최상위 모델에 속도를 붙였고, GPT-6.1 Sol용 Ultrafast는 곧 나온다.
- 발표
- 2026년 9월 29일 오픈AI 데브데이 2026(샌프란시스코) · 공식 X 게시물 17:57 UTC · 9월 30일 기준 조회 약 87만 8천 회
- 속도
- Codex 최대 8배 · API 최대 6배 · 초당 최대 300토큰 · Codex 기준 Astra 표준 대비 8배, Astra Fast 대비 4배
- 대상 모델
- GPT-6 Astra 즉시 · GPT-6.1 Sol 곧 · API 가이드상 GPT-5.6 Sol 프리뷰
- 제공처
- API · 챗GPT Work · Codex(Pro 500·Enterprise)
- 단가 배수
- API 표준 대비 6배 · Fast 모드(표준 2배) 대비 3배(보도)
- Pro 500
- 챗GPT Plus 대비 25배 사용 한도 · Ultrafast 포함
- 기존 Pro 변경(보도)
- 챗GPT Work·Codex 한도 Plus 20배→10배 · GPT-6 Pro 메시지 주 200→100 · 전환 기간·일회성 크레딧
- API 한도
- 사용 등급 1~3 분당 50만 토큰 · 4등급 100만 · 5등급 500만 · 웹소켓 권장 · 미국 데이터 상주·글로벌 처리만
- 8월 프리뷰
- 2026년 8월 13일 GPT-5.6 Sol 최대 14배 · 세레브라스 · 초당 최대 750토큰 · 제인 스트리트·포디움·베이시스·로고 제한 공개
- 비교(보도)
- 아티피셜 애널리시스 측정 Gemini 3.5 Flash 약 201 · Mercury 2 약 769 · Celeris-1 약 1,491 토큰/초
- 영상
- 45초 · Standard와 Ultrafast가 같은 로켓 3D 장면 제작 · Ultrafast 6.4초, Standard 30.3초
오픈AI가 9월 29일 샌프란시스코에서 연 데브데이 2026에서 프리미엄 속도 등급 Ultrafast를 출시했다. 오픈AI는 공식 X 계정에서 Ultrafast가 코딩 도구 Codex에서 토큰 생성 속도를 최대 8배, API에서 최대 6배 끌어올리고 초당 최대 300토큰을 낸다고 밝혔다. 첫 적용 모델은 최상위 모델 GPT-6 Astra이고, 이날부터 API와 챗GPT Work, Codex에서 쓸 수 있다. GPT-6.1 Sol용 Ultrafast는 곧 나온다.
속도는 공짜가 아니다. 보도에 따르면 API에서 Ultrafast를 쓰면 같은 모델 표준 단가의 6배를 낸다. 오픈AI가 이미 파는 Fast 모드는 표준의 2배 값이고, Astra 기준으로 약 2.5배 빠르다. Ultrafast는 그 Fast 모드보다 다시 3배 비싼 자리에 놓인다. 오픈AI Developers 계정은 Codex 기준으로 Ultrafast가 "Astra 표준보다 최대 8배, Astra Fast보다 4배 빠르다"며 "입력하는 속도만큼 빠르게 아이디어를 현실로 만들라"고 적었다.
챗GPT Work와 Codex에서 Ultrafast를 쓰려면 새 요금제가 필요하다. 오픈AI는 같은 날 Pro 500을 내놓으며 챗GPT Plus의 25배에 이르는 가장 큰 사용 한도와 Ultrafast 이용권을 묶었다. 기업 고객은 Enterprise 요금제로 쓴다. 보도에 따르면 기존 Pro 요금제의 챗GPT Work·Codex 한도는 Plus의 20배에서 10배로 줄고, 채팅의 GPT-6 Pro 메시지도 주 200개에서 100개로 절반이 된다. 기존 가입자는 전환 기간 동안 지금 한도를 유지하고 일회성 크레딧을 받는다.
메탈이 확인한 45초 발표 영상은 같은 3D 장면을 두 등급이 나란히 만드는 경주다. 왼쪽 Standard 화면과 오른쪽 Ultrafast 화면 모두 원형 작업대 위에서 로봇 팔 두 개가 로켓을 조립하기 시작한다. Ultrafast 쪽은 6.4초 만에 몸체와 날개를 붙이고 발사대 장면으로 넘어가 로켓을 하늘로 띄운다. Standard 쪽은 같은 시각 빈 작업대에 머물러 있다가 30.3초가 돼서야 조립을 마치고 발사대로 옮겨 간다. 영상이 붙은 첫 게시물은 9월 30일 기준 조회 87만 8천여 회를 기록했다.
개발자 쪽 조건은 오픈AI API 가이드에 적혀 있다. 요청에 service_tier를 ultrafast로 지정하면 되고, GPT-6 Astra는 모든 API 사용자에게 열렸지만 처음엔 낮은 한도로 시작한다. 기본 한도는 사용 등급 1~3에서 분당 50만 토큰, 4등급 100만 토큰, 5등급 500만 토큰이다. 오픈AI는 도구 호출이 잦은 에이전트라면 연결을 계속 열어 두는 웹소켓을 쓰라고 강하게 권했다. 요청마다 새로 연결하면 네트워크 지연이 속도 이득을 깎아 먹기 때문이다. Ultrafast는 미국 데이터 상주와 글로벌 처리만 지원하고 EU 등 다른 지역 처리 엔드포인트는 지원하지 않는다.

이 등급은 한 달 반 전 예고편이 있었다. 메탈은 오픈AI가 8월 13일 GPT-5.6 Sol을 최대 14배 빠르게 돌리는 초고속 모드를 예고한 소식을 보도한 바 있다. 당시 오픈AI는 세레브라스 하드웨어로 초당 최대 750토큰을 냈고, 제인 스트리트와 포디움, 베이시스, 로고 등 일부 고객에게만 제한 공개했다. 제인 스트리트의 AI 어시스턴트 담당 존 크레페치는 당시 "세레브라스가 가져온 속도 향상은 인상적"이라며 "모델을 쓰는 다른 방식을 가능하게 하고, 개발자가 모델과 나란히 더 집중해서 생산적으로 일하게 해 준다"고 말했다. API 가이드에는 지금도 GPT-5.6 Sol이 프리뷰 대상으로 올라 있다.
이번 출시는 절대 속도에서 한발 물러선 대신 모델을 올렸다. 8월 프리뷰의 초당 750토큰보다 느린 300토큰이지만, 그 속도를 오픈AI 최상위 모델에 붙였다. 보도에 따르면 벤치마크 업체 아티피셜 애널리시스가 잰 출력 속도는 구글 Gemini 3.5 Flash가 초당 약 201토큰, 속도 특화 모델 Mercury 2가 약 769토큰, Celeris-1이 약 1,491토큰이다. 오픈AI가 앞서 세레브라스에서 초당 1,000토큰 넘게 낸 GPT-5.3-Codex-Spark도 벤치마크 점수가 낮은 작은 모델이었다. 보도에 따르면 Ultrafast의 차이는 절대 속도가 아니라 그 속도를 GPT-6급 최상위 모델에서 낸다는 점에 있다.
데브데이에서 Ultrafast는 20개가 넘는 발표 가운데 하나였다. 메탈은 같은 행사에서 나온 GPT-6.1 Sol과 상시 에이전트 dots도 전했다. 두 발표와 나란히 놓으면 오픈AI가 짠 판이 드러난다. GPT-6.1 Sol은 Astra에 가까운 성능을 Astra 표준 단가의 5분의 1로 내려 반복 작업을 싸게 만들고, Ultrafast는 거꾸로 사람이 화면 앞에서 기다리는 순간에 값을 6배로 매긴다. 오픈AI는 8월 발표문에서 장애 대응과 금융 리서치, 고객 상담, 커머스를 쓰임새로 꼽으며 "지능을 포기하지 않아도 속도를 얻을 수 있다면 AI는 사업에서 가장 시간에 민감한 영역으로 들어갈 수 있다"고 썼다.
기자의 눈으로 보면 이번 발표에서 새로 값이 붙은 것은 모델이 아니라 기다림이다. 같은 GPT-6 Astra가 같은 답을 내도 30초 걸리는 답과 6초 걸리는 답의 값이 달라졌다. 개인 개발자가 그 차이를 사려면 Pro 500으로 올라가야 하고, 기존 Pro 가입자의 한도는 절반으로 준다. 속도가 제품이 되면서 오픈AI 가격표에는 지능과 비용에 더해 시간이라는 세 번째 축이 생겼다.
출처
- OpenAI (X) — This is Ultrafast. Our premium speed tier, Ultrafast offers up to 8x faster token generation (300 tokens per second) in Codex and up to 6x in the API. →
- OpenAI (X) — Ultrafast is available today for GPT-6 Astra in Codex, ChatGPT Work, and the API, with GPT-6.1 Sol coming soon. →
- OpenAI Developers (X) — Ultrafast is our fastest way to build with Astra yet →
- OpenAI — DevDay 2026 Recap →
- OpenAI Developers — Ultrafast mode | OpenAI API →
- OpenAI — Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed →
- VentureBeat — OpenAI's GPT-6.1 Sol offers Astra-like performance at 1/5th price. A new Ultrafast tier clocks at 300 tokens per second. →
- The Decoder — OpenAI expands Codex and its API at DevDay with security scans, a Decisions API, and Ultrafast →





댓글