METAL for iPhone

AI 뉴스, 이제 앱에서 읽으세요.

METAL 앱을 다운로드하고 매일 새로운 AI 기사를 만나보세요.

App Store에서 다운로드

iPhone용 앱 · 무료 다운로드

iPhone의 App Store에서도 ‘메탈 AI 매거진’을 검색할 수 있습니다.

METAL

오픈AI, 속도 등급 Ultrafast 출시

오픈AI가 데브데이 2026에서 GPT-6 Astra를 초당 최대 300토큰으로 돌리는 Ultrafast를 출시했다. API 단가는 표준의 6배이고, 챗GPT Work와 Codex에서는 새 요금제 Pro 500과 Enterprise에서만 쓴다.

오픈AI, 속도 등급 Ultrafast 출시 · Image: METAL LAB

이미지: @OpenAI (X) 영상 갈무리

요약

  • 오픈AI가 9월 29일 데브데이 2026에서 프리미엄 속도 등급 Ultrafast를 출시했고, Codex에서 최대 8배, API에서 최대 6배 빠른 초당 최대 300토큰을 낸다.
  • 첫 모델은 GPT-6 Astra이며 API 단가는 표준의 6배이고, 챗GPT Work와 Codex에서는 Plus의 25배 한도를 주는 새 요금제 Pro 500과 Enterprise에서 쓴다.
  • 8월 프리뷰의 초당 750토큰보다 느리지만 최상위 모델에 속도를 붙였고, GPT-6.1 Sol용 Ultrafast는 곧 나온다.
This is Ultrafast. Our premium speed tier, Ultrafast offers up to 8x faster token generation (300 tokens per second) in Codex and up to 6x in the API.
발표
2026년 9월 29일 오픈AI 데브데이 2026(샌프란시스코) · 공식 X 게시물 17:57 UTC · 9월 30일 기준 조회 약 87만 8천 회
속도
Codex 최대 8배 · API 최대 6배 · 초당 최대 300토큰 · Codex 기준 Astra 표준 대비 8배, Astra Fast 대비 4배
대상 모델
GPT-6 Astra 즉시 · GPT-6.1 Sol 곧 · API 가이드상 GPT-5.6 Sol 프리뷰
제공처
API · 챗GPT Work · Codex(Pro 500·Enterprise)
단가 배수
API 표준 대비 6배 · Fast 모드(표준 2배) 대비 3배(보도)
Pro 500
챗GPT Plus 대비 25배 사용 한도 · Ultrafast 포함
기존 Pro 변경(보도)
챗GPT Work·Codex 한도 Plus 20배→10배 · GPT-6 Pro 메시지 주 200→100 · 전환 기간·일회성 크레딧
API 한도
사용 등급 1~3 분당 50만 토큰 · 4등급 100만 · 5등급 500만 · 웹소켓 권장 · 미국 데이터 상주·글로벌 처리만
8월 프리뷰
2026년 8월 13일 GPT-5.6 Sol 최대 14배 · 세레브라스 · 초당 최대 750토큰 · 제인 스트리트·포디움·베이시스·로고 제한 공개
비교(보도)
아티피셜 애널리시스 측정 Gemini 3.5 Flash 약 201 · Mercury 2 약 769 · Celeris-1 약 1,491 토큰/초
영상
45초 · Standard와 Ultrafast가 같은 로켓 3D 장면 제작 · Ultrafast 6.4초, Standard 30.3초

오픈AI가 9월 29일 샌프란시스코에서 연 데브데이 2026에서 프리미엄 속도 등급 Ultrafast를 출시했다. 오픈AI는 공식 X 계정에서 Ultrafast가 코딩 도구 Codex에서 토큰 생성 속도를 최대 8배, API에서 최대 6배 끌어올리고 초당 최대 300토큰을 낸다고 밝혔다. 첫 적용 모델은 최상위 모델 GPT-6 Astra이고, 이날부터 API와 챗GPT Work, Codex에서 쓸 수 있다. GPT-6.1 Sol용 Ultrafast는 곧 나온다.

속도는 공짜가 아니다. 보도에 따르면 API에서 Ultrafast를 쓰면 같은 모델 표준 단가의 6배를 낸다. 오픈AI가 이미 파는 Fast 모드는 표준의 2배 값이고, Astra 기준으로 약 2.5배 빠르다. Ultrafast는 그 Fast 모드보다 다시 3배 비싼 자리에 놓인다. 오픈AI Developers 계정은 Codex 기준으로 Ultrafast가 "Astra 표준보다 최대 8배, Astra Fast보다 4배 빠르다"며 "입력하는 속도만큼 빠르게 아이디어를 현실로 만들라"고 적었다.

챗GPT Work와 Codex에서 Ultrafast를 쓰려면 새 요금제가 필요하다. 오픈AI는 같은 날 Pro 500을 내놓으며 챗GPT Plus의 25배에 이르는 가장 큰 사용 한도와 Ultrafast 이용권을 묶었다. 기업 고객은 Enterprise 요금제로 쓴다. 보도에 따르면 기존 Pro 요금제의 챗GPT Work·Codex 한도는 Plus의 20배에서 10배로 줄고, 채팅의 GPT-6 Pro 메시지도 주 200개에서 100개로 절반이 된다. 기존 가입자는 전환 기간 동안 지금 한도를 유지하고 일회성 크레딧을 받는다.

메탈이 확인한 45초 발표 영상은 같은 3D 장면을 두 등급이 나란히 만드는 경주다. 왼쪽 Standard 화면과 오른쪽 Ultrafast 화면 모두 원형 작업대 위에서 로봇 팔 두 개가 로켓을 조립하기 시작한다. Ultrafast 쪽은 6.4초 만에 몸체와 날개를 붙이고 발사대 장면으로 넘어가 로켓을 하늘로 띄운다. Standard 쪽은 같은 시각 빈 작업대에 머물러 있다가 30.3초가 돼서야 조립을 마치고 발사대로 옮겨 간다. 영상이 붙은 첫 게시물은 9월 30일 기준 조회 87만 8천여 회를 기록했다.

개발자 쪽 조건은 오픈AI API 가이드에 적혀 있다. 요청에 service_tier를 ultrafast로 지정하면 되고, GPT-6 Astra는 모든 API 사용자에게 열렸지만 처음엔 낮은 한도로 시작한다. 기본 한도는 사용 등급 1~3에서 분당 50만 토큰, 4등급 100만 토큰, 5등급 500만 토큰이다. 오픈AI는 도구 호출이 잦은 에이전트라면 연결을 계속 열어 두는 웹소켓을 쓰라고 강하게 권했다. 요청마다 새로 연결하면 네트워크 지연이 속도 이득을 깎아 먹기 때문이다. Ultrafast는 미국 데이터 상주와 글로벌 처리만 지원하고 EU 등 다른 지역 처리 엔드포인트는 지원하지 않는다.

오픈AI Ultrafast 발표 영상 장면. 같은 로켓 3D 장면을 만드는 경주에서 오른쪽 Ultrafast는 6.4초에 조립을 끝내고 로켓을 띄웠고, 왼쪽 Standard는 29.5초에도 로봇 팔이 조립 중이다

이 등급은 한 달 반 전 예고편이 있었다. 메탈은 오픈AI가 8월 13일 GPT-5.6 Sol을 최대 14배 빠르게 돌리는 초고속 모드를 예고한 소식을 보도한 바 있다. 당시 오픈AI는 세레브라스 하드웨어로 초당 최대 750토큰을 냈고, 제인 스트리트와 포디움, 베이시스, 로고 등 일부 고객에게만 제한 공개했다. 제인 스트리트의 AI 어시스턴트 담당 존 크레페치는 당시 "세레브라스가 가져온 속도 향상은 인상적"이라며 "모델을 쓰는 다른 방식을 가능하게 하고, 개발자가 모델과 나란히 더 집중해서 생산적으로 일하게 해 준다"고 말했다. API 가이드에는 지금도 GPT-5.6 Sol이 프리뷰 대상으로 올라 있다.

이번 출시는 절대 속도에서 한발 물러선 대신 모델을 올렸다. 8월 프리뷰의 초당 750토큰보다 느린 300토큰이지만, 그 속도를 오픈AI 최상위 모델에 붙였다. 보도에 따르면 벤치마크 업체 아티피셜 애널리시스가 잰 출력 속도는 구글 Gemini 3.5 Flash가 초당 약 201토큰, 속도 특화 모델 Mercury 2가 약 769토큰, Celeris-1이 약 1,491토큰이다. 오픈AI가 앞서 세레브라스에서 초당 1,000토큰 넘게 낸 GPT-5.3-Codex-Spark도 벤치마크 점수가 낮은 작은 모델이었다. 보도에 따르면 Ultrafast의 차이는 절대 속도가 아니라 그 속도를 GPT-6급 최상위 모델에서 낸다는 점에 있다.

데브데이에서 Ultrafast는 20개가 넘는 발표 가운데 하나였다. 메탈은 같은 행사에서 나온 GPT-6.1 Sol과 상시 에이전트 dots도 전했다. 두 발표와 나란히 놓으면 오픈AI가 짠 판이 드러난다. GPT-6.1 Sol은 Astra에 가까운 성능을 Astra 표준 단가의 5분의 1로 내려 반복 작업을 싸게 만들고, Ultrafast는 거꾸로 사람이 화면 앞에서 기다리는 순간에 값을 6배로 매긴다. 오픈AI는 8월 발표문에서 장애 대응과 금융 리서치, 고객 상담, 커머스를 쓰임새로 꼽으며 "지능을 포기하지 않아도 속도를 얻을 수 있다면 AI는 사업에서 가장 시간에 민감한 영역으로 들어갈 수 있다"고 썼다.

기자의 눈으로 보면 이번 발표에서 새로 값이 붙은 것은 모델이 아니라 기다림이다. 같은 GPT-6 Astra가 같은 답을 내도 30초 걸리는 답과 6초 걸리는 답의 값이 달라졌다. 개인 개발자가 그 차이를 사려면 Pro 500으로 올라가야 하고, 기존 Pro 가입자의 한도는 절반으로 준다. 속도가 제품이 되면서 오픈AI 가격표에는 지능과 비용에 더해 시간이라는 세 번째 축이 생겼다.

김현국

METAL 발행인 · 아카이브저널 발행인 · 이라선 운영

매거진·서점·교육을 오래 해 온 편집자예요. 라이프스타일 매거진 <아카이브저널>을 발행하고, 아트 서점 <이라선>을 운영했으며, 라이카 아카데미에서 디렉터로 사진 교육 프로그램을 만들고 이끌었어요. 그 시선으로 전 세계 AI 소식을 독자에게 전하는 메탈(METAL) 매거진 편집장입니다.

이 에디터의 기사 더 보기 →

공유

댓글