METAL for iPhone

AI 뉴스, 이제 앱에서 읽으세요.

METAL 앱을 다운로드하고 매일 새로운 AI 기사를 만나보세요.

App Store에서 다운로드

iPhone용 앱 · 무료 다운로드

iPhone의 App Store에서도 ‘메탈 AI 매거진’을 검색할 수 있습니다.

METAL

오픈AI, Decisions API 베타 공개

오픈AI가 GPT-6 Luna로 확률·선택·점수만 돌려주는 Decisions API를 모든 개발자에게 퍼블릭 베타로 열었다. 입력 토큰 100만 개당 0.10달러에 출력 토큰은 과금하지 않으며, 회사는 몇 주 안에 정식 출시를 예상한다고 밝혔다.

오픈AI, Decisions API 베타 공개 · Image: METAL LAB

이미지: @OpenAIDevs (X) 영상 갈무리

요약

  • 오픈AI가 10월 6일(미국 시간) Decisions API를 모든 개발자에게 퍼블릭 베타로 공개하고, Responses API로 GPT-6 Luna를 부를 때보다 최대 10배 빠르다고 밝혔다.
  • 질문 유형은 조건의 참 확률을 내는 프레디킷, 선택지 하나를 고르는 초이스, 기준표 점수를 내는 스코어 세 가지이고 텍스트와 이미지를 받는다.
  • 요금은 입력 토큰 100만 개당 0.10달러로 출력·캐시 토큰은 과금하지 않으며, 자격 고객에게 ZDR과 HIPAA 용도를 지원한다.
Let your app choose the right model, tool, or action in near real-time with Decisions API
공개
2026년 10월 6일(미국 시간) · 모든 개발자 대상 퍼블릭 베타
이전 단계
9월 29일 데브데이 2026에서 제한 프리뷰
모델
GPT-6 Luna 단독 지원(9월 22일 GPT-6 Sol과 함께 공개)
엔드포인트
POST /v1/decisions
속도
Responses API로 GPT-6 Luna 호출 대비 최대 10배 빠름(오픈AI 발표)
시연
서버 응답 100밀리초 미만 · 71초 공식 영상
질문 유형
프레디킷(참 확률 0~1) · 초이스(선택지+확률+신뢰도) · 스코어(단계 확률 가중 평균)
요청 구조
model · input · questions → answers 배열
가이드 예시
손상 확률 0.92 · 결제 부서 0.95(신뢰도 0.93) · 심각도 점수 1.1(신뢰도 0.55)
이미지 입력
base64 인라인 데이터 URL만 · 외부 URL·file_id 불가
요금
입력 토큰 100만 개당 0.10달러 · 캐시 읽기·쓰기·출력 토큰 무과금 · 지역 처리 할증·긴 문맥 배수 적용
데이터
자격 고객 ZDR·HIPAA 지원 · 데이터 상주·지역 처리 미국·유럽(EEA·스위스)
SDK
파이썬 3.26.0 · 자바스크립트 7.30.0 · Go 3.73.0 · 루비 0.101.0 · 자바 4.78.0 이상
정식 출시
오픈AI, 몇 주 안 GA 예상
게시물 반응
조회 57만7000회 · 좋아요 2538 · 북마크 1322(작성 시점)

오픈AI가 질문 하나에 정해진 형식의 답만 돌려주는 Decisions API를 10월 6일(미국 시간) 모든 개발자에게 퍼블릭 베타로 공개했다. 회사는 공식 개발자 계정에서 이 API가 "앱이 적절한 모델이나 도구, 행동을 거의 실시간으로 고르게 해 준다"고 밝혔고, Responses API로 GPT-6 Luna를 부를 때보다 최대 10배 빠르게 결정을 내린다고 설명했다. 지원 모델은 GPT-6 Luna 하나이고, 호출 주소는 전용 엔드포인트인 POST /v1/decisions다. 오픈AI는 개발자 문서에서 몇 주 안에 정식 출시(GA)할 것으로 예상한다고 적었다.

이번 공개는 9월 29일 데브데이 2026에서 제한 프리뷰로 나온 뒤 일주일 만이다. 메탈은 오픈AI가 결정 전용 Decisions API를 제한 프리뷰로 공개했다고 보도한 바 있으며, 당시 호출당 요금과 데이터 정책은 공개되지 않았다. 이번 퍼블릭 베타에서 그 빈칸이 채워졌다. 기반 모델 GPT-6 Luna는 오픈AI가 9월 22일 GPT-6 Sol과 함께 내놓은 추론 모델이다.

요청은 세 칸으로 이뤄진다. model 칸에는 평가할 모델을, input 칸에는 질문들이 함께 참고할 증거를 텍스트 문자열이나 텍스트·이미지가 섞인 사용자 메시지로 넣는다. questions 칸에는 질문마다 유형과 지시문, 허용할 선택지나 점수 단계를 적는다. 응답은 answers 배열로 돌아오고, 질문마다 붙인 고유 이름이 답에 그대로 되돌아와 어느 질문의 답인지 가린다.

Decisions API 요청의 세 칸(model, input, questions)과 각 칸의 역할을 정리한 오픈AI 개발자 문서 표

질문 유형은 세 가지다. 프레디킷(predicate)은 어떤 조건이 참일 확률을 0에서 1 사이로 추정한다. 초이스(choice)는 개발자가 준 선택지 중 하나를 고르고 선택지마다의 확률과 별도의 신뢰도 값을 함께 낸다. 스코어(score)는 낮은 단계부터 높은 단계까지 정한 기준표에 입력을 대 보고, 단계 번호의 확률 가중 평균을 점수로 돌려준다. 그래서 점수는 단계와 단계 사이에 떨어질 수 있다.

메탈이 확인한 개발자 가이드의 예시는 이 구조를 숫자로 보여 준다. 제품 사진에서 금이나 찢김, 찌그러짐을 찾는 프레디킷 질문에는 확률 0.92가 돌아왔다. 「주문 금액이 두 번 청구됐다」는 고객 불만을 부서로 나누는 초이스 질문은 결제 부서를 0.95 확률로 골랐고 신뢰도는 0.93이었다. 사파리에서만 내보내기가 실패하는 문제를 세 단계 심각도에 대 본 스코어 질문은 0.1, 0.7, 0.2의 확률 분포에서 점수 1.1, 신뢰도 0.55를 냈다. 오픈AI는 이 값들이 설명용 응답 예시라고 밝혔다.

입력에는 조건이 붙는다. 이미지는 base64로 인코딩한 인라인 데이터 URL로만 보낼 수 있고, 외부에 올린 HTTP·HTTPS 이미지 주소나 file_id 입력은 받지 않는다. 서로 독립적인 질문은 한 요청의 questions 배열에 함께 넣어 같은 입력을 한 번에 평가할 수 있다. 앞선 답에 따라 갈리는 질문은 요청을 나눠 보내야 한다. 가이드는 손상 여부를 먼저 확인한 뒤 그 결과로 수리 범주를 물을지 정하는 식을 예로 들었다.

요금 구조도 처음 나왔다. GPT-6 Luna로 Decisions API를 쓰면 입력 토큰 100만 개당 0.10달러이고, 입력 토큰만 과금한다. 캐시 읽기와 캐시 쓰기, 출력 토큰에는 요금이 붙지 않는다. 지역 처리 할증과 긴 문맥 입력 배수는 그대로 적용되고, 이 요율은 /v1/decisions 호출에만 해당한다. 데이터 통제 쪽에서는 자격을 갖춘 고객에게 데이터 무보존(ZDR)과 HIPAA 용도를 지원하고, 데이터 상주와 지역 처리는 미국과 유럽(EEA·스위스)에서 된다.

개발 환경도 맞춰 놓았다. 가이드 예제를 돌리려면 파이썬 SDK 3.26.0, 자바스크립트 7.30.0, Go 3.73.0, 루비 0.101.0, 자바 4.78.0 이상이 필요하다. 코드를 쓰기 전에 플레이그라운드에서 질문과 입력을 시험해 볼 수 있다. 음성 앱에서는 Live API의 클라이언트 위임 기능과 묶어 음성 요청에서 행동을 고르고 결과를 사용자에게 알려 주게 할 수 있다.

71초짜리 공식 시연 영상은 속도를 앞에 세웠다. 영상 속 오픈AI 관계자는 느슨하게 적힌 사용자 입력이 영업 리드로 분류되는 장면을 보이며 "이건 배속 영상이 아니다"라고 말했고, 서버에서 Decisions API가 100밀리초 안에 응답했다고 설명했다. 도로와 장애물 화면을 받아 차를 올바른 차선으로 모는 게임 시연, 음성은 GPT Live 1이 맡고 캐릭터 표정은 Decisions API가 고르는 시연도 이어졌다. 게시물은 이 글을 쓰는 시점에 조회 57만7000회, 좋아요 2538개, 북마크 1322개를 기록했다.

AI 엔지니어의 눈으로 보면 이 API가 겨냥하는 자리는 생성이 아니라 분기다. 가이드는 직접 정한 JSON 스키마에 맞는 객체나 설명문이 필요하면 Responses API의 구조화 출력을, 모델이 인자와 함께 도구 호출을 요청해야 하면 함수 호출을 쓰라고 선을 긋는다. 남는 일은 분류와 라우팅, 우선순위 매기기처럼 에이전트가 다음 행동을 고르는 짧은 판단들이다. 출력 토큰에 요금을 매기지 않는 설계는 답이 확률 몇 개로 끝나는 이 쓰임새와 맞물린다.

운영에서 갈리는 곳은 임계값이다. 오픈AI는 가이드에서 "애플리케이션의 레이블된 예시를 써서 라우팅과 필터링, 검토의 임계값을 정하라"고 권하고, 오탐과 미탐의 비용을 따져 기준을 고르라고 적었다. 분류하지 못한 입력을 받을 "기타" 같은 대체 선택지를 두라는 주문도 붙였다. 확률을 돌려주는 API는 판단을 대신 내려 주지 않고, 그 확률을 어디서 끊을지는 여전히 개발자의 몫이다. 퍼블릭 베타는 그 기준선을 실제 트래픽으로 맞춰 볼 첫 기회다.

김현국

METAL 발행인 · 아카이브저널 발행인 · 이라선 운영

매거진·서점·교육을 오래 해 온 편집자예요. 라이프스타일 매거진 <아카이브저널>을 발행하고, 아트 서점 <이라선>을 운영했으며, 라이카 아카데미에서 디렉터로 사진 교육 프로그램을 만들고 이끌었어요. 그 시선으로 전 세계 AI 소식을 독자에게 전하는 메탈(METAL) 매거진 편집장입니다.

이 에디터의 기사 더 보기 →

공유

댓글