
이미지: 영상 갈무리
요약
- 앤스로픽이 10월 7일 Claude Haiku 5.5를 공개했다. 10만 토큰 이하 요청 단가는 Haiku 4.5보다 90% 낮고, 회사가 계산한 평균 실행 비용은 약 75% 줄었다.
- 발표문 성능표에서 OSWorld 2.1 72.4%, Terminal-Bench 4.0 39.2%, GDPval-AA v2.1 1620으로 GPT-6 Luna(48.9%, 16.4%, 1437)를 앞섰다.
- 같은 날 Sonnet 5.5 캐시 읽기 가격을 절반으로 내렸고 Max·Team 구독자에게 월 API 크레딧을 주기 시작했다.
- 발표
- 2026년 10월 7일 · 앤스로픽 · Claude Haiku 5.5
- 세대
- 5.5 세대 세 번째 · Opus 5.5(9월 22일) · Sonnet 5.5(9월 28일)
- 용도
- 요약·컴팩션·데이터베이스 질의·분류 · 코딩 하위 에이전트 · 실시간 고객 상담·브라우저 조작
- 속도
- 표준 속도 기준 앤스로픽 최고속 · Fast Mode Opus보다는 느림
- 가격(10만 토큰 이하)
- 입력 0.10달러 · 출력 0.50달러(100만 토큰당) · Haiku 4.5 대비 90% 인하
- 가격(10만 토큰 초과)
- 입력 0.50달러 · 출력 2.50달러 · 50% 인하
- 평균 절감
- 약 75% · Haiku 4.5 요청의 약 90%가 10만 토큰 이하 · 새 토크나이저 토큰 증가분 반영
- OSWorld 2.1(오프라인)
- Haiku 5.5 72.4% · Haiku 4.5 15.7% · GPT-6 Luna 48.9% · Sonnet 5.5 83.9%
- Terminal-Bench 4.0
- 39.2% · 0.0% · 16.4% · 70.6%
- GDPval-AA v2.1
- 1620 · 735 · 1437 · 1840
- AA-Briefcase v1.1
- 1578 · 614 · 1336 · 1824
- Humanity's Last Exam
- 도구 없이 45.9% · 도구 사용 57.4%
- FrontierCode 1.1
- Haiku 5.5 46.4% · GPT-6 Luna 42.4% · Sonnet 5.5 52.1%
- 노력 설정
- Haiku 계열 최초 · 기본값 중간 · 보도: Terminal-Bench 최대 노력 약 39%, 중간 약 20%
- 고객 평가
- 아사나 지연 30%↓·턴당 추론 최대 2.5배 · 허브스팟 92.8% · 알파센스 0.84 vs 0.76(400개 질의) · 박스 11점↑·지연 절반
- Sonnet 5.5
- 캐시 읽기 0.20달러→0.10달러 · 에이전트 작업 비용 약 20%↓
- API 크레딧
- Max 5x 월 100달러 · Max 20x 200달러 · Team 최대 500달러(합산)
- 안전
- 정렬 평가 대부분 개선 · 사이버 안전장치 Haiku 4.5보다 엄격 · 침투 테스트 차단
- 제공
- 클로드 플랫폼 claude-haiku-5-5 · AWS · 구글 클라우드 · 마이크로소프트 애저
앤스로픽이 소형 모델 Claude Haiku 5.5를 10월 7일 공개했다. 회사는 이 모델을 "지금까지 내놓은 가장 싸고, 가장 빠르고, 가장 유능한 소형 모델"이라고 소개했다. 10만 토큰 이하 요청의 토큰 단가는 전작 Haiku 4.5보다 90% 낮췄고, 앤스로픽이 계산한 평균 실행 비용은 약 75% 줄었다. 같은 날 Sonnet 5.5의 캐시 읽기 가격을 절반으로 내렸고, Max·Team 구독자에게 매달 API 크레딧을 주기 시작했다.
Haiku 5.5는 9월 22일 Opus 5.5, 9월 28일 Sonnet 5.5에 이은 5.5 세대의 세 번째 모델이다. 앤스로픽은 요약과 압축(컴팩션), 데이터베이스 질의, 분류처럼 양이 많고 반복되는 일을 겨냥했다고 밝혔다. 코딩 작업에서는 Opus 5.5나 Sonnet 5.5가 잘게 쪼갠 일을 넘겨받는 하위 에이전트로 쓰라고 권했다. 표준 속도 기준으로 회사에서 가장 빠른 모델이라 실시간 고객 상담과 브라우저 조작에도 맞는다는 설명이다. 다만 Fast Mode로 돌리는 Opus보다는 느리다고 회사는 각주에 적었다.
가격 구조는 요청 길이로 갈린다. 10만 토큰 이하 요청은 입력 100만 토큰당 0.10달러, 출력 0.50달러로 Haiku 4.5의 1달러·5달러에서 90% 내려갔다. 10만 토큰을 넘는 요청은 0.50달러·2.50달러로 50% 인하에 그친다. 앤스로픽에 따르면 Haiku 4.5로 들어온 요청의 약 90%가 10만 토큰 이하였다. 평균 75%라는 수치에는 새 토크나이저가 같은 일에 토큰을 조금 더 쓰는 몫까지 반영했다고 회사는 설명했다. 보도에 따르면 낮은 구간의 입력·출력·캐시 단가는 오픈AI가 지난달 내놓은 저가 모델 GPT-6 Luna와 똑같다.
성능표는 같은 가격대의 경쟁 모델을 정면으로 겨눴다. 메탈이 확인한 발표문 표에서 Haiku 5.5는 실제 컴퓨터를 조작하는 OSWorld 2.1 오프라인 부분집합에서 72.4%를 기록했다. Haiku 4.5는 15.7%, GPT-6 Luna는 48.9%였다. 명령줄 에이전트 코딩을 재는 Terminal-Bench 4.0에서는 39.2%로 Haiku 4.5의 0.0%, GPT-6 Luna의 16.4%를 앞섰다. 지식 노동 평가 GDPval-AA v2.1 점수는 1620으로 Haiku 4.5의 735, GPT-6 Luna의 1437보다 높았다. 휴머니티스 라스트 이그잼은 도구 없이 45.9%, 도구를 쓰면 57.4%였다.
상위 모델과의 거리는 남아 있다. 참고용으로 함께 실린 Sonnet 5.5는 OSWorld 2.1 83.9%, Terminal-Bench 4.0 70.6%를 기록했다. 앤스로픽은 복잡한 에이전트 코딩에는 여전히 Sonnet 5.5와 Opus 5.5가 낫고, Haiku 5.5는 범위가 좁은 일에 맞는다고 선을 그었다. 이 수치는 모두 회사가 직접 잰 값이다. 보도에 따르면 Terminal-Bench의 39%대 점수는 최대 노력 설정에서 나온 값이고, 기본값인 중간 설정에서는 약 20%다.

그 노력 설정이 이번 모델의 새 손잡이다. Haiku 5.5는 Haiku 계열 가운데 처음으로 노력(effort) 단계를 조절할 수 있다. 사용자는 같은 모델에서 비용을 아낄지, 지능을 끌어올릴지 고른다. 발표문의 OSWorld 2.1 도표를 보면 Low부터 Max까지 다섯 단계에서 점수와 시도당 비용이 함께 오르고, 모든 단계가 같은 비용대의 GPT-6 Luna 곡선보다 위에 있다.
출시 전 시험한 기업들은 속도를 먼저 꼽았다. 아사나의 에런 빈 스태프 소프트웨어 엔지니어는 AI 팀메이트 평가에서 지금 쓰는 모델보다 작업 완료 지연이 30% 넘게 줄고 에이전트 턴당 추론이 최대 2.5배 빨라졌다며 "눈에 띄게 더 경쾌한 경험"이라고 말했다. 허브스팟은 CRM 평가에서 세 번 평균 92.8%로 지금까지 본 최고점이 나왔다고 밝혔다. 문서 질의 기능을 주당 약 800만 번 호출하는 알파센스는 400개 질의에서 0.84점을 얻어 Haiku 4.5의 0.76점보다 통계적으로 유의하게 높았다고 전했다. 박스는 Haiku 4.5보다 11점 높은 점수를 지연 시간 절반으로 얻었다고 했다.

하위 에이전트 쓰임새는 금융 AI 기업 로고의 사례가 보여 준다. 큰 모델이 발표 자료를 만드는 동안 Haiku 5.5 하위 에이전트가 10-K 보고서에서 필요한 사업부 매출 한 줄을 찾아온다. 로고의 알렉스 왕은 "그 자리를 믿고 맡길 만큼 정확하고, 많이 돌릴 수 있을 만큼 빠르고 싸다"고 말했다. 코그니션은 Devin Fusion에서 Opus 5.5를 주 모델로, Haiku 5.5를 보조로 붙여 FrontierCode 66.2점을 유지하면서 비용과 지연을 줄였다고 밝혔다.
안전 장치도 다시 짰다. 앤스로픽은 정렬 평가 대부분에서 Haiku 4.5보다 크게 나아졌고 오용에 협조하려는 경향이 낮아졌다고 밝혔다. 사이버보안 안전장치는 Haiku 4.5보다 엄격하지만 Sonnet 5.5보다는 방어 작업을 더 넓게 허용한다. 침투 테스트처럼 공격자가 쓸 법한 기법은 막는다. 더 넓은 접근이 필요한 조직은 생명과학 검증 프로그램과 사이버 검증 프로그램에 신청할 수 있다.
나머지 라인업 가격도 함께 움직였다. Sonnet 5.5의 캐시 읽기 가격은 100만 토큰당 0.20달러에서 0.10달러로 내려갔다. 캐시 읽기가 토큰 소비의 큰 몫을 차지해 대부분의 에이전트 작업 비용이 약 20% 줄어든다고 회사는 추산했다. 이번 주부터 Max 5x 구독자는 매달 100달러, Max 20x는 200달러, Team은 사용자 합산 최대 500달러의 API 크레딧을 받는다. 파이썬·타입스크립트 SDK에는 컴퓨터 조작과 브라우저 조작 지원이 베타로 들어갔다. 메탈은 앤스로픽의 Sonnet 5.5 공개와 오픈AI의 GPT-6 Sol과 Luna 공개를 보도한 바 있다.
Haiku 5.5는 클로드 플랫폼에서 claude-haiku-5-5라는 이름으로 바로 쓸 수 있고 AWS, 구글 클라우드, 마이크로소프트 애저에도 올라갔다. 이번 발표의 무게는 성능표 한 장보다 가격과 역할 분담에 있다. 큰 모델이 판단하고 작은 모델이 반복 작업을 수없이 돌리는 구조에서, 가장 많이 호출되는 자리의 단가를 경쟁사 저가 모델과 같은 선까지 끌어내렸다. 남는 질문은 개발자가 노력 설정과 요청 길이까지 따져 작업을 나눌 때 실제 청구서가 회사가 말한 75%에 얼마나 가까워지느냐다.
출처
- Anthropic — Introducing Claude Haiku 5.5 →
- SiliconANGLE — Anthropic releases Claude Haiku 5.5 small model and halves Sonnet 5.5 cache read prices →
- The New Stack — Anthropic launches Haiku 5.5 at a much lower price →
- VentureBeat — Anthropic launches Claude Haiku 5.5 with 90% API price reduction, matching GPT-6 Luna →





댓글