METAL for iPhone

AI 뉴스, 이제 앱에서 읽으세요.

METAL 앱을 다운로드하고 매일 새로운 AI 기사를 만나보세요.

App Store에서 다운로드

iPhone용 앱 · 무료 다운로드

iPhone의 App Store에서도 ‘메탈 AI 매거진’을 검색할 수 있습니다.

METAL

앤스로픽, Sonnet 5.5 개발 가이드 공개

앤스로픽이 Claude Sonnet 5.5로 옮기는 개발자를 위한 개발 가이드를 냈다. 다섯 가지 호환성 변경을 정리했고, 사고를 끄던 설정과 도구 강제 호출은 이제 400 오류를 낸다고 밝혔다.

앤스로픽, Sonnet 5.5 개발 가이드 공개 · Image: METAL LAB

이미지: @ClaudeDevs (X) 영상 갈무리

요약

  • 앤스로픽이 9월 28일 Claude Sonnet 5.5 개발 가이드를 공개하고 Sonnet 5에서 옮길 때의 다섯 가지 호환성 변경과 응답 형태 변경 한 가지를 정리했다.
  • 사고를 끄던 설정과 도구 강제 호출, 옛 컴퓨터 사용 선언은 400 오류를 내며, 가이드는 between_tools 설정과 auto·strict 도구로 바꾸라고 권했다.
  • Sonnet 5.5는 Sonnet 5보다 30% 빠르고 작업당 비용이 최대 30% 줄며, Claude Code는 v2.1.284부터 sonnet 별칭을 새 모델로 돌렸다.
Building with Claude Sonnet 5.5
발표
2026년 9월 28일 claude.dev 개발 가이드 · 작성 애디 오스마니 · ClaudeDevs X 안내 글 조회 100만 회 이상
성능·비용
Sonnet 5 대비 30% 빠름 · 토큰당 가격 동일 · 작업당 비용 최대 30% 감소 · Terminal-Bench 4.0 70.6%(Sonnet 5 10.3%)
호환성 변경
다섯 가지 + 응답 형태 변경 한 가지 · thinking disabled·tool_choice any/tool·computer_20251124 선언은 400 오류
between_tools
도구 호출 사이에서만 사고 · low·medium·high에서만 작동, xhigh·max는 400 오류
노력 기본값
Claude API high · Claude Code medium · 노력 단계 재보정
캐시·이미지
최소 캐시 프롬프트 512토큰(Sonnet 5 1,024) · 캐시 읽기 입력가의 10분의 1 · 이미지 긴 변 2576픽셀, 2000×1500 이미지 Sonnet 4.6 대비 약 2.5배 토큰 · 미국 내 추론 1.1배
사양
컨텍스트 100만 토큰 · 최대 출력 12만8000토큰 · 학습 데이터 2026년 6월까지
Claude Code
v2.1.284부터 sonnet 별칭 = Sonnet 5.5 · medium 노력 · 사고 끄기·빠른 모드 없음 · 기본 모델 Opus 5.5

앤스로픽이 9월 28일 개발자 블로그에 Claude Sonnet 5.5 개발 가이드를 공개했다. 가이드의 결론은 모델 이름만 바꿔서는 이전이 끝나지 않는다는 것이다. Sonnet 5에서 넘어오는 코드는 다섯 가지 호환성 변경과 응답 형태 변경 한 가지를 거쳐야 하고, 이 가운데 상당수는 요청 자체를 400 오류로 돌려보낸다. 앤스로픽 개발자 계정 ClaudeDevs가 같은 날 X에 올린 안내 글은 100만 회 넘게 조회됐다.

가이드를 쓴 앤스로픽의 애디 오스마니는 Sonnet 5.5가 Sonnet 5보다 30% 빠르고, 토큰당 가격은 그대로지만 같은 일을 더 적은 토큰으로 끝내 대부분의 작업에서 비용이 최대 30% 줄어든다고 밝혔다. 메탈은 앞서 앤스로픽의 Claude Sonnet 5.5 공개를 보도한 바 있으며, 이번 가이드는 그 모델을 실제 제품에 넣는 사람을 위한 설명서다. 발표문에 따르면 Sonnet 5.5는 에이전트 코딩 평가 Terminal-Bench 4.0에서 70.6%를 기록해 Sonnet 5의 10.3%를 크게 넘었다.

역할 분담부터 분명히 했다. 가이드는 버그 수정, 기능의 빠른 반복, 요구사항 대조 같은 범위가 정해진 일상 코딩과 반복 실행하는 조사·리뷰·초안 작성 에이전트 작업을 Sonnet 5.5에, 긴 호흡의 에이전트 코딩과 신중한 판단이 필요한 지식 노동을 Opus 5.5에 배정했다. 오스마니는 Sonnet 5.5가 명확한 사양과 결과를 확인할 수단이 있는 작업에 가장 잘 맞는다고 적었다. 대량·저지연 작업용인 Claude Haiku 5.5는 몇 주 안에 합류할 예정이다.

첫 번째 함정은 사고 기능이다. Sonnet 5.5는 기본값으로 생각을 켠 채 답하기 때문에 응답이 사고 블록으로 시작할 수 있고, 첫 블록의 텍스트를 바로 읽는 코드는 깨진다. 사고를 끄던 thinking disabled 설정은 이제 400 오류를 낸다. 대신 새 설정 between_tools를 쓰면 도구 호출 사이에서만 생각하는데, 이 설정은 low·medium·high 노력 수준에서만 작동하고 xhigh나 max에서는 다시 400 오류가 난다.

작업 유형별로 Sonnet 5.5와 Opus 5.5 중 어느 모델로 시작할지 정리한 표

도구 강제 호출도 막혔다. tool_choice를 any나 특정 도구로 지정하면 토큰 계산 엔드포인트에서까지 400 오류가 나고, 가이드는 auto로 바꾼 뒤 도구에 strict 옵션을 걸어 입력이 스키마를 따르게 하라고 권했다. 컴퓨터 사용 기능은 새 도구 묶음 computer_toolset_20260801로만 쓸 수 있고 옛 선언은 오류가 된다. 다만 아마존 베드록은 옛 방식을 아직 받는다. 조언자 도구에서 Sonnet 5.5 실행자는 Opus 4.8, Opus 4.7, Sonnet 5를 조언자로 받지 않으며, 받아 주는 조언자의 조언도 암호화된 채 돌아와 코드가 그 내용을 읽을 수 없다.

사고 블록은 모델과 대화에 묶인다. Sonnet 5.5는 Sonnet 5의 사고 블록을 읽기 때문에 대화 중간에 모델을 바꿔도 추론이 이어지지만, Sonnet 5.5의 블록을 읽을 수 있는 다른 모델은 없다. 그래서 가이드는 대화를 덧붙이기만 하는 구조로 유지하라고 주문했다. 이전을 손으로 하지 않으려면 Claude Code에서 /claude-api 명령에 이전을 맡기면 되고, 번들로 든 Claude API 스킬이 코드베이스 전체의 모델 ID와 깨지는 매개변수를 한 번에 바꾼다.

노력 수준은 다시 재야 한다. 가이드는 노력 단계가 재보정돼 Sonnet 5의 설정값이 같은 양의 사고를 내지 않는다고 밝혔다. Claude API의 기본값은 high, Claude Code는 medium이다. 에이전트 코딩은 medium에서 시작해 어려운 작업만 high로 올리고, 채팅처럼 지연에 민감한 일은 medium이나 low로 시작하라는 것이 가이드의 권고다. 시스템 프롬프트로 생각을 줄이라고 요청해도 사고량이 안정적으로 줄지 않으니 노력 단계를 낮추라는 주문도 붙었다. 게으르지 말라는 식으로 Sonnet 5에 덧대 둔 우회 문구는 지우고 평가부터 다시 돌리라고 했다.

비용 구조에도 손이 갔다. 캐시할 수 있는 최소 프롬프트 길이는 1,024토큰에서 512토큰으로 내려가 짧은 시스템 프롬프트와 도구 정의도 캐시 대상이 된다. 캐시 읽기는 입력 가격의 10분의 1이지만, 요청마다 최상위 노력 수준을 바꾸면 캐시가 무효가 된다. 이미지는 긴 변 2576픽셀까지 받는 고해상도 등급이라 2000×1500 이미지 한 장이 Sonnet 4.6보다 약 2.5배의 토큰을 쓰고, 미국 안에서만 추론하도록 지정하면 표준 가격의 1.1배가 붙는다. 컨텍스트 창은 베타 헤더 없이 100만 토큰, 최대 출력은 12만8000토큰이며 학습 데이터는 2026년 6월까지다.

외부 개발사의 반응은 속도와 토큰 절감에 모였다. 대니얼 보겔 에픽게임즈 최고운영책임자는 "새 모델은 게임플레이 시스템 아키텍처를 위한 수만 줄의 코드를 다뤘고, 응답을 빠르게 유지했으며, 몇 시간짜리 작업을 처리했다"고 말했다. 코드 리뷰 업체 코드래빗의 데이비드 로커 AI 부문 부사장은 "단순한 리뷰와 중간 난도의 리뷰를 지금 옮기고, 앞으로 몇 주에 걸쳐 더 옮길 계획"이라고 밝혔다.

Sonnet 5.5의 모델 ID, 컨텍스트 창, 최대 출력, 노력 수준, 최소 캐시 프롬프트 등 사양표

거절 처리 방식도 달라졌다. 거절된 요청은 HTTP 200과 함께 거절 사유를 담아 돌아오고, 사유는 사이버, 생물, 프런티어 LLM, 추론 추출, 일반 위해의 다섯 범주로 나뉜다. 앤스로픽은 Sonnet 5.5가 최상위 모델과 비슷한 사이버보안 안전장치를 단 첫 Sonnet 모델이라고 설명했고, 서버 쪽 대체 기능은 사이버와 프런티어 LLM 범주의 거절만 Sonnet 5로 다시 보낸다. 가이드는 추론 추출 거절을 부르지 않으려면 응답 안에 추론을 쓰라고 요구하지 말고 요약된 사고 표시 기능을 읽으라고 권했다.

메탈이 확인한 40초 분량의 가이드 시연 영상에서는 두 모델이 같은 사진을 보고 직접 짠 파이썬 코드로 그림을 다시 그린다. 화면 설명에 따르면 이미지 생성 모델은 쓰지 않았고, 그림이 끝난 시점에 Sonnet 5는 스스로 만든 붓 엔진을 1만2249번, Sonnet 5.5는 4만4561번 호출해 도시 야경을 훨씬 촘촘하게 채웠다. X 게시물에는 참고 사진을 찍은 원작자가 출처 표기와 허락 없이 쓰였다고 밝혔다는 독자 제안 맥락이 평가 중으로 붙었고, 가이드 본문에는 그 원작자 계정이 참고 이미지 제공자로 적혀 있다.

Claude Code에서는 v2.1.284부터 sonnet 별칭이 Sonnet 5.5를 가리키고 medium 노력으로 돈다. 사고를 끌 수 없고 빠른 모드도 없으며, 기본 모델은 여전히 Opus 5.5다. 모델은 Claude API, 아마존 베드록, AWS의 Claude 플랫폼, 구글 클라우드, 마이크로소프트 파운드리에서 쓸 수 있고, 파운드리는 글로벌 스탠더드 배포에서만 제공된다.

엔지니어의 눈으로 보면 이번 가이드는 성능표보다 호환성 목록이 더 긴 문서다. 싸고 빨라진 모델을 얻는 대가로 사고 기본값, 도구 강제, 컴퓨터 사용, 조언자 조합이 한꺼번에 바뀌었고, 앤스로픽은 그 비용을 /claude-api 명령과 스킬로 덜어 주는 쪽을 택했다. 모델 ID 한 줄을 바꾸기 전에 400 오류 목록과 노력 수준 재측정부터 확인하라는 것이 이 문서가 개발자에게 남긴 요구다.

김현국

METAL 발행인 · 아카이브저널 발행인 · 이라선 운영

매거진·서점·교육을 오래 해 온 편집자예요. 라이프스타일 매거진 <아카이브저널>을 발행하고, 아트 서점 <이라선>을 운영했으며, 라이카 아카데미에서 디렉터로 사진 교육 프로그램을 만들고 이끌었어요. 그 시선으로 전 세계 AI 소식을 독자에게 전하는 메탈(METAL) 매거진 편집장입니다.

이 에디터의 기사 더 보기 →

공유

댓글