클로드 하이쿠 5.5 출시: 가격, 성능, 하이쿠 4.5에서 옮길 때 바꿀 것
이 글의 독자클로드 API로 요약, 분류, 고객 응대처럼 호출이 많은 일을 돌리면서, 하이쿠 5.5로 바꾸면 비용과 코드가 어떻게 달라지는지 알고 싶은 사람
한줄 요약: 2026년 10월 7일 나온 클로드 하이쿠 5.5는 하이쿠 4.5보다 평균 약 75% 싸고, 컨텍스트가 100만 토큰으로 늘었고, 생각하는 정도(effort)를 고를 수 있습니다. Anthropic은 요약, 분류, 서브에이전트처럼 호출이 많은 일에 맞는 모델로 소개했고, Terminal-Bench 4.0 같은 복잡한 에이전트 코딩은 소넷 5.5와 오퍼스 5.5가 낫다고 직접 밝혔습니다. 하이쿠 4.5에서 옮길 때는 코드 몇 곳을 고쳐야 합니다.
목차
2026년 10월 7일, Anthropic이 Introducing Claude Haiku 5.5를 발표했습니다. 아래 내용은 이 발표와 같은 날 올라온 개발자 문서(하이쿠 5.5 개요, 새 기능, 마이그레이션 가이드)를 기준으로 정리했습니다.
1. 무엇이 나왔나
발표는 하이쿠 5.5를 지금까지 낸 소형 모델 가운데 가장 싸고, 가장 빠르고, 성능이 가장 좋은 모델이라고 소개합니다. 발표가 든 쓰임은 아래와 같습니다.
- 빠르고 반복되는 대량 작업: 요약, 긴 대화 압축, 데이터베이스 조회, 분류
- 코딩의 서브에이전트: 오퍼스 5.5, 소넷 5.5와 짝을 이루는 코딩 보조. 서브에이전트는 주 모델이 일을 나눠 맡기는 보조 에이전트
- 속도가 중요한 일: 실시간 고객 응대, 브라우저 사용
| 항목 | 하이쿠 4.5 | 하이쿠 5.5 |
|---|---|---|
| 모델 ID (클로드 API) | claude-haiku-4-5-20251001 (별칭 claude-haiku-4-5) |
claude-haiku-5-5 |
| 컨텍스트 | 20만 토큰 | 100만 토큰 |
| 최대 출력 | 6만 4천 토큰 | 12만 8천 토큰 |
| 생각 방식 | 켜고 끄며 토큰 예산을 직접 지정 | 모델이 스스로 조절, effort로 강도 지정 (기본 medium) |
| 지식 기준 시점 | 2025년 2월 | 2026년 6월 |
| 은퇴 약속 (클로드 API 기준) | 2026년 10월 15일 이후 | 2027년 10월 7일 이후 |
- 하이쿠 5.5는 클로드 API 말고도 Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS에서 같은 날 쓸 수 있습니다. Bedrock만 ID가
anthropic.claude-haiku-5-5입니다. - 발표 각주는 하이쿠 5.5가 각 모델의 표준 속도로 비교하면 가장 빠르지만, 빠른 모드(Fast Mode)로 돌린 오퍼스보다는 느리다고 적었습니다.
- 하이쿠 5.5는 claude.ai와 iOS, Android 앱에서도 쓰입니다(시스템 프롬프트 문서). 도움말에 따르면 유료 요금제(Pro, Max, Team, Enterprise) 채팅에서 하이쿠 5.5의 컨텍스트는 100만 토큰이고, 채팅 화면의 effort 선택기도 하이쿠 5.5에서 쓸 수 있습니다.
- 클로드 코드 모델 설정 문서는
haiku별칭이 Anthropic API에서는 하이쿠 5.5를, Claude Platform on AWS, Bedrock, Google Cloud, Foundry에서는 하이쿠 4.5를 가리킨다고 적었습니다. 하이쿠 5.5는 클로드 코드 v2.1.293 이상에서 씁니다.
2. 가격: 10만 토큰을 기준으로 두 단가
하이쿠 5.5는 요청 하나의 프롬프트가 10만 토큰 이하인지 넘는지에 따라 단가가 다릅니다. 발표는 하이쿠 4.5로 들어온 요청의 약 90%가 10만 토큰 이하였다고 밝혔습니다.
- 발표 각주 기준으로 10만 토큰 이하 요청은 하이쿠 4.5보다 90%, 넘는 요청은 50% 쌉니다.
- 다만 하이쿠 5.5는 새 토크나이저(글을 토큰으로 자르는 방식)를 써서, 같은 글이 하이쿠 4.5보다 약 30% 더 많은 토큰으로 세어진다고 문서가 설명합니다.
- 발표의 “평균 약 75% 저렴”은 위 할인 폭에 요청 분포와 작업당 토큰이 조금 늘어나는 점까지 반영한 값이라고 각주가 설명합니다.
- 하이쿠 4.5에서 7만 7천 토큰쯤이던 프롬프트는 문서의 약 30%를 그대로 적용하면 10만 토큰을 넘어, 단가가 5배인 구간에 들어갈 수 있습니다.
- 캐시는 자주 쓰는 프롬프트 앞부분을 저장해 두고 다시 읽는 기능이고, 저장할 때가 캐시 쓰기, 다시 읽을 때가 캐시 읽기 단가입니다.
- 1시간짜리 캐시 쓰기는 10만 토큰 이하 0.20달러, 초과 1달러이고, 배치 API는 입력과 출력이 50% 할인됩니다(하이쿠 5.5 개요 문서).
3. 성능: 벤치마크와 effort 단계
발표는 하이쿠 5.5를 하이쿠 4.5, OpenAI의 GPT-6 Luna와 나란히 놓고, 소넷 5.5를 참고용으로 붙였습니다.
| 벤치마크 | 발표 설명 |
|---|---|
| GDPval-AA v2.1 | 44개 직업의 실제 업무 평가 |
| OSWorld 2.1 | 실제 컴퓨터 조작으로 긴 여러 단계 작업 완료 |
| Humanity’s Last Exam | 전문가 수준 학술 지식과 추론 |
| Terminal-Bench 4.0 | 명령줄에서 복잡한 여러 단계 업무 완료 |
- 나머지 셋은 발표가 분류만 붙였습니다. AA-Briefcase는 지식 업무, FrontierCode는 에이전트 코딩, Chartography는 시각 추론입니다.
- 점수가 있는 모든 항목에서 하이쿠 5.5는 하이쿠 4.5보다 높고, 점수가 공개된 항목에서는 GPT-6 Luna보다 높습니다. 소넷 5.5보다는 모든 항목에서 낮습니다.
- Terminal-Bench 4.0에서는 하이쿠 5.5 39.2%, 소넷 5.5 70.6%로 차이가 큽니다. 발표도 Terminal-Bench 4.0 같은 복잡한 에이전트 코딩에는 소넷 5.5와 오퍼스 5.5가 여전히 낫고, 하이쿠 5.5는 압축, 요약, 서브에이전트처럼 범위가 좁은 일에 맞는다고 적었습니다.
하이쿠 5.5는 하이쿠급에서 처음으로 effort를 고를 수 있는 모델입니다. 단계는 Low, Med, High, Xhigh, Max 다섯 가지이고(API 값은 low, medium, high, xhigh, max), 발표는 세 가지 벤치마크에서 단계별 점수와 비용을 그래프로 보여 줍니다.
- 그래프에서 하이쿠 5.5의 Max 단계는 70%대, 기본값인 Med 단계는 50%대에 찍혀 있습니다. 위 표의 72.4%는 그래프의 Max 점과 높이가 비슷해 보이지만, 표의 점수가 어느 단계 값인지는 발표에 적혀 있지 않습니다.
- 같은 그래프에서 하이쿠 5.5의 Max 단계는 소넷 5.5의 가장 왼쪽 점보다도 왼쪽(더 싼 쪽)에 있습니다.
- 클로드 API에서 effort를 지정하지 않으면 medium으로 동작합니다(모델 개요 문서).
발표에는 초기 테스트에서 하이쿠 5.5를 시험한 고객사 6곳의 평가도 실렸습니다. 아래 표는 하이쿠 5.5 자체의 수치를 낸 4곳입니다.
- Cognition은 하이쿠 5.5를 보조 모델로 둔 자사 시스템(Devin Fusion)의 점수를, Rogo는 수치 없이 쓰임을 적었습니다.
- 고객사가 낸 숫자이고 측정 방식은 각자 다릅니다.
| 고객사 | 발표에 실린 평가 |
|---|---|
| Asana | AI 에이전트 작업 완료 지연 30% 이상 감소, 에이전트 한 턴 추론 최대 2.5배 빨라짐 (현재 쓰는 모델 대비) |
| HubSpot | CRM 작업 평가에서 3회 평균 92.8%, 주로 소형 모델을 시험해 온 이 평가에서 지금까지 본 최고 점수 |
| AlphaSense | 문서 질의 400건에서 0.84 대 하이쿠 4.5 0.76 |
| Box | 하이쿠 4.5보다 11점 높고 지연은 약 절반 |
4. 하이쿠 4.5에서 옮길 때 바꿀 것
Messages API를 직접 부르는 코드는 모델 ID 말고도 확인할 것이 있습니다. 하이쿠 4.5에서 받던 요청 가운데 일부 파라미터가 든 요청을 하이쿠 5.5는 오류(400)로 돌려보냅니다. Claude Managed Agents를 쓰고 있다면 모델 이름만 바꾸면 된다고 문서가 안내합니다.
아래 표는 마이그레이션 가이드의 체크리스트입니다.
| 바꿀 것 | 이유 |
|---|---|
모델 ID를 claude-haiku-5-5로 교체 |
날짜 없는 고정 ID, 별칭 없음 |
max_tokens와 비용 추정 다시 계산 |
같은 글이 약 30% 더 많은 토큰 |
budget_tokens 생각 설정을 adaptive로 교체 |
예전 방식은 오류 |
| 응답의 첫 블록을 답으로 읽는 코드 수정 | 응답이 생각 블록으로 시작할 수 있음 |
temperature, top_p, top_k 제거 |
top_k는 값과 무관하게 오류, temperature와 top_p는 기본값 외 오류, 둘을 함께 넣으면 오류 |
| 마지막 메시지를 어시스턴트로 끝내는 프리필 제거 | 생각을 꺼도 오류 |
| 컴퓨터 사용 도구를 새 툴셋으로 교체 | 클로드 API와 Google Cloud에서 예전 도구는 오류 |
| 저장한 대화는 만든 계정이나 연결된 계정으로 재생 | 그 밖의 계정에선 생각 블록이 빠짐 |
| 생각 블록을 돌려보낼 땐 앞선 대화를 고치지 않음 | 앞부분이 바뀌면 오류 (2026-08-31 UTC 전에 만든 계정은 thinking.block_binding.prefix_mismatch_behavior를 넣은 요청에서만) |
stop_reason: "refusal" 처리 추가 |
안전 분류기가 요청을 거절할 수 있음, 서버 쪽 대체 모델 없음 |
- 생각 블록의 내용은 기본으로 비어서 옵니다. 요약된 생각을 받으려면
display를summarized로 지정합니다. - 도구 호출을 강제(
tool_choice를any나 특정 도구로 지정)하면 응답이 생각 블록 없이 도구 호출로 바로 시작합니다. - 생각에 쓰는 토큰도
max_tokens안에 들어갑니다. 하이쿠 4.5에 맞춰max_tokens를 작게 잡아 두었다면 답이 나오기 전에 끊길 수 있으니 한도를 올리거나 effort를 낮춥니다. - 클로드 코드를 쓰고 있다면 문서가 안내하는
/claude-api migrate명령으로 위 변경을 프로젝트에 적용하고 확인 목록을 받을 수 있습니다.
5. 함께 발표된 것
소넷 5.5 캐시 읽기 50% 인하. 같은 날부터 소넷 5.5의 캐시 읽기 단가가 100만 토큰당 0.20달러에서 0.10달러로 내렸습니다. 발표는 에이전트 작업 대부분에서 소넷 5.5 비용이 약 20% 줄어든다고 설명합니다.
Max, Team 요금제 월간 API 크레딧. Max와 Team 구독자에게 Claude Platform에서 쓰는 API 크레딧을 매달 줍니다. 발표는 발표일(10월 7일)이 속한 주 안에 지급을 시작한다고 밝혔습니다.
금액과 조건은 도움말 문서 기준입니다.
| 요금제 | 월간 크레딧 |
|---|---|
| Max 5x | 100달러 |
| Max 20x | 200달러 |
| Team Standard 좌석 | 좌석당 20달러 |
| Team Premium 좌석 | 좌석당 100달러 |
| Team 합계 상한 | 500달러 |
- Free, Pro, Enterprise는 대상이 아닙니다. 할인 Team 요금제(Nonprofit, Scientists)는 Team과 같은 금액으로 대상입니다.
- 요금제에 가입한 지 7일이 지나야 받을 수 있습니다. claude.ai 결제 설정에서 Claude Console 조직 하나를 연결하면 크레딧이 그 조직으로 들어갑니다.
- 연결하는 사람은 Max면 구독자 본인, Team이면 Primary Owner나 Owner여야 하고, Console 조직에서는 Owner, Admin, Billing 역할 중 하나면 됩니다.
- 크레딧은 결제 주기마다 새로 채워지고 남은 금액은 다음 달로 넘어가지 않습니다. 클로드 API, 배치 API, Console 플레이그라운드, Managed Agents, Agent SDK에 쓸 수 있습니다.
- 연결할 수 있는 Console 조직은 하나이고, 연결한 뒤에는 직접 바꿀 수 없어 지원팀에 문의해야 합니다.
- 터미널, IDE, 데스크톱, 웹에서 대화하며 쓰는 클로드 코드, 추가 사용량, Bedrock, Google Cloud(Vertex AI), Foundry에는 쓸 수 없습니다.
SDK의 컴퓨터 사용, 브라우저 사용 베타. Claude의 Python, TypeScript SDK가 컴퓨터 사용과 브라우저 사용을 베타로 지원합니다. 발표는 속도, 성능, 가격을 함께 놓고 보면 하이쿠 5.5가 이 일에 특히 잘 맞는다고 적었습니다. 하이쿠 5.5는 클로드 API와 Google Cloud에서 브라우저 사용 도구를 쓸 수 있고, 하이쿠 4.5는 이 도구를 지원하지 않습니다.
6. 안전장치
- 정렬: 하이쿠 4.5보다 거의 모든 정렬 평가에서 크게 나아졌고, 어긋난 행동과 악용에 협조하는 경향이 줄었다고 발표는 밝혔습니다. 평가 과정은 시스템 카드에 있습니다.
- 사이버보안: 하이쿠 4.5보다 제한이 강하지만, 최근 다른 모델들보다는 조금 덜 제한합니다. 소넷 5.5보다 넓은 범위의 방어 작업을 허용하고, 침투 테스트처럼 공격자가 쓸 가능성이 큰 기법은 막습니다.
- 생물학: 소넷 5, 소넷 5.5, 오퍼스 5와 같은 안전장치입니다. 연구용 생물학 질문은 허용하고 해를 끼칠 가능성이 큰 요청은 제한합니다.
- 더 넓은 생물학, 사이버 작업이 필요한 조직은 Life Sciences Verification Program과 Cyber Verification Program에 신청할 수 있습니다.
7. 발표에 없는 것
이 글에서 확인한 발표, 개발자 문서, 도움말에는 아래 내용이 적혀 있지 않습니다.
- claude.ai 무료 요금제에서 하이쿠 5.5를 고를 수 있는지
- 하이쿠 4.5가 실제로 은퇴하는 날짜 (모델 지원 종료 페이지에는 2026년 10월 15일 이후라는 약속만 있음)
- 한국어 작업에서 따로 잰 성능이나 토큰 증가율
댓글