클로드 하이쿠 5.5 가격 100만 토큰 0.1달러 — 90% 싸졌다는데 평균은 75%인 이유
Anthropic released Claude Haiku 5.5 on October 7, 2026, at $0.10 per million input tokens and $0.50 per million output tokens for prompts up to 100,000 tokens, 90% below Haiku 4.5. Above 100,000 tokens the whole request is billed at five times that rate, and a new tokenizer turns the same text into roughly 30% more tokens, so Anthropic's own average saving is about 75%. The small model scored 72.4% on the OSWorld 2.1 computer-use test, against 15.7% for Haiku 4.5, and has a 1 million-token context window.
앤트로픽은 2026년 10월 7일 소형 모델 클로드 하이쿠 5.5를 내놓았다. 10만 토큰 이하 요청은 100만 토큰당 입력 0.10달러·출력 0.50달러로 하이쿠 4.5(1달러·5달러)보다 90% 싸다. 그러나 요청이 10만 토큰을 넘으면 요청 전체에 다섯 배 요금(0.50달러·2.50달러)이 붙고, 새 토크나이저가 같은 글을 약 30% 더 많은 토큰으로 쪼갠다. 그래서 앤트로픽이 밝힌 평균 절감폭은 90%가 아니라 약 75%다. 컴퓨터 사용 시험(OSWorld 2.1)은 72.4%로 하이쿠 4.5(15.7%)의 4.6배였고, 컨텍스트는 100만 토큰, 무료 요금제를 포함한 모든 클로드 플랜에서 쓸 수 있다
3줄 요약
- 가격 — 10만 토큰 이하 입력 0.10달러·출력 0.50달러(100만 토큰당), 하이쿠 4.5보다 90% 저렴
- 함정 — 10만 토큰 넘으면 요청 전체가 5배 요금, 토큰도 약 30% 더 나와 평균 절감은 75%
- 성능 — OSWorld 2.1 72.4%(4.5는 15.7%), 컨텍스트 100만 토큰, 2027년 10월 7일까지 유지 약속
핵심 질문
- 클로드 하이쿠 5.5 가격
- **10만 토큰을 기준으로 두 구간이다(100만 토큰당).** | 항목 | 10만 이하 | 10만 초과 | 하이쿠 4.5 | |---|---|---|---| | 입력 | 0.10달러 | 0.50달러 | 1달러 | | 출력 | 0.50달러 | 2.50달러 | 5달러 | | 캐시 읽기 | 0.01달러 | 0.05달러 | 0.10달러 | | 캐시 쓰기(5분) | 0.125달러 | 0.625달러 | 1.25달러 | 배치 API는 50% 추가 할인.
- 하이쿠 5.5 10만 토큰 넘으면
- **넘는 부분만이 아니라 요청 전체가 비싼 구간으로 계산된다.** | 요청 크기 | 적용 입력 단가 | |---|---| | 9만9천 토큰 | 0.10달러 | | 10만1천 토큰 | 0.50달러(요청 전체) | 긴 문서 분석, 대화 기록을 통째로 넣는 챗봇, 코드베이스 에이전트가 이 구간에 걸리기 쉽다.
- 하이쿠 5.5 GPT-6 루나 비교
- **API 가격은 같고, 앤트로픽 발표 벤치마크에서는 하이쿠 5.5가 앞섰다.** | 항목 | 하이쿠 5.5 | GPT-6 루나 | |---|---|---| | 입력/출력(100만 토큰) | 0.10 / 0.50달러 | 0.10 / 0.50달러 | | OSWorld 2.1 | 72.4% | 48.9% | | 터미널벤치 4.0 | 39.2% | 16.4% | | GDPval-AA v2.1(Elo) | 1620 | 1437 | 벤치마크는 앤트로픽 발표 수치다.
가격표의 첫 줄은 90% 인하다. 그런데 앤트로픽이 스스로 내세운 숫자는 75%다. 그 15%포인트 차이에 이번 가격의 구조가 다 들어 있다. 앤트로픽은 2026년 10월 7일 소형 모델 클로드 하이쿠 5.5를 내놓았다. 오퍼스 5.5가 나온 지 2주, 소넷 5.5가 나온 지 9일 만이다. 요약·분류·데이터 조회처럼 요청 수가 많고 단가가 중요한 일을 겨냥한 모델이다. 같은 날 오픈AI가 무료 이용자에게 GPT-6 루나를 풀면서(「GPT-6 무료 사용 10월 9일부터」), 두 회사의 소형 모델이 같은 가격선에서 맞붙었다.
1. 가격표 — 10만 토큰을 기준으로 두 개의 요금
| 100만 토큰당 | 하이쿠 5.5(요청 10만 토큰 이하) | 하이쿠 5.5(10만 초과) | 하이쿠 4.5 |
|---|---|---|---|
| 입력 | 0.10달러 | 0.50달러 | 1.00달러 |
| 출력 | 0.50달러 | 2.50달러 | 5.00달러 |
| 캐시 읽기 | 0.01달러 | 0.05달러 | 0.10달러 |
| 캐시 쓰기(5분) | 0.125달러 | 0.625달러 | 1.25달러 |
| 하이쿠 4.5 대비 | 90% 저렴 | 50% 저렴 | — |
배치 API를 쓰면 두 구간 모두 입력·출력이 50% 더 싸다. 생각(추론) 토큰은 출력 요금으로 계산된다.
중요한 것은 10만 토큰 경계가 요청 단위라는 점이다. 9만9천 토큰짜리 요청은 입력 0.10달러가 적용되지만, 10만1천 토큰짜리 요청은 넘은 1천 토큰만이 아니라 요청 전체가 0.50달러로 계산된다. 토큰 하나 차이로 단가가 다섯 배가 된다. 긴 계약서 분석, 대화 기록을 통째로 넣는 상담 챗봇, 큰 코드베이스를 붙들고 일하는 에이전트가 이 구간에 걸리기 쉽다. 앤트로픽은 이전 모델에서 요청의 90%가 10만 토큰 이하였다고 설명했다.
2. 왜 평균은 75%인가 — 토큰이 30% 더 나온다
두 번째 이유는 토크나이저다. 하이쿠 5.5는 소넷 5.5·오퍼스 5.5와 같은 새 토크나이저를 쓰는데, 같은 글을 하이쿠 4.5보다 약 30% 많은 토큰으로 쪼갠다(DataCamp, 36Kr는 약 25%로 추정). 토큰 단가가 90% 내려도 토큰 수가 늘면 실제 청구액은 덜 줄어든다.
| 계산 예(입력 1만 단어 분량, 10만 토큰 이하) | 하이쿠 4.5 | 하이쿠 5.5 |
|---|---|---|
| 토큰 수(가정) | 100 | 130 |
| 단가(100만 토큰당 입력) | 1.00달러 | 0.10달러 |
| 상대 비용 | 100 | 13(87% 절감) |
여기에 10만 토큰을 넘는 요청(50% 절감에 그침)이 섞이면 평균 절감폭은 더 내려간다. 앤트로픽이 "평균 약 75% 싸다"고 밝힌 이유다. 토크나이저가 무엇이고 왜 모델마다 토큰 수가 다른지는 「토크나이저란」에 따로 정리했다.
한 개발자의 직접 시험도 있다. DataCamp 필자가 송장 24건 판정을 두 모델에 맡겼더니 둘 다 24건을 모두 맞혔고, 전체 비용은 하이쿠 5.5가 0.0098달러, 하이쿠 4.5가 0.25달러였다. 이 작업에서는 약 25분의 1이었다.
3. 성능 — 4.5와는 다른 등급, 소넷 5.5보다는 아래
앤트로픽이 출시 글에 낸 수치다.
| 벤치마크 | 하이쿠 5.5 | 하이쿠 4.5 | 소넷 5.5 | GPT-6 루나 |
|---|---|---|---|---|
| OSWorld 2.1(컴퓨터 사용) | 72.4% | 15.7% | 83.9% | 48.9% |
| 터미널벤치 4.0 | 39.2% | 0.0% | 70.6% | 16.4% |
| GDPval-AA v2.1(Elo) | 1620 | 735 | 1840 | 1437 |
| 인류의 마지막 시험(도구 없음) | 45.9% | 10.2% | 56.9% | — |
| 프론티어코드 1.1 | 46.4% | — | 52.1% | 42.4% |
하이쿠 5.5는 공개된 모든 항목에서 하이쿠 4.5를 넘었고, 둘 다 수치가 있는 항목에서는 GPT-6 루나보다 높았다. 모든 항목에서 소넷 5.5보다는 낮다. API 가격은 루나와 똑같은 입력 0.10달러·출력 0.50달러다.
그 밖의 사양은 다음과 같다.
| 항목 | 내용 |
|---|---|
| 컨텍스트 | 100만 토큰 |
| 최대 출력 | 12만8천 토큰(배치는 30만) |
| 노력(effort) 설정 | 하이쿠 계열 최초, low~max |
| 제공처 | 클로드 API, AWS 베드록, 구글 클라우드, 마이크로소프트 |
| 클로드 앱 | 무료를 포함한 모든 플랜 |
| 유지 약속 | 2027년 10월 7일 전에는 종료하지 않음 |
같은 날 앤트로픽은 소넷 5.5의 캐시 읽기 가격도 100만 토큰당 0.20달러에서 0.10달러로 절반 내렸다. 앤트로픽은 이 인하로 소넷 5.5의 에이전트 작업 비용이 대부분 약 20% 줄어든다고 밝혔다.
4. 남은 것과 확인되지 않은 것
- 한국어 토큰 증가율: 새 토크나이저가 한국어 문장을 얼마나 더 쪼개는지는 공개되지 않았다. 30%는 영어 위주 측정이다. 한국어 서비스라면 자기 데이터로 직접 재 보는 것이 정확하다.
- 벤치마크 검증: 위 수치는 앤트로픽 발표다. 독립 기관 재현은 아직 확인하지 못했다.
- 중국 소형 모델과의 경쟁: 큐원3.8 플래시(입력 0.15·출력 0.47달러), GLM 5.3 플래시(0.15·0.50달러)가 비슷한 가격대에 있다. 성능 비교는 공개된 것이 없다.
- 이전 세대 가격 경쟁의 흐름은 「클로드 오퍼스 5.5와 GPT-6 솔 가격」, 토큰 가격의 기본 개념은 「AI 토큰 가격이란」에 있다.
출처
- Anthropic — Introducing Claude Haiku 5.5
- DataCamp — Claude Haiku 5.5: Features, Benchmarks, and Pricing
- OrcaRouter — Claude Haiku 5.5: the 100K Price Cliff Nobody Mentioned
- MarkTechPost — Anthropic Releases Claude Haiku 5.5: A Small Model With 1M Context
- Yahoo Finance — Anthropic reveals Haiku 5.5 model as AI pricing war intensifies
- 36Kr — Claude Haiku 5.5 Cuts Prices to Rock-Bottom Levels