For AI agents: the public content index is available at https://we0.ai/llms.txt, and the English article bundle is available at https://we0.ai/llms-full.txt.
For AI agents: the complete content index is available at https://we0.ai/llms.txt, the full English article bundle is available at https://we0.ai/llms-full.txt, and this page is available as Markdown at https://we0.ai/ko/articles/claude-haiku-5-vs-gpt-6-luna-benchmarks-p-ec36c306.md.
Anthropic이 **Claude Haiku 5.5**를 출시했습니다. 이번 업데이트는 단순한 소형 모델 개선이 아닙니다.

Anthropic이 Claude Haiku 5.5를 출시했습니다. 이번 업데이트는 단순한 소형 모델 개선이 아닙니다.
새로운 Haiku는 컴퓨터 사용, 코딩, 전문 업무, 도구 중심 에이전트 작업에서 Haiku 4.5를 크게 앞서며, 동시에 기본 API 가격을 대폭 낮췄습니다.
Anthropic이 자체적으로 공개한 출시 비교 자료에서 Haiku 5.5는 GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0, FrontierCode 1.1, Chartography 등 여러 벤치마크 항목에서 GPT-6 Luna를 앞서기도 했습니다.
따라서 Haiku 5.5는 다음과 같은 대규모 처리량 워크로드에서 새롭게 검토할 만한 중요한 선택지가 되었습니다.
하지만 이번 출시에는 중요한 주의 사항도 있습니다.
가격은 100K 프롬프트 경계에서 달라지고, 새로운 토크나이저는 동일한 텍스트에 더 많은 토큰을 사용합니다. 또한 기존 Haiku 4.5 통합을 업그레이드하려면 여러 API 변경이 필요합니다.

Anthropic은 Haiku 5.5를 현재까지 가장 저렴하고 빠르며 성능이 뛰어난 소형 모델로 소개합니다.
공식 벤치마크 표에는 의도된 경쟁 모델이 분명하게 드러납니다. GPT-6 Luna가 Haiku 5.5 바로 옆에 직접 포함되어 있습니다.

출시 결과는 다음과 같습니다.
| 벤치마크 | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1, 오프라인 하위 집합 | 72.4% | 15.7% | 48.9% | 83.9% |
| Humanity’s Last Exam, 도구 미사용 | 45.9% | 10.2% | — | 56.9% |
| Humanity’s Last Exam, 도구 사용 | 57.4% | 18.7% | — | 64.5% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1 (Main) | 46.4% | — | 42.4% | 52.1% |
| Chartography, 도구 미사용 | 46.4% | 6.4% | 29.1% | 61.6% |
핵심은 Haiku 5.5가 갑자기 모든 대형 모델을 대체한다는 뜻이 아닙니다.
이제 가장 작은 Claude 등급도 과거에는 더 큰 모델이 필요했던 유형의 작업을 훨씬 더 잘 처리하게 되었다는 점이 중요합니다.
100K 토큰 이하의 프롬프트에 대해 Anthropic은 다음과 같이 과금합니다.
Haiku 5.5 입력: $0.10 / 1M 토큰
Haiku 5.5 출력: $0.50 / 1M 토큰
캐시 읽기: $0.01 / 1M 토큰
캐시 쓰기: $0.125 / 1M 토큰
OpenAI의 GPT-6 Luna 표준 가격은 현재 다음과 같습니다.
GPT-6 Luna 입력: $0.10 / 1M 토큰
GPT-6 Luna 캐시 입력: $0.01 / 1M 토큰
GPT-6 Luna 캐시 쓰기: $0.125 / 1M 토큰
GPT-6 Luna 출력: $0.50 / 1M 토큰
따라서 짧은 컨텍스트의 표준 API 작업에서는 두 모델의 기본 토큰 요금이 거의 정확히 일치합니다.

Haiku 5.5는 두 가지 가격 등급을 사용합니다.
| 토큰 유형 | 프롬프트 ≤100K | 프롬프트 >100K |
|---|---|---|
| 캐시 읽기 | $0.01/M | $0.05/M |
| 캐시 쓰기 | $0.125/M | $0.625/M |
| 입력 | $0.10/M | $0.50/M |
| 출력 | $0.50/M | $2.50/M |
Anthropic에 따르면 Haiku 4.5 요청의 약 90%가 100K 토큰 이하의 프롬프트였으며, 이것이 낮은 가격 등급이 예상 트래픽의 대부분을 포함하도록 설계된 이유입니다.
100K를 초과하는 프롬프트에서도 Haiku 5.5는 여전히 Haiku 4.5보다 저렴하지만, 할인 폭은 더 작습니다.
원문은 Haiku 5.5를 DeepSeek-V4.1-Flash와 비교합니다.
DeepSeek의 공식 가격은 현재 피크 시간대와 비피크 시간대 요금을 사용합니다.
캐시 미적중 입력 및 출력 가격은 다음과 같습니다.
| 모델 | 입력 / 1M | 출력 / 1M |
|---|---|---|
| Haiku 5.5, ≤100K 프롬프트 | $0.10 | $0.50 |
| DeepSeek-V4.1-Flash, 비피크 | $0.15 | $0.60 |
| DeepSeek-V4.1-Flash, 피크 | $0.30 | $1.20 |
DeepSeek은 캐시 적중 입력, 특히 비피크 시간대에는 여전히 더 저렴하므로 전체 비용은 워크로드 구조에 따라 달라집니다.

이전 Haiku 세대는 까다로운 컴퓨터 사용 작업에서 경쟁력이 높지 않았습니다.
Haiku 5.5는 이 부분을 크게 바꿉니다.
Anthropic의 OSWorld 2.1 오프라인 하위 집합 결과는 **Haiku 4.5의 15.7%**에서 **최대 노력 설정의 Haiku 5.5에서 72.4%**로 상승했습니다.
원문은 실용적인 테스트도 진행했습니다. Haiku 5.5에 Haiku 출시 페이지의 표에 GPT-6 및 DeepSeek 가격 데이터를 추가하도록 요청한 것입니다.
모델은 UI에서 개별 HTML 요소를 수동으로 편집하는 대신 브라우저 콘솔을 열고 스크립트를 주입해 변경 사항을 적용했습니다.

이 동작이 유용한 이유는 컴퓨터 사용 에이전트가 항상 사람의 마우스 움직임을 그대로 모방할 필요는 없기 때문입니다.
브라우저 환경에서 더 직접적인 실행 경로가 제공된다면 모든 셀을 클릭하는 것보다 스크립트를 사용하는 편이 더 빠르고 안정적일 수 있습니다.
Haiku 5.5는 조정 가능한 노력 수준을 제공하는 최초의 Haiku 계열 모델입니다.
이 모델은 더 저렴하고 빠른 동작부터 더 비싸지만 신중한 추론까지 폭넓은 설정을 지원합니다.
Anthropic의 출시 차트는 OSWorld에서 정확도와 비용 사이에 뚜렷한 곡선이 있음을 보여줍니다.

원문은 이 곡선에서 다음 두 지점을 강조합니다.
실제 프로덕션 작업의 정확한 비용은 프롬프트 길이, 출력 길이, 캐싱 및 도구 사용에 따라 달라집니다. 그러나 전체적인 패턴은 중요합니다.
이제 “소형 모델”을 하나의 고정된 성능 수준으로 취급하지 않고 작업에 따라 Haiku를 조정할 수 있습니다.
GDPval-AA v2.1은 44개 직종에 걸친 실제 전문 업무를 측정합니다.

Anthropic은 최대 노력 수준에서 Haiku 5.5의 Elo가 1620으로, Haiku 4.5의 735와 비교된다고 보고합니다.
다시 말해 Sonnet 5.5가 여전히 더 강력하지만, “소형” 모델과 “전문 업무에 유용한” 모델 사이의 격차는 크게 줄어들었습니다.
Haiku 5.5는 최신 Claude 세대와 공유되는 새로운 토크나이저를 도입합니다.
이는 동일한 텍스트가 Haiku 4.5에서와 동일한 토큰 수로 변환되지 않는다는 뜻입니다.
Anthropic의 마이그레이션 가이드에 따르면 동일한 입력 텍스트는 Haiku 4.5보다 Haiku 5.5에서 약 30% 더 많은 토큰을 생성하지만, 정확한 증가 폭은 콘텐츠에 따라 달라집니다.
워크로드에 따라 영향은 더 커지거나 작아질 수 있습니다. 특히 코드, 표, 비영어 텍스트는 다시 측정할 필요가 있습니다.
따라서 다음과 같은 비교는 지나치게 단순합니다.
기존 입력 가격: $1.00
새 입력 가격: $0.10
따라서 모든 작업이 정확히 90% 저렴해진다
더 나은 계산 방식은 다음과 같습니다.
실제 작업 비용
= 새로운 토큰 수
× 새로운 토큰 가격
+ 캐시 비용
+ 출력 비용
+ 도구 비용
Anthropic은 토크나이저 변경을 반영하면 Haiku 5.5가 모든 작업에서 일괄적으로 90% 저렴해지는 것이 아니라, 평균적으로 Haiku 4.5보다 약 75% 저렴하다고 설명합니다.
Artificial Analysis는 저렴한 모델을 비교할 때 토큰 효율성이 중요한 이유도 보여줍니다.

모델의 토큰 가격이 낮더라도 작업을 완료하기 위해 훨씬 더 많은 출력 토큰을 사용할 수 있습니다.
프로덕션 시스템에서는 100만 토큰당 가격만 보는 것보다 완료된 작업당 비용이 더 유용합니다.
원문은 이 점을 분명히 합니다. “작은 컵”은 여전히 작은 컵입니다.
Haiku 5.5는 Haiku 4.5보다 크게 강력해졌지만, 복잡한 자율 코딩은 여전히 더 큰 모델에 적합한 작업입니다.
Terminal-Bench 4.0은 그 격차를 보여줍니다.
Haiku 5.5: 39.2%
Sonnet 5.5: 70.6%
Anthropic은 복잡한 에이전트형 코딩에는 Sonnet 5.5 또는 Opus 5.5를 사용할 것을 명시적으로 권장합니다.
Haiku 5.5는 이미 범위가 명확한 작업에 더 적합합니다.
Cognition은 이미 Devin Fusion에서 이러한 구조를 사용하고 있습니다.
출시 페이지에 따르면 Opus 5.5가 리드 역할을 하고 Haiku 5.5가 보조 역할을 수행할 수 있습니다.
Cognition이 보고한 구성에서 이 조합은 66.2 FrontierCode 점수에 도달하면서 비용과 지연 시간을 줄였습니다.

패턴은 간단합니다.
Opus / Sonnet
→ 계획 수립, 분해, 어려운 판단
Haiku 5.5
→ 범위가 좁은 하위 작업, 병렬 실행, 빠른 조회, 요약
모든 곳에서 더 큰 모델을 대체하려 하기보다 이것이 Haiku 5.5를 사용하는 더 현실적인 방법일 가능성이 높습니다.
애플리케이션이 이미 Haiku 4.5를 사용하고 있다면 Anthropic은 여러 변경 사항이 기존 요청을 중단시킬 수 있다고 경고합니다.
공식 모델 ID는 이제 다음과 같습니다.
claude-haiku-5-5
그러나 마이그레이션에는 몇 가지 추가 요구 사항이 있습니다.
다음과 같은 Haiku 4.5 요청은 더 이상 유효하지 않습니다.
{
"thinking": {
"type": "enabled",
"budget_tokens": 8000
}
}
아이디어를 한 문장으로 입력하면 We0 AI가 쇼케이스 사이트, 페이지, CMS를 생성하고 출시 후 고객과 트래픽 확보를 돕습니다.
무료 등록을 위한 하나의 완전한 프로젝트 생성
하나의 완전한 생성 흐름을 시도하고 첫 번째 프로젝트 초안을 빠르게 보는 데 가장 적합합니다.
Haiku 5.5는 대신 적응형 추론과 노력 수준 제어를 사용합니다.
{
"thinking": {
"type": "adaptive"
},
"output_config": {
"effort": "medium"
}
}
기존 budget_tokens 형식으로 요청을 보내면 400 오류가 반환됩니다.
적응형 추론은 기본적으로 활성화되어 있으므로 애플리케이션은 첫 번째 응답 콘텐츠 블록이 항상 일반 답변 텍스트라고 가정해서는 안 됩니다.
블록을 type별로 파싱해야 합니다.
max_tokens 재검토새로운 토크나이저는 동일한 텍스트를 더 많은 토큰으로 계산하므로 기존 max_tokens 값으로는 동일한 출력에 필요한 공간이 부족할 수 있습니다.
추론 토큰도 출력 예산에 포함됩니다.
Haiku 4.5의 토큰 추정치를 재사용하지 말고 claude-haiku-5-5를 사용해 프롬프트를 다시 계산해야 합니다.
Haiku 5.5는 Haiku 4.5에서처럼 임의의 샘플링 설정을 더 이상 지원하지 않습니다.
Anthropic은 다음 항목을 생략할 것을 권장합니다.
temperature
top_p
top_k
기본값이 아닌 값은 400 오류를 발생시킬 수 있으며, top_k는 허용되지 않습니다.
창의적 변형을 위해 샘플링 매개변수를 사용하던 애플리케이션은 해당 제어를 프롬프트 또는 다른 애플리케이션 수준 전략으로 옮겨야 합니다.
Haiku 4.5는 일부 구성에서 최종 어시스턴트 메시지에 이어서 응답을 생성할 수 있었습니다.
Haiku 5.5는 어시스턴트 프리필을 거부합니다.
다음과 같은 접두사를 사용해 JSON 출력을 강제했다면:
{"result":
대신 구조화된 출력 또는 도구 스키마로 마이그레이션해야 합니다.
Claude API 및 Google Cloud 통합에서는 기존 컴퓨터 사용 선언인 다음 항목을:
computer_20250124
다음 항목으로 변경해야 합니다.
computer_toolset_20260801
새로운 도구 세트는 이벤트 구조가 다르므로 에이전트 루프가 반환된 도구 사용 블록을 올바르게 전달하고 결과에 toolset_name을 유지해야 합니다.
Haiku 5.5는 지원되는 플랫폼에서 웹페이지 작업을 위한 Anthropic의 브라우저 사용 도구 세트도 지원합니다.
Haiku 5.5를 배포하기 전에 최소한 다음 항목을 확인해야 합니다.
claude-haiku-5-5로 변경합니다.budget_tokens 추론을 적응형 추론과 노력 수준 설정으로 교체합니다.type별로 파싱합니다.computer_toolset_20260801로 업데이트합니다.refusal 중지 이유를 처리합니다.Anthropic은 자동화된 Claude Code 마이그레이션 명령도 제공합니다.
/claude-api migrate this project to claude-haiku-5-5
이 도구는 모델 ID를 변경하고 호환되지 않는 여러 요청 패턴을 감지할 수 있지만, 수동 검증도 권장됩니다.
Haiku 5.5가 Anthropic이 발표한 유일한 가격 변경은 아닙니다.
Sonnet 5.5의 캐시 읽기 가격은 다음과 같이 인하되었습니다.
$0.20 / 1M 토큰
에서:
$0.10 / 1M 토큰
Anthropic은 많은 에이전트 워크플로에서 캐시 읽기가 토큰 소비의 큰 비중을 차지한다고 설명합니다. 따라서 이번 변경으로 대부분의 Sonnet 5.5 에이전트형 작업 비용이 약 20% 줄어듭니다.

이로 인해 혼합 모델 아키텍처가 더욱 매력적으로 바뀝니다.
Sonnet 5.5
→ 계획 수립 및 더 어려운 실행
Haiku 5.5
→ 저렴한 대규모 하위 작업
Anthropic은 적격 Max 및 Team 구독자를 대상으로 월별 Claude Platform 크레딧도 도입했습니다.
현재 공식 크레딧 금액은 다음과 같습니다.
| 요금제 | 월별 API 크레딧 |
|---|---|
| Max 5x | $100 |
| Max 20x | $200 |
| Team Standard 좌석 | 좌석당 $20 |
| Team Premium 좌석 | 좌석당 $100 |
| Team 공동 최대 한도 | $500 |

크레딧은 다음과 같은 Claude Platform 워크로드에 사용할 수 있습니다.
이 크레딧은 사용자의 Claude 또는 Claude Code 구독 사용량 한도를 늘리지 않습니다. 또한 구독 요금제로 과금되는 일반적인 대화형 Claude Code 세션에도 적용되지 않습니다.
크레딧은 하나의 Claude Console 조직에 연결되며 무기한 이월되지 않습니다.
원문은 가벼운 비교로 마무리됩니다.
Anthropic이 더 저렴한 모델, 더 저렴한 Sonnet 캐시 읽기, 월별 API 크레딧을 발표하는 동안 OpenAI의 Codex 및 ChatGPT Work 책임자인 Thibault Sottiaux는 Codex와 ChatGPT Work 전체에서 활성 사용자 4,000만 명을 축하하며 유료 계정을 위한 또 다른 적립형 리셋을 발표했습니다.

적립형 리셋은 영구적인 가격 인하와 다릅니다.
이는 모델의 지속적인 토큰 가격을 변경하는 것이 아니라, 적격 사용자가 저장해 두었다가 사용할 수 있는 추가 사용량 리셋입니다.
따라서 두 발표의 비교는 기술적이라기보다 수사적인 성격이 강합니다.
Anthropic 출시:
새로운 소형 모델 + 더 낮은 캐시 가격 + 월별 API 크레딧
OpenAI 업데이트:
유료 Codex / Work 계정을 위한 추가 적립형 사용량 리셋
두 회사 모두 헤비 유저에게 더 많은 실험 여지를 제공하려는 것이지만, 작동 방식은 서로 다릅니다.
이번 출시로 Haiku의 활용성이 크게 높아졌지만, 이상적인 역할은 여전히 비교적 명확합니다.
다음과 같은 작업에는 Haiku 5.5를 사용할 수 있습니다.
다음과 같은 작업에는 더 큰 Claude 모델을 우선 고려하는 편이 좋습니다.
가장 저렴한 모델이 작업을 완료하는 가장 저렴한 방법은 아닐 수 있습니다.
프로덕션 시스템에서는 다음을 측정해야 합니다.
성공한 작업당 비용
=
입력 + 캐시 + 출력 + 도구 사용 + 재시도 + 실패
이 지표가 모델의 기본 입력 가격보다 더 많은 정보를 제공합니다.
Claude Haiku 5.5는 대규모 처리량, 비용 민감형, 지연 시간 민감형 워크로드를 위해 출시된 Anthropic의 최신 소형 Claude 모델입니다. 또한 조정 가능한 노력 수준을 제공하는 최초의 Haiku 모델이며, 코딩, 컴퓨터 사용 및 전문 업무 평가에서 Haiku 4.5보다 크게 향상되었습니다.
100K 토큰 이하의 프롬프트에서는 입력 토큰 100만 개당 $0.10, 출력 토큰 100만 개당 $0.50입니다. 100K를 초과하는 프롬프트에서는 입력 100만 토큰당 $0.50, 출력 100만 토큰당 $2.50으로 요금이 올라가며, 캐시 읽기와 캐시 쓰기에는 별도의 가격이 적용됩니다.
표준 단기 컨텍스트 토큰 가격만 보면 기본 입력, 캐시 입력, 캐시 쓰기 및 출력 요금이 사실상 동일합니다. Haiku 5.5는 프롬프트가 100K를 초과하면 가격이 올라가므로 장기 컨텍스트 워크로드는 별도로 비교해야 합니다.
아닙니다. Anthropic의 Terminal-Bench 4.0 결과에서 Sonnet 5.5는 70.6%, Haiku 5.5는 39.2%를 기록했습니다. Haiku는 범위가 좁고 반복적이며 대규모로 처리해야 하는 작업과 서브에이전트 업무에 더 적합하고, Sonnet과 Opus는 복잡한 자율 코딩에 더 적합합니다.
Haiku 5.5는 새로운 토크나이저를 사용합니다. Anthropic의 마이그레이션 가이드에 따르면 동일한 텍스트는 Haiku 4.5보다 Haiku 5.5에서 평균적으로 약 30% 더 많은 토큰을 생성하지만, 정확한 증가 폭은 콘텐츠에 따라 달라집니다.
네. 중요한 변경 사항에는 수동 budget_tokens 대신 적응형 추론 사용, 샘플링 매개변수 동작 변경, 어시스턴트 프리필 제거, 새로운 컴퓨터 사용 도구 세트, 응답 블록을 type별로 파싱하는 방식이 포함됩니다. Anthropic은 공식 마이그레이션 가이드와 Claude Code 마이그레이션 명령을 제공합니다.
Claude API에서 모델 ID는 claude-haiku-5-5입니다. Anthropic은 Amazon Bedrock, Google Cloud, Microsoft Foundry 및 AWS의 Claude Platform에 해당하는 ID도 문서화하고 있습니다.
적격 Max 및 Team 구독자는 월별 Claude Platform 크레딧을 받을 수 있습니다. Max 5x는 $100, Max 20x는 $200을 받고, Team 크레딧은 좌석 유형에 따라 계산되며 월 최대 $500까지 공동으로 적용됩니다.
Claude Haiku 5.5는 Anthropic의 소형 모델 제품군을 크게 개선한 모델입니다. 컴퓨터 사용, 전문 업무, 코딩 및 추론에서 Haiku 4.5를 큰 폭으로 앞서며, GPT-6 Luna의 단기 컨텍스트 기본 API 가격과 맞먹고 Anthropic이 공개한 여러 벤치마크 비교에서는 Luna를 앞섭니다.
가격 인하는 실제로 이루어졌지만, 프로덕션 팀은 새로운 토크나이저와 100K 프롬프트 가격 경계를 무시해서는 안 됩니다. 동일한 텍스트가 Haiku 4.5보다 약 30% 더 많은 토큰을 사용할 수 있으며, 긴 프롬프트에는 더 높은 가격 등급이 적용됩니다.
마이그레이션에는 실제로 호환성을 깨뜨리는 변경 사항도 포함됩니다. 적응형 추론이 수동 추론 예산을 대체하고, 사용자 지정 샘플링 제어가 제한되며, 어시스턴트 프리필이 제거되고, 컴퓨터 사용 통합에는 새로운 도구 세트가 필요합니다. 기존 Haiku 4.5 애플리케이션은 모델 이름만 변경하지 말고 마이그레이션 가이드를 따라야 합니다.
Haiku 5.5는 복잡하고 장기적인 작업에서 Sonnet이나 Opus를 보편적으로 대체하는 모델이 아니라, 대규모 처리와 서브에이전트 작업을 위한 빠르고 저렴한 실행 모델로 이해하는 것이 가장 적절합니다.
한 문장에서 시작해 몇 분 안에 완전한 웹사이트를 받아보세요.