For AI agents: the public content index is available at https://we0.ai/llms.txt, and the English article bundle is available at https://we0.ai/llms-full.txt.
For AI agents: the complete content index is available at https://we0.ai/llms.txt, the full English article bundle is available at https://we0.ai/llms-full.txt, and this page is available as Markdown at https://we0.ai/ru/articles/claude-haiku-5-vs-gpt-6-luna-benchmarks-p-ec36c306.md.
Anthropic выпустила **Claude Haiku 5.5**, и это не обычное обновление небольшой модели.

Anthropic выпустила Claude Haiku 5.5, и это не обычное обновление небольшой модели.
Новая версия Haiku значительно превосходит Haiku 4.5 в работе с компьютером, программировании, профессиональных задачах и агентских сценариях с активным использованием инструментов, одновременно резко снижая заявленную цену API.
Согласно собственным сравнительным данным Anthropic, Haiku 5.5 также превосходит GPT-6 Luna в нескольких бенчмарках, включая GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0, FrontierCode 1.1 и Chartography.
Это делает Haiku 5.5 серьезным новым вариантом для высоконагруженных сценариев, таких как:
Однако запуск сопровождается важными оговорками.
Цены меняются на границе в 100 тыс. токенов промпта, новый токенизатор использует больше токенов для того же текста, а обновление существующей интеграции с Haiku 4.5 требует нескольких изменений API.

Anthropic позиционирует Haiku 5.5 как самую дешевую, быструю и функциональную небольшую модель компании на данный момент.
Официальная таблица бенчмарков явно показывает предполагаемого конкурента: GPT-6 Luna указана непосредственно рядом с Haiku 5.5.

Результаты запуска включают:
| Бенчмарк | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1, автономная выборка | 72.4% | 15.7% | 48.9% | 83.9% |
| Humanity’s Last Exam, без инструментов | 45.9% | 10.2% | — | 56.9% |
| Humanity’s Last Exam, с инструментами | 57.4% | 18.7% | — | 64.5% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1 (Main) | 46.4% | — | 42.4% | 52.1% |
| Chartography, без инструментов | 46.4% | 6.4% | 29.1% | 61.6% |
Вывод не в том, что Haiku 5.5 внезапно заменяет все более крупные модели.
Суть в том, что самая компактная модель Claude стала гораздо эффективнее в задачах, для которых раньше требовалась более крупная модель.
Для промптов объемом до 100 тыс. токенов Anthropic взимает:
Ввод Haiku 5.5: $0.10 / 1 млн токенов
Вывод Haiku 5.5: $0.50 / 1 млн токенов
Чтение кэша: $0.01 / 1 млн токенов
Запись в кэш: $0.125 / 1 млн токенов
Стандартные цены OpenAI для GPT-6 Luna в настоящее время составляют:
Ввод GPT-6 Luna: $0.10 / 1 млн токенов
Кэшированный ввод GPT-6 Luna: $0.01 / 1 млн токенов
Запись в кэш GPT-6 Luna: $0.125 / 1 млн токенов
Вывод GPT-6 Luna: $0.50 / 1 млн токенов
Таким образом, для стандартной работы API с коротким контекстом две модели почти полностью совпадают по заявленным тарифам за токены.

Haiku 5.5 использует два ценовых уровня.
| Тип токенов | Промпт ≤100 тыс. | Промпт >100 тыс. |
|---|---|---|
| Чтение кэша | $0.01/млн | $0.05/млн |
| Запись в кэш | $0.125/млн | $0.625/млн |
| Ввод | $0.10/млн | $0.50/млн |
| Вывод | $0.50/млн | $2.50/млн |
Anthropic сообщает, что на промпты объемом до 100 тыс. токенов приходилось около 90% запросов к Haiku 4.5, поэтому более низкий тарифный уровень охватывает большую часть ожидаемого трафика.
Для промптов объемом более 100 тыс. токенов Haiku 5.5 по-прежнему дешевле Haiku 4.5, но скидка меньше.
В исходной статье Haiku 5.5 сравнивается с DeepSeek-V4.1-Flash.
Официальные цены DeepSeek в настоящее время разделяются на тарифы для пикового и непикового времени.
Для ввода без попадания в кэш и вывода:
| Модель | Ввод / 1 млн | Вывод / 1 млн |
|---|---|---|
| Haiku 5.5, промпт ≤100 тыс. | $0.10 | $0.50 |
| DeepSeek-V4.1-Flash, непиковое время | $0.15 | $0.60 |
| DeepSeek-V4.1-Flash, пиковое время | $0.30 | $1.20 |
DeepSeek остается дешевле по вводу с попаданием в кэш, особенно в непиковое время, поэтому итоговая стоимость по-прежнему зависит от структуры рабочей нагрузки.

Предыдущее поколение Haiku не могло конкурировать в сложных задачах с использованием компьютера.
Haiku 5.5 кардинально меняет ситуацию.
Результат автономной выборки OSWorld 2.1, опубликованный Anthropic, вырос с 15.7% у Haiku 4.5 до 72.4% у Haiku 5.5 при максимальном уровне усилий.
В исходной статье также проведен практический тест: Haiku 5.5 попросили добавить данные о ценах GPT-6 и DeepSeek в таблицу на странице запуска Haiku.
Вместо ручного редактирования отдельных HTML-элементов через пользовательский интерфейс модель открыла консоль браузера и внесла изменения с помощью скрипта.

Такое поведение полезно, поскольку агентам, работающим с компьютером, не всегда нужно буквально имитировать движения человеческой мыши.
Если среда браузера предоставляет более прямой путь выполнения, использование скрипта может быть быстрее и надежнее, чем нажатие на каждую ячейку.
Haiku 5.5 — первая модель класса Haiku с регулируемым уровнем усилий.
Модель поддерживает диапазон от более дешевого и быстрого поведения до более дорогого и обстоятельного рассуждения.
График запуска Anthropic показывает четкую зависимость точности от стоимости в OSWorld.

В исходном материале выделены две точки этой кривой:
Точная стоимость производственной задачи будет зависеть от длины промпта, длины вывода, кэширования и использования инструментов, но общая закономерность важна.
Теперь Haiku можно настраивать под конкретную задачу, а не воспринимать «небольшую модель» как один фиксированный уровень возможностей.
GDPval-AA v2.1 измеряет качество выполнения реальных профессиональных задач в 44 профессиях.

При максимальном уровне усилий Anthropic сообщает рейтинг Elo 1620 для Haiku 5.5 по сравнению с 735 для Haiku 4.5.
Sonnet 5.5 по-прежнему сильнее, однако разрыв между «небольшой» и «полезной для профессиональной работы» моделью резко сократился.
Haiku 5.5 использует новый токенизатор, общий для более новых поколений Claude.
Это важно, поскольку один и тот же текст теперь не обязательно преобразуется в такое же количество токенов, как в Haiku 4.5.
В руководстве Anthropic по миграции говорится, что один и тот же входной текст создает примерно на 30% больше токенов в Haiku 5.5, чем в Haiku 4.5, хотя точное увеличение зависит от содержимого.
Влияние может быть больше или меньше в зависимости от рабочей нагрузки; особенно важно повторно измерить код, таблицы и тексты не на английском языке.
Поэтому такое сравнение слишком упрощает ситуацию:
Старая цена ввода: $1.00
Новая цена ввода: $0.10
Следовательно, каждая задача стала ровно на 90% дешевле
Более корректный расчет выглядит так:
фактическая стоимость задачи
= новое количество токенов
× новая цена токенов
+ стоимость кэша
+ стоимость вывода
+ стоимость инструментов
Сама Anthropic заявляет, что с учетом изменений токенизатора Haiku 5.5 в среднем обходится примерно на 75% дешевле, чем Haiku 4.5, а не дает универсального снижения на 90% для каждой задачи.
Artificial Analysis также показывает, почему эффективность токенов важна при сравнении недорогих моделей.

Модель может иметь низкую цену токенов и при этом использовать гораздо больше выходных токенов для завершения задачи.
Для производственных систем стоимость завершенной задачи полезнее, чем одна только цена за миллион токенов.
В исходной статье этот момент сформулирован ясно: «маленькая чашка» все еще остается маленькой чашкой.
Haiku 5.5 значительно сильнее Haiku 4.5, однако сложное автономное программирование по-прежнему остается задачей для более крупной модели.
Terminal-Bench 4.0 показывает разрыв:
Haiku 5.5: 39.2%
Sonnet 5.5: 70.6%
Anthropic прямо рекомендует Sonnet 5.5 или Opus 5.5 для сложного агентского программирования.
Haiku 5.5 лучше подходит для задач, которые уже имеют четкие границы:
Cognition уже использует такую структуру в Devin Fusion.
На странице запуска говорится, что Opus 5.5 может выступать в роли ведущей модели, а Haiku 5.5 — работать как помощник.
В заявленном Cognition сценарии такая комбинация достигла результата 66.2 по FrontierCode, одновременно снизив стоимость и задержки.

Схема проста:
Opus / Sonnet
→ планирование, декомпозиция, сложные решения
Haiku 5.5
→ узкие подзадачи, параллельное выполнение, быстрый поиск, суммаризация
Вероятно, это более реалистичный способ использовать Haiku 5.5, чем пытаться заменить ею более крупную модель во всех сценариях.
Если приложение уже использует Haiku 4.5, Anthropic предупреждает, что несколько изменений могут нарушить работу существующих запросов.
Официальный идентификатор модели теперь:
claude-haiku-5-5
Однако миграция включает несколько дополнительных требований.
Такой запрос Haiku 4.5 больше недействителен:
{
"thinking": {
"type": "enabled",
"budget_tokens": 8000
}
}
Опишите идею одной фразой, и We0 AI создаст сайт-витрину, страницы и CMS, а после запуска поможет привлечь клиентов и трафик.
Одна полная генерация проекта для бесплатной регистрации
Лучше всего попробовать один полный поток генерации и быстро увидеть первый черновик проекта.
Haiku 5.5 вместо этого использует адаптивное рассуждение и настройки уровня усилий:
{
"thinking": {
"type": "adaptive"
},
"output_config": {
"effort": "medium"
}
}
Запрос со старым форматом budget_tokens возвращает ошибку 400.
Адаптивное рассуждение также включено по умолчанию, поэтому приложениям не следует считать, что первый блок содержимого ответа всегда является обычным текстом ответа.
Обрабатывайте блоки по полю type.
max_tokensПоскольку новый токенизатор считает один и тот же текст как большее количество токенов, старые значения max_tokens могут больше не оставлять достаточно места для эквивалентного вывода.
Токены рассуждений также учитываются в бюджете вывода.
Пересчитайте промпты с использованием claude-haiku-5-5, а не переносите оценки количества токенов Haiku 4.5.
Haiku 5.5 больше не поддерживает произвольные настройки сэмплирования так, как это делала Haiku 4.5.
Anthropic рекомендует исключить:
temperature
top_p
top_k
Нестандартные значения могут приводить к ошибкам 400, а top_k не поддерживается.
Приложениям, которые использовали параметры сэмплирования для создания вариативных результатов, следует перенести этот контроль в промптинг или другую стратегию на уровне приложения.
Haiku 4.5 могла в некоторых конфигурациях продолжать ответ после финального сообщения ассистента.
Haiku 5.5 отклоняет предварительное заполнение сообщения ассистента.
Если раньше вы использовали префикс, например:
{"result":
для принудительной генерации JSON, перейдите на структурированные ответы или схему инструмента.
Для интеграций Claude API и Google Cloud старое объявление работы с компьютером:
computer_20250124
необходимо заменить на:
computer_toolset_20260801
Новый набор инструментов использует другую структуру событий, поэтому цикл агента должен корректно обрабатывать возвращаемые блоки использования инструментов и сохранять toolset_name в результатах.
Haiku 5.5 также поддерживает набор инструментов Anthropic для работы с браузером на поддерживаемых платформах.
Перед развертыванием Haiku 5.5 проверьте как минимум следующие пункты:
claude-haiku-5-5.budget_tokens на адаптивное рассуждение и настройку уровня усилий.type, а не исходите из предположения, что нулевой блок содержит текст ответа.computer_toolset_20260801.refusal.Anthropic также предоставляет автоматизированную команду миграции Claude Code:
/claude-api migrate this project to claude-haiku-5-5
Инструмент может применить изменения идентификатора модели и обнаружить несколько несовместимых шаблонов запросов, однако ручная проверка по-прежнему рекомендуется.
Haiku 5.5 была не единственным ценовым изменением, о котором объявила Anthropic.
Цена чтения кэша Sonnet 5.5 снизилась с:
$0.20 / 1 млн токенов
до:
$0.10 / 1 млн токенов
Anthropic заявляет, что чтение кэша составляет значительную долю потребления токенов во многих агентских рабочих процессах, поэтому это изменение снижает стоимость большинства агентских задач Sonnet 5.5 примерно на 20%.

Это делает смешанную архитектуру моделей более привлекательной:
Sonnet 5.5
→ планирование и более сложное выполнение
Haiku 5.5
→ недорогие высокообъемные подзадачи
Anthropic также ввела ежемесячные кредиты Claude Platform для соответствующих требованиям подписчиков Max и Team.
Текущие официальные суммы кредитов:
| План | Ежемесячный кредит API |
|---|---|
| Max 5x | $100 |
| Max 20x | $200 |
| Team Standard seat | $20 за место |
| Team Premium seat | $100 за место |
| Максимум общего пула Team | $500 |

Кредиты можно использовать для рабочих нагрузок Claude Platform, таких как:
Они не увеличивают лимиты использования подписок Claude или Claude Code и не покрывают обычные интерактивные сессии Claude Code, если такие сессии оплачиваются через тарифный план подписки.
Кредиты привязаны к одной организации Claude Console и не переносятся бессрочно.
Исходная статья завершается более легким сравнением.
Пока Anthropic объявила о более дешевых моделях, более дешевом чтении кэша Sonnet и ежемесячных кредитах API, руководитель направлений Codex и ChatGPT Work в OpenAI Тибо Соттё объявил о еще одном накопительном сбросе лимита для платных аккаунтов, одновременно отметив 40 млн активных пользователей Codex и ChatGPT Work.

Накопительный сброс отличается от постоянного снижения цены.
Это дополнительный сброс лимита использования, который соответствующие требованиям пользователи могут сохранить и активировать позднее, а не изменение постоянной цены токенов модели.
Поэтому сравнение носит скорее риторический, чем технический характер:
Запуск Anthropic:
новая небольшая модель + более низкая цена чтения кэша + ежемесячные кредиты API
Обновление OpenAI:
дополнительный накопительный сброс лимита использования для платных аккаунтов Codex / Work
Обе компании пытаются предоставить активным пользователям больше возможностей для экспериментов, но используют разные механизмы.
Запуск сделал Haiku гораздо полезнее, однако оптимальная роль модели остается достаточно понятной.
Используйте Haiku 5.5 для:
Для следующих задач предпочтительнее более крупная модель Claude:
Самая дешевая модель не всегда является самым дешевым способом завершить работу.
Для производственных систем измеряйте:
стоимость успешного выполнения задачи
=
ввод + кэш + вывод + использование инструментов + повторные попытки + ошибки
Этот показатель расскажет больше, чем заявленная цена ввода модели.
Claude Haiku 5.5 — это последняя небольшая модель Anthropic, выпущенная для высокообъемных, чувствительных к стоимости и задержке рабочих нагрузок. Это также первая модель Haiku с регулируемым уровнем усилий; она значительно превосходит Haiku 4.5 в оценках программирования, работы с компьютером и профессиональных задач.
Для промптов объемом до 100 тыс. токенов стоимость составляет $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов. Для промптов объемом более 100 тыс. токенов тарифы повышаются до $0.50 за вход и $2.50 за вывод на миллион токенов; для чтения и записи кэша действуют отдельные цены.
Для стандартной цены токенов при коротком контексте заявленные тарифы за ввод, кэшированный ввод, запись в кэш и вывод практически совпадают. Цена Haiku 5.5 увеличивается после порога в 100 тыс. токенов промпта, поэтому рабочие нагрузки с длинным контекстом следует сравнивать отдельно.
Нет. Собственные результаты Anthropic в Terminal-Bench 4.0 показывают 70.6% у Sonnet 5.5 против 39.2% у Haiku 5.5. Haiku лучше подходит для узких, повторяемых и высокообъемных задач, а также для работы субагентов, тогда как Sonnet и Opus остаются более подходящими для сложного автономного программирования.
Haiku 5.5 использует новый токенизатор. В руководстве Anthropic по миграции говорится, что один и тот же текст в среднем создает примерно на 30% больше токенов, чем в Haiku 4.5, хотя точное увеличение зависит от содержимого.
Да. Среди важных изменений — адаптивное рассуждение вместо ручного budget_tokens, обновленное поведение параметров сэмплирования, удаление предварительного заполнения сообщения ассистента, новый набор инструментов для работы с компьютером и необходимость обрабатывать блоки ответа по полю type. Anthropic предоставляет официальное руководство по миграции и команду миграции Claude Code.
В Claude API идентификатор модели — claude-haiku-5-5. Anthropic также документирует соответствующие идентификаторы для Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform в AWS.
Соответствующие требованиям подписчики Max и Team могут получить ежемесячные кредиты Claude Platform. Max 5x получает $100, Max 20x — $200, а кредиты Team рассчитываются по типу места и объединяются в общий пул объемом до $500 в месяц.
Claude Haiku 5.5 — крупное обновление небольшой линейки моделей Anthropic. Она с большим отрывом превосходит Haiku 4.5 в работе с компьютером, профессиональных задачах, программировании и рассуждении, одновременно совпадая с заявленными ценами API GPT-6 Luna для короткого контекста и превосходя Luna в нескольких опубликованных Anthropic сравнениях бенчмарков.
Снижение цены действительно существенно, однако производственным командам не следует игнорировать новый токенизатор или ценовой порог в 100 тыс. токенов промпта. Один и тот же текст может потреблять примерно на 30% больше токенов, чем в Haiku 4.5, а для длинных промптов применяется более высокий тариф.
Миграция также включает реальные несовместимые изменения: адаптивное рассуждение заменяет ручные бюджеты рассуждений, пользовательские настройки сэмплирования ограничены, предварительное заполнение сообщения ассистента удалено, а интеграции работы с компьютером требуют нового набора инструментов. Существующим приложениям на Haiku 4.5 следует использовать руководство по миграции, а не ограничиваться изменением названия модели.
Haiku 5.5 лучше всего понимать как быструю и недорогую модель выполнения для масштабирования и субагентов, а не как универсальную замену Sonnet или Opus в сложных задачах с долгим горизонтом планирования.
Начните с одной фразы и получите полноценный сайт за считанные минуты.