Claude Haiku 5.5 для быстрых задач с большим объёмом запросов#
Claude Haiku 5.5 — самая быстрая на сегодняшний день модель компании и её самая мощная компактная модель. Это также самая недорогая из выпущенных компанией моделей.
Модель предназначена для задач, где важны и объём, и цена. Она справляется с частыми, чётко определёнными задачами, такими как суммаризация, сжатие, запросы к базам данных и классификация. В программировании Haiku 5.5 может работать как субагент вместе с Opus 5.5 или Sonnet 5.5. Благодаря высокой скорости модель подходит и для задач, чувствительных к задержкам, включая поддержку клиентов в реальном времени и взаимодействие с браузером.¹
В среднем запуск Haiku 5.5 обходится примерно на 75% дешевле, чем Haiku 4.5.²#
Запуск модели также сопровождается изменениями во всей линейке моделей. Теперь чтение кэша для Claude Sonnet 5.5 стоит вдвое дешевле, благодаря чему для большинства агентных задач модель обходится примерно на 20% дешевле. Кроме того, подписчики Claude Max и Team получают ежемесячный кредит на API для создания приложений и агентов на Claude Platform.
Результаты бенчмарков#
Ниже приведено сравнение Haiku 5.5 с Haiku 4.5, GPT-6 Luna и Sonnet 5.5, включённой для ориентира.
Работа со знаниями — GDPval-AA v2.1 Haiku 5.5: 1620 Haiku 4.5: 735 GPT-6 Luna: 1437 Sonnet 5.5: 1840

Работа со знаниями — AA-Briefcase v1.1 Haiku 5.5: 1578 Haiku 4.5: 614 GPT-6 Luna: 1336 Sonnet 5.5: 1824
Работа с компьютером — OSWorld 2.1 Haiku 5.5: 72.4% (автономная выборка) Haiku 4.5: 15.7% (автономная выборка) GPT-6 Luna: 48.9% (автономная выборка) Sonnet 5.5: 83.9% (автономная выборка)
Междисциплинарное рассуждение — Humanity’s Last Exam Haiku 5.5: 45.9% без инструментов; 57.4% с инструментами Haiku 4.5: 10.2% без инструментов; 18.7% с инструментами GPT-6 Luna: результат не указан — ни для режима без инструментов, ни для режима с инструментами Sonnet 5.5: 56.9% без инструментов; 64.5% с инструментами
Агентное программирование — Terminal-Bench 4.0 Haiku 5.5: 39.2% Haiku 4.5: 0.0% GPT-6 Luna: 16.4% Sonnet 5.5: 70.6%
Агентное программирование — FrontierCode 1.1 (Main) Haiku 5.5: 46.4% Haiku 4.5: результат не указан GPT-6 Luna: 42.4% Sonnet 5.5: 52.1% (Xhigh)
Визуальное рассуждение — Chartography Haiku 5.5: 46.4% без инструментов Haiku 4.5: 6.4% без инструментов GPT-6 Luna: 29.1% без инструментов Sonnet 5.5: 61.6% без инструментов
Подробности о методике оценки приведены в системной карте Haiku 5.5.
Настраиваемый уровень усилий и работа с компьютером#
Haiku 5.5 — первая модель семейства Haiku с настраиваемым уровнем усилий. Как и в других моделях компании, пользователи могут выбрать баланс между более низкой стоимостью и более высокими интеллектуальными возможностями. На сопроводительных графиках сравниваются результаты модели при разных уровнях усилий в трёх бенчмарках.

Один из показанных бенчмарков — OSWorld 2.1; на графике представлены точность и стоимость для автономной выборки. OSWorld 2.1 проверяет, способен ли агент работать на настоящем компьютере и выполнять длительные многоэтапные задачи.
Результаты первых испытаний у клиентов соответствовали заявленным улучшениям производительности и стоимости. В Asana поделились впечатлениями от Haiku 5.5:
«Мы очень впечатлены Claude Haiku 5.5, особенно её скоростью. Мы проверили модель на нашем наборе оценочных тестов для AI Teammates — нашего продукта с ИИ-агентами. В него входят такие сценарии, как сортировка ошибок по приоритету, настройка проектов и поиск по крупным портфелям задач, чтобы выявлять задачи с высоким риском или просроченные. По сравнению с используемой нами сейчас моделью, выполнение задач стало более чем на 30% менее задержанным, а инференс за один ход агента — до 2,5 раза быстрее. Взаимодействие стало заметно отзывчивее».
Заявление принадлежит Аарону Вину, ведущему инженеру-программисту в Asana.
Цены на Haiku 5.5#
Цены указаны за 1 миллион токенов. Для Haiku 5.5 действуют отдельные тарифы на запросы объёмом до 100 000 токенов и свыше этого лимита. Более дешёвый тариф особенно актуален, поскольку запросы объёмом до 100 000 токенов составляют около 90% запросов к предыдущей модели Haiku.

Чтение кэша Haiku 5.5, до 100 тыс. токенов: $0.01 Haiku 5.5, свыше 100 тыс. токенов: $0.05 Haiku 4.5: $0.10 Sonnet 5.5: $0.10
Запись в кэш Haiku 5.5, до 100 тыс. токенов: $0.125 Haiku 5.5, свыше 100 тыс. токенов: $0.625 Haiku 4.5: $1.25 Sonnet 5.5: $2.50
Входные токены Haiku 5.5, до 100 тыс. токенов: $0.10 Haiku 5.5, свыше 100 тыс. токенов: $0.50 Haiku 4.5: $1.00 Sonnet 5.5: $2.00
Выходные токены Haiku 5.5, до 100 тыс. токенов: $0.50 Haiku 5.5, свыше 100 тыс. токенов: $2.50 Haiku 4.5: $5.00 Sonnet 5.5: $10.00
Согласованность и защитные меры#
Почти по всем оценкам согласованности Haiku 5.5 значительно превосходит Haiku 4.5. Проверки выявили меньше случаев поведения, не соответствующего заданным принципам, и меньшую готовность содействовать злоупотреблениям. Дополнительная информация о процессе и результатах тестирования приведена в системной карте Haiku 5.5.
Защитные меры в сфере кибербезопасности в Haiku 5.5 строже, чем в Haiku 4.5, но не настолько ограничительны, как в некоторых других недавно выпущенных моделях. Они допускают более широкий спектр защитных действий в области кибербезопасности, чем меры в Sonnet 5.5, но по-прежнему блокируют тестирование на проникновение и другие методы, которые с большей вероятностью могут быть использованы злоумышленниками.
Для запросов, связанных с биологией, Haiku 5.5 применяет те же защитные меры, что и Sonnet 5, Sonnet 5.5 и Opus 5. Они позволяют задавать вопросы по биологии для исследовательских целей, ограничивая при этом запросы, которые могут привести к вреду. Организации, ведущие более масштабную работу в области биологии или кибербезопасности, могут подать заявку на участие в программе проверки для наук о жизни или программе проверки в сфере кибербезопасности.

Доступность и инструменты для разработчиков#
Claude Haiku 5.5 уже доступна на всех платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure. Разработчики, использующие Claude Platform, могут обращаться к модели по идентификатору claude-haiku-5-5. В руководстве по миграции приведены инструкции по переходу на новую модель.
Компания также обновляет SDK для Claude на Python и TypeScript, добавляя бета-поддержку работы с компьютером и браузером. Скорость, возможности и стоимость Haiku 5.5 делают её особенно подходящей для таких задач. Дополнительная информация приведена в документации Claude Platform.
Дополнительные изменения цен и API#
Снижение цены на чтение кэша для Sonnet 5.5 вступает в силу сегодня. Теперь чтение кэша стоит $0.10 за миллион токенов вместо $0.20. Поскольку во многих моделях на чтение кэша приходится значительная доля потребления токенов, это изменение снижает стоимость большинства агентных задач с Sonnet 5.5 примерно на 20%.
Изменение цены также влияет на соотношение стоимости и производительности в Terminal-Bench 4.0. Этот бенчмарк оценивает, насколько хорошо модель выполняет сложные многоэтапные профессиональные задачи в интерфейсе командной строки.
Результаты показывают, что модели подходят для разных задач. Sonnet 5.5 и Opus 5.5 остаются более эффективным выбором для сложных задач агентного программирования, подобных тем, что представлены в Terminal-Bench 4.0. Haiku 5.5 предназначена для более узкоспециализированных задач, которые могли быть слишком дорогими для предыдущих моделей Claude, включая сжатие, суммаризацию и работу субагентов.
На этой неделе всем подписчикам Claude Max и Team также начнут предоставлять новый ежемесячный кредит на API для использования на Claude Platform. Подписчики Max 5x будут получать $100 в месяц, а подписчики Max 20x — $200. Подписчики Team получат до $500 в месяц на всю команду. Эти кредиты помогут подписчикам экспериментировать с созданием инструментов, приложений и агентов, использующих API, и их можно будет потратить на любые модели компании. Дополнительная информация доступна в Справочном центре.












Комментарии0
Войдите, чтобы участвовать в обсуждении.
ВойтиКомментариев пока нет
Начните обсуждение — ваш комментарий будет первым.