Темы



Представляем Claude Haiku 5.5

Коротко сгенерировано ИИ по тексту статьи
  • 7 октября 2026 года Anthropic представила Claude Haiku 5.5 — свою самую быструю на сегодня модель; её использование в среднем на 75% дешевле Haiku 4.5.
  • Модель поддерживает настраиваемый уровень усилий и рассчитана на массовые задачи, включая сводки, классификацию и работу субагентов.
  • Haiku 5.5 доступна на Claude, AWS, Google Cloud и Microsoft Azure; идентификатор модели — claude-haiku-5-5.

Почему это важно: Она предназначена для задач с большим объёмом операций и жёсткими требованиями к стоимости.

89e9b0fbfe0181f6ca565d913686ce8e49b5e9c2-1200x630.jpg
  1. Введение
  2. Производительность
  3. Стоимость
  4. Безопасность
  5. Доступность
  6. Дальнейшие обновления

7 октября 2026 года

  1. (1)Производительность
  2. (2)Стоимость
  3. (3)Безопасность
  4. (4)Дальнейшие обновления
  5. Идентификатор моделиСкопированоclaude-haiku-5-5
Пропустить вступлениеПрокрутить вниз

Представляем Claude Haiku 5.5 — самую дешёвую, быструю и мощную малую модель из всех, что мы выпускали.

Claude Haiku 5.5 создана для задач с большим объёмом операций и жёсткими требованиями к стоимости. Она надёжно справляется с быстрыми и повторяющимися задачами — например, с подготовкой сводок, сжатием контекста, запросами к базам данных и классификацией. При работе с кодом она хорошо дополняет Opus 5.5 и Sonnet 5.5 в роли субагента. Кроме того, это наша самая быстрая на сегодняшний день модель, поэтому она особенно хорошо подходит для задач, где важна скорость, например для поддержки клиентов в реальном времени и работы в браузере.¹

Haiku 5.5 стоит значительно дешевле Haiku 4.5. В среднем её использование теперь обходится примерно на 75% дешевле.²

Вместе с этим запуском мы повышаем ценность всей линейки наших моделей. Мы вдвое снижаем стоимость чтения из кэша для Claude Sonnet 5.5, благодаря чему её использование в большинстве агентных задач теперь обходится примерно на 20% дешевле. Кроме того, мы вводим ежемесячный кредит на использование API для подписчиков Claude Max и Team, чтобы помочь им создавать новых агентов и приложения, работающие на платформе Claude.

Производительность

Вот как Claude Haiku 5.5 показывает себя в различных тестах:

Haiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5Для сравнения
Работа со знаниямиGDPval-AA v2.1
Работа со знаниямиGDPval-AA v2.1162073514371840
Работа со знаниямиAA-Briefcase v1.1
Работа со знаниямиAA-Briefcase v1.1157861413361824
Работа с компьютеромOSWorld 2.1
Работа с компьютеромOSWorld 2.172,4%Офлайн-подвыборка15,7%Офлайн-подвыборка48,9%Офлайн-подвыборка83,9%Офлайн-подвыборка
Междисциплинарные рассужденияHumanity«s Last Exam
Междисциплинарные рассужденияHumanity«s Last Exam45,9%без инструментов10,2%без инструментов—56,9%без инструментов
57,4%с инструментами18,7%с инструментами—64,5%с инструментами
Агентное программированиеTerminal-Bench 4.0
Агентное программированиеTerminal-Bench 4.039,2%0,0%16,4%70,6%
Агентное программированиеFrontierCode 1.1 (Main)
Агентное программированиеFrontierCode 1.1 (Main)46,4%—42,4%52,1%Xhigh
Визуальные рассужденияChartography
Визуальные рассужденияChartography46,4%без инструментов6,4%без инструментов29,1%без инструментов61,6%без инструментов

Подробнее о том, как мы проводим оценку, читайте в системной карточке Haiku 5.5.

Haiku 5.5 — первая модель класса Haiku с настраиваемым уровнем усилий. Это означает, что, как и в случае с другими нашими моделями, пользователи могут выбирать, что для них важнее — стоимость или интеллектуальные возможности. На графиках ниже показаны результаты Haiku 5.5 в трёх тестах при каждом уровне усилий:

Работа с компьютером: OSWorldРабота со знаниями: GDPval-AAМеждисциплинарные рассуждения: Humanity«s Last Exam
Работа с компьютером: OSWorldРабота со знаниями: GDPval-AAМеждисциплинарные рассуждения: Humanity«s Last Exam
OSWorld 2.1 (офлайн-подмножество)Точность и стоимость
  • Haiku 5.5
  • Haiku 4.5
  • Sonnet 5.5
  • GPT-6 Luna
0102030405060708090Результат с частичным начислением баллов (%)0.050.100.200.50125Стоимость одной попытки (долл. США, логарифмическая шкала)НизкийСреднийВысокийОчень высокийМаксимум

OSWorld 2.1 оценивает, насколько хорошо агенты умеют работать с реальным компьютером, чтобы выполнять длительные многоэтапные задачи.

GDPval-AA v2.1Точность и стоимость
  • Haiku 5.5
  • Haiku 4.5
  • Sonnet 5.5
  • GPT-6 Luna
8001000120014001600180020000Рейтинг Elo, согласно опубликованным данным0.0050.010.020.050.100.200.50125Стоимость задачи (долл. США, логарифмическая шкала)НизкийСреднийВысокийОчень высокийМаксимум

GDPval-AA v2.1 от Artificial Analysis оценивает агентов на примере реальных профессиональных задач в 44 профессиях.

Последний экзамен человечества (без инструментов)Точность и стоимость
  • Haiku 5.5
  • Haiku 4.5
  • Sonnet 5.5
010203040506070Оценка (%)0.0050.010.020.050.100.200.501Стоимость одной попытки (USD, логарифмическая шкала)НизкаяСредняяВысокаяОчень высокаяМаксимальная

Humanity«s Last Exam (HLE) — тест на знания и аналитические способности экспертного уровня.

По результатам первых испытаний наши клиенты сообщили о показателях, соответствующих приведённым выше улучшениям производительности и стоимости. Вот что они рассказали о новой модели:

AsanaHubSpotAlphaSenseBoxRogoCognition
AsanaHubSpotAlphaSenseBoxRogoCognition
Цитата

«Мы под большим впечатлением от Claude Haiku 5.5, особенно от его скорости. Мы проверили его на нашем наборе тестов для AI Teammates — нашего продукта с ИИ-агентами, охватывающего такие сценарии, как сортировка ошибок, настройка проектов и поиск по крупным портфелям с целью выявления задач с высоким риском или просроченных задач. По сравнению с моделью, которую мы используем сейчас, выполнение задач стало более чем на 30% быстрее, а инференс за один ход агента — до 2,5 раза быстрее. Разница в скорости заметна».

КомпанияAsana
АвторАарон Вин, ведущий инженер-программист
Цитата

«В HubSpot мы используем смоделированные порталы, чтобы оценивать новые модели на задачах CRM, например на подготовке отчётов по сделкам. В основном мы тестируем более компактные и эффективные модели, и Claude Haiku 5.5 показала наилучший результат из всех, что мы видели в этом наборе тестов: 92,8% в среднем по трём запускам. В рамках одной из задач по аудиту CRM модели должны выявлять устаревшие, но неоднозначные записи. Среди всех протестированных нами моделей Haiku 5.5 справилась с задачей быстрее всех, показала самый высокий процент верных срабатываний и самый низкий процент ложноположительных результатов».

КомпанияHubSpot
АвторЗеэв Клапоу, выдающийся инженер-программист
Цитата

«Ask in Document — один из самых затратных для нас продуктов: в рабочей среде он обрабатывает около 8 млн запросов в неделю. Он отвечает на очень конкретные вопросы по одному или нескольким документам. Мы выполнили 400 запросов, и Claude Haiku 5.5 показала статистически значимое улучшение по сравнению с Haiku 4.5: 0,84 против 0,76».

КомпанияAlphaSense
АвторДэниел Кампос, выдающийся инженер
Цитата

«Наши клиенты используют Box AI для работы с большими объёмами корпоративных материалов. При широком использовании важно контролировать эффективность и затраты, а также выбирать модель, наилучшим образом подходящую для конкретной задачи. По результатам первых испытаний Claude Haiku 5.5 набрала на 11 баллов больше, чем Haiku 4.5, при этом задержка была примерно вдвое меньше. Мы планируем использовать её для аналитической работы в больших масштабах — от отчётов о затратах до финансовых сводок и еженедельных регулярных обзоров».

КомпанияBox
АвторЯшодха Бхавнани, вице-президент по ИИ-продуктам
Цитата

«Claude Haiku 5.5 подходит для коротких и массовых задач, таких как быстрые поисковые запросы, субагенты и составление сводок. Пока более крупная модель готовит презентацию, субагент на базе Haiku 5.5 изучает форму 10-K и извлекает данные о выручке по сегментам, необходимые для презентации. Модели можно доверить эту задачу: она достаточно точна, а её скорость и низкая стоимость позволяют запускать её часто».

КомпанияRogo
АвторАлекс Ван, прикладной ИИ
Цитата

«Claude Haiku 5.5 стала отличным дополнением к линейке вспомогательных моделей Devin Fusion. С Haiku 5.5 в роли помощника Fusion сохраняет результат FrontierCode высшего уровня — 66,2, одновременно сокращая затраты и задержку. Попробовать её можно уже сегодня в Devin CLI, назначив Opus 5.5 ведущей моделью».

КомпанияCognition
АвторУолден Ян, сооснователь и директор по продукту

Стоимость

В таблице ниже показано, как цены на Claude Haiku 5.5 соотносятся с ценами на другие наши модели. Haiku 5.5 особенно выгодна при выполнении задач с промптами объёмом до 100 000 токенов — на них приходится около 90% запросов к нашей предыдущей модели Haiku.

Цена за 1 млн токеновHaiku 5.5
промпты до / свыше 100 тыс.
Haiku 4.5Sonnet 5.5
Чтение из кэша$0.01 / $0.05$0.10$0.10
Запись в кэш$0.125 / $0.625$1.25$2.50
Входные токены$0.10 / $0.50$1.00$2.00
Выходные токены$0.50 / $2.50$5.00$10.00

Безопасность

Соответствие принципам. По сравнению с Haiku 4.5 Claude Haiku 5.5 демонстрирует значительные улучшения почти по всем нашим оценкам соответствия принципам. В частности, мы обнаружили гораздо меньше случаев поведения, не соответствующего заданным принципам, и меньшую готовность содействовать злоупотреблениям. В системной карте модели подробнее описаны процесс оценки и её результаты.

Меры защиты. В соответствии с её возможностями меры защиты Haiku 5.5 в области кибербезопасности строже, чем у Haiku 4.5, но несколько мягче, чем меры, применённые нами к другим недавним моделям. В сфере кибербезопасности они допускают более широкий спектр защитных задач, чем меры для Sonnet 5.5, однако по-прежнему блокируют тестирование на проникновение и другие методы, которые с большей вероятностью могут использовать злоумышленники.

Меры биологической безопасности Haiku 5.5 такие же, как у Sonnet 5, Sonnet 5.5 и Opus 5. Они позволяют задавать вопросы по исследовательской биологии, но ограничивают доступ к запросам, которые, по нашей оценке, могут причинить вред. Организации, ведущие более широкую деятельность в области биологии и кибербезопасности, могут подать заявку в Программу верификации для наук о жизни и Программу верификации в сфере кибербезопасности.

Доступность

Claude Haiku 5.5 уже доступна на всех платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure. Разработчики могут начать работу с моделью на платформе Claude с помощью claude-haiku-5-5.

Подробности см. в нашем руководстве по миграции.

Дополнительные обновления

Одновременно с введением новых цен на Claude Haiku 5.5 мы продолжаем повышать ценность наших моделей и продуктов.

Во-первых, начиная с сегодняшнего дня, мы снижаем цену на чтение из кэша для Claude Sonnet 5.5. Теперь чтение из кэша стоит на 50% меньше: 0,10 доллара за миллион токенов вместо 0,20 доллара. Поскольку на чтение из кэша приходится значительная часть потребления токенов моделями, стоимость Sonnet 5.5 при выполнении большинства агентных задач снизится примерно на 20%.

Например, вот как снижение цены влияет на соотношение производительности и стоимости Sonnet 5.5 в тесте Terminal-Bench 4.0:

Terminal-Bench 4.0Точность и стоимость
  • Haiku 5.5
  • Haiku 4.5
  • Sonnet 5.5 (чтение кэша за $0.10)
  • Sonnet 5.5 (чтение кэша за $0.20)
010203040506070Баллы (pass@1, %)0.5012510Стоимость одной попытки (доллары США, логарифмическая шкала)НизкийСреднийВысокийОчень высокийМаксимальный

Terminal-Bench 4.0 оценивает, насколько хорошо модель справляется со сложными многоэтапными профессиональными задачами в командной строке.

Эта диаграмма показывает важное различие между Haiku 5.5 и нашими более крупными моделями. Sonnet 5.5 и Opus 5.5 по-прежнему лучше подходят для сложных задач агентного программирования, подобных тем, что оценивает Terminal-Bench 4.0. Haiku 5.5, напротив, лучше справляется с более узкими задачами, которые в предыдущих версиях Claude могли оказаться слишком дорогими, — например, с уплотнением контекста, суммированием или работой субагентов.

Во-вторых, на этой неделе мы начнём предоставлять всем подписчикам Max и Team ежемесячный кредит API для использования на платформе Claude. Пользователи Max 5x будут получать кредит на 100 долларов в месяц, пользователи Max 20x — 200 долларов, а подписчики Team — до 500 долларов на всех пользователей команды. Эти кредиты призваны помочь пользователям экспериментировать с созданием инструментов, приложений и агентов, использующих наш API. Их можно потратить на любую из наших моделей. Подробнее — в статье в нашем справочном центре.

Для разработчиков мы также обновляем SDK Claude для Python и TypeScript, добавляя в бета-версии поддержку управления компьютером и работы с браузером. Haiku 5.5 особенно хорошо подходит для этих задач благодаря сочетанию скорости, возможностей и цены. Подробнее — в документации платформы Claude.

Примечания

1 Claude Haiku 5.5 — наша самая быстрая модель при стандартной скорости работы каждой модели, хотя в Fast Mode она работает медленнее моделей Opus.

2 Claude Haiku 5.5 стоит на 90% дешевле Claude Haiku 4.5 для запросов объёмом до 100 000 токенов и на 50% дешевле для запросов свыше 100 000 токенов. У Haiku 4.5 90% запросов относились к первой категории. При расчёте также учитываются изменения в количестве токенов, необходимых Haiku 4.5 и Haiku 5.5 для выполнения одной и той же задачи: в Haiku 5.5 обновлён токенизатор, аналогичный токенизаторам Sonnet 5.5 и Opus 5.5, поэтому на каждую задачу расходуется немного больше токенов.

Полный текст статьи читайте на Anthropic

Об этом также пишут