Anthropic представила новую компактную модель для задач, где важны скорость и стоимость: обработки документов, классификации, работы с базами данных и поддержки клиентов. Контекстное окно выросло с 200 тысяч до 1 миллиона токенов, максимальный ответ — с 64 до 128 тысяч.
Haiku 5.5 также получила адаптивное рассуждение и настройку effort, которая регулирует объём вычислений в зависимости от задачи. Детали в материале Postium.
Читайте также: 5 лучших нейросетей для работы
Нейросеть Claude Haiku 5.5 — что умеет и как работает
Haiku 5.5 можно использовать как субагента вместе с Opus 5.5 и Sonnet 5.5. Например, поручить ей поиск нужных данных в документе, пока старшая модель решает основную задачу.
Адаптивное рассуждение включено по умолчанию. Параметр effort позволяет выбирать между меньшими затратами и более тщательной обработкой задачи. При низком уровне модель может вообще не запускать отдельное рассуждение, если запрос простой.
Для агентных задач Haiku 5.5 поддерживает управление компьютером. Также можно подключить browser use через API и использовать модель для действий в браузере.
Anthropic называет Haiku 5.5 своей самой быстрой моделью. В оценках компании на офлайн-части OSWorld 2.1, где агент выполняет задания на компьютере, Haiku 5.5 получила 72,4% против 15,7% у Haiku 4.5. На Humanity’s Last Exam без инструментов результат вырос с 10,2% до 45,9%. В Terminal-Bench 4.0 модель набрала 39,2% против 0% у предыдущего поколения.

Как пользоваться
Haiku 5.5 доступна пользователям Claude на тарифах Free, Pro, Max, Team и Enterprise, в Claude Code и через API. Модель также доступна через AWS, Google Cloud и Microsoft Foundry.

Для запросов через API до 100 тысяч токенов миллион входных токенов стоит $0,10 (≈9 ₽), выходных — $0,50 (≈43 ₽). Это на 90% ниже расценок Haiku 4.5. При запросах длиннее 100 тысяч токенов ставки увеличиваются до $0,50 за миллион входных и $2,50 за миллион выходных токенов.
Почему это важно? Haiku 5.5 заметно выросла по бенчмаркам, стала быстрее, получила управление глубиной рассуждений, а цена при этом снизилась.
Ранее Anthropic выпустила Claude Opus 5.5, которая также стала быстрее и дешевле предыдущей версии, а 30 сентября компания представила Sonnet 5.5, которая генерирует ответы более чем на 30% быстрее Sonnet 5 и расходует меньше токенов на те же задачи.