Anthropic выпустила Claude Haiku 5.5 и в десять раз снизила цену младшей модели
Claude Haiku 5.5 закрывает обновление линейки, которое Anthropic начала 22 сентября с Opus 5.5 и продолжила 28 сентября выпуском Sonnet 5.5 . Компания называет новинку самой дешёвой, быстрой и способной из своих малых моделей и прямо говорит, для чего она нужна. Это массовая работа, где важны скорость и счёт за токены. Релиз состоялся 7 октября, модель доступна сразу везде.
Haiku 5.5 как помощник старших моделей
Самый показательный сценарий для Claude Haiku 5.5 — работа в паре со старшими моделями. Opus 5.5 или Sonnet 5.5 ведут сложную задачу и раздают мелкие поручения Haiku: найти нужный кусок данных, ужать длинную переписку, разложить записи по категориям. Такие помощники называются субагентами, и от их скорости зависит, как долго пользователь ждёт итогового ответа.
Партнёры Anthropic уже собирают такие связки. Cognition поставила Haiku 5.5 младшим напарником к Opus 5.5 в Devin CLI и сохранила высокий результат на тесте FrontierCode при меньших затратах и задержках. Финансовая платформа Rogo отдаёт Haiku извлечение данных из годовых отчётов компаний, а Asana насчитала больше 30% сокращения времени на выполнение задач и до 2,5 раза более быстрый ответ на каждом шаге агента.
«В ранних тестах Claude Haiku 5.5 набрала на 11 пунктов больше, чем Haiku 4.5, примерно при вдвое меньшей задержке»,
- рассказала Яшодха Бхавнани, вице-президент Box по ИИ-продуктам.
Кроме субагентов Anthropic называет поддержку клиентов в реальном времени, работу в браузере, краткие пересказы, запросы к базам данных и классификацию.
Сколько стоит Claude Haiku 5.5
У Claude Haiku 5.5 две ставки, и граница проходит по длине запроса в 100 тысяч токенов. Цены за миллион токенов выглядят так:
- вход — 0,10 доллара для запросов до 100 тысяч токенов и 0,50 доллара для более длинных (у Haiku 4.5 было 1 доллар);
- выход — 0,50 и 2,50 доллара (у Haiku 4.5 — 5 долларов);
- запись в кэш — 0,125 и 0,625 доллара;
- чтение из кэша — 0,01 и 0,05 доллара.
Для коротких запросов Haiku 5.5 дешевле предшественницы на 90%, для длинных — вдвое. Anthropic уточняет, что около 90% обращений к Haiku 4.5 укладывались в первый диапазон. Пакетная обработка, как и раньше, срезает счёт ещё наполовину.
Средняя экономия, которую обещает компания, скромнее — около 75%. Здесь нужно оговориться. Haiku 5.5 получила обновлённый токенизатор, тот же, что у Sonnet 5.5 и Opus 5.5, и тратит на ту же задачу немного больше токенов. Часть выигрыша в цене съедает именно он.
Впервые в классе Haiku появилась настройка уровня усилий. Пять ступеней от Low до Max позволяют самому решать, сколько модель думает над ответом и сколько за это платить.
GPT-6 Luna по той же цене проигрывает
Ставки 0,10 и 0,50 доллара выбраны неслучайно. Ровно столько стоит GPT-6 Luna, младшая модель OpenAI , вышедшая 22 сентября, и Anthropic сравнивает Haiku 5.5 именно с ней. Результаты по ключевым тестам:
- GDPval-AA v2.1 (офисная работа со знаниями) — 1620 баллов Elo против 1437 у Luna и 735 у Haiku 4.5;
- OSWorld 2.1 (управление компьютером) — 72,4% против 48,9% у Luna и 15,7% у Haiku 4.5;
- Terminal-Bench 4.0 (программирование в терминале) — 39,2% против 16,4% у Luna и нуля у Haiku 4.5;
- Chartography (чтение графиков без инструментов) — 46,4% против 29,1% у Luna и 6,4% у Haiku 4.5;
- FrontierCode 1.1 (агентное программирование) — 46,4% против 42,4% у Luna.
Во всех строках таблицы Claude Haiku 5.5 уступает Sonnet 5.5. Сильнее всего разрыв в сложном коде — 39,2% против 70,6% на Terminal-Bench. Anthropic сама советует оставлять такие задачи Sonnet и Opus, а Haiku брать на узкие поручения. На Humanity's Last Exam, наборе экспертных вопросов из разных наук, Haiku 5.5 набрала 45,9% без инструментов и 57,4% с ними, у Haiku 4.5 было 10,2% и 18,7%.
Где доступна Claude Haiku 5.5
В приложениях Claude модель можно выбрать на всех тарифах, от бесплатного до Enterprise, в веб-версии и на iOS и Android. Разработчикам Haiku 5.5 доступна в API под именем claude-haiku-5-5, а также через Amazon Web Services, Google Cloud и Microsoft Azure. В тот же день модель появилась в GitHub Copilot на платных тарифах, раскатка идёт постепенно.
Вместе с релизом Anthropic добавила в SDK для Python и TypeScript поддержку управления компьютером и браузером в статусе бета-версии. Для Haiku с её 72,4% на OSWorld это логичная пара.
Фильтры по кибербезопасности у Haiku 5.5 строже, чем у Haiku 4.5, но мягче, чем у Sonnet 5.5. Модель помогает с широким кругом защитных задач и отказывает в тестах на проникновение и приёмах, которые чаще используют атакующие.
Sonnet 5.5 подешевел в тот же день
Релиз Haiku сопровождают ещё две экономические новости. Чтение из кэша у Sonnet 5.5 подешевело вдвое, с 0,20 до 0,10 доллара за миллион токенов, и Anthropic оценивает снижение стоимости большинства агентных задач на Sonnet примерно в 20%.
Подписчикам Claude Max и Team начисляют ежемесячные кредиты на API. Тариф Max 5x получает 100 долларов, Max 20x — 200 долларов, команды — до 500 долларов на всех участников. Кредиты раскатываются в течение недели и тратятся на любую модель.
Массовые задачи сайта на Haiku 5.5
Владельцам сайтов Claude Haiku 5.5 стоит проверить на рутине, которая считается тысячами штук. Это краткие описания товаров, сортировка заявок и отзывов, выжимки из длинных текстов. Разумно держать запросы короче 100 тысяч токенов, начинать с низкого уровня усилий и поднимать его только там, где качество не устраивает. Если такие задачи сейчас крутятся на Sonnet, разница в счёте будет двадцатикратной.
Ценовая война младших моделей дошла до паритета
Anthropic понадобилось 15 дней, чтобы ответить на GPT-6 Luna ценой копейка в копейку. При равной ставке спор переходит в качество, и по опубликованным тестам Haiku 5.5 его выигрывает с заметным запасом. Сравнение пока построено на цифрах самой Anthropic. Главной проверкой станут независимые замеры и то, насколько часто токенизатор будет съедать обещанные 90% экономии в реальной работе.