Anthropic выпустила Claude Sonnet 5.5 с контекстом на 1 млн токенов и ускорением на 30%
Claude Sonnet 5.5 занимает среднюю позицию в новом семействе Anthropic . Opus 5.5 компания оставляет для сложных задач, где требуется длительная работа и больше самостоятельных решений, а Sonnet ориентирует на повседневное программирование, исправление ошибок, повторяемые агентские задачи и подготовку документов, презентаций и таблиц. Haiku 5.5 для массовых и чувствительных к цене сценариев Anthropic обещает выпустить в ближайшие недели.
Скорость выросла, цена за токены осталась прежней
Claude Sonnet 5.5 стоит $2 за 1 млн входных и $10 за 1 млн выходных токенов. Чтение кэша обходится в $0,20 за миллион токенов, пятиминутная запись - в $2,50. Эти расценки совпадают с Sonnet 5.
Экономию до 30% Anthropic связывает с тем, что новой модели обычно требуется меньше токенов для выполнения одной и той же задачи. Поэтому цифру стоит читать именно как оценку стоимости задачи в тестах компании, а не как снижение тарифа на API. Одновременно Anthropic заявляет об ускорении генерации более чем на 30%.
Пользователь может выбирать уровень усилий модели: low, medium, high, xhigh или max. В Claude Code по умолчанию установлен medium, а в Claude API - high. Чем выше значение, тем больше времени и токенов модель может тратить на проверку ответа.
Контекст на 1 млн токенов доступен без beta-заголовка
Контекстное окно Claude Sonnet 5.5 составляет 1 млн токенов и работает нативно. Максимальный обычный ответ ограничен 128 тыс. токенов, а через Message Batches API в бета-режиме лимит можно увеличить до 300 тыс. токенов. Данные для обучения и надёжный срез знаний модели заканчиваются июнем 2026 года.
Модель использует адаптивное рассуждение по умолчанию. Для разработчиков это одновременно новая возможность и причина внимательно читать руководство по миграции: прежнее отключение thinking через thinking: {"type": "disabled"} теперь возвращает ошибку. Anthropic предлагает режим between_tools, если рассуждение перед первым вызовом инструмента не требуется.
Переход с Sonnet 5 потребует изменений в API
Замены идентификатора модели недостаточно для всех существующих приложений. Anthropic перечисляет несколько несовместимых изменений: принудительный tool_choice типов any и tool больше не принимается, изменена работа блоков рассуждения, а Computer Use на Claude API и Google Cloud переведён на новый набор инструментов.
Есть и менее заметная ловушка. Текстовые обновления между вызовами инструментов теперь могут приходить внутри блоков thinking. Интерфейс, который ожидает обычный текст на каждом таком шаге, способен перестать показывать промежуточный прогресс без ошибки самого запроса. Для команд, которые просто меняют ID модели в продакшене, этот пункт потенциально важнее красивых цифр из бенчмарков.
Anthropic делает ставку на код и повторяемые задачи
В опубликованных Anthropic тестах Sonnet 5.5 набрала 70,6% на Terminal-Bench 4.0 против 10,3% у Sonnet 5. На CursorBench 4.0 результат составил 55,5% против 34,1%. В GDPval-AA модель почти сравнялась с Opus 5.5 по опубликованным баллам.
Такие сравнения полезны для оценки направления прогресса, но сами по себе не делают Sonnet заменой Opus. Anthropic прямо пишет, что Opus 5.5 остаётся сильнее на сложной открытой работе, где требуется длительное самостоятельное принятие решений. Для Sonnet компания выбрала более практичную нишу: задачи с понятным результатом, который можно проверить автоматически или человеком.
Claude Sonnet 5.5 уже доступна разработчикам
Модель доступна через Claude API под идентификатором claude-sonnet-5-5, а также в Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. В Claude Code алиас sonnet указывает на Sonnet 5.5 начиная с версии 2.1.284; модель там работает с контекстом 1 млн токенов и уровнем усилий medium по умолчанию.
Главный аргумент этого релиза находится не в одном рекордном бенчмарке. Anthropic пытается сократить разрыв между дорогой старшей моделью и массовой рабочей моделью: Sonnet 5.5 получила часть возможностей Opus, но должна оставаться удобнее для задач, которые запускаются сотни и тысячи раз. Проверять это имеет смысл по двум показателям - реальному расходу токенов и числу задач, которые модель завершает без повторного запуска.