Claude 3.7 Sonnet

Дата релиза:
Компания-разработчик:
Anthropic
Источник и документация:

Claude 3.7 Sonnet была представлена публике 24 февраля 2025 года, о чём Anthropic объявила через свои официальные каналы. Этот релиз последовал за Claude 3.5 Sonnet, который был выпущен в июне 2024 года, что демонстрирует стремительный темп разработки Anthropic в области ИИ. Запуск произошёл в рамках стратегии компании по улучшению моделей каждые несколько месяцев, с акцентом на баланс между интеллектом, скоростью и стоимостью.

Основные характеристики Claude 3.7 Sonnet

Гибридная модель рассуждений:

  • Claude 3.7 Sonnet — это первая модель Anthropic, которая объединяет в себе два режима работы: "стандартный" (быстрые ответы) и "расширенное мышление" (extended thinking). Пользователи могут выбирать между мгновенными ответами для простых задач и пошаговым, детализированным рассуждением для сложных проблем.

  • В отличие от других моделей, где быстрые ответы и глубокие рассуждения разделены между разными версиями, Claude 3.7 объединяет эти возможности в одной модели, что делает её универсальной

Расширенное мышление (Extended Thinking):

  • В режиме расширенного мышления модель способна анализировать задачи более тщательно, планировать решения и рассматривать несколько подходов перед выдачей ответа. Это особенно полезно для сложных задач, таких как программирование, научные вычисления или многоэтапные рабочие процессы.

  • Пользователи могут контролировать "бюджет мышления" (thinking budget), задавая лимит токенов, что позволяет балансировать между скоростью и глубиной анализа. Например, можно указать модели "думать" не более определённого количества токенов, вплоть до максимального предела в 128 тысяч токенов на вывод.

Улучшенные возможности программирования:

  • Claude 3.7 Sonnet считается лучшей моделью Anthropic для кодирования на момент выпуска. Она демонстрирует выдающиеся результаты в понимании контекста, решении творческих задач и создании кода.

  • На тесте SWE-bench Verified модель достигла 70,3% точности в стандартном режиме, что делает её лидером среди других моделей в задачах программирования. Это значительный скачок по сравнению с 49% у Claude 3.5 Sonnet.

Агентские способности:

  • Модель оптимизирована для выполнения "агентских" задач — тех, где требуется самостоятельное принятие решений, использование инструментов и адаптация к новым условиям. Например, она может эффективно управлять файлами, выполнять команды в терминале и адаптироваться к изменениям в процессе выполнения задачи.

  • Вместе с выпуском Claude 3.7 был представлен инструмент Claude Code — командная строка для агентского программирования, что усиливает её возможности в реальных проектах.

Длина вывода:

Claude 3.7 Sonnet поддерживает вывод до 128 тысяч токенов в режиме расширенного мышления (в бета-версии), что в 15 раз превышает предел предыдущих моделей Claude (8 192 токена). Это делает её идеальной для задач, требующих детальных объяснений, примеров или длинных текстов.

Скорость и стоимость:

  • В стандартном режиме модель работает быстрее, чем Claude 3.5 Sonnet, сохраняя при этом улучшенное качество ответов.

  • Стоимость осталась прежней: $3 за миллион входных токенов и $15 за миллион выходных токенов (включая токены, потраченные на "мышление").

Безопасность и надёжность:

  • Anthropic провела тщательное тестирование модели на безопасность и устойчивость к злоупотреблениям. Claude 3.7 Sonnet лучше различает вредоносные и безобидные запросы, что сократило количество ненужных отказов на 45% по сравнению с предыдущей версией.

  • Системная карта (system card), опубликованная Anthropic, подробно описывает результаты тестов безопасности, включая защиту от атак типа "prompt injection".

По сравнению с Claude 3.5 Sonnet:

  • Claude 3.7 превосходит предшественника по большинству бенчмарков, включая кодирование, сложные рассуждения и выполнение реальных задач.

  • Добавление режима расширенного мышления делает её более гибкой, тогда как Claude 3.5 был ограничен стандартным режимом.

  • Увеличенная длина вывода (до 128K токенов против 8K) и снижение отказов улучшают пользовательский опыт.

Доступность

  • Claude 3.7 Sonnet доступна на всех тарифных планах Claude (Free, Pro, Team, Enterprise), а также через API Anthropic, Amazon Bedrock и Google Cloud Vertex AI.

  • Режим расширенного мышления доступен на всех платформах, кроме бесплатного уровня.

Примеры использования

  • Программирование: создание кода, исправление ошибок, разработка документации.

  • Анализ данных: построение дашбордов, обработка больших объёмов информации.

  • Образование: пошаговое объяснение сложных концепций.

  • Игры: модель показала успех в прохождении Pokémon Red, демонстрируя способность планировать и адаптироваться.

Claude 3.7 Sonnet — это значительный шаг вперёд в развитии ИИ, сочетающий скорость, гибкость и мощные возможности рассуждений.

Бесплатно
  • EN
Claude может анализировать документы на сотни страниц, качественно писать код, понимать изображения и управлять компьютером
3.58K