Китайская нейросеть Qwen3-235B-A22B обошла Claude и Kimi в тестах интеллекта

Она показала рекордные результаты в логике, математике и генерации текста. Новая модель от Alibaba Cloud обучена на 36 триллионах токенов, поддерживает 119 языков и способна обрабатывать до 256 000 токенов контекста.
Китайская нейросеть Qwen3-235B-A22B обошла Claude и Kimi в тестах интеллекта

21 июля 2025 года компания Alibaba Cloud представила усовершенствованную модель искусственного интеллекта Qwen3-235B-A22B — и сразу же вызвала оживлённые обсуждения в профессиональном сообществе. По словам разработчиков, новая версия, получившая название Qwen3-235B-A22B-Instruct-2507 , обошла ведущие западные аналоги — Claude 4 Opus и Kimi K2 — в ряде ключевых бенчмарков.

Модель доступна на  Hugging Face  и  ModelScope , а также имеет демоверсию на  Hugging Face Spaces . Поддержка SGLang и vLLM упрощает интеграцию в собственные проекты. Пользователи отмечают: Qwen3 демонстрирует высокую точность при генерации текста, решении математических задач и написании кода, причём работает в режиме без рассуждений, что особенно ценно в задачах на скорость.

Победа в цифрах

Бенчмарк

В сравнении с конкурентами Qwen3 показала убедительное преимущество в тестах, направленных на логику и точность. Так, в SuperGPQA она набрала 62,6%, тогда как Claude 4 — 56,5%, а Kimi K2 — 57,2%. В других бенчмарках модель также уверенно вошла в лидеры:

Тест Claude 4 Opus Kimi K2 Qwen3-235B-A22B
MMLU-Pro 86,6 81,1 83,0
MMLU-Redux 94,2 92,7 93,1
SuperGPQA 56,5 57,2 62,6
SimpleQA 22,8 31,0 54,3
AIME25 33,9 49,5 70,3
ARC-AGI 30,3 13,3 41,8

К слову, даже такие сложные тесты, как AIME25, сдаются новой китайской модели с заметным перевесом.

Глобальный масштаб

Разработчики подчёркивают: Qwen3 обучалась на массиве из 36 триллионов токенов — это огромный корпус текстов на 119 языках и диалектах, включая русский. Кроме того, модель способна обрабатывать до 256 000 токенов контекста, что позволяет анализировать тексты объёмом в целую книгу — например, «Гарри Поттер и Кубок огня» или дважды «Мастер и Маргарита».

Реакция сообщества

Пользователи уже делятся первыми впечатлениями. Один из разработчиков пишет: «Qwen3 работает лучше некоторых закрытых моделей — и при этом остаётся открытой и доступной». Модель можно протестировать через демоверсию на Hugging Face Spaces или интегрировать с помощью SGLang и vLLM.

Почему это важно

Релиз Qwen3-235B-A22B — не просто очередной апдейт. Это сигнал о том, что китайские технологии ИИ догоняют (а порой и перегоняют) западные решения. Особенно это актуально для русскоязычных пользователей: модель отлично справляется с кириллицей, доступна в открытом виде и показывает высокую производительность. Возможности для образования, науки и бизнеса — почти безграничны.

08:50
674
Нет комментариев. Ваш будет первым!