Китайская нейросеть Qwen3-235B-A22B обошла Claude и Kimi в тестах интеллекта
21 июля 2025 года компания Alibaba Cloud представила усовершенствованную модель искусственного интеллекта Qwen3-235B-A22B — и сразу же вызвала оживлённые обсуждения в профессиональном сообществе. По словам разработчиков, новая версия, получившая название Qwen3-235B-A22B-Instruct-2507 , обошла ведущие западные аналоги — Claude 4 Opus и Kimi K2 — в ряде ключевых бенчмарков.
Модель доступна на Hugging Face и ModelScope , а также имеет демоверсию на Hugging Face Spaces . Поддержка SGLang и vLLM упрощает интеграцию в собственные проекты. Пользователи отмечают: Qwen3 демонстрирует высокую точность при генерации текста, решении математических задач и написании кода, причём работает в режиме без рассуждений, что особенно ценно в задачах на скорость.
Победа в цифрах
В сравнении с конкурентами Qwen3 показала убедительное преимущество в тестах, направленных на логику и точность. Так, в SuperGPQA она набрала 62,6%, тогда как Claude 4 — 56,5%, а Kimi K2 — 57,2%. В других бенчмарках модель также уверенно вошла в лидеры:
| Тест | Claude 4 Opus | Kimi K2 | Qwen3-235B-A22B |
|---|---|---|---|
| MMLU-Pro | 86,6 | 81,1 | 83,0 |
| MMLU-Redux | 94,2 | 92,7 | 93,1 |
| SuperGPQA | 56,5 | 57,2 | 62,6 |
| SimpleQA | 22,8 | 31,0 | 54,3 |
| AIME25 | 33,9 | 49,5 | 70,3 |
| ARC-AGI | 30,3 | 13,3 | 41,8 |
К слову, даже такие сложные тесты, как AIME25, сдаются новой китайской модели с заметным перевесом.
Глобальный масштаб
Разработчики подчёркивают: Qwen3 обучалась на массиве из 36 триллионов токенов — это огромный корпус текстов на 119 языках и диалектах, включая русский. Кроме того, модель способна обрабатывать до 256 000 токенов контекста, что позволяет анализировать тексты объёмом в целую книгу — например, «Гарри Поттер и Кубок огня» или дважды «Мастер и Маргарита».
Реакция сообщества
Пользователи уже делятся первыми впечатлениями. Один из разработчиков пишет: «Qwen3 работает лучше некоторых закрытых моделей — и при этом остаётся открытой и доступной». Модель можно протестировать через демоверсию на Hugging Face Spaces или интегрировать с помощью SGLang и vLLM.
Почему это важно
Релиз Qwen3-235B-A22B — не просто очередной апдейт. Это сигнал о том, что китайские технологии ИИ догоняют (а порой и перегоняют) западные решения. Особенно это актуально для русскоязычных пользователей: модель отлично справляется с кириллицей, доступна в открытом виде и показывает высокую производительность. Возможности для образования, науки и бизнеса — почти безграничны.