Что такое Qwen и почему версий так много
Qwen — это не одна нейросеть, а целое семейство моделей, которое выпускает команда Qwen
внутри Alibaba Group. Китайское название линейки — 通义千问 (Tongyi Qianwen), в русском поиске
оно прижилось как «квен». Под общим брендом живут текстовые модели, зрительно-языковые,
генератор изображений Qwen-Image, синтез и распознавание речи Qwen3-TTS и Qwen3-ASR,
агентские фреймворки и терминальный ассистент Qwen Code.
Отсюда путаница в запросах. «Qwen 3.0» и «Qwen 3» — это поколение 2025 года, «Qwen 3.6 35B
A3B» — открытая MoE-модель апреля 2026-го, а «Qwen 3.8 Max» — актуальный флагман августа
2026-го. Номера растут дробными шагами, и внутри каждого поколения есть развилка Max / Plus /
Flash плюс отдельная ветка открытых весов. Разбор всей линейки — на
отдельной странице.
Qwen 3.8 Max: что в нём нового
Главная новость поколения сформулирована в карточке модели прямо: впервые модель Max-класса
вышла в открытый доступ. До этого веса публиковались только для средних и малых размеров,
а флагманы Max оставались закрытыми — Qwen3.7 Max так и остался проприетарным.
Технически это разреженная смесь экспертов: 92 слоя, 512 экспертов, на каждый токен
включаются 10 маршрутизируемых экспертов и один общий, гибридная схема внимания —
Gated DeltaNet чередуется с Gated Attention. Такая конструкция даёт скорость модели
на 95 миллиардов активных параметров при знаниях модели на 2,4 триллиона.
Второе заметное изменение — управляемая глубина рассуждений. Параметр
reasoning_effort принимает значения xhigh (по умолчанию),
medium и low: это прямой рычаг «точность против скорости и цены».
Плюс preserve_thinking — модель сохраняет ход рассуждений из предыдущих сообщений
диалога, а не начинает думать заново на каждом шаге.
Две разные версии одной модели
Их легко перепутать, и разница принципиальная.
| Свойство | Открытые веса Qwen3.8-2.4T-A95B | Облачная qwen3.8-max |
| Вход | Только текст | Текст, изображения, видео |
| Режим мышления | Всегда включён, отключить нельзя | Есть режим без рассуждений |
| Контекст | 262 144, расширяется до 1 010 000 | 1 000 000 по умолчанию |
| Встроенные инструменты | Нет, поднимаете сами | Поиск, извлечение веб-страниц, интерпретатор кода, поиск по картинкам |
| Лицензия | Собственная qwen3.8-max | Платный сервис по договору |
То есть скачанная модель и модель в чате — не одно и то же. Если вам нужно, чтобы Qwen
разбирал скриншоты и часовые видео, это умеет только облачная версия. Подробности —
на странице о возможностях.
Как выглядит результат в тестах
Разработчик публикует сравнение с Opus 4.8, Fable 5 и GPT 5.6 Sol в карточке модели.
Qwen3.8-Max лидирует в PaperBench (93,0 против 90,5 у GPT 5.6 Sol), WideSearch (81,9),
IFBench (82,8 — лучший результат в таблице), HealthBench (60,2), PLawBench (73,2) и
PRBench-Finance (58,3). Уступает в чистом кодинге: Terminal Bench 2.1 — 86,6
против 88,8, SWE-bench Pro — 67,7 против 80,0 у Fable 5.
Картина складывается характерная: сильная модель для длинной профессиональной работы —
юридической, финансовой, исследовательской — которая не выигрывает гонку чистого
программирования, но подтягивается к лидерам вплотную.
Где пользоваться