Qwen 3.8 → Версии

Линейка

Версии Qwen: как устроена линейка

За полгода Alibaba выпустила четыре поколения моделей и полтора десятка размеров. Разбираем, что за чем шло, чем 3.8 отличается от 3.6, и какие версии вообще можно скачать.

Хронология релизов

Даты ниже взяты из ленты новостей официального репозитория поколения — это самый надёжный источник, потому что запись там появляется в день выкладки весов.

ДатаЧто вышлоРазмер
16.02.2026Qwen3.5 — первый релиз поколения397B-A17B
24.02.2026Средние размеры Qwen3.5122B-A10B, 35B-A3B, 27B
02.03.2026Малые размеры Qwen3.59B, 4B, 2B, 0.8B
16.04.2026Qwen3.6-35B-A3B35B-A3B
22.04.2026Qwen3.6-27B27B
20.05.2026Qwen3.7 Max — по датированным вторичным источникамне раскрыт
12.08.2026Qwen3.8-2.4T-A95B — веса флагмана2.4T-A95B
14.08.2026Qwen3.8-27B27B

Оговорка по дате Qwen3.7 Max. Официальный блог Qwen собран как одностраничное приложение и даты в исходном коде страницы не отдаёт. 20 мая 2026 года — дата по датированным вторичным источникам, а не по первоисточнику. Все остальные даты в таблице подтверждены лентой репозитория.

Что значат уровни Max, Plus и Flash

Внутри каждого поколения модели делятся не по размеру, а по позиции в прайсе. Max — верхний уровень, самая способная модель серии. Plus — рабочая лошадка: у неё тот же контекст в миллион токенов и мультимодальный вход, но вход стоит впятеро дешевле. Flash — самый быстрый и дешёвый вариант, рассчитанный на массовые однотипные запросы.

Показательно сравнение прайса в облаке: qwen3.8-max стоит 2 доллара за миллион входных токенов и 6 за миллион выходных, qwen3.7-plus — 0,4 и 1,6 соответственно. Разница в пять раз при одинаковом окне контекста, и именно поэтому в проде часто держат обе: Plus на поток, Max — на сложные шаги.

Открытые и закрытые версии

Здесь у поколения 3.8 произошёл перелом. До него флагманы Max оставались закрытыми: у Qwen3.7 Max весов не было вообще, модель существовала только как облачный сервис. С выходом 3.8 разработчик впервые опубликовал модель Max-класса — карточка так и начинается с фразы о том, что Qwen-Max-класс впервые выходит в открытый доступ.

Но лицензии разные, и это важно проверять перед коммерческим использованием:

МодельПараметрыМодальностиЛицензия
Qwen3.8-2.4T-A95B2,4 трлн / 95 млрд активныхТолько текстСобственная qwen3.8-max
Qwen3.8-27B27 млрд, плотнаяТекст, изображения, видеоApache 2.0
Qwen3.6-35B-A3B35 млрд / 3 млрд активныхТекст, изображения, видеоApache 2.0
Qwen3.6-27B27 млрд, плотнаяТекст, изображения, видеоApache 2.0
qwen3.8-max (облако)не публикуется отдельноТекст, изображения, видеоПлатный сервис

Отдельно стоит помнить: у старых поколений лицензия бывает своя. Например, Qwen2.5-72B-Instruct выложен не под Apache 2.0, а под кастомной лицензией Qwen. Проверять нужно поштучно, в карточке конкретной модели.

Насколько 3.8 лучше предшественников

Разработчик приводит прямое сравнение 27-миллиардной модели поколений. По агентскому кодингу в терминале Qwen3.8-27B даёт 73,0 против 63,4 у Qwen3.6-27B, по SWE-bench Pro — 61,7 против 53,5, по собственному QwenSWEBench — 79,0 против 49,3. В мультимодальных задачах разрыв ещё заметнее: работа с компьютером (OSWorld-Verified) — 84,3 против 63,9, работа в браузере — 64,8 против 48,8, визуальная математика — 90,0 против 85,1.

Для флагманов сравнение поколений выглядит так же: Qwen3.8-Max против Qwen3.7-Max даёт 86,6 против 74,5 по Terminal Bench 2.1 и 93,0 против 64,8 по PaperBench. Общие знания при этом почти не сдвинулись — GPQA Diamond 92,6 против 92,4. Поколение вкладывалось в автономность и длинные задачи, а не в эрудицию.

Что за буквы в именах файлов

Помимо номера версии в названиях встречаются суффиксы, по которым и ищут: FP8 — официальная восьмибитная сборка, весит вдвое меньше оригинала; GPTQ-Int4 — четырёхбитная квантованная версия; Base — модель без дообучения на диалог; MTP — вариант с предсказанием нескольких токенов за шаг, ускоряющий генерацию. Форматы файлов и их применение разобраны на странице о локальном запуске.

Частые вопросы

Какая версия Qwen сейчас последняя?

Поколение 3.8. Флагман — qwen3.8-max в облаке, открытые веса — Qwen3.8-2.4T-A95B (новость репозитория от 12.08.2026) и Qwen3.8-27B (14.08.2026). Номера растут дробно, поэтому 3.8 старше 3.7 и 3.6, хотя выглядит как незначительное обновление.

Чем Max отличается от Plus и Flash?

Это уровни одной серии по соотношению «качество — цена». Max — самая сильная и самая дорогая модель поколения. Plus — компромисс: у qwen3.7-plus в облаке 0,4 доллара за миллион входных токенов против 2 долларов у qwen3.8-max, тот же контекст в миллион и мультимодальный вход. Flash — самый быстрый и дешёвый вариант для массовых простых задач.

Что значит 35B-A3B и 2.4T-A95B в названиях?

Первое число — общий размер модели, второе после буквы A — количество активных параметров на токен. Qwen3.6-35B-A3B содержит 35 миллиардов параметров, но на каждый токен включает только 3 миллиарда, потому что это смесь экспертов. Отсюда её скорость: памяти нужно как под 35B, а считает она как модель на 3B.

Какую версию Qwen выбрать для домашнего компьютера?

Из свежих — Qwen3.8-27B под Apache 2.0: плотная модель, понимает изображения и видео, в квантованном виде помещается на одну сильную видеокарту. Если карта слабее, идут вниз по линейке 3.5: 9B, 4B, 2B и 0,8B. Флагманский 2.4T-A95B домашнему железу недоступен ни в каком кванте.

Когда вышел Qwen 3.8 и где смотреть даты релизов?

Веса флагмана Qwen3.8-2.4T-A95B опубликованы 12.08.2026, младшая Qwen3.8-27B — 14.08.2026. Самый надёжный источник дат — лента новостей официального репозитория поколения: запись там появляется в день выкладки весов. Исключение — Qwen3.7 Max: блог Qwen собран как одностраничное приложение и дат в коде страницы не отдаёт, поэтому 20.05.2026 стоит по датированным вторичным источникам.

Что означают суффиксы FP8, GPTQ-Int4, Base и MTP в названиях моделей Qwen?

Это варианты одной и той же модели, а не разные модели. FP8 — официальная восьмибитная сборка, весит примерно вдвое меньше оригинала. GPTQ-Int4 — четырёхбитная квантованная версия, публикуется для части линейки 3.5. Base — модель без дообучения на диалог, для собственного файн-тюнинга. MTP — сборка с предсказанием нескольких токенов за шаг, она ускоряет генерацию.

Смежные разделы