Qwen 3.8 → Версии
Линейка
Версии Qwen: как устроена линейка
За полгода Alibaba выпустила четыре поколения моделей и полтора десятка размеров. Разбираем, что за чем шло, чем 3.8 отличается от 3.6, и какие версии вообще можно скачать.
Qwen 3.8 → Версии
Линейка
За полгода Alibaba выпустила четыре поколения моделей и полтора десятка размеров. Разбираем, что за чем шло, чем 3.8 отличается от 3.6, и какие версии вообще можно скачать.
Даты ниже взяты из ленты новостей официального репозитория поколения — это самый надёжный источник, потому что запись там появляется в день выкладки весов.
| Дата | Что вышло | Размер |
|---|---|---|
| 16.02.2026 | Qwen3.5 — первый релиз поколения | 397B-A17B |
| 24.02.2026 | Средние размеры Qwen3.5 | 122B-A10B, 35B-A3B, 27B |
| 02.03.2026 | Малые размеры Qwen3.5 | 9B, 4B, 2B, 0.8B |
| 16.04.2026 | Qwen3.6-35B-A3B | 35B-A3B |
| 22.04.2026 | Qwen3.6-27B | 27B |
| 20.05.2026 | Qwen3.7 Max — по датированным вторичным источникам | не раскрыт |
| 12.08.2026 | Qwen3.8-2.4T-A95B — веса флагмана | 2.4T-A95B |
| 14.08.2026 | Qwen3.8-27B | 27B |
Оговорка по дате Qwen3.7 Max. Официальный блог Qwen собран как одностраничное приложение и даты в исходном коде страницы не отдаёт. 20 мая 2026 года — дата по датированным вторичным источникам, а не по первоисточнику. Все остальные даты в таблице подтверждены лентой репозитория.
Внутри каждого поколения модели делятся не по размеру, а по позиции в прайсе. Max — верхний уровень, самая способная модель серии. Plus — рабочая лошадка: у неё тот же контекст в миллион токенов и мультимодальный вход, но вход стоит впятеро дешевле. Flash — самый быстрый и дешёвый вариант, рассчитанный на массовые однотипные запросы.
Показательно сравнение прайса в облаке: qwen3.8-max стоит 2 доллара за миллион входных токенов и 6 за миллион выходных, qwen3.7-plus — 0,4 и 1,6 соответственно. Разница в пять раз при одинаковом окне контекста, и именно поэтому в проде часто держат обе: Plus на поток, Max — на сложные шаги.
Здесь у поколения 3.8 произошёл перелом. До него флагманы Max оставались закрытыми: у Qwen3.7 Max весов не было вообще, модель существовала только как облачный сервис. С выходом 3.8 разработчик впервые опубликовал модель Max-класса — карточка так и начинается с фразы о том, что Qwen-Max-класс впервые выходит в открытый доступ.
Но лицензии разные, и это важно проверять перед коммерческим использованием:
| Модель | Параметры | Модальности | Лицензия |
|---|---|---|---|
| Qwen3.8-2.4T-A95B | 2,4 трлн / 95 млрд активных | Только текст | Собственная qwen3.8-max |
| Qwen3.8-27B | 27 млрд, плотная | Текст, изображения, видео | Apache 2.0 |
| Qwen3.6-35B-A3B | 35 млрд / 3 млрд активных | Текст, изображения, видео | Apache 2.0 |
| Qwen3.6-27B | 27 млрд, плотная | Текст, изображения, видео | Apache 2.0 |
| qwen3.8-max (облако) | не публикуется отдельно | Текст, изображения, видео | Платный сервис |
Отдельно стоит помнить: у старых поколений лицензия бывает своя. Например, Qwen2.5-72B-Instruct выложен не под Apache 2.0, а под кастомной лицензией Qwen. Проверять нужно поштучно, в карточке конкретной модели.
Разработчик приводит прямое сравнение 27-миллиардной модели поколений. По агентскому кодингу в терминале Qwen3.8-27B даёт 73,0 против 63,4 у Qwen3.6-27B, по SWE-bench Pro — 61,7 против 53,5, по собственному QwenSWEBench — 79,0 против 49,3. В мультимодальных задачах разрыв ещё заметнее: работа с компьютером (OSWorld-Verified) — 84,3 против 63,9, работа в браузере — 64,8 против 48,8, визуальная математика — 90,0 против 85,1.
Для флагманов сравнение поколений выглядит так же: Qwen3.8-Max против Qwen3.7-Max даёт 86,6 против 74,5 по Terminal Bench 2.1 и 93,0 против 64,8 по PaperBench. Общие знания при этом почти не сдвинулись — GPQA Diamond 92,6 против 92,4. Поколение вкладывалось в автономность и длинные задачи, а не в эрудицию.
Помимо номера версии в названиях встречаются суффиксы, по которым и ищут:
FP8 — официальная восьмибитная сборка, весит вдвое меньше оригинала;
GPTQ-Int4 — четырёхбитная квантованная версия; Base — модель
без дообучения на диалог; MTP — вариант с предсказанием нескольких токенов
за шаг, ускоряющий генерацию. Форматы файлов и их применение разобраны
на странице о локальном запуске.
Поколение 3.8. Флагман — qwen3.8-max в облаке, открытые веса — Qwen3.8-2.4T-A95B (новость репозитория от 12.08.2026) и Qwen3.8-27B (14.08.2026). Номера растут дробно, поэтому 3.8 старше 3.7 и 3.6, хотя выглядит как незначительное обновление.
Это уровни одной серии по соотношению «качество — цена». Max — самая сильная и самая дорогая модель поколения. Plus — компромисс: у qwen3.7-plus в облаке 0,4 доллара за миллион входных токенов против 2 долларов у qwen3.8-max, тот же контекст в миллион и мультимодальный вход. Flash — самый быстрый и дешёвый вариант для массовых простых задач.
Первое число — общий размер модели, второе после буквы A — количество активных параметров на токен. Qwen3.6-35B-A3B содержит 35 миллиардов параметров, но на каждый токен включает только 3 миллиарда, потому что это смесь экспертов. Отсюда её скорость: памяти нужно как под 35B, а считает она как модель на 3B.
Из свежих — Qwen3.8-27B под Apache 2.0: плотная модель, понимает изображения и видео, в квантованном виде помещается на одну сильную видеокарту. Если карта слабее, идут вниз по линейке 3.5: 9B, 4B, 2B и 0,8B. Флагманский 2.4T-A95B домашнему железу недоступен ни в каком кванте.
Веса флагмана Qwen3.8-2.4T-A95B опубликованы 12.08.2026, младшая Qwen3.8-27B — 14.08.2026. Самый надёжный источник дат — лента новостей официального репозитория поколения: запись там появляется в день выкладки весов. Исключение — Qwen3.7 Max: блог Qwen собран как одностраничное приложение и дат в коде страницы не отдаёт, поэтому 20.05.2026 стоит по датированным вторичным источникам.
Это варианты одной и той же модели, а не разные модели. FP8 — официальная восьмибитная сборка, весит примерно вдвое меньше оригинала. GPTQ-Int4 — четырёхбитная квантованная версия, публикуется для части линейки 3.5. Base — модель без дообучения на диалог, для собственного файн-тюнинга. MTP — сборка с предсказанием нескольких токенов за шаг, она ускоряет генерацию.