Qwen 3.8 → Цены
Деньги
Сколько стоит Qwen на самом деле
У Qwen три разных прайса и один из них — нулевой. Разбираем, за что платят и сколько, и отдельно перечисляем цифры, которые ходят по обзорам без источника.
Qwen 3.8 → Цены
Деньги
У Qwen три разных прайса и один из них — нулевой. Разбираем, за что платят и сколько, и отдельно перечисляем цифры, которые ходят по обзорам без источника.
В собственном репозитории команда пишет о Qwen Studio прямо: бесплатен, открыт всем. Ни пробного периода, ни платного входа.
Открытые модели скачиваются бесплатно с Hugging Face и ModelScope. Расходы переезжают на железо и электричество.
Новым пользователям QwenCloud начисляет свыше 70 миллионов токенов на пробу — этого хватает, чтобы всерьёз протестировать модель.
Основной платный сценарий — обращение к моделям по API. Тарификация за миллион токенов, вход и выход считаются отдельно.
| Позиция | qwen3.8-max | qwen3.7-plus |
|---|---|---|
| Вход | $2 за 1 млн | $0,4 за 1 млн |
| Выход | $6 за 1 млн | $1,6 за 1 млн |
Разница между уровнями Max и Plus — пятикратная при одинаковом окне контекста в миллион токенов. Поэтому типовая рабочая схема выглядит так: массовый поток обрабатывает Plus, а Max подключается только на сложных шагах. Отдельно тарифицируется кэш контекста — повторное чтение сохранённого куска обходится примерно в двенадцать раз дешевле обычного входа, и на длинных системных промптах это меняет счёт кардинально; ставки по всем видам кэша — в разделе об API.
Альтернатива поштучной оплате — Token Plan. Подписка бывает личной и командной, оплачивается на месяц, квартал или год и делится на три уровня — Lite, Standard и Pro. Разница между ними заявлена по объёму кредитов и по числу агентов, которых можно запускать одновременно. Разработчик пишет, что подписка выходит примерно на 40 процентов дешевле поштучной оплаты, и что она работает не только с их собственным Qwen Code, но и с любым инструментом, понимающим протоколы OpenAI или Anthropic.
Сумм здесь нет намеренно. Страница тарифов рисует цены скриптом уже в браузере, в исходном коде страницы цифр нет — проверить их автоматически невозможно. Мы не публикуем цены, которые нельзя сверить с первоисточником: актуальные суммы смотрите в кабинете QwenCloud.
Чтобы прайс за миллион токенов превратился во что-то осязаемое, полезны две привязки. Миллион токенов — это порядка 700 тысяч слов, то есть несколько толстых книг. Средний рабочий диалог с документом на десяток страниц — это единицы тысяч токенов на вход и сотни на выход.
Отсюда практический вывод: разорить пользователя способен не объём переписки, а два других сценария. Первый — длинный контекст, который заново отправляется при каждом обращении (лечится кэшем). Второй — режим глубоких рассуждений: он тарифицируется как выход, а на флагмане по умолчанию стоит максимальный уровень и на рассуждения выделяется до 262 тысяч токенов. Если задача простая, снижение уровня до среднего или низкого сокращает счёт в разы.
Вокруг Qwen ходит несколько сумм, у которых при проверке не находится первоисточника. Перечисляем прямо, чтобы вы не считали по ним бюджет:
Подтверждено первоисточником в этом тексте только то, что стоит в таблице выше: прайс за токены с карточек моделей и факт существования трёх уровней Token Plan.
Если платить не хочется вовсе, работающих вариантов два. Первый — веб-чат: там доступна флагманская модель, и разработчик описывает доступ как бесплатный. Второй — развернуть открытую модель у себя: Qwen3.8-27B под Apache 2.0 работает на одной сильной видеокарте, а линейка 3.5 спускается до размеров, которые тянет обычный ноутбук. Токены в этом случае не считаются вообще.
Чат бесплатный: разработчик в собственном репозитории пишет, что Qwen Studio бесплатен и открыт всем. Платить нужно за API — там поштучная тарификация за токены или подписка. Веса открытых моделей тоже бесплатны, но за железо под них платите вы.
Отдельной страницы тарифов у чата не существует, и подтверждённых цен нет. Цифры вроде 59 юаней в месяц, которые гуляют по обзорам, при проверке первоисточником не подтверждаются. Подписка Token Plan, которая точно существует, относится к API и инструментам разработчика, а не к веб-чату.
Числа не публикует никто — ни Qwen, ни его конкуренты. Формулировки везде качественные. На практике лимит существует и упирается в количество сообщений за период у самых тяжёлых моделей; лёгкие модели линейки обычно доступны дальше.
Token Plan — подписка вместо поштучного счёта. Бывает личной и командной, оплачивается на месяц, квартал или год и делится на три уровня: Lite, Standard и Pro. Отличаются они объёмом кредитов и числом агентов, которых можно запускать одновременно. Разработчик пишет, что подписка выходит примерно на 40 процентов дешевле поштучной оплаты. Сумм мы не приводим: страница тарифов рисует цены скриптом уже в браузере, проверить их по исходному коду невозможно.
Свыше 70 миллионов на старте — этого достаточно, чтобы всерьёз протестировать модель, а не просто посмотреть на неё. Для ориентира: миллион токенов — это порядка 700 тысяч слов, а средний рабочий диалог с документом на десяток страниц занимает единицы тысяч токенов на вход.
Три рычага. Первый — кэш контекста: повторное чтение сохранённого куска обходится примерно в двенадцать раз дешевле обычного входа, и на длинных системных промптах это меняет счёт кардинально. Второй — уровень модели: qwen3.7-plus стоит 0,4 доллара за миллион входных токенов против 2 у qwen3.8-max при том же окне контекста. Третий — глубина рассуждений: она тарифицируется как выход, на флагмане по умолчанию стоит максимальный уровень и на рассуждения выделяется до 262 тысяч токенов.