Сначала отделите классы проблем
Диагностика начинается с одного вопроса: страница вообще открывается? Если нет —
проблема сетевая или на стороне сервиса. Если открывается, но модель не отвечает —
проблема в сессии, лимитах или конкретном диалоге. Это две разные ветки, и лечатся
они по-разному.
Страница не грузится
Белый экран, бесконечная загрузка, ошибка соединения. Сеть, DNS, расширения браузера или сбой сервиса.
Страница есть, ответа нет
Чат открылся, но сообщение висит или падает с ошибкой. Сессия, лимиты, слишком длинный контекст, зависший предыдущий запрос.
Ошибка в коде
Работаете через API. Код ответа скажет точнее любых догадок: 401, 429 и 400 означают три разные вещи.
Типовые сообщения и что за ними стоит
| Что видно | Что происходит | Что делать |
| Проблема подключения к Qwen | Сессия устарела или запрос не дошёл до сервера | Обновить страницу, выйти и войти заново, отключить блокировщики |
| Internal error | Сбой на стороне сервиса или конкретной модели | Переключить модель в списке, повторить через несколько минут |
| The chat is in progress | Предыдущая генерация ещё идёт | Подождать, обновить страницу, начать новый диалог |
| The request is ended | Поток ответа оборвался, не дойдя до конца | Повторить запрос, при длинном контексте — сократить его |
| Ответ обрывается на полуслове | Упёрлись в лимит длины вывода | Попросить продолжить, разбить задачу на части |
Когда виноват не сервис
Три причины, которые дают симптомы «не работает», хотя с Qwen всё в порядке:
- Расширения браузера. Блокировщики рекламы и скриптов регулярно ломают
одностраничные приложения — а чат Qwen именно такое. Проверка занимает секунды: открыть
в приватном окне с отключёнными расширениями.
- Старая сессия в фоновой вкладке. Вкладка, провисевшая ночь, почти
гарантированно отвалится. Это не сбой, а истёкший токен.
- Гостевой режим. В нём часть функций недоступна по замыслу,
и отказ выглядит как ошибка. Вход в аккаунт снимает вопрос.
Лимиты: что известно точно
По бесплатному чату разработчик числовых лимитов не публикует — и это не особенность
Qwen, так делают все крупные вендоры. Формулировки везде качественные, конкретных
цифр нет ни у кого. На практике ограничение проявляется как временная недоступность
самой тяжёлой модели при сохранении доступа к более лёгким.
По API цифры, наоборот, опубликованы, и упереться в них можно вполне буднично:
| Ограничение | qwen3.8-max | Как проявляется |
| Запросов в минуту | 15 000 | Ошибка ограничения частоты, код 429 |
| Токенов в минуту | 2 000 000 | То же, но при небольшом числе тяжёлых запросов |
| Максимальный вход | 991 000 токенов | Отказ с кодом 400 до начала генерации |
| Вход с рассуждениями | 983 000 токенов | Порог ниже обычного — часть окна зарезервирована |
| Максимальный выход | 131 000 токенов | Ответ обрывается по достижении потолка |
Если ответы стали очень долгими
Это не сбой, а настройка. У поколения 3.8 глубина рассуждений задаётся параметром
reasoning_effort, и по умолчанию стоит максимальный уровень — на рассуждения
может уйти до 262 тысяч токенов, прежде чем появится первое слово ответа.
В API это лечится переключением на medium или low. В чате
время ответа зависит от выбранной модели: лёгкие варианты линейки отвечают заметно
быстрее флагмана.
Отдельный случай — открытые веса флагманской модели: там режим мышления выключить
нельзя вообще, ответ всегда начинается с блока рассуждений. Это заявлено в карточке
модели, а не является дефектом сборки.
Ошибки при локальном запуске
Другой класс проблем, но ищут его теми же словами. Три самые частые причины:
- Нехватка памяти. Модель не помещается в видеопамять вместе с контекстом.
Лечится квантованием пожёстче или уменьшением
--max-model-len.
- Рассуждения в тексте ответа. Не указан
--reasoning-parser qwen3,
и служебный блок размышлений уезжает пользователю.
- Вызовы функций не срабатывают. Не указан
--tool-call-parser qwen3_coder — модель возвращает вызов строкой, а движок
его не разбирает.
Подробнее о флагах и требованиях — на странице о локальном запуске.
Как понять, что это массовый сбой
Признак массового сбоя простой: перестают работать сразу несколько моделей,
а не одна, и симптом воспроизводится в приватном окне на другом устройстве и другой сети.
Если же не работает только у вас и только в одном браузере — почти наверняка дело
в сессии или расширениях. Промежуточный вариант, когда сервис доступен, но нестабилен,
обычно проявляется как чередование нормальных ответов и внутренних ошибок; тут остаётся
только подождать.