Модель Qwen3-Max Thinking с функцией рассуждений стала доступна на веб-сайте и мобильных приложениях. Чтобы активировать данный режим, пользователям необходимо выбрать модель Qwen3-Max и включить опцию «Мышление» (Thinking). Уникальной особенностью данной модели является возможность настройки максимального бюджета токенов, доступного для рассуждений, через специальное меню, расположенное рядом с кнопкой. Это позволяет находить оптимальный баланс между производительностью и скоростью работы.

На данный момент Alibaba ограничилась краткими сообщениями в X и не предоставила официального анонса с детальными бенчмарками. Доступные данные основаны на сравнении предварительной версии Thinking с «обычным» Qwen3-Max и другими моделями. Qwen3-Max Thinking построена на базе самой крупной модели Alibaba с 1 трлн параметров и архитектурой «смесь экспертов» (MoE), поддерживает длинный контекст до 262 тыс. токенов и акцентирует внимание на коде и агентности. Модель предоставляется через облачные сервисы, но открытых весов у Max нет.