Alibaba сделала значительный шаг в области искусственного интеллекта, выпустив модель Qwen3-Next-80B-A3B, которая сочетает в себе 80 миллиардов параметров с непревзойденной эффективностью. В отличие от своих предшественников, новая архитектура активирует лишь 3 миллиарда параметров на токен, что позволяет в десять раз сократить затраты на обучение и инференс по сравнению с Qwen3-32B. Модель особенно эффективна при работе с длинными текстами — от 32 тысяч токенов и более.

Основой Qwen3-Next-80B-A3B является гибридная архитектура Gated DeltaNet + Gated Attention, которая обеспечивает точность и скорость. Ультраразреженная схема Mixture-of-Experts задействует 512 экспертов, из которых одновременно активны лишь десять. Это позволяет оптимально распределять вычислительные ресурсы.

Модель также поддерживает Multi-Token Prediction, что увеличивает скорость генерации текстов без потери качества. В тестах Qwen3-Next-80B-A3B превосходит Qwen3-32B и демонстрирует результаты, приближающиеся к более дорогой Qwen3-235B. Специализированные версии модели почти достигли уровня флагманских решений, что делает её одним из самых интересных релизов в 2025 году. Qwen3-Next-80B-A3B доступна на платформах Qwen Chat, HuggingFace, ModelScope, Kaggle и в облаке Alibaba Cloud.