Команда Qwen из Alibaba Cloud презентовала пять новых компактных моделей серии Qwen3.5: 9B, 4B, 2B и 0.8B, все они выполнены в dense-формате и имеют открытые веса под лицензией Apache 2.0. Это завершает линейку, которая была запущена поэтапно: флагманская модель на 397B-A17B появилась 16 февраля, средние модели — 24 февраля, а теперь доступны компактные версии. Модели можно найти на Hugging Face, ModelScope и Ollama. Для запуска 9B-версии достаточно одной команды: ollama run qwen3.5:9b.
Интригующие результаты бенчмарков 9B-модели: она набрала 82.5 на MMLU-Pro, что лучше, чем 80.8 у GPT-OSS-120B. На GPQA Diamond разница еще больше: 81.7 против 73.4 у Qwen3-30B-A3B. Все модели используют гибридную архитектуру Gated DeltaNet + Gated Attention, что позволяет поддерживать контекст в 262 тысячи токенов. Поддержка языков увеличилась с 119 до 201. Даже 4B-модель демонстрирует впечатляющие результаты, такие как 79.1 на MMLU-Pro. Самая маленькая модель 0.8B предназначена для встроенных устройств и edge-сценариев.
