Alibaba представила свою новую модель Qwen3.7-Max, предназначенную для решения длительных агентных задач. В ходе демонстрации модель выполнила 1158 вызовов инструментов за 34,7 часа и увеличила скорость работы GPU-ядра SGLang Triton Kernel в 10 раз. Для сравнения, DeepSeek V4 Pro показал 3,3x, Kimi K2.6 — 5x, а GLM 5.1 — 7,3x. Qwen3.7-Max была обучена на более чем 8200 различных окружениях, что значительно повысило её рейтинг на восьми агентских бенчмарках — с 9-го места у базовой версии до 3-го у финальной. На 12 публичных бенчмарках Qwen3.7-Max демонстрирует лидерство, например, на Terminal-Bench 2.0 она получила 69,7 балла, в то время как Claude Opus 4.6 Max — 65,4. Модель доступна в чат-боте и API компании по цене $2,5 за миллион входящих токеов и $7,5 за миллион исходящих, однако открытые веса не будут опубликованы.