Команда Qwen, работающая в Alibaba Cloud, выпустила пять новых компактных моделей Qwen3.5 с параметрами 9B, 4B, 2B и 0.8B. Все модели представлены в dense-формате и имеют открытые веса под лицензией Apache 2.0. Это завершает линейку, запущенную Alibaba в три этапа: флагманская модель на 397B-A17B появилась 16 февраля, средние модели (122B-A10B, 35B-A3B, 27B) — 24 февраля, а теперь доступны компактные версии. Модели можно найти не только на Hugging Face, но и на ModelScope и Ollama. Для запуска 9B-версии достаточно одной команды: ollama run qwen3.5:9b.
Что касается бенчмарков, 9B-модель демонстрирует впечатляющие результаты: 82.5 на MMLU-Pro, что превосходит 80.8 у GPT-OSS-120B и 80.9 у Qwen3-30B-A3B. На GPQA Diamond разрыв еще больше — 81.7 против 73.4 у Qwen3-30B-A3B. Все модели используют гибридную архитектуру Gated DeltaNet + Gated Attention, что позволяет поддерживать контекст в 262 тысячи токенов и расширять его до миллиона. Поддержка языков увеличилась с 119 до 201. Даже 4B-модель показывает высокие результаты: 79.1 на MMLU-Pro и 76.2 на GPQA Diamond. Самая маленькая модель, 0.8B, подходит для встраиваемых решений и edge-сценариев.