Команда Qwen от Alibaba Cloud анонсировала пять новых компактных моделей серии Qwen3.5, включая варианты на 9B, 4B, 2B и 0.8B параметров. Все они представлены в dense-формате и имеют открытые веса под лицензией Apache 2.0. Этот релиз завершает линейку, которую компания выпускала в три этапа: флагманская модель на 397B-A17B была представлена 16 февраля, средние варианты (122B-A10B, 35B-A3B, 27B) — 24 февраля, а сейчас доступны компактные версии для локального использования. Модели можно найти не только на Hugging Face, но и на ModelScope и Ollama. Чтобы запустить 9B-версию, достаточно ввести команду: ollama run qwen3.5:9b.
Интересные результаты бенчмарков 9B-модели: она набрала 82.5 на MMLU-Pro, что выше показателей GPT-OSS-120B (80.8) и Qwen3-30B-A3B (80.9). На GPQA Diamond разница еще более заметна — 81.7 против 73.4 у Qwen3-30B-A3B. В агентных задачах 9B-версия показывает 66.1 на BFCL-V4 и 79.1 на TAU2-Bench, что недоступно было моделям с гораздо большим количеством параметров полгода назад. Все модели основаны на гибридной архитектуре Gated DeltaNet + Gated Attention и могут обрабатывать до 262 тысяч токенов, с возможностью расширения до миллиона. Поддержка языков увеличена до 201. Даже 4B-модель демонстрирует впечатляющие результаты: 79.1 на MMLU-Pro, 76.2 на GPQA Diamond и 85.1 на MathVista, и для ее запуска достаточно видеокарты уровня RTX 3060/4060. Самая маленькая модель на 0.8B предназначена для встраиваемых устройств.