Qwen команда Alibaba Cloud выпустила серию Qwen3.5 Small — четыре компактные мультимодальные модели с размерами 0.8B, 2B, 4B и 9B параметров. Все модели работают с текстом и изображениями «из коробки», без дополнительных адаптеров.
Новые модели используют улучшенную архитектуру и масштабированное обучение с подкреплением (RL). Младшие версии 0.8B и 2B нацелены на edge-устройства — смартфоны, планшеты, IoT-гаджеты. Модель 4B позиционируется как база для легковесных ИИ-агентов, а 9B уже конкурирует с гораздо более крупными аналогами.
Контекст и конкуренты
Рынок компактных LLM растёт на фоне потребности в локальной обработке данных. Пока OpenAI и Anthropic наращивают параметры флагманских моделей, китайские команды делают ставку на эффективность. Qwen конкурирует с Microsoft Phi-3, Google Gemma и серией Llama от Meta.
Alibaba Cloud уже выпускала 14 версий Qwen — это один из самых активных релизных циклов среди крупных игроков. Предыдущие версии показали сильные результаты в китайском сегменте, но международное распространение пока ограничено геополитическими факторами.
Практические сценарии
Модели 0.8B и 2B запустятся на смартфонах среднего уровня без интернета — подходят для персональных помощников, переводчиков, анализа фото. Версия 4B может стать основой для чат-ботов в enterprise-приложениях, где важна скорость ответа. Старшая 9B потянет сложную аналитику документов и код-ревью.
Все модели доступны как базовые версии (pre-trained) и дообученные для чата. Лицензия позволяет коммерческое использование — это преимущество перед некоторыми западными аналогами с ограничениями.
Релиз Qwen3.5 Small усиливает тренд на «демократизацию ИИ» через компактные модели, способные работать без облачной инфраструктуры.