Alibaba выпустила свою новую AI-модель Qwen3.8-2.4T-A95B, которая состоит из 2,4 трлн параметров и предназначена для решения сложных задач, включая анализ больших документов и кодирование. Эта модель обладает уникальной архитектурой, сочетающей полное и линейное внимание, что позволяет обрабатывать контекст до 1 миллиона токенов.
Возможности Qwen3.8
С Qwen3.8 разработчики могут настраивать глубину вывода в зависимости от сложности задачи. При этом модель обеспечивает пропускную способность более 4 тыс. токенов в секунду на GPU NVIDIA GB300 NVL72, что делает её идеальной для высоконагруженных AI-приложений. Кроме того, за счёт адаптивной активации маршрутизаторов становится возможным эффективно использовать вычислительные ресурсы, сокращая затраты на выполнение задач.
Архитектурные инновации и производительность
Модель оснащена 72 GPUs NVIDIA Blackwell, что обеспечивает минимизацию узких мест в обработке данных с пропускной способностью связи до 130 ТБ/с. Это позволяет добиться высокой производительности и низкой задержки при выполнении сложных вычислений, что особенно важно для задач с многими шагами.
Значение для разработчиков и бизнеса
Для российских разработчиков внедрение Qwen3.8 может существенно ускорить рутинные процессы в AI, позволяя обрабатывать множество данных за короткий промежуток времени. Компании, работающие с большими объемами информации, могут ожидать значительного повышения производительности и эффективности, что является главным приоритетом в современных условиях рынка.
Следующим шагом будет интеграция Qwen3.8 в предприятия для оптимизации рабочих процессов, что повысит интерес к даже самым сложным вычислительным задачам.