NVIDIA анонсировала NVLink Fusion, новую технологию, которая увеличивает производительность вычислительных ускорителей до 30%, обеспечивая большую пропускную способность памяти и сниженное энергопотребление. Это позволит гипермасштабируемым компаниям и разработчикам ИИ более эффективно запускать сложные модели и ускорять время выхода на рынок.
Что такое NVLink Fusion и NVHBM
NVLink Fusion объединяет вычислительные ресурсы в рамках единой архитектуры, интегрируя пользовательские XPUs и CPUs в платформу NVIDIA AI. Основная цель — обеспечить высокую пропускную способность и оптимизацию энергопотребления для масштабируемых приложений. Технология NVHBM предоставит до 30% большую пропускную способность памяти в сравнении со стандартной HBM4E, а также освободит до 25% площади кристалла XPU под вычислительные блоки.
Как утверждают разработчики NVIDIA, новая архитектура позволяет значительно улучшить производительность ИИ-решений, что является решающим фактором для работы с большими моделями и сложными заданиями в реальном времени. В переходе на NVLink Fusion также учтены требования по снижению энергопотребления — до 15% для HBM по сравнению со стандартной HBM4E.
Как это повлияет на рынок
От новых решений NVIDIA выиграют не только разработчики на Западе, но и российские стартапы, работающие в сфере ИИ. С увеличением объёма обучения и внедрения ИИ технологии, возможность быстро и эффективно разрабатывать решения значительно повысит конкурентоспособность.
По данным NVIDIA, использование XPUs в рамках NVLink Fusion должно сократить сложность интеграции и ускорить вывод новых ИИ-чипов на рынок. Это означает, что компании смогут быстрее реагировать на изменения в потребностях рынка, ускоряя процесс разработки ИИ-продуктов.
Будущее за облачными ИИ-решениями
NVLink Fusion и NVHBM представляют собой ключевые этапы в развитии облачной инфраструктуры для ИИ, и, по прогнозам, подобные технологии будут востребованы в будущем, когда нагрузка на вычислительные мощности продолжит расти. NVIDIA позиционирует эти решения как основу для следующего поколения ИИ-инфраструктуры.