Intel раскрыла новые детали о серверном GPU Crescent Island, и самое необычное здесь не кодовое имя, а конфигурация: PCIe-карта, до 480 ГБ LPDDR5x и явный уход от привычной гонки за HBM. Для рынка AI-инференса это важный сигнал: Crescent Island выглядит как попытка занять нишу, которую Nvidia сама же освободила после сворачивания Rubin CPX.
О новинке Crescent Island сообщает The Register со ссылкой на презентации и обсуждения на Computex 2026. По данным издания, Intel позиционирует этот датацентровый GPU не только как ускоритель для корпоративного AI, но и как потенциальную платформу для задач prefill — той части LLM-инференса, где модель сначала «переваривает» запрос пользователя, контекст и документы, прежде чем начать выдавать токены.
На бумаге устройство выглядит почти вызывающе странно на фоне топовых ускорителей 2025–2026 годов. Пока Nvidia и AMD уходят в сокетные решения, HBM и все более плотные стойки, Intel оставляет Crescent Island в формате PCIe. Вместо HBM и даже не GDDR компания использует LPDDR5x — память, которую обычно ассоциируют с ноутбуками и смартфонами, а не с GPU для дата-центров. Зато объем впечатляет: до 480 ГБ. Для сравнения, флагманские GPU Nvidia сейчас доходят до 288 ГБ. При этом LPDDR5x дешевле HBM и GDDR, что особенно важно на фоне роста цен на память: The Register пишет, что за последний год они в глобальной цепочке поставок выросли более чем втрое.
Компромисс очевиден: LPDDR5x не про рекордную пропускную способность. Intel пока не раскрыла точные цифры для Crescent Island, но если исходить из предположения о 1024-битной шине, речь может идти примерно о 1,2 ТБ/с. Для сравнения, актуальные ускорители Nvidia и AMD уже играют в лиге около 20 ТБ/с. Еще недавно такой разрыв сам по себе выглядел бы приговором для любого «большого» AI-GPU: скорость генерации токенов долгое время слишком сильно упиралась именно в память. Но архитектура AI-инференса быстро меняется, и этот контекст здесь важнее сырых спецификаций.
За последний год крупные игроки все активнее переходят к разнесенной схеме, где inference делится на две разные фазы: prefill и decode. Prefill — это вычислительно тяжелый этап обработки входного промпта и контекста. Пользователь видит его как паузу между отправкой запроса и началом ответа. Decode — уже собственно генерация токенов, где память и ее пропускная способность остаются критичными. В такой схеме prefill можно вынести на отдельный класс ускорителей: им тоже нужна память, но они сильнее зависят от вычислений, чем от экстремально дорогой HBM. Именно поэтому идея GPU с большим, но не самым быстрым пулом памяти внезапно перестает выглядеть экзотикой и начинает напоминать вполне рациональный инженерный выбор.
Собственно, Nvidia сама подталкивала рынок к такой логике. Летом 2025 года компания анонсировала Rubin CPX — ускоритель для prefill с 128 ГБ GDDR7 и производительностью до 30 PFLOPS в NVFP4. Сценарий был понятным: тяжелые задачи с огромным объемом входных токенов, вроде кодовых ассистентов, отправляют prefill на CPX, а генерация токенов остается на Vera Rubin Superchips с HBM4. На фоне бурного роста AI-агентов, которые подают в модель все больше контекста, документов, логов и кода, такая архитектура выглядела логичной. Но уже к марту 2026 года Nvidia эту линию, по сути, заморозила, чтобы отдать приоритет стойкам LPX на базе Groq LPU, а там ставка сделана на противоположную часть пайплайна — ускорение decode и улучшение экономики генерации.
Важно, что сама идея при этом никуда не исчезла. The Register приводит слова Иэна Бака, вице-президента Nvidia по Hyperscale и HPC: на одной из весенних встреч с прессой он признал, что CPX был хорошей концепцией и она еще может вернуться в следующих поколениях. Для Intel это почти готовое окно возможностей. Компания пока осторожна в формулировках и не называет Crescent Island прямым ответом на отмененный Rubin CPX, но намеки считываются без особых усилий. Особенно если учитывать, что Intel упоминала поддержку Nvidia Dynamo — фреймворка для разделения prefill и decode между несколькими GPU. Если Dynamo действительно придет на эту платформу, Crescent Island получит не просто железную экзотику, а понятный сценарий интеграции в существующие AI-стэки.
Для разработчиков, платформенных команд и IT-руководителей это, пожалуй, самая практичная часть истории. На рынке уже заметен сдвиг от универсального «один гигантский GPU на все» к более специализированным конфигурациям под разные этапы inference. Если Intel сможет предложить карту с большим объемом сравнительно дешевой памяти и внятной поддержкой disaggregated inference, это может заинтересовать компании, которые строят RAG-системы, кодовые ассистенты, корпоративные чат-боты и агентные платформы с длинным контекстом. В таких сценариях стоимость памяти и цена входного токена начинают значить не меньше, чем чистая скорость генерации. И здесь PCIe-ускоритель с 480 ГБ LPDDR5x выглядит не как компромисс для бедных, а как узкоспециализированный инструмент под вполне конкретную боль.
Открытый вопрос в другом: хватит ли Intel не просто необычной конфигурации, а экосистемы вокруг нее. Рынок AI-ускорителей уже давно продает не чипы сами по себе, а готовые архитектурные роли внутри стоек, кластера и inference-пайплайна. Если Crescent Island останется просто «странным GPU с большим объемом памяти», этого мало. Если же Intel успеет встроить его в новую норму, где prefill и decode живут на разных классах железа, компания может неожиданно занять сегмент, который Nvidia сначала почти создала, а потом временно оставила пустым.
