В рамках конференции Hot Chips 2026, прошедшей в августе 2026 года, Intel представила подробную архитектуру своего ускорителя Crescent Island — специализированного GPU для выполнения задач ИИ-инференса в центрах обработки данных. Компания впервые раскрыла вычислительную часть чипа: ускоритель получил 32 ядра Xe3P и 256 матричных движков XMX, а также поддерживает до 480 ГБ памяти LPDDR5X. По позиционированию Intel, Crescent Island — это «производительный и эффективный GPU, оптимизированный для агентного ИИ», что подчёркивает ориентацию на массовое обслуживание автономных ИИ-агентов, а не на обучение нейросетей.
Архитектура: четыре Compute Slice и отказ от 3D-графики
Вычислительная часть Crescent Island организована в четыре блока Compute Slice, каждый из которых объединяет по восемь ядер Xe. В совокупности GPU располагает 32 ядрами архитектуры Xe3P, 256 векторными движками и 256 матричными движками XMX, отвечающими за ускорение матричных операций, лежащих в основе работы нейросетей. Каждое ядро Xe оснащено 512 Кбайт объединённого кеша L1 и локальной памяти SLM, что в сумме даёт 16 Мбайт на уровне первого уровня. Дополнительно в чипе предусмотрено 32 Мбайт общего кеша второго уровня. Архитектура Xe3P представляет собой специализированное развитие Xe3 с упором на производительность и энергоэффективность при вычислительных нагрузках: Intel сознательно отказалась от блоков, необходимых для обработки традиционной 3D-графики, направив освободившийся транзисторный бюджет на вычислительные ресурсы. Ускоритель поддерживает широкий диапазон форматов данных — от FP4, ориентированного на ИИ-инференс, до FP64, требуемого для высокоточных научных вычислений.
Память: ставка на LPDDR5X вместо HBM
Одной из наиболее дискуссионных особенностей Crescent Island стала подсистема памяти. Вместо дорогой HBM, которую используют современные ускорители Nvidia и AMD, Intel выбрала LPDDR5X. Эталонная карта самой Intel будет оснащаться 160 ГБ памяти, тогда как партнёры компании смогут создавать ускорители с объёмом до 480 ГБ. Такой подход обеспечивает меньшую пропускную способность по сравнению с HBM, однако позволяет существенно увеличить доступный объём памяти при умеренной стоимости и энергопотреблении. Большой объём памяти призван обеспечить размещение крупных языковых моделей целиком на одном ускорителе, обслуживание более длинного контекста и одновременное выполнение запросов большего числа ИИ-агентов — ключевые требования для «агентных» сценариев, на которые делает ставку Intel.
Позиционирование: инференс, а не обучение
Crescent Island рассчитан не на конкуренцию с наиболее производительными ускорителями для обучения нейросетей, а прежде всего на экономичное выполнение уже обученных моделей. Intel делает особый акцент на стоимости генерации токенов и возможности устанавливать новые ускорители в существующие серверные стойки без перехода на жидкостное охлаждение. Эталонная PCIe-карта Crescent Island имеет энергопотребление 350 Вт и рассчитана на стандартное воздушное охлаждение. На слайде презентации также подчёркивается, что архитектура оптимизирована для prefill-фазы (High FLOP/W, compute-bound workloads), что характерно именно для инференсных нагрузок с длинным контекстом.
Программное обеспечение и экосистема
Intel заявляет о «открытом программном стеке» и «Day 0» поддержке отраслевых стандартных фреймворков. На визуализации программного обеспечения, представленной на слайде Hot Chips 2026, видны слои, включающие Intel AI Library, OneAPI и другие компоненты, а также интеграция с популярными ML-фреймворками. Подчёркивается готовность к агентному ИИ: поддержка более конкурентных сессий, длинных контекстных нагрузок и крупных моделей заявлена как ключевое архитектурное свойство платформы.
Хронология и сроки поставок
Crescent Island был впервые анонсирован Intel осенью 2025 года с базовой конфигурацией 160 ГБ LPDDR5X. Весной 2026 года компания расширила спецификацию платформы, разрешив партнёрам создавать версии с объёмом памяти до 480 ГБ. Первые образцы ускорителей должны поступить клиентам во второй половине 2026 года. Конкретные данные о производительности в FLOPS или токенах в секунду, а также точные сроки начала серийных поставок Intel на момент презентации Hot Chips 2026 не раскрыла.