Телеграм Чат
d-Matrix интегрирует чипы Raptor в серверы Nvidia через NVLink Fusion — обзор 2026

10 сентября 2026 года компания d-Matrix объявила об использовании технологии Nvidia NVLink Fusion для интеграции собственных ИИ-процессоров Raptor в системы Nvidia. Речь идёт прежде всего об ускорении inference — непосредственного выполнения уже обученной ИИ-модели. Это несколько отличается от обучения моделей: inference требует очень высокой скорости обработки запросов и низких задержек. Новая архитектура ориентирована на такие задачи, как чат-боты, AI coding assistants, голосовые агенты, автономные ИИ-системы и обработка запросов в реальном времени. Ожидается, что интегрированные системы появятся на рынке в 2027 году. Это ещё один показатель того, как меняется архитектура серверов: вместо стандартной схемы «CPU + GPU» формируются гибридные платформы с несколькими специализированными процессорами.

Ключевые цифры и факты

Технология
NVLink Fusion
Интеграция XPU в стойки Nvidia
Чип
Raptor XPU
Тапе-аут до конца 2026
Рынок
2027
Q4 2027 — первые системы
Финансирование
$500M+
Включая Microsoft M12

Почему это важно для рынка ИИ-инфраструктуры

d-Matrix специализируется на inference с момента основания в 2019 году, когда, по словам CEO Сида Шета, «мало кто вообще знал, что такое inference». За последние 12 месяцев произошёл взрыв спроса на низколатентный inference — от AI coding assistants до голосовых агентов. Традиционные GPU, созданные для обучения, неэффективны для этих задач. Подход d-Matrixmemory-centric computing с вертикальным размещением памяти над вычислительным слоем — позволяет достичь значительно более высокой пропускной способности памяти и низких задержек.

Интеграция в экосистему Nvidia через NVLink Fusion даёт d-Matrix доступ к проверенной стоечной архитектуре MGX, сетевому стеку и цепочке поставок Nvidia, позволяя компании сосредоточиться на разработке собственного кремния. Как отметил Сид Шет: «Эта коллаборация с Nvidia — определяющий момент на нашем пути к бесконечному inference, доступному всем».

Технические детали интеграции

Компонент Описание
Технология подключения NVLink Fusion — высокоскоростное соединение с малой задержкой для кастомных XPU
Стоечная архитектура Nvidia MGX — модульные безкабельные лотки, проверенная экосистема поставок
Компоненты стойки Vera CPU, NVLink switches, BlueField-4 DPU, ConnectX-9 SuperNIC, Spectrum-X Ethernet
Партнёр по подключению Astera Labs — кастомные решения для высокопроизводительного потока данных
Задержка XPU-to-XPU 3x ниже по сравнению с обычным Ethernet, 10x выше пакетная скорость, 3 ТБ/с all-to-all пропускная способность

Источник: официальные заявления d-Matrix и Nvidia (сентябрь 2026).

Позиционирование d-Matrix на рынке inference-ускорителей

Игрок Подход Ключевое отличие Партнёрство с Nvidia
d-Matrix Memory-centric XPU (Raptor) Вертикальный стек памяти, 10x быстрее GPU в inference NVLink Fusion, MGX
Nvidia Groq 3 LPX GPU для decode-фазы Интеграция в стандартную GPU-экосистему Собственный продукт
AMD GPU + CPU Открытая экосистема ROCm Нет
Groq LPU (Language Processing Unit) Детерминированная архитектура для inference Нет

Источник: отраслевые отчёты, данные компаний (сентябрь 2026).

Рост доли inference в общих затратах на ИИ-вычисления

По оценкам d-Matrix, inference уже составляет 60–70% общих затрат на ИИ-вычисления, и эта доля будет расти. «Обучение — это первые 20 лет. Inference — следующие 40», — отметил CEO компании Сид Шет.

Дорожная карта d-Matrix

Июнь 2026
Запуск платформы Corsair с memory-centric подходом
Сентябрь 2026
Анонс интеграции с Nvidia NVLink Fusion
Конец 2026
Тапе-аут чипа Raptor XPU
Q4 2027
Первые системы d-Matrix в стойках Nvidia MGX
⚠️ Что это означает для индустрии.
Интеграция d-Matrix в экосистему Nvidia — это символ смены архитектурной парадигмы. Если раньше серверы строились по схеме «CPU + GPU», то теперь формируются гибридные платформы с несколькими специализированными процессорами: GPU для prefill-фазы, XPU для decode-фазы, CPU для оркестрации. Nvidia открывает свою экосистему для сторонних производителей кремния через NVLink Fusion, превращаясь из поставщика чипов в платформенного игрока. Для d-Matrix это ускоренный путь к масштабному развёртыванию без необходимости строить собственную стоечную инфраструктуру с нуля. Для рынка — рост конкуренции и ускорение инноваций в области inference-ускорителей.

Часто задаваемые вопросы

▶ Что такое NVLink Fusion и зачем он нужен d-Matrix?
NVLink Fusion — это платформа Nvidia для интеграции сторонних кастомных XPU и CPU в экосистему NVLink, стоечную архитектуру MGX и полный стек AI-фабрики. Для d-Matrix это означает возможность пропустить создание собственной стоечной инфраструктуры и сразу подключиться к проверенной платформе Nvidia, которая уже развёрнута по всему миру.
▶ Чем inference отличается от обучения?
Обучение — это процесс «настройки» ИИ-модели на больших объёмах данных, требующий огромной вычислительной мощности. Inference — это запуск уже обученной модели для генерации ответов. Inference требует не столько пиковой производительности, сколько низких задержек и высокой пропускной способности памяти. Именно на этом специализируется d-Matrix.
▶ Когда появятся первые системы?
Тапе-аут чипа Raptor XPU ожидается до конца 2026 года, а первые интегрированные системы в стойках Nvidia MGX появятся в четвёртом квартале 2027 года.
▶ Кто финансирует d-Matrix?
d-Matrix привлекла более $500 млн, включая раунд Series C на $275 млн при оценке $2 млрд. Среди инвесторов — Microsoft M12, Qatar Investment Authority, Samsung Ventures, SK Hynix и другие.
▶ Что означает переход к гибридным платформам?
Вместо стандартной схемы «CPU + GPU» формируются гибридные системы с несколькими специализированными процессорами: GPU для prefill-фазы, XPU для decode-фазы, CPU для оркестрации. Это позволяет оптимизировать каждую фазу inference и снизить общую стоимость владения инфраструктурой.

0
0