Skip to content
DigitalNeuron
Chips & Infrastruktur

d-Matrix verbindet Raptor-XPUs über NVLink Fusion mit der NVIDIA-Plattform

d-Matrix announced it will use NVIDIA NVLink Fusion to connect its next-generation Raptor XPUs to NVIDIA's AI infrastructure platform.

Von DigitalNeuron Desk2 Min. Lesezeit

Kurze Antwort

Was hat d-Matrix zu NVIDIA NVLink Fusion bekanntgegeben?

d-Matrix announced it will use NVIDIA NVLink Fusion to connect its next-generation Raptor XPUs to NVIDIA's AI infrastructure platform, including NVLink scale-up and Spectrum-X networking and the MGX rack architecture. The company said this gives it a path to deploy Raptor at large scale alongside NVIDIA systems.

Das Wichtigste

  • d-Matrix announced it will connect its next-generation Raptor XPUs to NVIDIA's AI infrastructure platform using NVLink Fusion.
  • Die Integration verbindet Raptor mit dem Scale-up-Netzwerk NVIDIA NVLink, dem Scale-out-Netzwerk Spectrum-X sowie der Rack-Architektur NVIDIA MGX.
  • d-Matrix said its racks can operate alongside NVIDIA GPU-based systems such as NVIDIA Vera Rubin NVL72 for disaggregated inference.
  • d-Matrix erklärte, außerdem die Integration von NVIDIAs Vera-CPUs, ConnectX-9-SuperNICs, BlueField-4-DPUs und Spectrum-X-Ethernet-Netzwerktechnik zu planen.
  • d-Matrix CEO Sid Sheth said the approach gives customers a faster, lower-risk path to deploy and scale ultralow-latency inference.

Der auf KI-Inferenz spezialisierte Chiphersteller d-Matrix hat angekündigt, seine Raptor-XPUs der nächsten Generation über NVIDIA NVLink Fusion an die KI-Infrastrukturplattform von NVIDIA anzubinden. Das geht aus einem Blogbeitrag von NVIDIA hervor.

Wie das Unternehmen mitteilte, verbindet diese Anbindung Raptor mit dem Scale-up-Netzwerk NVIDIA NVLink, dem Scale-out-Netzwerk Spectrum-X, der Rack-Architektur NVIDIA MGX sowie der breiteren NVIDIA-KI-Plattform.

Was d-Matrix dazu sagt

„Die Nachfrage nach Inferenz wächst rasant, doch Kapital, Zeit und Energie bleiben begrenzt", sagte Sid Sheth, Mitgründer und CEO von d-Matrix, laut NVIDIA im Rahmen eines Pressebriefings. „Mit NVLink Fusion und MGX können wir unsere Raptor-XPUs in eine breit eingesetzte, flüssigkeitsgekühlte Architektur integrieren und unseren Kunden so einen schnelleren, risikoärmeren Weg zur Bereitstellung und Skalierung von Inferenz mit extrem niedriger Latenz eröffnen."

NVIDIA erklärte, NVLink Fusion sei die Hochbandbreiten- und Niedriglatenztechnologie, die kundenspezifische XPUs und CPUs mit dem NVIDIA-Stack verbinde, und erweitere damit die Offenheit der NVIDIA-KI-Plattform auf Silizium von Drittanbietern.

Geplante Integrationen

Laut NVIDIA plant d-Matrix Folgendes:

  • Die eigenen XPUs über NVIDIA NVLink in einer einzigen Scale-up-Domäne mit hoher Bandbreite und niedriger Latenz zu verbinden
  • Die eigenen Racks gemeinsam mit NVIDIA-GPU-Systemen wie NVIDIA Vera Rubin NVL72 für disaggregierte Inferenz zu betreiben
  • NVIDIA-Vera-CPUs, ConnectX-9-SuperNICs, BlueField-4-DPUs und das Spectrum-X-Ethernet-Netzwerk zu integrieren

Diese Komponenten verschafften d-Matrix in Kombination mit NVLink und MGX, so NVIDIA, eine Grundlage, um spezialisierte Inferenz-Hardware innerhalb dessen einzusetzen, was NVIDIA als vereinheitlichte KI-Fabriken bezeichnet.

Plattformkontext

NVIDIA beschrieb seine Full-Stack-KI-Fabrikplattform als eine Kombination aus NVIDIA Vera Rubin NVL72, Groq 3 LPX, dem Vera-CPU-Rack, dem Vera-BlueField-4-STX-Speicher und dem Spectrum-6-SPX-Ethernet-Netzwerk. Sie sei darauf ausgelegt, KI-Workloads und Modellarchitekturen entsprechend den eigenen Zielvorgaben für Leistung pro Watt und Kosten pro Token auszuführen. NVLink Fusion verschaffe Kunden dabei die Flexibilität, Rechenleistung innerhalb dieser gemeinsamen Plattform passgenau auf ihre Workloads abzustimmen.

Quelle: NVIDIA Blog, „d-Matrix Adopts NVIDIA NVLink Fusion for Rack-Scale XPU Deployment", veröffentlicht am 10. September 2026.

Häufige Fragen

Womit verbindet sich d-Matrix mit NVIDIAs Plattform?
d-Matrix is connecting its next-generation Raptor XPUs to NVIDIA's AI infrastructure platform using NVLink Fusion.
Welche NVIDIA-Technologien umfasst die Integration?
d-Matrix said it plans to use NVLink scale-up networking, Spectrum-X scale-out networking, the MGX rack architecture, Vera CPUs, ConnectX-9 SuperNICs, BlueField-4 DPUs, and Spectrum-X Ethernet.
Was sagte der CEO von d-Matrix zu diesem Schritt?
Sid Sheth, cofounder and CEO of d-Matrix, said NVLink Fusion and MGX let the company integrate Raptor XPUs into a broadly deployed, liquid-cooled architecture, giving customers a faster, lower-risk path to deploy and scale ultralow-latency inference.
Können die Racks von d-Matrix mit NVIDIA-GPU-Systemen zusammenarbeiten?
d-Matrix said its racks can work alongside NVIDIA GPU-based systems like NVIDIA Vera Rubin NVL72 for disaggregated inference.

Quellen

  1. d-Matrix Adopts NVIDIA NVLink Fusion for Rack-Scale XPU Deployment | NVIDIA BlogNVIDIA
Schlagwörternvidiad-matrixnvlink-fusioninference-chipsmgxdata-center-networking

Passend dazu

AWS führt Modell-Caching ein, um Kaltstarts bei der Inferenz auf SageMaker HyperPod zu verkürzen

AWS hat Modell-Caching für Amazon SageMaker Inference auf HyperPod eingeführt. Die Funktion lädt Modellgewichte und Container-Images vorab auf die Cluster-Knoten, sodass Pods mit rund 7 GB/s von lokalem NVMe-Speicher statt über das Netzwerk lesen können. Dadurch beginnen Pods laut AWS in der Regel innerhalb von Sekunden statt zig Minuten mit der Verarbeitung von Traffic.

2 Min. Lesezeit

Anthropic wählt Google Cloud zur Unterstützung der Claude-Entwicklung

Anthropic hat Google Cloud im Rahmen einer am 3. Februar 2023 angekündigten Partnerschaft als Cloud-Anbieter ausgewählt. Die Unternehmen planen, gemeinsam KI-Computing-Systeme zu entwickeln, während Anthropic erklärt, die GPU- und TPU-Cluster von Google Cloud zum Training, zur Skalierung und zum Einsatz seiner KI-Systeme, einschließlich Claude, zu nutzen.

2 Min. Lesezeit