HyperAIHyperAI

Command Palette

Search for a command to run...

NVLink Fusion integriert XPUs nahtlos in AI-Fabriken

NVIDIA hat mit der Plattform NVLink Fusion eine Lösung vorgestellt, die die Integration eigener Beschleunigerchips, sogenannter XPUs, in seine unternehmensreifen KI-Infrastrukturen ermöglicht. Diese Entwicklung adressiert einen zentralen Engpass beim Bau skalierbarer KI-Fabriken, bei denen die Wirtschaftlichkeit durch Metriken wie Token pro Sekunde, Energieeffizienz und Auslastung bestimmt wird. Im Kern bindet NVLink Fusion Drittanbieter-XPUs in die sechste Generation der NVLink-Netzwerkarchitektur ein. Die Lösung unterstützt Scale-Up-Domänen bis zu 72 Prozessoren mit einer Ausbauperspektive auf 1.152 Beschleuniger. Im Vergleich zu herkömmlichen Ethernet-Lösungen reduziert die Architektur die End-to-End-Latenz um das Dreifache und steigert die Paketrate um das Zehnfache. Für die Verbindung zu Host-Prozessoren kommt NVLink-C2C zum Einsatz, das im Vergleich zu PCIe-Schnittstellen eine sechsfach höhere Energieeffizienz bietet und so die Kopplung von Steuerungs- und Rechenressourcen für komplexe KI-Workloads optimiert. Die Plattform basiert auf der standardisierten MGX-Architektur und ermöglicht die gemeinsame Nutzung von Stromversorgung, Kühlung, Netzwerkinfrastruktur und Managementsystemen. Dadurch entkoppeln Auftraggeber die Infrastrukturentwicklung vom Fertigungszeitplan der eigenen Chips. Bauvorhaben für Rechenzentren können fortgeführt werden, während die finale Siliziumauswahl offen bleibt. Fertigungspartner betonen, dass dieser Ansatz Automatisierungsgrade von nahezu hundert Prozent in der Produktionslinie ermöglicht und Integrationsrisiken signifikant senkt. Auf Infrastrukturebene orientiert sich NVLink Fusion an der DSX-Referenzarchitektur von NVIDIA und wird mittels digitaler Zwillinge der Omniverse-Plattform validiert. Die Rechenzellen sind vollständig flüssigkeitsgekühlt, erfordern keine Lüfter und ermöglichen einen Hot-Swap-Betrieb, ohne andere Rack-Bereiche zu beeinträchtigen. Die Softwaresteuerung erfolgt über eine integrierte Toolchain aus NCCL, Dynamo, NIXL und Mission Control, die den koordinierten Betrieb hybrider KI-Cluster sicherstellt. Branchenanwender heben hervor, dass NVLink Fusion die Time-to-Market für semikundenspezifische KI-Chips beschleunigt und gleichzeitig die Flexibilität für wechselnde Arbeitslasten wie Training, Inferenz und agentic AI erhöht. Durch die Vereinigung individueller XPU-Entwicklung mit bewährter Netzwerk-, Kühl- und Softwareinfrastruktur schaffen Hyperscaler und KI-Unternehmen leistungsfähige, zukunftsresistente KI-Fabriken.

Verwandte Links