
AI Infrastructure2026-07-22
NVIDIA AI Blog
NVIDIA Vera Rubin startet für KI im Gigamaßstab
NVIDIAs KI-Plattform der nächsten Generation, Vera Rubin NVL72, geht offiziell in Produktion und wird mit großen Cloud- und Infrastrukturpartnern wie CoreWeave, Google Cloud, Microsoft Azure und Oracle Cloud Infrastructure hochgefahren. Das ist ein bedeutender Sprung im KI-Computing im Gigamaßstab, denn die Plattform erstreckt sich über 350 Fabrikstandorte in 30 Ländern.
Vera Rubin wurde entwickelt, um die höchste Leistung pro Watt und die niedrigsten Token-Kosten für KI-Workloads zu liefern. Das macht sie zur idealen Wahl für das Training und den Einsatz großer KI-Modelle. Die Architektur der Plattform ist sowohl für Training als auch für Inferenz optimiert, sodass Organisationen komplexe KI-Aufgaben effizienter als je zuvor ausführen können. Durch die Reduzierung des Energieverbrauchs bei gleichzeitiger Steigerung der Rechenleistung adressiert Vera Rubin zwei der größten Herausforderungen moderner KI: Kosten und Nachhaltigkeit.
Der Hochlauf mit führenden Cloud-Anbietern bedeutet, dass Unternehmen bald über ihre bevorzugten Cloud-Plattformen auf die Fähigkeiten von Vera Rubin zugreifen können. Diese breite Verfügbarkeit wird voraussichtlich die Einführung von KI im Gigamaßstab in allen Branchen beschleunigen – von der Verarbeitung natürlicher Sprache und Computer Vision bis hin zu wissenschaftlichen Simulationen und autonomen Systemen.
NVIDIAs Partner haben sich begeistert über das Potenzial der Plattform geäußert. CoreWeave, bekannt für seine spezialisierte Cloud-Infrastruktur für KI, sieht Vera Rubin als Game-Changer für High-Performance-Computing-Workloads. Auch Google Cloud, Microsoft Azure und Oracle Cloud Infrastructure bereiten sich darauf vor, die Plattform in ihre Dienste zu integrieren und Kunden beispiellose KI-Rechenleistung zu bieten.
Da KI-Modelle weiter an Größe und Komplexität zunehmen, wird der Bedarf an effizienter, skalierbarer Infrastruktur kritisch. Vera Rubin ist NVIDIAs Antwort auf diesen Bedarf und verspricht, eine neue Ära des KI-Computings im Gigamaßstab einzuleiten, die sowohl leistungsstark als auch kosteneffizient ist.