Die Ankündigung erfolgte bei CoreWeave Fully Connected in San Francisco. CoreWeave bietet Vera Rubin NVL72 zusammen mit Spectrum-X-Ethernet-Netzwerk mit 102,4 Tbit/s an. Cognition, das Unternehmen hinter dem KI-Softwareentwickler Devin, ist nach Angaben von NVIDIA der erste Kunde, der produktive Workloads auf Vera Rubin ausführt. CoreWeave betreibt für Cognition Training, Reinforcement Learning und Inferenz; das Unternehmen skalierte dort innerhalb von neun Monaten auf Tausende GPUs.
Für den Vergleich mit GB200 NVL72 nutzte Cognition eine reale Softwareentwicklungsaufgabe. Dafür wurden Aufgaben aus FrontierCode ausgewählt und von KI-Agenten bearbeitet. In frühen Tests erreichte Vera Rubin NVL72 bei SWE-2-Inferenz laut Cognition bis zu 4,8-mal so viel Token-Durchsatz. NVIDIA führt als mögliche Auswirkungen für Devin schnellere Codegenerierung in Echtzeit und reaktionsfähigeres mehrstufiges Schlussfolgern an.
CoreWeave will außerdem die NVIDIA Vera CPU, die für KI-Agenten ausgelegt ist, über seine Cloud anbieten. Ein Rack umfasst 128 CPUs und 11.264 Kerne; laut NVIDIA reicht das für mehr als 11.000 gleichzeitig laufende Umgebungen mit jeweils einem Kern. In Tests starteten Agent-Sandbox-Umgebungen auf Vera-CPUs mehr als dreimal schneller. Bei Terminal-Bench meldete CoreWeave über alle Aufgaben mit bestandenem Ergebnis eine Leistungssteigerung um den Faktor 1,7. Die Sandboxes isolieren Ausführungsumgebungen etwa für Reinforcement Learning, den Einsatz von Agenten-Werkzeugen und Modellbewertungen.
Zusätzlich hat CoreWeave CoreWeave Forge gestartet. Die Umgebung soll Training, Bewertung und Verbesserung von Modellen und Agenten auf NVIDIA-Beschleunigerhardware verbinden. Die neue Vera-Rubin-Kapazität lässt sich über CoreWeave Kubernetes Service, SUNK, CoreWeave Mission Control, CoreWeave Sandboxes und CoreWeave Inference betreiben. NVIDIA verweist zudem darauf, dass CoreWeave weiterhin V100-GPUs aus der Volta-Generation für Kunden-Workloads einsetzt; die Generation wurde vor nahezu einem Jahrzehnt eingeführt.
