Mehr KI-Durchsatz. Weniger Energie pro erzeugtem Token.
Durchbrechende Ergebnisse der Recheneffizienz auf real validiertLLMInferenz-Workloads mitNVIDIA A40 hardware.
Gemessen an realLLM workloads.
Ausgewählte abgeschlossene Validierung läuft von der aktuellenNVIDIA A40Beweismaterial.
Ergebnisse, die die Validierung überlebt haben.
Es wird kein universeller Prozentsatz beansprucht.
DistilGPT-2
31,3% geringere Energie pro erzeugten Token
54% + höherer Erzeugungsdurchsatz
100% identische validierte gierige Ausgabe
Qwen 2.5 0.5B
35,1% geringere Energie pro erzeugten Token
70,3% höherer Erzeugungsdurchsatz
100% identische validierte gierige Ausgabe
Qwen 2.5 1.5B
36,4% geringere Energie pro erzeugtes Token
131,4% höherer Erzeugungsdurchsatz
100% identische validierte gierige Ausgabe
AusführenVarion Computegegen Ihre eigene Arbeitsbelastung.
Kommerzielle Freigabe enthält 10 kostenlosGPU-Stunden für die Messung Test, plus die Offline-Selbsttest-Pfad. Keine Kreditkarte ist für die kostenlose Testversion erforderlich.
Aktuelle Validierungsgrenze
NVIDIA A40Die Ergebnisse sind validiert.GPUAnsprüche werden erst erhoben, wenn zusätzliche Hardware-Ergebnisse vorliegen.
Überprüfen Sie den veröffentlichten Validierungs-Snapshot.
Die maschinenlesbareJSONzeichnet den aktuellenNVIDIA A40Validierungsgrenze und Schlagzeilenergebnisse auf dieser Seite. Ergebnisse bleiben loadload-spezifisch und sind keine universelle Spargarantie.