Varion Compute· Kommerzielle Freigabe

Mehr KI-Durchsatz. Weniger Energie pro erzeugtem Token.

Durchbrechende Ergebnisse der Recheneffizienz auf real validiertLLMInferenz-Workloads mitNVIDIA A40 hardware.

Die aktuelle Validierung ist amNVIDIA A40. Die Ergebnisse variieren je nach Modell, Hardware und Workload; breitereGPUDie Validierung läuft.
Bestätigte Ergebnisse

Gemessen an realLLM workloads.

Ausgewählte abgeschlossene Validierung läuft von der aktuellenNVIDIA A40Beweismaterial.

36.4%geringere Energie pro erzeugten Token ·Qwen 2.5 1.5B
131.4%höhere Erzeugungsdurchsatz ·Qwen 2.5 1.5B
100%identische gierige Erzeugung in validierten KV-Cache-Tests
1.5BParameterQwenModell validiert
Nachweise

Ergebnisse, die die Validierung überlebt haben.

Es wird kein universeller Prozentsatz beansprucht.

DistilGPT-2

31,3% geringere Energie pro erzeugten Token
54% + höherer Erzeugungsdurchsatz
100% identische validierte gierige Ausgabe

Qwen 2.5 0.5B

35,1% geringere Energie pro erzeugten Token
70,3% höherer Erzeugungsdurchsatz
100% identische validierte gierige Ausgabe

Qwen 2.5 1.5B

36,4% geringere Energie pro erzeugtes Token
131,4% höherer Erzeugungsdurchsatz
100% identische validierte gierige Ausgabe

10 kostenlosGPU- Stunden

AusführenVarion Computegegen Ihre eigene Arbeitsbelastung.

Kommerzielle Freigabe enthält 10 kostenlosGPU-Stunden für die Messung Test, plus die Offline-Selbsttest-Pfad. Keine Kreditkarte ist für die kostenlose Testversion erforderlich.

Aktuelle Validierungsgrenze

NVIDIA A40Die Ergebnisse sind validiert.GPUAnsprüche werden erst erhoben, wenn zusätzliche Hardware-Ergebnisse vorliegen.

Offene Benchmark-Daten

Überprüfen Sie den veröffentlichten Validierungs-Snapshot.

Die maschinenlesbareJSONzeichnet den aktuellenNVIDIA A40Validierungsgrenze und Schlagzeilenergebnisse auf dieser Seite. Ergebnisse bleiben loadload-spezifisch und sind keine universelle Spargarantie.