NVIDIA startet Serienproduktion des Groq 3 LPX
NVIDIA bringt Groq 3 LPX in Serie; Nebius erster AI-Cloud-Anbieter
Mit KI erstellt◆ Fakten auf einen Blick
- NVIDIA Groq 3 LPX ist jetzt in voller Produktion.
- Groq 3 LPX ist eine Erweiterung der NVIDIA Vera Rubin Plattform bzw. des Vera Rubin NVL72 Rack-Scale-Systems.
- Die Ankündigung erfolgte auf der Hot Chips 2026.
- Im Artificial-Analysis-Benchmark mit dem offenen agentischen Modell Gemma 4 31B lieferte Groq 3 LPX 3.400 Ausgabe-Tokens pro Sekunde für 100.000-Token-Langkontext-Anwendungsfälle.
- Damit war Groq 3 LPX 4x schneller als die nächstbeste Alternative.
- Nebius ist der erste AI-Cloud-Anbieter, der NVIDIA Groq 3 LPX übernimmt.
NVIDIA startet Serienproduktion des Groq 3 LPX
NVIDIA hat den Groq 3 LPX in die volle Produktion überführt. Der dedizierte Inferenz-Beschleuniger erweitert die Vera-Rubin-Plattform und ist für agentische Workloads mit langen Kontexten ausgelegt. Er zielt auf schnelle Token-Generierung für agentische Systeme ab. Im Artificial-Analysis-Benchmark mit Gemma 4 31B erreicht er 3.400 Ausgabe-Tokens pro Sekunde für 100.000-Token-Langkontext-Anwendungsfälle – viermal schneller als die nächstbeste Alternative. Die Ankündigung erfolgte auf der Hot Chips 2026.
Nebius wird erster Cloud-Anbieter mit Groq 3 LPX
Nebius ist der erste AI-Cloud-Anbieter, der den Groq 3 LPX übernimmt. Der Beschleuniger ist für agentische KI-Workloads und latenzempfindliche Anwendungen wie agentisches Coding konzipiert. Er liefert ultraschnelle Token-Generierung, die für hochresponsive agentische KI-Workloads erforderlich ist. Als zweckgebundene Erweiterung der Vera-Rubin-Plattform zielt er auf schnelle Inferenz ab.



