Synthszr Charts — die großen AI-Marken im Wettkampf ums Podium
synthszr charts
groq

Groq · v3 · lpx · seit 24. August 2026 (Vollproduktion angekündigt); Auslieferung/Verfügbarkeit ursprünglich für Q3 2026 geplant · 18× · zuletzt 29. Aug. 2026

100
Momentum

NVIDIA Groq 3 LPX ist ein rack-skalierter KI-Inferenzbeschleuniger, der die NVIDIA Vera-Rubin-Plattform als spezialisierter "Decode"-Coprozessor ergänzt. Ein LPX-Rack besteht aus 256 miteinander verbundenen Groq-3-LPU-Chips (Nachfolger der Groq-LPU-Architektur, die NVIDIA im Dezember 2025 für rund 20 Mrd. USD lizenzierte) und arbeitet im Zusammenspiel mit Vera-Rubin-GPUs, um lange Kontexte und agentische KI-Workloads mit niedriger Latenz zu verarbeiten. Das Produkt ist seit dem 24. August 2026 in Vollproduktion, wird auf einem 4-nm-Prozess bei Samsung Foundry gefertigt und Nebius ist der erste angekündigte Kunde. In Benchmarks von Artificial Analysis erreichte das System 3.400 Output-Token/Sekunde beim Modell Gemma 4 31B.

Momentum-Verlauf
01.06.30.08.

Features

Fertigungsprozess (nm)4-nm-Prozess (Samsung Foundry SF4X)
PlattformErweiterung der NVIDIA Vera-Rubin-Plattform (Vera-Rubin NVL72), Rubin-GPUs übernehmen Prefill, LPX übernimmt Decode
PreisKein öffentlicher Stückpreis; NVIDIA nennt Zielpreis von 45 USD pro Million Tokens im Systembetrieb
Rechenleistung (FLOPS/TOPS)3.400 Output-Token/Sek. im Artificial-Analysis-Benchmark (Gemma 4 31B, 100.000-Token-Kontext); 4x schnellere Reaktionszeit als nächstbeste Alternativplattform
Release-DatumVollproduktion angekündigt am 24. August 2026 (Hot Chips 2026); Vorstellung auf GTC 2026 im März 2026
Speicher500 MB SRAM pro LPU-Chip, 150 TB/s SRAM-Bandbreite, 2,5 TB/s Scale-up-Bandbreite; volles Rack (256 Chips) = 128 GB SRAM, 40 PB/s Bandbreite
VerfügbarkeitSeit 24. August 2026 in Vollproduktion; erster Kunde Nebius, Rack-Deployment soll noch 2026 online gehen

Weitere Produkte in dieser Kategorie: KI-Inferenz-Hardware

Belege (18)

Subscribe free. Unsubscribe the second it sucks.

High-signal news across AI, business, UX, and tech. Every morning.