KI-Wirtschaft

Nvidia startet Groq-Chip – Tempo-Rekord unter Kritik

3 Min. Lesezeit

TL;DR Too Long; Didn’t read

Nvidia hat den Inferenzchip Groq 3 LPX in Serienfertigung überführt und meldet 3.400 Token pro Sekunde für ein offenes 31-Milliarden-Parameter-Modell. Der Chip stammt aus der 20-Milliarden-Dollar-Übernahme von Groq und soll KI-Agenten schneller antworten lassen, Erstkunde ist Nebius. Fachleute halten den vierfachen Geschwindigkeitsvorsprung gegenüber Cerebras für irreführend, weil Nvidia dafür 64 statt ein bis zwei Chips braucht.

Ein Mikrochip mit Groq-Logo-Sticker liegt auf einer Nvidia-Logo-Plakette, daneben rennt ein Hase mit Blitz-Symbol an einer langsameren Schildkröte mit Cerebras-Sticker vorbei Generiertes Bild mit GPT Image 2

Das Wichtigste in Kürze

  • Groq 3 LPX ist seit dem 24. August 2026 in Serienproduktion, gefertigt bei Samsung.
  • Der Chip erreicht 3.400 Token pro Sekunde bei 100.000 Token Kontextfenster im Agenten-Benchmark.
  • Nvidia kaufte Groqs Technologie im Dezember 2025 für 20 Milliarden Dollar als Lizenz- und Personal-Deal.
  • Cloud-Anbieter Nebius integriert den Chip als erster Kunde in seine Token-Factory-Plattform.
  • Für den Vergleich mit Cerebras braucht Nvidia mindestens 64 Chips, Cerebras nur ein bis zwei.
  • Senatorin Warren hinterfragte den Groq-Deal im März 2026 als mögliche Kartellrechts-Umgehung.

Nvidia hat den spezialisierten Inferenzchip Groq 3 LPX in die Serienfertigung überführt und positioniert ihn als Antwort auf wachsende Anforderungen von KI-Agenten. Im Benchmark erreicht der Chip 3.400 Token pro Sekunde bei einem offenen 31-Milliarden-Parameter-Modell mit 100.000 Token Kontextfenster – nach Angaben von Nvidia viermal schneller als die nächste Konkurrenzplattform.

Serienchip stammt aus umstrittenem Lizenzdeal

Der Chip basiert auf Technologie aus einem Deal, den Nvidia laut eigener Pressemitteilung am 24. August 2026 in Serienproduktion überführte. Grundlage ist eine im Dezember 2025 geschlossene Vereinbarung im Wert von 20 Milliarden Dollar – Nvidias bislang größter Zukauf. Rechtlich handelt es sich nicht um eine klassische Übernahme: Nvidia erwirbt eine nicht-exklusive Lizenz auf Groqs Chip-Technologie und stellt einen Großteil der Führungsriege ein, darunter den bisherigen Vorstandsvorsitzenden, während Groq formal eigenständig bleibt. Firmenchef Jensen Huang erklärte, das Vera-Rubin-Portfolio erweitere sich damit um eine Plattform, die speziell auf agentenbasierte KI-Workloads zugeschnitten sei.

Der Groq 3 LPX ergänzt die Vera-Rubin-NVL72-Plattform um einen dedizierten Baustein für die sogenannte Decode-Phase der Inferenz – jenen Abschnitt, der bestimmt, wie schnell ein System einzelne Antwort-Token erzeugt. Dafür verbaut der bei Samsung gefertigte Chip 500 Megabyte Zwischenspeicher direkt auf dem Die, um die Speicherbandbreite zu entlasten, die bei anderen Inferenz-Beschleunigern häufig zum Flaschenhals wird. Ein Preis für den Chip selbst wurde nicht veröffentlicht; er wird nicht einzeln verkauft, sondern ausschließlich über Cloud-Anbieter als Recheninfrastruktur bereitgestellt.

Nebius wird erster Kunde, SpaceX setzt auf Vera Rubin

Erster Abnehmer ist der KI-Cloud-Anbieter Nebius, an dem Nvidia bereits eine Beteiligung von 9,3 Prozent hält. Nebius integriert den Groq 3 LPX in seine Produktionsplattform Token Factory. Technikchef Danila Shtan begründete den Schritt damit, dass die Generierungsphase der Inferenz über die gefühlte Reaktionsgeschwindigkeit eines KI-Systems entscheide – genau dort setze der neue Chip an. Nebius sei die erste KI-Cloud, die den Baustein produktiv einsetze, und ermögliche damit schnellere Antwortzeiten für mehrstufige Agenten-Anwendungen.

Als weiterer Großkunde für die Vera-Rubin-Plattform gilt laut einem Bericht von SiliconANGLE das Raumfahrtunternehmen SpaceX. Es wolle seine nächste KI-Architektur auf Nvidias Vera-CPUs aufbauen, die Orchestrierung, Werkzeugausführung und Simulationsaufgaben sowohl in irdischen Rechenzentren als auch auf Satelliten übernehmen sollen. Die Kombination aus Nebius als Cloud-Kunde und SpaceX als Infrastrukturpartner zeigt, wie Nvidia den Groq-Zukauf über verschiedene Einsatzfelder hinweg verwertet – von öffentlich zugänglicher KI-Cloud-Infrastruktur bis zu unternehmensinterner Agenten-Infrastruktur. Ein Starttermin für Kunden in Deutschland oder der EU ist bislang nicht bekannt; Zugang besteht nur indirekt über internationale Cloud-Plattformen.

Fachleute halten Vergleich mit Cerebras für beschönigt

Nvidia bewirbt den Groq 3 LPX mit einem Geschwindigkeitsvorteil, der einer Analyse von The Register zufolge nur bedingt aussagekräftig ist. Im Benchmark erzielte der Chip 3.400 Token pro Sekunde gegenüber 882 Token pro Sekunde bei einem System von Cerebras – nach Nvidias Rechnung ein vierfacher Vorsprung. Die Analyse weist jedoch darauf hin, dass für den Nvidia-Wert mindestens 64 Groq-3-LPX-Chips nötig sind, während dieselbe Modellgröße bei Cerebras in ein bis zwei Beschleuniger passt. Zudem handle es sich beim getesteten Modell mit 31 Milliarden Parametern um einen für Nvidias Architektur besonders günstigen Fall, keinen typischen Produktionseinsatz. Cerebras kündigte zudem bereits Nachfolgesysteme mit doppelter Leistung an, sodass der Vergleich schnell veralten dürfte.

Der Zukauf steht zusätzlich unter politischer Beobachtung: Die US-Senatorinnen und -Senatoren Elizabeth Warren und Richard Blumenthal fragten Nvidia in einem offenen Brief vom 20. März 2026, ob der Deal als sogenannte Reverse-Acquihire-Konstruktion gezielt die kartellrechtliche Vorabprüfung nach dem Hart-Scott-Rodino-Gesetz umgehe. Nvidias rund 90-prozentiger Marktanteil bei KI-Beschleunigern verschärfe diese Bedenken laut den Senatoren zusätzlich; eine abschließende Entscheidung von Justizministerium oder Handelsaufsicht FTC steht bislang aus.

Entscheidend wird, ob sich der Leistungsvorsprung auch in Produktionsumgebungen mit größeren Modellen und gemischten Workloads bestätigt, statt nur im besonders günstig gewählten Testszenario. Offen bleibt zudem, wie die US-Kartellbehörden auf die Reverse-Acquihire-Konstruktion reagieren – eine Entscheidung, die über den Groq-Fall hinaus Signalwirkung für ähnliche Deals anderer Tech-Konzerne haben dürfte.

Häufige Fragen

Was kostet der Groq 3 LPX?

Nvidia hat keinen Preis veröffentlicht. Der Chip wird nicht einzeln verkauft, sondern über KI-Cloud-Anbieter wie Nebius als Recheninfrastruktur bereitgestellt.

Ist der Chip auch in Deutschland oder der EU verfügbar?

Direkt nicht. Zugang gibt es nur indirekt über internationale Cloud-Plattformen, die den Chip in ihre Infrastruktur integrieren; ein europäischer Starttermin ist bislang nicht bekannt.

Was unterscheidet den Groq 3 LPX von normalen Nvidia-GPUs?

Er ist ausschließlich auf die Token-Generierungsphase der Inferenz spezialisiert und nutzt großen Zwischenspeicher direkt auf dem Chip, statt wie GPUs Training und Inferenz gemeinsam abzudecken.

Wie verhält sich Groq selbst zu dem Deal?

Groq bleibt laut Vereinbarung formal ein eigenständiges Unternehmen und bezeichnete die Vereinbarung als nicht-exklusive Lizenzvereinbarung, während Führungskräfte zu Nvidia wechselten.

Wann prüfen US-Behörden den Deal?

Die Senatorinnen und Senatoren forderten Justizministerium und Handelsaufsicht FTC auf, bis zum 3. April 2026 Stellung zu beziehen; eine öffentliche Entscheidung liegt bislang nicht vor.

Quellen (5)
  1. NVIDIA Groq 3 LPX Now in Full Production With World-Class Speed for Agentic AI
  2. What Nvidia's first Groq 3 LPU benchmarks do and don't tell us about its $20B gamble
  3. Nvidia buying AI chip startup Groq's assets for about $20 billion in its largest deal on record
  4. Nvidia's dedicated inference accelerator Groq 3 LPX enters full production to supercharge AI agents
  5. Warren, Blumenthal Question Whether NVIDIA's $20 Billion Groq Deal is Attempt to Avoid Antitrust Laws

Dein KI-Update für die Arbeitswoche

Einmal pro Woche das Wichtigste aus der KI-Welt – plus ein Praxis-Tipp zum direkt Ausprobieren. Kein Spam, jederzeit abbestellbar.

← Zurück zum Blog