← Overzicht

NVIDIA Groq 3 LPX in volle productie voor agentic inference

· opgehaald 05:16

NVIDIA zet Groq 3 LPX op Hot Chips in volle productie: de inference-accelerator uit de deal van 20 miljard dollar voor Groq-assets, als uitbreiding van Vera Rubin NVL72. Artificial Analysis meet 3.400 outputtokens per seconde op Gemma 4 31B bij 100k context. Een rack telt 256 Groq 3-chips; Nebius is de eerste cloudafnemer via Token Factory, met racks later dit jaar.

Op 24 augustus 2026 meldt NVIDIA op Hot Chips dat Groq 3 LPX in volle productie is. De chip komt uit de overname van Groq-assets voor 20 miljard dollar en is bedoeld als inference-accelerator bij Vera Rubin NVL72.

Het doel is decode en tokengeneratie voor agentic AI. Artificial Analysis rapporteert 3.400 outputtokens per seconde op Gemma 4 31B bij 100k context.

Racks pakken 256 Groq 3-chips. Nebius is de eerste cloudafnemer via Token Factory; de racks zouden later dit jaar live gaan.

Let op de spelling: Groq is de chip, niet Grok.