Nvidia oznámila, že její inferenční akcelerátor Groq 3 LPX přechází do plné produkce. Čip je součástí platformy Vera Rubin NVL72 a míří na nejnáročnější agentní úlohy s dlouhým kontextem. V prvním nezávislém benchmarku od Artificial Analysis dosáhl s modelem Gemma 4 31B rychlosti 3 431 výstupních tokenů za sekundu při kontextu 100 tisíc tokenů. Na testu SPEED-Bench pak naměřili medián 4 767 tokenů za sekundu. Podle Nvidie technologie využívá kompilátorem naplánované zpracování a překrývání komunikace s výpočty, takže zvládá i malé dávky typické pro vícenásobné dotazování agentů. Platforma podporuje oddělené zpracování prefillu i dekódování a škálování až na modely s biliony parametrů. Groq 3 LPX tak doplňuje platformu Vera Rubin o rychlou odezvu pro interaktivní nasazení.
Nvidia uvedla do plné produkce akcelerátor Groq 3 LPX pro agenty