Dion Harris, senior riaditeľ firmy NVIDIA, povedal, že prvé racky Groq 3 LPX budú nasadené na platforme poskytovateľa cloudových služieb Nebius. V kombinácii s procesormi Vera a GPU Rubin vytvoria kompletný heterogénny výpočtový klaster, ktorý začne ponúkať služby v druhej polovici roka 2026.
Každý rack LPX integruje 256 jazykových procesorových jednotiek Groq 3, alebo LPUs. Systém využíva veľké množstvo SRAM na čipe, aby znížil náklady spojené s prístupom k externému pamäťovému úložisku a je optimalizovaný na inferečné úlohy vyžadujúce dlhé kontextové okná a rýchle časy reakcie, vrátane agentov AI a programovania asistovaného AI. Podľa oficiálnych benchmarkových výsledkov rack poskytuje 3 400 výstupných tokenov za sekundu pri spustení modelu Gemma 4 31B s 100 000-tokenovým kontextovým oknom, čo mu poskytuje jasnú výkonnostnú výhodu v úlohách citlivých na latenciu.
NVIDIA a Groq dosiahli dohodu v hodnote 20 miliárd dolárov v decembri 2025. V rámci tejto transakcie NVIDIA získala licencie na technológiu architektúry čipov Groq a priviedla zakladajúci tím Groq a kľúčových inžinierov do spoločnosti. Bola to najväčšia technologická transakcia v histórii NVIDIA. Groq zostal nezávislou spoločnosťou a jeho existujúci cloudový biznis pokračoval v činnosti. Pred dohodou si Groq už získal značnú pozornosť odvetvia za svoju technológiu inferencie LPU s nízkou latenciou používanú s open-source veľkými jazykovými modelmi.
Platforma Vera Rubin zamestnáva disaggregovanú, heterogénnu architektúru inferencie. GPU Rubin zvládajú operácie predvyplnenia modelu a spracovanie kontextu v veľkom meradle, zatiaľ čo systémy Groq 3 LPX sú zamerané na vysokorýchlostnú generáciu tokenov počas fázy dekódovania. Procesory Vera vykonávajú úlohy všeobecného účelu, ako sú volania nástrojov a vykonávanie kódu. Toto rozdelenie úloh umožňuje rôznym procesorom podporiť celý tok práce agenta AI podľa ich zodpovedajúcich silných stránok.
Zariadenia na výrobu čipov tiež odrážajú rozdiely v dodávateľskom reťazci. LPUs série Groq vyrába spoločnosť Samsung, zatiaľ čo mainstreamové GPU NVIDIA sú produkované za použitia výrobných kapacít TSMC.






























































































