Nvidia Bereidt Groq Inference Chips voor Lancering op de Chinese Markt
Door Wendy Frey
Nvidia zal vanaf mei 2026 Groq AI-chips naar China verzenden. Het bedrijf onthulde het plan op 17 maart na het verkrijgen van goedkeuring van de toezichthouder voor de verkoop van H200. Jensen Huang wedt erop dat inference-processors de trainingsrestricties zullen omzeilen die hebben geleid tot de annulering van H20- en B30A-zendingen. De deal van $20 miljard voor licenties van Groq in december 2025 begint plotseling logisch te worden. China krijgt taalverwerkingsunits in plaats van GPU's. Beijing keurde de import goed ondanks de ban op trainingschips.
De timing volgt een pijnlijk patroon. De Biden-regering blokkeerde de verkoop van H20 in januari 2026. De regering-Trump handhaafde de beperkingen. Alibaba en Tencent zochten wanhopig naar alternatieven terwijl Nvidia $15 miljard aan kwartaalomzet verloor. Groq-chips glippen door de mazen omdat ze inference versnellen in plaats van grote taalmodellen te trainen. Huang vertelde investeerders om China uit de prognoses te sluiten. Toen vond hij de maas in de wet.
Huang Aankondigde Groq 3 op GTC 2026 voor Mei Implementatie
De GTC 2026-conferentie in San Jose onthulde de strategie. Huang introduceerde Groq 3-chips die zijn gebouwd voor inference-snelheid in plaats van modeltraining. Chinese klanten ontvangen de eerste exportversies. Reuters berichtte over de tijdlijn en citeerde twee bronnen die bekend zijn met de zaak. De chips zijn verantwoordelijk voor het genereren van tokens voor uitgerolde AI-modellen, niet voor training. Dit onderscheid houdt ze binnen de wettelijke grenzen terwijl ze voldoen aan de vraag van Alibaba, ByteDance en Tencent.
Het technische ontwerp is gericht op taalverwerkingsunits. Groq-technologie versnelt AI-inference door middel van een compiler die is geoptimaliseerd voor token generatie. Nvidia herontwierp de architectuur specifiek om te voldoen aan de Chinese exportregels. Geen tensorcores voor training. Pure inference doorvoer. Bronnen zeggen dat de chips in bestaande H200-servers als compagnonprocessors zullen worden geplaatst. Het resultaat is een hybride systeem dat technisch voldoet aan de Amerikaanse beperkingen terwijl het de prestaties levert die Chinese technologiebedrijven nodig hebben.
$20 Miljard Wed op Inference Vermijdt Trump Beperkingen
Nvidia betaalde in december $20 miljard voor Groq-technologie. Die overname dient nu als de achterdeur van het bedrijf naar China. De deal omvatte licentieovereenkomsten die compilertechnologie en chipontwerpen naar Nvidia's controle overdragen. Huang leidde onmiddellijk ingenieursmiddelen om naar export-conforme producten. Twee miljoen H200-bestellingen staan al in de wachtrij. Groq creëert een nieuwe inkomstenstroom zonder nationale veiligheidsbeperkingen te activeren.
De politieke berekening blijft riskant. Officials van de Trump-regering zouden de inference-maas van de wet van de ene op de andere dag kunnen sluiten. Maar Huang wedt erop dat inference-chips buiten Washington's focus op trainingsmogelijkheden vallen. China heeft inference nodig om bestaande AI-modellen te draaien. Het heeft training hardware nodig om nieuwe te bouwen. De Verenigde Staten hebben het laatstgenoemde verboden. Nvidia verkoopt nu het eerstgenoemde. Als de strategie standhoudt, kan Groq miljarden genereren via Alibaba Cloud-diensten en het AI-ecosysteem van ByteDance. Als toezichthouders ingrijpen, verliest Huang de laatste belangrijke brug van Nvidia naar China.




