Nvidia felkészíti a Groq inferenciát szolgáló chipjeit a kínai piacon való bevezetésre
Szerző: Wendy Frey
Nvidia Groq AI chipeket szállít Kínába 2026 májusától. A cég ezt a tervet március 17-én jelentette be, miután megszerezte a H200 eladásához szükséges szabályozói jóváhagyást. Jensen Huang arra fogad, hogy az inferencia processzorok elkerülik azokat a kiképzési korlátozásokat, amelyek megölték a H20 és B30A szállítmányokat. A 2025 decemberében kötött 20 milliárd dolláros Groq licencszerződés hirtelen értelmet nyer. Kína nyelvi feldolgozó egységeket kap a GPU-k helyett. Peking jóváhagyta az importokat, annak ellenére, hogy betiltotta a képzési chipeket.
Az időzítés egy fájdalmas mintát követ. A Biden-kormányzat 2026 januárjában blokkolta a H20 eladásokat. A Trump-kormányzat fenntartotta a korlátozásokat. Az Alibaba és a Tencent alternatívák után kutatott, miközben az Nvidia 15 milliárd dolláros negyedéves bevételt veszített. A Groq chipek átszivárognak, mert az inferenciát gyorsítják, nem pedig nagy nyelvi modellek oktatását. Huang azt mondta a befektetőknek, hogy a kínait ki kell zárni a előrejelzésekből. Aztán rátalált a kiskapura.
Huang bejelentette a Groq 3-at a GTC 2026-on a májusi bevezetésre
A GTC 2026 konferencia San Joséban leleplezte a stratégiát. Huang bemutatta a Groq 3 chipeket, amelyeket az inferencia sebességére terveztek, nem a modellek oktatására. A kínai ügyfelek kapják az első export változatokat. A Reuters beszámolt a menetrendről, hivatkozva két, az üggyel ismerős forrásra. A chipek a telepített AI modellek token generálását végzik - nem a képzést. Ez a megkülönböztetés jogi keretek között tartja őket, miközben kielégíti az Alibaba, a ByteDance és a Tencent iránti keresletet.
A technikai tervezés a nyelvi feldolgozó egységekre összpontosít. A Groq technológia felgyorsítja az AI inferenciát egy token generálásra optimalizált fordítón keresztül. Az Nvidia a kínai exportszabályoknak való megfelelés érdekében újjáépítette az architektúrát. Nincsenek tensor magok az oktatáshoz. Tiszta inferencia átvitel. A források szerint a chipek illeszkedni fognak a meglévő H200 szerverekhez, mint kiegészítő processzorok. Az eredmény egy hibrid rendszer, amely technikailag megfelel az amerikai korlátozásoknak, miközben teljesíti a kínai technológiai cégek által igényelt teljesítményt.
20 milliárd dolláros tipp az inferenciába elkerüli a Trump-korlátozásokat
Az Nvidia 20 milliárd dollárt fizetett a Groq technológiáért decemberben. Ez a felvásárlás most az Nvidia hátsó bejárataként szolgál Kínába. Az üzlet licencmegállapodásokat is magában foglalt, amelyek a fordító technológiát és a chipterveket az Nvidia ellenőrzésébe átruházták. Huang azonnal átirányította a mérnöki erőforrásokat export-kompatibilis termékek felé. Kétmillió H200 rendelés már a sorban áll. A Groq új bevételi forrást teremt anélkül, hogy nemzeti biztonsági korlátozásokat aktiválna.
A politikai számítás kockázatos marad. A Trump-adminisztráció tisztviselői egy éjszaka alatt bezárhatják az inferencia kiskaput. De Huang azon fogad, hogy az inferencia chipek kívül esnek Washington képzési képességekre összpontosító figyelmén. Kínának inferenciára van szüksége a meglévő AI modellek futtatásához. Új modellek létrehozásához képzési hardware-re van szüksége. Az Egyesült Államok ez utóbbit betiltotta. Az Nvidia most az előbbieket értékesíti. Ha a stratégia működik, a Groq milliárdokat generálhat az Alibaba Cloud szolgáltatásokon és a ByteDance AI ökoszisztémáján keresztül. Ha a szabályozók beavatkoznak, Huang elveszíti az Nvidia utolsó nagy hídját Kínába.




