Nvidia ruošia Groq inferencijos mikroschemas Kinijos rinkai
Autorius: Wendy Frey
Nvidia pradės siųsti Groq AI mikroschemas į Kiniją nuo 2026 m. gegužės. Įmonė paskelbė apie šį planą kovo 17 d., gavusi reguliavimo leidimą H200 pardavimams. Jensen Huang lažinasi, kad inferencijos mikroschemos apeis mokymo apribojimus, kurie nutraukė H20 ir B30A siuntas. 20 milijardų dolerių Groq licencijavimo sutartis, pasirašyta 2025 m. gruodį, dabar atrodo logiška. Kinija gauna kalbos apdorojimo įrenginius vietoj GPU. Pekinas patvirtino importą, nepaisant mokymo mikroschemų draudimo.
Laikas seka skausmingą modelį. Bideno administracija užblokavo H20 pardavimus 2026 m. sausį. Trump'o administracija išlaikė apribojimus. Alibaba ir Tencent skubėjo ieškoti alternatyvų, kol Nvidia prarado 15 milijardų dolerių ketvirtinio pajamų. Groq mikroschemos praslys, nes jos pagreitina inferenciją, o ne treniruoja didelius kalbos modelius. Huang sakė investuotojams, kad reikia neįtraukti Kinijos į prognozes. Tada jis rado spragą.
Huang paskelbė apie Groq 3 GTC 2026 konferencijoje gegužės diegimui
GTC 2026 konferencija San Chosėje atskleidė strategiją. Huang pristatė Groq 3 mikroschemas, sukurtas inferencijos greičiui, o ne modelių mokymui. Kinijos klientai gaus pirmąsias eksportui skirtas versijas. Reuters pranešė apie terminus, cituodama du šaltinius, žinomas apie šią situaciją. Mikroschemos tvarko simbolių generavimą diegtiems AI modeliams - ne mokymui. Tas skirtumas leidžia joms laikytis teisinių apribojimų, tuo pačiu tenkinant Alibaba, ByteDance ir Tencent poreikius.
Techninis dizainas yra orientuotas į kalbos apdorojimo įrenginius. Groq technologija pagreitina AI inferenciją per kompiliatorių, optimizuotą simbolių generavimui. Nvidia perdaro architektūrą specialiai, kad atitiktų Kinijos eksporto taisykles. Nėra tensorių branduolių mokymui. Grynas inferencijos pralaidumas. Šaltiniai sako, kad mikroschemos įsilies į esamus H200 serverius kaip pagalbiniai procesoriai. Rezultate gaunamas hibridinis sistema, kuri techniškai atitinka JAV apribojimus tuo pačiu metu teikdama Kinijos technologijų kompanijoms reikiamą našumą.
20 milijardų dolerių statymas dėl inferencijos apeina Trump'o apribojimus
Nvidia sumokėjo 20 milijardų dolerių už Groq technologiją gruodį. Šis įsigijimas dabar tarnauja kaip įmonės užpakalinis įėjimas į Kiniją. Sutartis apėmė licencijavimo sutartis, kurios perleido kompiliatoriaus technologiją ir mikroschemos dizainus Nvidia kontrolei. Huang iš karto nukreipė inžinerijos išteklius į eksportui atitinkančius produktus. Du milijonai H200 užsakymų jau laukia eilėje. Groq sukuria naują pajamų srautą, nesukeldamas nacionalinio saugumo apribojimų.
Politinis skaičiavimas išlieka rizikingas. Trump'o administracijos pareigūnai gali uždaryti inferencijos spragą per naktį. Bet Huang lažinasi, kad inferencijos mikroschemos iškrenta už Vašingtono dėmesio centro, susijusio su mokymo galimybėmis. Kinijai reikia inferencijos, kad veiktų esami AI modeliai. Reikia mokymo įrangos, kad būtų kuriami nauji. Jungtinės Valstijos uždraudė pastaruosius. Nvidia dabar parduoda pirmuosius. Jei strategija pasiteisins, Groq gali generuoti milijardus per Alibaba Cloud paslaugas ir ByteDance AI ekosistemą. Jei reguliuotojai įsikiš, Huang praras paskutinį didelį Nvidia tiltą į Kiniją.




