Nvidia sagatavo Groq inferenču mikroshēmas Ķīnas tirgum
Autors: Wendy Frey
Nvidia sāk piegādāt Groq AI mikroshēmas Ķīnai, sākot no 2026. gada maija. Uzņēmums plānu paziņoja 17. martā, pēc regulatīvā apstiprinājuma saņemšanas H200 pārdošanai. Jensen Huang paļaujas uz to, ka inferenču procesori apies apmācību ierobežojumus, kas iznīcināja H20 un B30A piegādes. 20 miljardu dolāru Groq licences līgums, noslēgts 2025. gada decembrī, pēkšņi iegūst jēgu. Ķīna iegūst valodas apstrādes vienības, nevis GPU. Pekina apstiprinājusi importa piegādes, neskatoties uz apmācību mikroshēmu aizliegumu.
Laikapstākļi seko sāpīgai tendencei. Baidena administrācija 2026. gada janvārī bloķēja H20 pārdošanu. Trampa administrācija saglabāja ierobežojumus. Alibaba un Tencent steidzās meklēt alternatīvas, kamēr Nvidia zaudēja 15 miljardus dolāru ceturkšņa ieņēmumos. Groq mikroshēmas izslīd, jo tās paātrina inferenci, nevis apmāca lielus valodas modeļus. Huang teica investoriem, lai izslēdz Ķīnu no prognozēm. Pēc tam viņš atrada likumīgo caurumu.
Huang paziņoja par Groq 3 GTC 2026 priekšpiegādei
GTC 2026 konference Sanhosē atklāja stratēģiju. Huang iepazīstināja ar Groq 3 mikroshēmām, kas izstrādātas inferenču ātrumam, nevis modeļu apmācībai. Ķīnas klienti saņems pirmās eksporta versijas. Reuters ziņoja par laika grafiku, atsaucoties uz diviem avotiem, kas pazīstami ar šo jautājumu. Mikroshēmas apstrādā tokenu ģenerāciju izvietotajiem AI modeļiem, nevis apmācībai. Šī atšķirība ļauj tām palikt likumiskajās robežās, vienlaikus apmierinot pieprasījumu no Alibaba, ByteDance un Tencent.
Tehniskais dizains ir koncentrēts uz valodas apstrādes vienībām. Groq tehnoloģija paātrina AI inferenci caur kompilatoru, kas optimizēts tokenu ģenerācijai. Nvidia pārstrādāja arhitektūru konkrēti, lai atbilstu Ķīnas eksporta regulējumiem. Nav tensoru kodolu apmācībai. Tīra inferences caurlaidspēja. Avoti ziņo, ka mikroshēmas iekļausies esošajos H200 serveros kā palīgprocesori. Rezultāts ir hibrīdsistēma, kas tehniski atbilst ASV ierobežojumiem, vienlaikus nodrošinot sniegumu, ko vajag Ķīnas tehnoloģiju uzņēmumiem.
20 miljardu dolāru derība uz inferenci apiet Trampa ierobežojumus
Nvidia samaksāja 20 miljardus dolāru par Groq tehnoloģiju decembrī. Šī iegāde tagad kalpo kā uzņēmuma aizmugurējā durvju izeja uz Ķīnu. Līgums ietvēra licences nolikumus, kas pārcēla kompilatora tehnoloģiju un mikroshēmu dizainus uz Nvidia kontroles. Huang nekavējoties novirzīja inženiertehniskos resursus uz eksporta atbilstīgiem produktiem. Divi miljoni H200 pasūtījumu jau ir rindā. Groq radīs jaunu ieņēmumu straumi, neatverot valsts drošības ierobežojumus.
Politiskā aprēķina riski paliek augsti. Trampa administrācijas amatpersonas varētu noslēgt šo inferenču caurumu vienas nakts laikā. Bet Huang paļaujas uz to, ka inferenču mikroshēmas atrodas ārpus Vašingtonas uzmanības centrā uz apmācību iespējām. Ķīnai vajag inferenci, lai darbinātu esošos AI modeļus. Tai nepieciešami apmācību aparāti, lai izveidotu jaunus. Amerikas Savienotās Valstis aizliedza pēdējos. Nvidia tagad pārdod pirmos. Ja stratēģija izturēs, Groq varētu ģenerēt miljardus caur Alibaba Cloud pakalpojumiem un ByteDance AI ekosistēmu. Ja regulatori iejauksies, Huang zaudē pēdējo lielo tiltu uz Ķīnu.




