Nvidia valmistelee Groq-inferenssipiirejä Kiinan markkinoille

News

Kirjoittaja: Wendy Frey

vecteezy_futuristic-server-racks-with-neon-lighting-in-a-dark-data_53192210-scaled.jpg Nvidia alkaa lähettää Groq AI -piirejä Kiinaan toukokuusta 2026 alkaen. Yhtiö julkisti suunnitelmansa 17. maaliskuuta saadessaan sääntelyviranomaisten hyväksynnän H200-myynnille. Jensen Huang uskoo, että inferenssiprosessorit ohittavat koulutuksen rajoitukset, jotka estivät H20- ja B30A-lähetykset. 20 miljardin dollarin Groq-lisenssihankinta joulukuulta 2025 alkaa yhtäkkiä näyttää järkevältä. Kiina saa kieliprosessointiyksiköitä sen sijaan, että se saisi GPU:eita. Peking hyväksyi tuonnin huolimatta koulutuspiirien kiellosta.

Aikataulu seuraa tuskallista kaavaa. Bidenin hallinto esti H20-myynnit tammikuussa 2026. Trumpin hallinto ylläpitää rajoituksia. Alibaba ja Tencent etsivät vaihtoehtoja samalla kun Nvidia menetti 15 miljardia dollaria neljännesvuosituloistaan. Groq-piirit pääsevät läpi, koska ne nopeuttavat inferenssiä sen sijaan, että ne kouluttaisivat suuria kielimalleja. Huang kehotti sijoittajia jättämään Kiinan ennusteista pois. Sitten hän löysi porsaanreiän.

Huang ilmoitti Groq 3:sta GTC 2026:ssa toukokuun sijoituksia varten

GTC 2026 -konferenssi San Josessa paljasti strategian. Huang esitteli Groq 3 -piirejä, jotka on rakennettu inferenssinopeutta varten eikä mallin kouluttamiseksi. Kiinalaiset asiakkaat saavat ensimmäiset vientiversiot. Reuters raportoi aikarajan, viitaten kahteen asiaan perehtyneeseen lähteeseen. Piirit käsittelevät token-generointia toimitetuissa AI-malleissa - eivät koulutusta. Tämä ero pitää ne lain rajojen sisällä samalla, kun se tyydyttää Alibaba, ByteDance ja Tencentin kysynnän.

Tekninen muotoilu keskittyy kieliprosessointiyksiköihin. Groq-tekniikka nopeuttaa AI-inferenssiä token-generointiin optimoidun kääntäjän kautta. Nvidia suunnitteli arkkitehtuurin erityisesti vastaamaan Kiinan vientisääntöjä. Ei tensoriytimiä koulutusta varten. Puhdas inferenssikapasiteetti. Lähteiden mukaan piirit asennetaan olemassa oleviin H200-palvelimiin kumppaniprosessoreina. Tulos on hybridi-järjestelmä, joka teknisesti noudattaa Yhdysvaltojen rajoituksia, samalla kun se tarjoaa suorituskyvyn, jota kiinalaiset teknologiayritykset tarvitsevat.

20 miljardin dollarin veto inferenssimarkkinoilla ohittaa Trumpin rajoitukset

Nvidia maksoi 20 miljardia dollaria Groq-tekniikasta joulukuussa. Tämä hankinta toimii nyt yhtiön takaovena Kiinaan. Kauppaan sisältyi lisensointisopimuksia, jotka siirsivät kääntäjätekniikan ja piirisuunnitelmat Nvidian hallintaan. Huang ohjasi heti insinöörivaroja vientisääntöjen mukaisiin tuotteisiin. Kaksi miljoonaa H200-tilausta odottaa jo vuorossa. Groq luo uuden tulovirransa ilman kansallisen turvallisuuden rajoitusten laukaisemista.

Poliittinen laskelma on edelleen riskialtis. Trumpin hallinnon viranomaiset saattavat sulkea inferenssiporsaanreiän yön yli. Mutta Huang uskoo, että inferenssipiiirien ei ole tarkoitus olla Washingtonin keskipisteessä koulutusmahdollisuuksia ajatellen. Kiina tarvitsee inferenssiä nykyisten AI-mallien ajamiseksi. Se tarvitsee koulutuslaitteistoa uusien rakentamiseksi. Yhdysvallat on kieltänyt jälkimmäiset. Nvidia myy nyt ensimmäisiä. Jos strategia toimii, Groq voisi tuottaa miljardeja Alibaba Cloud -palvelujen ja ByteDancen AI-ekosysteemin kautta. Jos sääntelyviranomaiset puuttuvat asiaan, Huang menettää Nvidian viimeisen merkittävän sillan Kiinaan.

Lähde: https://www.reuters.com/world/china/nvidia-preparing-groq-chips-that-can-be-sold-chinese-market-sources-say-2026-03-17/

Viraalit mallit

Tutustu viraaleihin AI-malleihimme ja käytä niitä omissa kuvissasi.

Tutustu malleihin