Nvidia Forbereder Groq Inference-chips til Lancering på det Kinesiske Marked

News

Af Wendy Frey

vecteezy_futuristic-server-racks-with-neon-lighting-in-a-dark-data_53192210-scaled.jpg Nvidia vil sende Groq AI-chips til Kina fra maj 2026. Virksomheden afslørede planen den 17. marts efter at have sikret sig reguleringsgodkendelse til H200-salg. Jensen Huang satser på, at inference-processorer vil omgå træningsrestriktionerne, der dræbte H20- og B30A-leverancer. Den $20 milliarder store Groq-licensaftale fra december 2025 giver pludselig mening. Kina får sprogbehandlingsenheder i stedet for GPU'er. Beijing godkendte importen på trods af forbuddet mod træningschips.

Timingen følger et smertefuldt mønster. Biden-administrationen blokerede H20-salg i januar 2026. Trump-administrationen opretholdt restriktionerne. Alibaba og Tencent kæmpede for alternativer, mens Nvidia tabte $15 milliarder i kvartalsmæssige indtægter. Groq-chips slipper gennem, fordi de accelererer inference i stedet for at træne store sprogmodeller. Huang bad investorer om at udelade Kina fra prognoserne. Så fandt han smuthullet.

Huang Annoncede Groq 3 ved GTC 2026 til Udrulning i Maj

GTC 2026-konferencen i San Jose afslørede strategien. Huang introducerede Groq 3-chips, der er bygget til inference-hastighed i stedet for modeltræning. Kinesiske kunder vil modtage de første eksportversioner. Reuters rapporterede tidshorisonten og citerede to kilder, der er fortrolige med sagen. Chipsene håndterer token-generation for deployerede AI-modeller - ikke træning. Den adskillelse holder dem inden for lovens rammer, samtidig med at den opfylder efterspørgslen fra Alibaba, ByteDance og Tencent.

Det tekniske design fokuserer på sprogbehandlingsenheder. Groq-teknologien accelererer AI-inference gennem en compiler optimeret til token-generation. Nvidia redesignede arkitekturen specifikt for at overholde kinesiske eksportregler. Ingen tensor-kerner til træning. Ren inference-gennemløb. Kilder siger, at chipsene vil passe ind i eksisterende H200-servere som følgeskabsprocessorer. Resultatet er et hybrid-system, der teknisk set overholder de amerikanske restriktioner, samtidig med at det leverer den præstation, som kinesiske teknologivirksomheder har brug for.

$20 Milliarder Veddemål på Inference Undgår Trump-restriktioner

Nvidia betalte $20 milliarder for Groq-teknologi i december. Den opkøb nu fungerer som virksomhedens bagdør ind i Kina. Aftalen omfattede licensaftaler, der overførte compiler-teknologi og chipdesigns til Nvidias kontrol. Huang omdirigerede straks ingeniørressourcer mod eksportkompatible produkter. To millioner H200-ordrer sidder allerede i køen. Groq skaber en ny indtægtsstrøm uden at udløse nationale sikkerhedsrestriktioner.

Den politiske beregning forbliver risikabel. Trump-administrationsfolk kunne lukke inference-smuthullet fra den ene dag til den anden. Men Huang satser på, at inference-chips falder uden for Washingtons fokus på træningskapaciteter. Kina har brug for inference for at køre eksisterende AI-modeller. Det har brug for træningshardware for at bygge nye. USA har forbudt sidstnævnte. Nvidia sælger nu det førstnævnte. Hvis strategien holder, kan Groq generere milliarder gennem Alibaba Cloud-tjenester og ByteDances AI-økosystem. Hvis tilsynsmyndighederne griber ind, mister Huang Nvidias sidste store bro ind til Kina.

Source: https://www.reuters.com/world/china/nvidia-preparing-groq-chips-that-can-be-sold-chinese-market-sources-say-2026-03-17/

Virale skabeloner

Udforsk vores virale AI-skabeloner, og brug dem på dine fotos.

Udforsk skabeloner