Nvidia Prepara i Chip Groq per il Lancio nel Mercato Cinese

News

Di Wendy Frey

vecteezy_futuristic-server-racks-with-neon-lighting-in-a-dark-data_53192210-scaled.jpg\nNvidia inizierà a spedire i chip Groq AI in Cina a partire da maggio 2026. L'azienda ha svelato il piano il 17 marzo dopo aver ottenuto l'approvazione normativa per le vendite di H200. Jensen Huang scommette che i processori di inferenza bypasseranno le restrizioni alla formazione che hanno bloccato le spedizioni di H20 e B30A. Il contratto di licenza da 20 miliardi di dollari con Groq di dicembre 2025 assume improvvisamente un senso. La Cina riceve unità di elaborazione del linguaggio anziché GPU. Pechino ha approvato le importazioni nonostante il divieto di chip di addestramento.

Il tempismo segue un modello doloroso. L'amministrazione Biden ha bloccato le vendite di H20 a gennaio 2026. L'amministrazione Trump aveva mantenuto le restrizioni. Alibaba e Tencent si sono affrettate a cercare alternative mentre Nvidia ha perso 15 miliardi di dollari in entrate trimestrali. I chip Groq riescono a passare perché accelerano l'inferenza piuttosto che addestrare grandi modelli di linguaggio. Huang ha invitato gli investitori a escludere la Cina dalle previsioni. Poi ha trovato la scappatoia.

Huang Annuncia Groq 3 al GTC 2026 per il Dispiegamento di Maggio

La conferenza GTC 2026 a San Jose ha rivelato la strategia. Huang ha presentato i chip Groq 3 progettati per la velocità di inferenza piuttosto che per l'addestramento del modello. I clienti cinesi riceveranno le prime versioni d'esportazione. Reuters ha riportato la tempistica, citando due fonti a conoscenza della questione. I chip gestiscono la generazione di token per i modelli AI distribuiti, non l'addestramento. Questa distinzione li mantiene entro i confini legali soddisfacendo la domanda da Alibaba, ByteDance e Tencent.

Il design tecnico si concentra sulle unità di elaborazione del linguaggio. La tecnologia Groq accelera l'inferenza AI attraverso un compilatore ottimizzato per la generazione di token. Nvidia ha ridisegnato l'architettura specificamente per conformarsi alle normative sulle esportazioni cinesi. Niente core tensor per l'addestramento. Solo throughput di inferenza pura. Le fonti dicono che i chip si inseriranno nei server H200 esistenti come processori compagni. Il risultato è un sistema ibrido che tecnicamente rispetta le restrizioni statunitensi fornendo le prestazioni di cui hanno bisogno le aziende tecnologiche cinesi.

Scommessa da 20 Miliardi su Inferenza Evita Restrizioni di Trump

Nvidia ha pagato 20 miliardi di dollari per la tecnologia Groq a dicembre. Quella acquisizione ora funge da ingresso secondario dell'azienda in Cina. L'accordo includeva contratti di licenza che trasferivano la tecnologia del compilatore e i progetti dei chip al controllo di Nvidia. Huang ha immediatamente reindirizzato le risorse ingegneristiche verso prodotti conformi alle esportazioni. Due milioni di ordini di H200 sono già in coda. Groq crea un nuovo flusso di entrate senza attivare restrizioni sulla sicurezza nazionale.

Il calcolo politico rimane rischioso. I funzionari dell'amministrazione Trump potrebbero chiudere la scappatoia dell'inferenza da un giorno all'altro. Ma Huang scommette che i chip di inferenza rientrano al di fuori dell'attenzione di Washington sulle capacità di addestramento. La Cina ha bisogno di inferenza per gestire i modelli AI esistenti. Ha bisogno di hardware di addestramento per costruirne di nuovi. Gli Stati Uniti hanno vietato quest'ultimo. Nvidia ora vende il primo. Se la strategia regge, Groq potrebbe generare miliardi attraverso i servizi Alibaba Cloud e l'ecosistema AI di ByteDance. Se i regolatori intervenissero, Huang perderebbe l'ultima grande via di accesso di Nvidia in Cina.

Source: https://www.reuters.com/world/china/nvidia-preparing-groq-chips-that-can-be-sold-chinese-market-sources-say-2026-03-17/

Modelli virali

Scopri i nostri modelli virali IA e applicali alle tue foto.

Scopri i modelli