Nvidia prépare des puces d'inférence Groq pour le lancement sur le marché chinois

News

Par Wendy Frey

vecteezy_futuristic-server-racks-with-neon-lighting-in-a-dark-data_53192210-scaled.jpg Nvidia expédiera des puces d'IA Groq en Chine à partir de mai 2026. La société a dévoilé ce plan le 17 mars après avoir obtenu l'approbation réglementaire pour les ventes de H200. Jensen Huang parie que les processeurs d'inférence contourneront les restrictions de formation qui ont tué les envois de H20 et B30A. Le contrat de licence Groq de 20 milliards de dollars conclu en décembre 2025 prend soudain tout son sens. La Chine reçoit des unités de traitement du langage au lieu de GPU. Pékin a approuvé les importations malgré l'interdiction des puces de formation.

Le timing suit un schéma douloureux. L'administration Biden a bloqué les ventes de H20 en janvier 2026. L'administration Trump a maintenu les restrictions. Alibaba et Tencent se sont précipités vers des alternatives tandis que Nvidia a perdu 15 milliards de dollars de revenus trimestriels. Les puces Groq passent à travers car elles accélèrent l'inférence plutôt que de former de grands modèles linguistiques. Huang a dit aux investisseurs d'exclure la Chine des prévisions. Puis il a trouvé la faille.

Huang a annoncé Groq 3 à GTC 2026 pour un déploiement en mai

La conférence GTC 2026 à San Jose a révélé la stratégie. Huang a présenté les puces Groq 3 conçues pour la rapidité d'inférence plutôt que pour la formation de modèles. Les clients chinois recevront les premières versions d'exportation. Reuters a rapporté le calendrier, citant deux sources au courant de la question. Les puces gèrent la génération de tokens pour les modèles d'IA déployés, et non la formation. Cette distinction les maintient dans les limites légales tout en satisfaisant la demande d'Alibaba, ByteDance et Tencent.

La conception technique se concentre sur les unités de traitement du langage. La technologie Groq accélère l'inférence d'IA grâce à un compilateur optimisé pour la génération de tokens. Nvidia a redessiné l'architecture spécifiquement pour se conformer aux réglementations d'exportation chinoises. Pas de cœurs tensoriels pour la formation. Un débit d'inférence pur. Les sources disent que les puces s'intégreront dans les serveurs H200 existants en tant que processeurs compagnons. Le résultat est un système hybride qui respecte techniquement les restrictions américaines tout en offrant la performance dont les entreprises technologiques chinoises ont besoin.

Pari de 20 milliards de dollars sur l'inférence qui évite les restrictions de Trump

Nvidia a payé 20 milliards de dollars pour la technologie Groq en décembre. Cette acquisition sert maintenant de porte dérobée à la société pour entrer en Chine. Le contrat incluait des accords de licence qui transferaient la technologie de compilateur et les conceptions de puces au contrôle de Nvidia. Huang a immédiatement redirigé les ressources d'ingénierie vers des produits conformes à l'exportation. Deux millions de commandes de H200 sont déjà en attente. Groq crée un nouveau flux de revenus sans déclencher de restrictions de sécurité nationale.

Le calcul politique demeure risqué. Les fonctionnaires de l'administration Trump pourraient fermer la faille d'inférence du jour au lendemain. Mais Huang parie que les puces d'inférence échappent à l'intérêt de Washington pour les capacités de formation. La Chine a besoin de l'inférence pour faire fonctionner les modèles d'IA existants. Elle a besoin de matériel de formation pour en construire de nouveaux. Les États-Unis ont interdit ce dernier. Nvidia vend maintenant le premier. Si la stratégie fonctionne, Groq pourrait générer des milliards grâce aux services cloud d'Alibaba et à l'écosystème IA de ByteDance. Si les régulateurs interviennent, Huang perd le dernier grand pont de Nvidia vers la Chine.

Source: https://www.reuters.com/world/china/nvidia-preparing-groq-chips-that-can-be-sold-chinese-market-sources-say-2026-03-17/

Modèles viraux

Découvrez nos modèles viraux IA et appliquez-les à vos photos.

Découvrir les modèles