Nvidia pregătește cipurile de inferență Groq pentru lansarea pe piața din China

News

De Wendy Frey

vecteezy_futuristic-server-racks-with-neon-lighting-in-a-dark-data_53192210-scaled.jpg Nvidia va livra cipurile de inteligență artificială Groq către China începând cu mai 2026. Compania a dezvăluit planul pe 17 martie, după ce a obținut aprobarea de reglementare pentru vânzările H200. Jensen Huang pariază că procesoarele de inferență vor ocoli restricțiile de formare care au distrus livrările H20 și B30A. Acordul de licență Groq de 20 de miliarde de dolari din decembrie 2025 devine dintr-o dată logic. China primește unități de procesare a limbajului în loc de GPU-uri. Beijingul a aprobat importurile în ciuda interdicției privind cipurile de formare.

Timpul urmează un tipar dureros. Administrația Biden a blocat vânzările H20 în ianuarie 2026. Administrația Trump a menținut restricțiile. Alibaba și Tencent s-au zbătut pentru alternative, în timp ce Nvidia a pierdut 15 miliarde de dolari din venitul trimestrial. Cipurile Groq au scăpat pentru că accelerează inferența în loc să antreneze modele mari de limbaj. Huang le-a spus investitorilor să excludă China din prognoze. Apoi a descoperit lacuna.

Huang a anunțat Groq 3 la GTC 2026 pentru desfășurare în mai

Conferința GTC 2026 din San Jose a dezvăluit strategia. Huang a introdus cipurile Groq 3 construite pentru viteza de inferență, nu pentru formarea modelului. Clienții din China vor primi primele versiuni de export. Reuters a raportat cronologia, citând două surse familiare cu subiectul. Cipurile se ocupă cu generarea de token-uri pentru modelele AI desfășurate, nu cu formarea. Acea distincție le menține în limitele legale, satisfăcând totodată cererea din partea Alibaba, ByteDance și Tencent.

Designul tehnic se concentrează pe unitățile de procesare a limbajului. Tehnologia Groq accelerează inferența AI printr-un compilator optimizat pentru generarea de token-uri. Nvidia a reproiectat arhitectura specific pentru a respecta reglementările de export din China. Fără nuclee tensor pentru formare. Flux pur de inferență. Sursele spun că cipurile se vor integra în serverele H200 existente ca procesoare complementare. Rezultatul este un sistem hibrid care respectă tehnic restricțiile din SUA, iar în același timp oferă performanța de care au nevoie companiile tehnologice chineze.

Pariul de 20 de miliarde pe inferență ocolește restricțiile Trump

Nvidia a plătit 20 de miliarde de dolari pentru tehnologia Groq în decembrie. Această achiziție servește acum ca o ușă din spate pentru companie în China. Acordul a inclus contracte de licențiere care au transferat tehnologia compilatorului și designurile de cipuri către controlul Nvidia. Huang a redirecționat imediat resursele de inginerie către produse conforme cu exportul. Două milioane de comenzi H200 așteaptă deja în rând. Groq creează un nou flux de venituri fără a declanșa restricțiile de securitate națională.

Calculul politic rămâne riscant. Oficialii din administrația Trump ar putea închide lacuna de inferență peste noapte. Dar Huang pariază că cipurile de inferență nu se încadrează în atenția Washingtonului asupra capacităților de formare. China are nevoie de inferență pentru a rula modelele AI existente. Are nevoie de hardware de formare pentru a construi noi modele. Statele Unite au interzis ultima. Nvidia vinde acum prima. Dacă strategia funcționează, Groq ar putea genera miliarde prin serviciile Alibaba Cloud și ecosistemul AI de la ByteDance. Dacă reglementatorii intervine, Huang pierde ultima mare punte a Nvidia în China.

Source: https://www.reuters.com/world/china/nvidia-preparing-groq-chips-that-can-be-sold-chinese-market-sources-say-2026-03-17/

Șabloane virale

Descoperă șabloanele noastre virale AI și aplică-le pe fotografiile tale.

Explorează șabloanele