Nvidia Sedia Chip Inferens Groq untuk Pelancaran Pasaran China

News

Oleh Wendy Frey

vecteezy_futuristic-server-racks-with-neon-lighting-in-a-dark-data_53192210-scaled.jpg Nvidia akan menghantar chip AI Groq ke China bermula pada Mei 2026. Syarikat itu mendedahkan rancangan tersebut pada 17 Mac selepas mendapatkan kelulusan pengawalseliaan untuk penjualan H200. Jensen Huang bertaruh bahawa pemproses inferens akan mengelak daripada sekatan latihan yang menghentikan penghantaran H20 dan B30A. Perjanjian pelesenan Groq bernilai $20 bilion pada Disember 2025 kini menjelma dengan logik. China memperoleh unit pemprosesan bahasa dan bukannya GPU. Beijing meluluskan import walaupun melarang chip latihan.

Masa pelancaran mengikuti pola yang menyakitkan. Pentadbiran Biden menyekat penjualan H20 pada Januari 2026. Pentadbiran Trump mengekalkan sekatan tersebut. Alibaba dan Tencent berlumba-lumba mencari alternatif sementara Nvidia kehilangan $15 bilion dalam pendapatan suku tahunan. Chip Groq dapat memasuki pasaran kerana mereka mempercepatkan inferens dan bukannya melatih model bahasa besar. Huang memberitahu pelabur untuk mengecualikan China dari ramalan. Kemudian dia menemui celah tersebut.

Huang Umumkan Groq 3 di GTC 2026 untuk Pelancaran Mei

Persidangan GTC 2026 di San Jose telah mendedahkan strategi tersebut. Huang memperkenalkan chip Groq 3 yang dibina untuk kelajuan inferens dan bukannya latihan model. Pelanggan China akan menerima versi eksport pertama. Reuters melaporkan jadual waktu tersebut, memetik dua sumber yang biasa dengan perkara itu. Chip ini mengendalikan penjanaan token untuk model AI yang digunakan, bukan latihan. Perbezaan ini memastikan mereka tetap dalam sempadan undang-undang sambil memenuhi permintaan dari Alibaba, ByteDance, dan Tencent.

Reka bentuk teknikal berfokus pada unit pemprosesan bahasa. Teknologi Groq mempercepat inferens AI melalui kompilator yang dioptimumkan untuk penjanaan token. Nvidia menyusun semula seni bina khusus untuk mematuhi peraturan eksport China. Tiada inti tensor untuk latihan. Hasil inferens tulen. Sumber-sumber mengatakan chip akan dipasang dalam pelayan H200 sedia ada sebagai pemproses tambahan. Hasilnya adalah sistem hibrid yang secara teknikal mematuhi sekatan AS sambil memberikan prestasi yang diperlukan oleh syarikat teknologi China.

Pertaruhan $20 Bilion pada Inferens Mengelak Sekatan Trump

Nvidia membayar $20 bilion untuk teknologi Groq pada bulan Disember. Perolehan itu kini berfungsi sebagai pintu belakang syarikat ke China. Perjanjian tersebut termasuk perjanjian pelesenan yang memindahkan teknologi kompilator dan reka bentuk chip ke dalam kawalan Nvidia. Huang segera mengalihkan sumber kejuruteraan ke arah produk yang mematuhi eksport. Dua juta pesanan H200 kini sudah berada dalam barisan. Groq mewujudkan aliran pendapatan baru tanpa mencetuskan sekatan keselamatan negara.

Pengiraan politik kekal berisiko. Pegawai pentadbiran Trump boleh menutup celah inferens tersebut dalam sekelip mata. Tetapi Huang bertaruh bahawa chip inferens berada di luar tumpuan Washington pada keupayaan latihan. China memerlukan inferens untuk menjalankan model AI yang sedia ada. Ia memerlukan perkakasan latihan untuk membina yang baru. Amerika Syarikat telah melarang yang terakhir. Nvidia kini menjual yang pertama. Jika strategi ini berjaya, Groq boleh menjana berbilion melalui perkhidmatan Alibaba Cloud dan ekosistem AI ByteDance. Jika pengawal selia campur tangan, Huang kehilangan jambatan utama terakhir Nvidia ke China.

Source: https://www.reuters.com/world/china/nvidia-preparing-groq-chips-that-can-be-sold-chinese-market-sources-say-2026-03-17/

Templat viral

Terokai templat AI viral kami dan gunakannya pada foto anda.

Terokai templat