Penterjemah AI Offline Google Tunjukkan Apa yang Dapat Dilakukan AI Tempatan Tanpa Awan

News

Oleh Wendy Frey

Kecerdasan buatan tidak selalunya memerlukan pusat data untuk berguna. Eksperimen terbaru Google dengan Penterjemah Gemma menjadikan idea itu lebih nyata: sebuah penterjemah suara kecil dan mudah alih yang dapat mendengar, menterjemah dan bercakap tanpa sambungan internet.

Dibina di sekitar Raspberry Pi 5 dan model ringan Gemma 4 E2B milik Google, projek ini mengubah sekumpulan komponen murah menjadi peranti penterjemahan AI sepenuhnya tempatan. Ia bukan alat Google komersial yang baru, tetapi prototaip sumber terbuka yang direka untuk menunjukkan betapa mampunya AI berpindah dari awan kepada perkakasan seharian.

Dan itu mungkin lebih penting daripada penterjemah itu sendiri. Penterjemah Gemma adalah satu lagi contoh perubahan lebih luas ke arah AI dalam peranti, di mana pemprosesan berlaku secara tempatan bukannya menghantar setiap permintaan ke pelayan jauh.

Apakah Penterjemah Gemma Google?

Penterjemah Gemma adalah projek penterjemahan suara sumber terbuka yang dibangunkan dengan bantuan Google Antigravity. Tujuannya mudah: membolehkan dua orang yang berbahasa berbeza berkomunikasi melalui peranti kompak yang menjalankan keseluruhan proses penterjemahan secara tempatan.

Prototip ini menggabungkan Raspberry Pi 5 dengan 8GB RAM, mikrofon, pembesar suara atau fon kepala dan paparan kecil. Perkakasan ini boleh diletakkan di dalam rumah 3D cetak khas, menjadikan hasilnya kelihatan lebih seperti penterjemah pegang tangan khusus daripada komputer papan tunggal konvensional.

Bagaimanapun, terdapat perbezaan penting. Google tidak mengumumkan Penterjemah Gemma sebagai produk pengguna. Ia adalah demonstrasi teknologi dan projek sumber terbuka. Kod, skrip penyebaran dan fail kes cetak 3D disediakan untuk pembangun dan peminat yang ingin menghasilkan semula atau mengubah sistem.

KomponenPeranan
Raspberry Pi 5, 8GBPerkakasan pengkomputeran tempatan
Gemma 4 E2BPenterjemahan AI
LiteRT-LMPelaksanaan model tempatan
MoonshinePemprosesan suara
MikrofonInput suara
Pembesar suara/fon kepalaOutput ucapan yang diterjemah
Paparan kecilAntara muka pengguna
Kes cetak 3DRumah mudah alih

Bagaimana Penterjemah AI Offline Berfungsi?

Bahagian paling menarik projek ini bukan perkakasnya tetapi cara lapisan perisian dibahagikan kepada beberapa komponen tempatan.

Apabila seorang bercakap ke dalam mikrofon, audio diproses pada peranti tersebut. Ucapan ditranskripsi, teks yang dihasilkan diterjemahkan oleh Gemma, dan ayat yang diterjemahkan kemudian ditukar semula ke dalam ucapan. Repositori menggambarkan ini sebagai saluran tempatan yang melibatkan pengenalan ucapan, penterjemahan berasaskan Gemma dan teks kepada suara.

Projek ini direka sekitar dua saluran perbualan. Setiap orang memilih bahasa, merakam frasa mereka dan menerima terjemahan dalam bahasa orang lain. Dalam pelaksanaan semasa, interaksi adalah berdasarkan kawalan tekan untuk bercakap bukannya pembantu yang sentiasa mendengar.

Titik penting ialah inferens AI itu sendiri berlaku secara tempatan. Setelah perisian dan model yang diperlukan dipasang, penterjemah tidak memerlukan sambungan internet untuk melakukan tugas utamanya.

Itu mengubah penggunaan praktikal dengan ketara. Penterjemah berasaskan awan boleh menjadi tidak boleh dipercayai apabila sambungan lemah. Peranti dalam talian boleh terus berfungsi di dalam pesawat, di kawasan terpencil atau di lokasi di mana infrastruktur rangkaian tidak tersedia.

Mengapa Gemma 4 E2B Penting

Di tengah projek ini adalah Gemma 4 E2B, salah satu model Gemma yang lebih kecil milik Google yang direka untuk aplikasi tepi.

Model AI besar sangat kuat, tetapi biasanya memerlukan sumber pengkomputeran yang besar. Tujuan model kecil tepi adalah berbeza: mereka mengorbankan beberapa skala sebagai pertukaran untuk keupayaan berjalan terus di telefon, komputer dan perkakasan tertanam.

Google secara aktif memajukan pendekatan ini dengan Gemma 4 dan runtime LiteRT-LM-nya. Syarikat itu mengatakan LiteRT-LM direka untuk menjadikan model Gemma praktikal di seluruh pelbagai peranti, termasuk Raspberry Pi 5. Dokumentasi Google sendiri menyoroti model E2B dan E4B sebagai pilihan untuk aplikasi tepi dan IoT.

Penterjemah Gemma menunjukkan apa yang kelihatan seperti strategi itu di luar penanda aras atau demon pembangun. Bukannya meminta perkhidmatan AI jauh untuk menterjemah ayat, Raspberry Pi menjadi komputer AI.

Itu adalah perubahan ketara dalam cara kita boleh memikirkan perkakasan AI.

Tanpa Awan Bererti Lebih Dari Sekadar Bekerja Secara Offline

Kelebihan jelas penterjemahan tempatan adalah kesambungan. Jika tiada Wi-Fi atau isyarat mudah alih, peranti masih boleh melaksanakan fungsi utamanya.

Tetapi privasi mungkin sama pentingnya.

Dengan perkhidmatan penterjemahan awan, rakaman suara atau perbualan yang ditranskripsi mungkin perlu meninggalkan peranti untuk pemprosesan. Seni bina offline boleh menjaga saluran pemprosesan ucapan pada perkakasan tempatan. Untuk perbualan sensitif, mesyuarat persendirian atau operasi lapangan, itu boleh menjadi kelebihan yang bermakna.

Ini tidak secara automatik menjadikan setiap aplikasi AI tempatan sempurna secara peribadi atau selamat. Jaminan privasi sebenar bergantung pada konfigurasi lengkap perisian dan perkakasan. Namun, menghapuskan keperluan untuk menghantar data suara ke perkhidmatan AI jauh menghilangkan kategori pendedahan yang penting.

Prinsip yang sama berlaku di luar penterjemahan. AI tempatan boleh berguna untuk pembantu peribadi, alat aksesibiliti, peranti pendidikan, sistem industri dan peralatan kecemasan di mana sambungan tidak dapat dijamin.

Google Membangun Menuju Ekosistem AI Dalam Peranti yang Lebih Besar

Penterjemah Gemma lebih masuk akal apabila dilihat sebagai sebahagian daripada strategi AI tepi yang lebih luas oleh Google.

Tumpuan LiteRT-LM syarikat itu direka khusus untuk menjalankan AI generatif secara tempatan. Google menggambarkannya sebagai lanjutan teknologi LiteRTnya dengan keupayaan yang dioptimumkan untuk model generatif, sementara kerja terbaru Gemma 4 telah menekankan menjalankan model yang lebih kecil di seluruh perkakasan mudah alih, desktop dan IoT.

Raspberry Pi sangat menarik kerana ia berada di antara komputer tradisional dan peranti tertanam. Ia murah, padat dan boleh diakses oleh pembangun. Jika model menjadi cukup mampu untuk melakukan tugas berguna pada perkakasan sekecil ini, bilangan aplikasi AI yang mungkin akan berkembang dengan ketara.

Oleh itu, penterjemah tersebut kurang menarik sebagai pengganti untuk Google Translate daripada sebagai bukti konsep.

Ia mengajukan soalan yang lebih besar: apa yang berlaku apabila AI berguna tidak lagi perlu tinggal di awan?

Bolehkah Anda Membangun Penterjemah Google Sendiri?

Ya. Salah satu aspek terkuat projek ini adalah bahawa Google telah membuat pelaksanaan tersedia sebagai sumber terbuka.

Repositori rasmi termasuk kod aplikasi, skrip penyediaan, konfigurasi penyebaran dan fail STL untuk rumah cetak 3D. Keperluan perkakasan yang didokumentasikan adalah Raspberry Pi 5 dengan 8GB RAM, bersama dengan input audio, output audio dan paparan.

Perisian boleh disebarkan melalui skrip yang disediakan. Projek ini mencipta persekitaran Python, memuat turun model Gemma yang diperlukan dan memulakan perkhidmatan tempatan. Terdapat juga skrip penyebaran Raspberry Pi khusus untuk mengkonfigurasi peranti sebagai alat gaya kiosk tetap.

Ini menjadikan Penterjemah Gemma lebih dari sekadar demonstrasi yang mencolok. Pembangun boleh memeriksa pelaksanaan, bereksperimen dengan antara muka, menggantikan komponen atau menggunakan seni bina sebagai titik permulaan untuk projek AI tepi mereka sendiri.

Masih terdapat had yang jelas. Peranti ini adalah prototaip daripada produk komersial yang diperhalusi, dan prestasi AI tempatan bergantung pada konfigurasi perkakasan dan perisian. Raspberry Pi tidak boleh memberikan kapasiti pemprosesan yang sama seperti kluster infrastruktur awan besar.

Tetapi itu adalah tepat yang menjadikan eksperimen ini menarik.

Gambaran Lebih Besar: AI Makin Dekat Dengan Pengguna

Selama bertahun-tahun, model AI yang dominan adalah mudah: peranti anda menghantar permintaan kepada pelayan yang kuat, pelayan memprosesnya dan menghantar hasil kembali.

Model itu tidak hilang. AI awan akan tetap menjadi penting untuk banyak aplikasi yang menuntut.

Tetapi projek seperti Penterjemah Gemma Google menunjukkan alternatifnya. Apabila model menjadi lebih kecil dan runtime menjadi lebih cekap, lebih banyak keupayaan AI boleh berpindah secara langsung ke peranti yang sudah kita miliki.

Penterjemahan adalah pameran yang sangat baik kerana aliran kerjanya mudah difahami. Anda bercakap, AI memproses permintaan dan orang lain mendengar hasilnya. Tiada infrastruktur pelayan yang terlihat dan, selepas pemasangan, tiada sambungan internet diperlukan.

Bahagian paling penting bagi projek Google mungkin tidak semestinya penterjemah kecil itu sendiri. Itu adalah demonstrasi bahawa model AI generatif moden boleh menjadi komponen di dalam peranti kecil, murah dan mudah alih.

Penterjemah Gemma bukan produk Google Translate seterusnya. Ia adalah pandangan tentang apa yang datang selepas AI hanya di awan: peranti pintar yang boleh beroperasi secara bebas, menyimpan lebih banyak pemprosesan secara tempatan dan tetap berguna walaupun internet hilang.

Templat viral

Terokai templat AI viral kami dan gunakannya pada foto anda.

Terokai templat