Telset.id – Google resmi merilis model Gemini 3.8 Live yang kini dilengkapi avatar pilihan untuk membuat interaksi terasa lebih seperti berbicara dengan manusia. Kemampuan ini hadir berkat kombinasi fitur pidato real-time Gemini dan pembuatan video berlatensi rendah, sehingga avatar yang dipilih tampak melakukan sinkronisasi bibir dengan teks yang dibacakan Gemini kepada pengguna.
Peluncuran ini menandai langkah baru Google dalam menghadirkan pengalaman AI yang memiliki “kehadiran visual” yang jauh lebih kuat. Peneliti Shuo-yiin Chang dan software engineer CJ Zheng menyebut bahwa AI kini terasa memiliki kehadiran visual yang lebih nyata. Avatar-avatar tersebut dirancang khusus untuk pengguna enterprise, bukan sekadar alat bagi karyawan perusahaan untuk menyelesaikan pekerjaan, melainkan sebagai demonstrasi kemampuan yang bisa ditawarkan Google kepada pengguna akhir dari para pelanggannya.
Dengan kata lain, avatar Gemini 3.8 Live dapat dimanfaatkan untuk berbagai kebutuhan seperti layanan pelanggan, resepsionis, hingga pelatihan. Sejak peluncuran, bisnis dapat memilih dari pustaka avatar preset yang tersedia, namun mereka juga diberi kebebasan untuk membuat avatar kustom agar sesuai dengan identitas merek perusahaan, misalnya dengan menambahkan logo relevan pada seragam avatar tersebut.

Keamanan dan Dukungan Multibahasa
Dari sisi keamanan, Google menegaskan bahwa video avatar mereka menyertakan watermark SynthID untuk memverifikasi bahwa konten tersebut memang dihasilkan oleh AI. Perusahaan menyatakan bahwa watermark tak terlihat ini dijalin langsung ke dalam output audio dan video, membantu memastikan konten yang dihasilkan AI tetap dapat dideteksi guna meminimalkan misinformasi dan salah atribusi.
Dalam unggahan terpisah, Google juga mengungkap bahwa Gemini 3.8 Live kini mendukung 97 bahasa dengan kemampuan pergantian bahasa otomatis, sehingga percakapan multibahasa menjadi lebih mulus. Versi yang lebih canggih dari model ini, yakni 3.8 Live Extended Thinking, diklaim mengungguli GPT-Live-1 Astra dan Grok Voice Think Fast 2.0 di berbagai benchmark, sekaligus menawarkan biaya operasional per jam input audio yang lebih murah.
Kemampuan Gemini 3.8 Live ini melengkapi ekosistem AI Google yang terus berkembang. Sebelumnya, Google juga telah merilis Live Avatar Gemini 3.8 yang menyasar segmen enterprise. Langkah ini menunjukkan fokus Google dalam memperluas penerapan AI di berbagai sektor bisnis dan layanan publik.
Baca Juga:
Selain pengembangan model bahasa dan avatar, Google juga tengah menggarap berbagai inovasi lain di ranah AI. Salah satunya adalah Project Suncatcher yang menguji cip AI di orbit, serta upaya mengirim data center AI ke orbit melalui proyek serupa. Inisiatif-inisiatif ini memperlihatkan ambisi Google untuk memperluas infrastruktur AI ke luar angkasa.
Di sisi aplikasi konsumen, Google juga terus memperbarui layanannya. Google Photos baru saja merilis alat Redact yang berfungsi menyensor data sensitif pada gambar. Fitur-fitur semacam ini menunjukkan bagaimana Google berupaya menghadirkan AI yang tidak hanya canggih, tetapi juga memperhatikan aspek privasi dan keamanan pengguna.

Dampak bagi Bisnis dan Pengguna
Kehadiran avatar pada Gemini 3.8 Live membuka peluang baru bagi perusahaan yang ingin meningkatkan interaksi dengan pelanggan. Dengan kemampuan kustomisasi avatar sesuai branding, bisnis dapat menciptakan pengalaman yang lebih personal dan konsisten dengan identitas mereka. Penggunaan untuk layanan pelanggan, resepsionis, dan pelatihan menjadi beberapa contoh konkret bagaimana teknologi ini dapat diterapkan.
Dari perspektif pengguna akhir, interaksi dengan AI menjadi lebih alami karena adanya elemen visual yang mendampingi suara. Meski demikian, Google menekankan bahwa teknologi ini ditujukan untuk enterprise, sehingga adopsi awal kemungkinan besar akan terjadi di lingkungan bisnis sebelum merambah ke penggunaan yang lebih luas.
Dengan dukungan 97 bahasa dan pergantian bahasa otomatis, Gemini 3.8 Live juga berpotensi menjangkau pasar global yang lebih luas. Kemampuan ini sangat relevan bagi perusahaan multinasional yang melayani pelanggan dari berbagai negara dengan bahasa yang berbeda-beda.
Perbandingan dengan model pesaing seperti GPT-Live-1 Astra dan Grok Voice Think Fast 2.0 menunjukkan bahwa Google berupaya memposisikan Gemini 3.8 Live Extended Thinking sebagai pilihan yang kompetitif, baik dari sisi performa maupun efisiensi biaya. Klaim unggul di berbagai benchmark dan biaya operasional yang lebih murah menjadi nilai tawar utama yang ditawarkan Google.
Secara keseluruhan, peluncuran Gemini 3.8 Live dengan fitur avatar menandai babak baru dalam evolusi asisten AI. Fokus pada segmen enterprise, dukungan multibahasa, serta perhatian pada aspek keamanan melalui watermark SynthID menjadi tiga pilar utama yang diusung Google dalam produk ini.
[ META_DESCRIPTION]
Google merilis Gemini 3.8 Live dengan fitur avatar untuk enterprise, dukungan 97 bahasa, dan watermark SynthID untuk keamanan konten AI.





Komentar
Belum ada komentar.