AITeknologi

Gemini 3.8 Flash TTS dan Flash-Lite TTS Dirilis, Bisa Kloning Suara dari Teks

Avatar of Sulsel Times
0
×

Gemini 3.8 Flash TTS dan Flash-Lite TTS Dirilis, Bisa Kloning Suara dari Teks

Sebarkan artikel ini
Gemini 3.8 Flash TTS dan Flash-Lite TTS Dirilis, Bisa Kloning Suara dari Teks
Gemini 3.8 Flash TTS dan Flash-Lite TTS Dirilis, Bisa Kloning Suara dari Teks
WhatsApp Logo
Sulsel Times Hadir di WhatsApp Channel
Follow

Sulseltimes.com, Jumat, 25/09/2026 — Google merilis Gemini 3.8 Flash TTS dan Gemini 3.8 Flash-Lite TTS, dua model kecerdasan buatan yang mengubah perintah teks menjadi suara dengan dukungan lebih dari 100 bahasa.

Ringkasnya…
  • Google merilis Gemini 3.8 Flash TTS dan Flash-Lite TTS
  • Kedua model mengubah teks menjadi suara dan mendukung lebih dari 100 bahasa
  • Fitur kloning suara memerlukan sampel 30 detik dan persetujuan lisan pemilik suara
  • Audio satu jam setara sekitar 90.000 token audio
  • Akses Enterprise API menyusul
Disclaimer: Ringkasan dibuat secara otomatis.

Google menyebut Gemini 3.8 Flash TTS cocok untuk proyek kreatif, termasuk karakter game, buku audio, dan podcast.

Scroll Kebawah
Advertisement

Sedangkan versi Lite ditujukan untuk produksi ucapan dalam skala besar dengan biaya lebih terjangkau, seperti dubbing, konten audio, dan agen suara.

Pembuatan dan Kloning Suara

Dengan Gemini 3.8 Flash TTS, pengguna dapat membuat suara baru dari nol.

Perintah teks dapat menentukan peran, aksen, dan karakteristik vokal suara dalam berbagai bahasa serta dialek.

Pengguna juga dapat memilih lebih dari 2.000 suara siap pakai, termasuk varian regional seperti bahasa Spanyol Meksiko, Prancis Quebec, dan Inggris Skotlandia.

Fitur kloning suara membutuhkan sampel berdurasi 30 detik.

Pemilik suara yang dikloning wajib memberikan persetujuan secara lisan, dan suara pada rekaman persetujuan harus sama dengan sampel yang dikirim.

Audio hasil Gemini 3.8 Flash TTS dilengkapi watermark SynthID sebagai tanda dibuat oleh AI, tetapi watermark tersebut tidak terdengar.

Kontrol Dialog dan Ketersediaan

Kedua model memungkinkan pengguna menambahkan arahan pada setiap baris dialog.

Model juga dapat menafsirkan petunjuk dalam naskah untuk mengatur ekspresi, jeda, dan reaksi suara.

Pengguna dapat menempatkan tawa, helaan napas, dan suara reaksi pada bagian dialog yang diinginkan.

Google menyatakan kedua model dapat menghasilkan audio berdurasi berjam-jam dengan perubahan karakter suara yang rendah selama proses pembuatan.

Dalam mode dua suara, model dapat membaca percakapan dari satu naskah sekaligus mempertahankan perbedaan karakter kedua suara.

Pengujian The Decoder menemukan aksen dan intonasi Gemini 3.8 Flash TTS cukup meyakinkan dalam satu skenario, tetapi juga menangkap dengungan bernada tinggi pada dua pengujian.

Pada satu pengujian lain, karakter suara berubah pada bagian akhir klip, menunjukkan hasil belum selalu konsisten.

Kedua model tersedia melalui Gemini API dan Google AI Studio.

Gemini 3.8 Flash TTS juga dapat digunakan di Gemini Notebook, sedangkan Flash-Lite TTS tersedia melalui Google Vids.

Agora, LiveKit, Pipecat, dan Vercel telah mendukung integrasi melalui Gemini API, sementara akses Enterprise API akan menyusul.

Google menghitung biaya berdasarkan jumlah token audio. Satu detik audio setara dengan 25 token, sehingga audio berdurasi satu jam membutuhkan sekitar 90.000 token audio.

Data dari paket gratis digunakan untuk meningkatkan produk Google, sedangkan Google mengatakan data dari paket berbayar tidak digunakan untuk tujuan tersebut.

Fitur Voice Remix yang dapat mengubah karakter, nada, tempo, dan aksen suara dari pustaka tersedia belum ditawarkan.

Pilihan suara, batas penggunaan, dan ketentuan data dapat berbeda menurut jalur akses; pengguna perlu melihat dokumentasi model serta halaman harga yang berlaku sebelum membuat layanan komersial.

Sampel untuk kloning suara sebaiknya berasal dari orang yang benar-benar memberi persetujuan, bukan rekaman yang ditemukan di internet.

WhatsApp Logo
Ikuti Sulsel Times di
Google News
Follow

Tinggalkan Balasan

Alamat email Anda tidak akan dipublikasikan. Ruas yang wajib ditandai *