Sulseltimes.com, Jumat, 18/09/2026 — OpenAI meluncurkan GPT‑Live, model suara generasi baru yang memungkinkan interaksi manusia‑AI terasa seperti percakapan nyata.
- GPT‑Live adalah model suara generasi baru yang membuat percakapan AI terasa seperti percakapan nyata.
- Menggunakan arsitektur full‑duplex sehingga dapat mendengarkan dan berbicara secara bersamaan.
- Platform pembelajaran bahasa Speak melaporkan bahwa GPT‑Live‑1 mengurangi interupsi hingga hampir 80% dibandingkan sistem berbasis giliran sebelumnya.
- Tersedia melalui API OpenAI, model ini memungkinkan pengembang menyesuaikan nada, kecepatan, dan gaya melalui system prompt.
- Model ini mendukung penerapan telepon untuk agen suara berbasis telepon dan dilengkapi dengan SynthID watermarking untuk provenance.
Cara Kerja dan Penerapan GPT-Live
Arsitektur Full-Duplex
GPT‑Live dibangun di atas arsitektur full‑duplex, yang memungkinkan model mendengarkan dan berbicara secara bersamaan.
Interaksi yang Lebih Alami
Selama percakapan, GPT‑Live dapat menunjukkan perhatian dengan frasa seperti “mhmm” atau “yeah”, memberikan umpan balik yang terasa seperti percakapan manusia.
Pengurangan Interupsi
Platform pembelajaran bahasa Speak melaporkan bahwa GPT‑Live‑1 mengurangi interupsi hingga hampir 80% dibandingkan sistem berbasis giliran sebelumnya.
Integrasi API dan Kustomisasi
Model ini tersedia melalui API OpenAI, memungkinkan pengembang menyesuaikan nada, kecepatan, dan gaya percakapan melalui system prompt.
Delegasi untuk Penalaran yang Lebih Dalam
Untuk pertanyaan yang membutuhkan pencarian web atau penalaran yang lebih kompleks, GPT‑Live mendelegasikan tugas ke model frontier terbaru di latar belakang dan membawa kembali hasilnya.
Penanganan Kebisingan dan Konteks
GPT‑Live mengelola kebisingan latar belakang dan keheningan tanpa menginterupsi percakapan, mempertahankan konteks dalam interaksi yang panjang.
Dukungan Aplikasi Telepon
Model ini mendukung penerapan telepon untuk agen suara berbasis telepon, memperluas kegunaannya ke dalam alur kerja bisnis dan layanan pelanggan.
Keamanan dan Provenance
Update terbaru menambahkan SynthID watermarking ke audio yang dihasilkan, dan alat verifikasi publik sekarang dapat mendeteksi sinyal provenance OpenAI dalam file audio yang didukung.
OpenAI terus memperbarui GPT‑Live, dengan peningkatan keamanan dan akses API yang lebih luas bagi pengembang yang ingin membangun pengalaman suara yang lebih alami.















