Advertisement

IDNWire

Ruang informasi terpercaya untuk pembaca Indonesia

–
|

Kategori

Kategori

Sub Kategori 2

Media Network

Informasi

Connect With Us

News

OpenAI Luncurkan GPT-Live, Teknologi Asisten Suara Pintar yang Bisa Memotong Pembicaraan

Tampilan layar gpt-live
OpenAI meluncurkan GPT-Live, fitur percakapan suara AI terbaru yang menggunakan arsitektur full-duplex sehingga mampu mendengar dan merespons obrolan secara bersamaan tanpa jeda. | Foto: Open AI

Era Baru Asisten Suara Tanpa Jeda Kaku

Interaksi kaku dengan robot pembantu kini mulai bergeser. OpenAI meluncurkan fitur percakapan suara AI terbaru bernama GPT-Live untuk menciptakan gaya komunikasi yang mengalir natural mirip manusia. Berdasarkan data yang dikutip dari Yourstory, teknologi ini diperkenalkan dalam dua jenis akses. Pelanggan berbayar di paket Plus atau Pro mendapatkan versi standar GPT-Live-1, sementara pengguna akun gratis mendapatkan versi GPT-Live-1 mini.

Lompatan terbesar pada sistem ini terletak pada penggunaan arsitektur full-duplex. Lewat metode tersebut, AI mampu mendengarkan sekaligus memberikan respons pada waktu yang sama. Pengguna tidak perlu lagi menunggu mesin selesai memproses data atau berhenti bicara secara total. Sistem dirancang sensitif terhadap jeda kalimat, interupsi, hingga dinamika kecepatan mengobrol secara real-time.

Komponen Sistem Peran Utama Karakteristik Alur Kerja
Input Pengguna Mengirimkan suara secara kontinu Berbicara tanpa perlu menunggu AI selesai merespons (bisa memotong pembicaraan).
GPT-Live (Garda Depan) Manajemen konversasi langsung & interaksi real-time Menggunakan arsitektur full-duplex untuk mendengar dan merespons simultan, menyisipkan konfirmasi pendek ("ya", "mengerti"), dan menjaga alur obrolan tetap hidup.
Model Latar Belakang (GPT-5.5) Pekerjaan kognitif berat & penalaran intensif Menerima delegasi tugas rumit (pencarian web mendalam, analisis sains/GPQA) dan memprosesnya di latar belakang tanpa membuat interaksi depan menjadi hening.

Cara Kerja Pembagian Beban Kognitif

Kelancaran berbicara ini terjadi berkat dua sistem utama di belakang layar. Pertama, kemampuan memproses masukan teks/suara dan memproduksi keluaran secara simultan membuat model bisa mengambil keputusan interaksi dalam hitungan milidetik. Robot bisa menyisipkan konfirmasi pendek seperti "ya" atau "mengerti" untuk menunjukkan perhatian aktif, atau memilih diam saat mendeteksi pengguna sedang berpikir.

Kedua, OpenAI memisahkan koridor obrolan santai dengan proses penalaran yang berat. Saat pengguna melontarkan pertanyaan rumit yang memerlukan penelusuran internet mendalam, GPT-Live melemparkan tugas tersebut ke model latar belakang yang lebih kuat seperti GPT-5.5. Selagi sistem utama bekerja mencari jawaban, GPT-Live tetap mengajak pengguna berbicara sehingga tidak ada kekosongan obrolan yang canggung.

Uji internal perusahaan mengonfirmasi pengguna lebih menyukai GPT-Live-1 ketimbang mode suara versi terdahulu. Pada pengujian tolok ukur GPQA yang menguji pengetahuan sains tingkat ahli seperti fisika dan biologi, akurasi model ini melampaui standar lama. Kemampuan filtrasinya juga membaik, sehingga pengguna dapat memakai fitur ini di tengah kebisingan jalan raya atau ruang publik tanpa terganggu suara latar.

Proteksi Sistem Keamanan dan Batasan Fitur

Sistem keamanan pada platform suara ini diintegrasikan langsung pada lapis sistem untuk memeriksa materi obrolan secara instan. Panggilan bisa langsung diputus atau dialihkan ke pesan keselamatan jika mendeteksi adanya indikasi bahaya. Pengembang memanfaatkan metode red teaming dengan melibatkan pakar luar untuk menguji celah penipuan, potensi melukai diri, hingga risiko ketergantungan emosional pengguna terhadap AI.

Terkait proteksi identitas, model ini dilarang meniru suara tokoh atau individu tertentu secara spesifik. OpenAI hanya menyediakan sembilan variasi suara bawaan yang telah dikalibrasi ulang. Pengguna usia muda juga mendapatkan dinding pelindung tambahan berupa fitur kontrol orang tua serta penyesuaian respons sesuai umur.

Meski sudah digulirkan pada aplikasi ponsel dan komputer meja, teknologi ini belum sempurna. Versi awal belum mendukung pemakaian video ataupun berbagi tampilan layar. Pembaruan untuk dua fitur tersebut dijanjikan menyusul kemudian. Kemampuan bahasanya pun baru optimal untuk bahasa populer, sehingga aksen kaku atau kesalahan dialek lokal masih mungkin ditemui di lapangan.

Penulis/Editor: Bagus Setiawan
Bagikan artikel ini:
IDNWire WhatsApp Channel ✓
IDNWire Resmi

Follow Saluran WhatsApp untuk Notifikasi Berita Terbaru

← Sebelumnya Selanjutnya →

Berita Terbaru

Memuat artikel…

Kurs Rupiah Hari Ini

Dolar A.S. / Rupiah
USDIDR • FX_IDC
Memeriksa...
Advertisement 5