Story
OpenAI Lancar Model Suara GPT-Live untuk ChatGPT

Summary
OpenAI telah melancarkan GPT-Live, sebuah generasi baharu model suara yang direka untuk menjadikan perbualan dengan ChatGPT lebih natural. Model ini membolehkan AI mendengar dan bercakap serentak untuk interaksi yang lebih lancar.
OpenAI pada hari Rabu telah mengumumkan pelancaran GPT-Live, satu siri model suara baharu yang kini menguasakan ciri Suara ChatGPT. Teknologi ini bertujuan untuk menjadikan perbualan dengan kecerdasan buatan (AI) lebih semula jadi, pantas, dan interaktif.
GPT-Live menggunakan seni bina dupleks penuh, yang membolehkan model tersebut mendengar input pengguna sambil menjana output secara serentak. Ini merupakan satu penambahbaikan berbanding sistem suara terdahulu yang memerlukan pengguna selesai bercakap sebelum AI boleh memberi respons. Model ini juga mampu memberikan isyarat pendengaran seperti "mhmm" atau "yeah" untuk mewujudkan aliran perbualan yang lebih lancar.
Untuk tugasan yang memerlukan penaakulan mendalam atau carian web, GPT-Live boleh menyerahkannya kepada model termaju yang berjalan di latar belakang, seperti GPT-5.5 pada waktu pelancaran. OpenAI merancang untuk mengemas kini model latar belakang ini apabila teknologi baharu tersedia.
Dua versi sedang dilancarkan: GPT-Live-1 untuk pengguna Go, Plus, dan Pro, manakala GPT-Live-1 mini akan tersedia untuk pengguna Percuma. Ciri ini dilancarkan secara global kepada pengguna di platform iOS, Android, dan laman web ChatGPT. OpenAI turut menyatakan rancangan untuk menyediakannya melalui API pada masa akan datang.
AdPengalaman Suara ChatGPT yang dikemas kini ini juga menyokong respons visual, seperti memaparkan kad maklumat untuk cuaca, saham, atau sukan semasa pengguna bercakap. Walau bagaimanapun, pada peringkat awal, ciri ini tidak menyokong fungsi suara bersama video atau perkongsian skrin.
Menurut OpenAI, lebih 150 juta orang menggunakan ciri Suara dan Imlak (Dictation) ChatGPT setiap minggu. Dalam penilaian dalaman, model GPT-Live didapati lebih digemari berbanding mod suara sebelumnya dari segi aliran perbualan dan keaslian interaksi.