RELUNG.ID – Perusahaan teknologi OpenAI membawa kemajuan besar dalam pembuatan konten teks, suara, dan gambar.
Kali ini, OpenAI merilis GPT-4o atau Omni. Dimana, fitur tersebut merupakan model bahasa besar multimodal (LLM) terbaru.
Fitur tersebut menawarkan interaksi yang lebih alami antara pengguna dan asisten.
Dikutip dari website resminya, OpenAI mengklaim bahwa model AI barunya dapat merespons input audio hanya dalam 232 milidetik dan secara signifikan lebih cepat dalam merespons teks dalam perintah non-Inggris dengan dukungan lebih dari 50 bahasa.
Pengguna juga dapat menyela model dengan pertanyaan atau klarifikasi baru saat model sedang berbicara.
GPT-4o ini dilengkapi dengan asisten suara yang lebih mumpuni dan terdengar seperti manusia yang merespons dalam waktu nyata dan dapat mengamati lingkungan sekitar pengguna melalui kamera pada perangkatnya.
Pengguna juga dapat memerintahkan asisten untuk bersuara lebih ceria atau beralih ke suara yang terdengar seperti robot.
Selain itu juga dapat terjemahan waktu nyata dalam lebih dari 50 bahasa dan dapat bertindak sebagai asisten aksesibilitas untuk tunanetra.
OpenAI mendemonstrasikan daftar panjang kemampuan GPT-4o dalam siaran langsungnya. Sehingga pengguna dapat menyaksikan semua demo fitur GPT-4o yang baru di saluran YouTube OpenAI.
GPT-4o akan tersedia untuk pengguna ChatGPT tingkat gratis, sementara pengguna ChatGPT Plus mendapatkan batas pesan 5x lebih tinggi.

