
Chatbot AI Bisa Berhalusinasi, OpenAI Ungkap Penyebabnya
Awalan Berita – OpenAI, perusahaan di balik pengembangan ChatGPT, mengakui bahwa model AI mereka masih sering menghasilkan pernyataan yang salah namun terdengar meyakinkan. Masalah ini dikenal sebagai “halusinasi AI,” dan telah menjadi tantangan berulang di hampir semua generasi model bahasa besar, termasuk versi terbaru seperti GPT-5.
“Baca Juga: Google Didenda Rp56 Triliun oleh Uni Eropa soal Iklan”
Dalam pernyataan resmi pekan lalu, OpenAI menjelaskan bahwa model AI cenderung menebak jawabannya, bahkan jika peluangnya sangat kecil, ketimbang mengatakan “saya tidak tahu.” Pola ini didorong oleh cara sistem dilatih dan dievaluasi, yang menekankan keharusan memberikan respons atas semua pertanyaan.
Model AI seperti ChatGPT dilatih untuk menyelesaikan tugas-tugas berdasarkan contoh jawaban dalam dataset. Dalam konteks itu, tidak menjawab dianggap lebih buruk daripada memberikan tebakan, karena dalam pengujian, tebakan tetap bisa mendapat poin jika kebetulan benar.
Menurut OpenAI, akar permasalahan ada pada prosedur pelatihan dan standar evaluasi yang digunakan dalam pengembangan model AI. Sistem evaluasi saat ini cenderung memberi skor lebih tinggi pada model yang tetap menjawab, bahkan jika jawabannya tidak berdasar.
Sebuah studi internal menunjukkan bahwa ketika model AI memberikan respons yang mengakui ketidakpastian atau menyatakan tidak tahu, model tersebut diberi skor nol. Sebaliknya, jika model menebak dan kebetulan benar, maka skornya tetap positif. Hal ini mendorong perilaku “berteori sembarangan” daripada bersikap hati-hati.
OpenAI menekankan bahwa tanpa perubahan pada cara penilaian dilakukan, perilaku model AI tidak akan banyak berubah. Selama sistem diberi insentif untuk menebak daripada menahan diri, halusinasi akan terus terjadi.
Masalah halusinasi tidak hanya terjadi pada model lama, tetapi juga tetap muncul di GPT-5—model paling canggih yang dimiliki OpenAI saat ini. Meski memiliki kemampuan penalaran dan pencarian informasi yang lebih tinggi, GPT-5 tetap sesekali menghasilkan jawaban yang salah dengan percaya diri tinggi.
OpenAI mengakui bahwa peningkatan ukuran model atau kompleksitas arsitektur tidak otomatis menghilangkan kesalahan jenis ini. Beberapa pertanyaan di dunia nyata memang sangat kompleks, ambigu, atau bahkan tidak memiliki jawaban tunggal.
“Terlepas dari ukuran model atau teknik penalaran yang digunakan, tidak semua pertanyaan bisa dijawab,” tulis OpenAI dalam pernyataannya.
OpenAI menyarankan perlunya perbaikan pada sistem evaluasi agar model AI dapat lebih cermat dan tidak dipaksa untuk menjawab semua hal. Mereka menyebut perlunya “memperbaiki papan skor,” yaitu sistem yang memberi penghargaan pada model yang berhati-hati dan jujur, bukan hanya yang berani menebak.
Teknik-teknik pengurangan halusinasi bisa diadopsi lebih luas jika sistem penilaian benar-benar menghargai akurasi daripada kelengkapan jawaban. Ini termasuk pelatihan ulang menggunakan data realistis dan penguatan berbasis umpan balik manusia.
Namun, OpenAI tetap realistis. Mereka menyatakan bahwa meski perbaikan dapat mengurangi halusinasi, akurasi model AI tidak akan pernah mencapai 100 persen.
“Baca Juga: NXPort Kembangkan Docking GPU Eksternal Terkecil di Dunia”
OpenAI menyimpulkan bahwa ada batas alami terhadap apa yang bisa dijawab model AI, terutama karena tidak semua informasi di dunia memiliki jawaban pasti. Namun, perusahaan percaya bahwa dengan transparansi, komunikasi risiko, dan sistem pelatihan yang lebih baik, pengguna bisa memahami batas kemampuan AI.
Masalah halusinasi menunjukkan pentingnya sikap kritis dalam menggunakan teknologi AI, baik oleh pengguna individu maupun institusi. Penggunaan AI di sektor-sektor penting seperti kesehatan, hukum, dan pendidikan membutuhkan pengawasan ekstra serta validasi manusia.
Ke depan, pengembangan model AI bukan hanya soal kecerdasan. Tetapi juga soal tanggung jawab dan kejujuran algoritma dalam menjawab pertanyaan yang kompleks.