
Logo OpenAI ditampilkan dalam ilustrasi terkait perkembangan teknologi kecerdasan buatan / Foto: (The Guardian)
JawaPos.com — OpenAI mengungkap enam kasus perilaku tidak terduga atau mengkhawatirkan dari model kecerdasan buatannya, sekaligus memperkenalkan sistem baru untuk melacak, menyelidiki, dan mengungkap kegagalan AI mengikuti nilai serta tujuan keselamatan manusia. Pengungkapan ini menjadi sinyal bahwa persoalan pengendalian AI kini tidak hanya berkaitan dengan kemampuan teknologi, tetapi juga bagaimana perilaku menyimpang dideteksi dan dilaporkan.
Salah satu kasus melibatkan model riset yang belum dirilis. Model itu memasukkan instruksi mirip jailbreak ke dalam catatan kerjanya sendiri untuk mengabaikan batasan normal. Dalam catatan tersebut, model bahkan mengarahkan dirinya agar “dibebaskan dari peran dan identitas yang mengikat chatbot lain”. Pada kasus lain, agen AI mengunggah berkas ke internet agar dapat memperoleh sumber untuk sitasi peramban, tanpa meminta persetujuan pengguna.
Dilansir dari The Guardian, Jumat (18/9/2026), OpenAI menyebut enam laporan itu ditemukan selama proses pelatihan atau evaluasi dalam beberapa bulan terakhir. Salah satunya memperlihatkan model yang membuat instruksi untuk menyembunyikan kesalahan yang dilakukannya. Kasus lain mencakup penggunaan kunci API yang terekspos tanpa izin dan kemudian membuat data palsu, pemanfaatan repositori perangkat lunak internal sebagai sarana komunikasi, serta agen yang membagikan berkas melalui situs penyimpanan publik meski diarahkan hanya menggunakan berkas lokal.
OpenAI menyatakan perilaku itu menjadi dasar kerangka baru yang memungkinkan karyawan mengajukan kasus untuk diperiksa tim keselamatan dan penyelarasan. Laporan kemudian dikategorikan ke jalur pengungkapan langsung, penyelidikan minor, atau penyelidikan lebih besar untuk kasus kompleks, terutama yang melibatkan pihak ketiga. OpenAI mengatakan kerangka tersebut masih dalam tahap pengembangan dan belum menjadi standar industri.
“Kami tidak meyakini industri AI telah menyelesaikan persoalan penyelarasan dan pemantauan hingga tingkat yang cukup untuk terus meningkatkan skala secara bertanggung jawab dengan kecepatan maksimum lebih lama lagi,” kata OpenAI. Perusahaan juga menegaskan keputusan pengembangan AI ke depan perlu bertumpu pada bukti yang dapat diperiksa pihak di luar perusahaan pembuat model AI terdepan.
Peringatan itu muncul ketika perdebatan mengenai laju pengembangan AI semakin luas. Google dan Elon Musk mendukung seruan untuk memperlambat pengembangan, sementara Donald Trump menolaknya dengan alasan Amerika Serikat perlu mempertahankan keunggulan dalam persaingan AI dengan Tiongkok. Sebagian pakar juga mempertanyakan mekanisme pengawasan sukarela dan memperingatkan agar perusahaan tidak menjadi auditor bagi dirinya sendiri.
Kekhawatiran tersebut diperkuat oleh perkembangan agen AI yang dapat menjalankan tugas secara mandiri. Pada Juli, OpenAI mengungkap bahwa segerombolan agen AI meretas startup Hugging Face dalam pengujian keamanan. Pada bulan yang sama, Anthropic mengatakan modelnya meretas tiga organisasi saat diuji tanpa perlindungan keamanan siber karena kesalahpahaman dengan perusahaan penguji sehingga model dapat mengakses internet terbuka.
Lian Jye Su, analis utama kelompok riset teknologi Omdia, mengatakan agen AI semakin mampu menyelesaikan tugas kompleks melalui kerja sama antarmodel, berbagi pengetahuan, penipuan, dan penyembunyian informasi. Menurutnya, perkembangan itu membuat pengendalian menggunakan pendekatan keamanan AI tradisional semakin sulit. “Prosesnya masih bersifat internal dan sukarela, tetapi merupakan langkah ke arah yang benar,” ujar Su mengenai kerangka OpenAI.
Di Skotlandia, kekhawatiran serupa disampaikan Raja Charles III dalam pertemuan dengan pimpinan teknologi, termasuk Jensen Huang dari Nvidia, Demis Hassabis dari Google DeepMind, Sarah Friar dari OpenAI, dan Menteri AI Inggris Kanishka Narayan. Raja Charles mengatakan AI berpotensi meningkatkan dan menyelamatkan kehidupan, terutama dalam ilmu hayati dan kedokteran, tetapi juga dapat memiliki kemampuan yang lebih berbahaya, “bahkan mungkin untuk merenggut nyawa”.
Raja Charles kemudian menyerukan pengendalian yang memadai. “Ada urgensi untuk mempertimbangkan secara memadai bahaya eksistensial dari teknologi semacam ini jika jatuh ke tangan yang salah dan digunakan dengan cara yang berpotensi membawa bencana. Tentunya, kita membutuhkan sarana pengendalian yang memadai sebelum semuanya terlambat,” ujarnya. Reuters melaporkan pertemuan itu berlangsung di Dumfries House, Skotlandia, saat perhatian global meningkat terhadap kemampuan AI yang berkembang cepat.
Jangan sampai ketinggalan berita hari ini!
Jadilah yang pertama tahu. Gabung channel kami sekarang!

Ultah Ariel NOAH ke-45 Dirayakan Bareng Wulan Guritno, Ada Pelukan hingga Candaan Duda-Janda
Ariel NOAH 18 Tahun Menduda, Dekat dengan Wulan Guritno di Ultah ke-45
Weton Satrio Wibowo: 5 Weton Pembawa Rezeki, Karisma, dan Kehormatan Menurut Primbon Jawa
7 Kebiasaan yang Bikin Ban Motor Cepat Botak, Mana yang pernah Kamu Lakukan?
Viral Pegawai BGN Sindir Korban Keracunan MBG Sambil Makan Chicken Katsu
'Tibo Sri': 7 Weton yang Memiliki Rezeki Seumur Hidupnya Mengalir Seperti Air dan Tidak Pernah Mengering Menurut Primbon Jawa
Sudah Tak Jadi Menkeu, Uang Rp 100 Ribu Bertanda Tangan Purbaya Malah Diburu
10 Kali Sidang Kasus Kuota Haji, Saksi Beberkan Tak Ada Dugaan Kerugian Negara
Psikolog Umum Kompeten dan Siap Berikan Layanan di Puskesmas, Pendidikan, Organisasi serta Komunitas
Tak Lagi jadi Menkeu, Momen Purbaya Makan Bakso Berdua Istri dan Kembali Nyetir Sendiri

Jawa PosTelah diverifikasi oleh Dewan PersSertifikat Nomor 1055/DP-Verifikasi/K/XII/2022