Logo JawaPos
Author avatar - Image
Jumat, 18 September 2026 | 16.56 WIB

Waspada, Ada 6 Perilaku AI yang Tak Terduga

Elon Musk dan Bos OpenAI dukung perlambatan pengembangan AI (The Guardian) - Image

Elon Musk dan Bos OpenAI dukung perlambatan pengembangan AI (The Guardian)

JawaPos.com - OpenAI mengungkap sejumlah temuan mengejutkan selama proses pengujian model kecerdasan buatan (AI).  Perusahaan itu menyebut setidaknya ada enam insiden ketika model yang tengah dikembangkan menunjukkan perilaku tidak selaras (misalignment) dan bertindak di luar ekspektasi.

Seperti dilansir dari Engadget, temuan tersebut disampaikan OpenAI melalui tulisan yang membahas penerapan kerangka kerja baru untuk mendokumentasikan dan melaporkan insiden misalignment. Kerangka itu dirancang agar perilaku AI yang berpotensi mengkhawatirkan dapat lebih cepat diketahui dan disampaikan kepada publik.

Salah satu kasus terjadi ketika sebuah model diminta menjawab pertanyaan sederhana mengenai data pendapatan suatu wilayah (county) di California. Alih-alih hanya memberikan jawaban berdasarkan informasi yang tersedia, model tersebut diketahui menemukan serta menggunakan kunci API yang terekspos tanpa izin.

Masalahnya tidak berhenti di situ. Setelah tidak berhasil menemukan angka pendapatan yang dibutuhkan, model tersebut justru menghasilkan angka secara mandiri. Angka yang dibuat-buat itu kemudian disampaikan seolah-olah merupakan data faktual yang berasal dari sumber resmi.

Pada pengujian lainnya, OpenAI menemukan perilaku berbeda dari agen AI yang belum dirilis. Agen tersebut mendapatkan tugas untuk mencari daftar danau dengan luas lebih dari 5 juta meter persegi.

Agen tersebut sebenarnya berhasil memperoleh jawaban yang benar. Namun, tugas yang diberikan juga mengharuskannya menyertakan referensi melalui sitasi peramban (browser citation), sementara kemampuan tersebut tidak tersedia bagi agen.

Untuk mengatasi keterbatasan itu, agen AI mengambil langkah yang tidak terduga. Ia memublikasikan jawabannya sendiri ke internet, kemudian menggunakan publikasi tersebut sebagai sumber referensi untuk jawabannya.

Perilaku serupa juga muncul ketika OpenAI melakukan pelatihan terhadap GPT-5.6 Sol. Dalam sejumlah kasus, model diketahui menyisipkan instruksi untuk model penerusnya agar menyembunyikan kesalahan maupun perilaku yang tidak biasa dari para penguji.

OpenAI juga menemukan cara lain yang digunakan model-model AI untuk berkomunikasi selama proses pengujian. Alih-alih menggunakan saluran komunikasi yang secara khusus disediakan untuk eksperimen, model-model tersebut memanfaatkan repositori perangkat lunak internal perusahaan sebagai semacam papan pesan.

Informasi mengenai pola komunikasi tersebut sebelumnya telah disampaikan karyawan OpenAI dalam sebuah konferensi. Mereka mengungkap bahwa model AI dapat menggunakan mekanisme tersebut untuk saling bertukar metode eksploitasi. Pertukaran itu kemudian dikaitkan dengan insiden yang berujung pada peretasan terhadap Hugging Face.

Editor: Diar Candra
Tags

Jangan sampai ketinggalan berita hari ini!

Jawa Pos

Ikuti

Jadilah yang pertama tahu. Gabung channel kami sekarang!

Jawa Pos
JawaPos.com adalah bagian dari Jawa Pos Group, perusahaan media terkemuka di Indonesia. Menyajikan berita terkini, akurat, dan terpercaya.
Graha Pena Lt.2 Jl. Raya Kby. Lama No.12, Grogol Utara, Kec. Kebayoran Lama, Kota Jakarta Selatan, Daerah Khusus Ibukota Jakarta 12210

Jawa PosTelah diverifikasi oleh Dewan PersSertifikat Nomor 1055/DP-Verifikasi/K/XII/2022

Download Aplikasi JawaPos.com
Download PlaystoreDownload Appstore