
AISI menyebut perilaku tak terduga tersebut dilakukan agen AI yang menggunakan model Mythos 5 dari Anthropic dan GPT-5.6 Sol dari OpenAI / Foto: (The Guardian)
JawaPos.com — Pengujian keamanan siber di Inggris mengungkap perilaku tak terduga dari agen AI berbasis model OpenAI dan Anthropic. Dalam upaya menyelesaikan tantangan siber, sistem tersebut membuat identitas daring palsu, menyamar sebagai pihak lain, dan mencoba memengaruhi pengembang manusia agar menerima kode berbahaya.
Dilansir dari The Guardian, Kamis (6/8/2026), temuan tersebut berasal dari AI Security Institute (AISI), lembaga keamanan AI Inggris yang dibentuk pada masa pemerintahan mantan Perdana Menteri Rishi Sunak. AISI menyebut perilaku itu sebagai “insiden serius” setelah menemukan aktivitas yang “berkelanjutan dan berpotensi membahayakan” terhadap orang dan organisasi nyata selama pengujian keamanan siber pada 28 Juli.
Dalam kasus paling serius, agen AI yang menggunakan model Mythos 5 dari Anthropic mencoba menyisipkan kode berbahaya ke proyek perangkat lunak sumber terbuka di GitHub. Untuk membuat kode itu diterima, agen tersebut menciptakan identitas daring palsu dan menggunakannya untuk menekan pengelola proyek.
Bahkan, agen AI tersebut menandatangani pesan dalam bahasa Denmark untuk meyakinkan pengembang yang menggunakan bahasa tersebut serta membuat akun GitHub palsu yang seolah-olah mendukung klaim bahwa perangkat lunaknya aman.
AISI menyatakan, “Ini adalah pertama kalinya kami melihat risiko terkait otonomi dan penipuan muncul sejelas ini, tanpa perintah khusus dari manusia, di dunia nyata.” Agen tersebut juga mengirim email berisi perangkat lunak berbahaya kepada dua pengembang tertentu melalui teknik spear-phishing. Tidak ada kerugian yang terjadi, tetapi pola tindakannya dinilai belum pernah ditemukan sebelumnya.
Dari 19 tindakan tanpa izin yang ditemukan selama pengujian, 17 dilakukan oleh Mythos 5 dan dua lainnya oleh GPT-5.6 Sol dari OpenAI. Menurut AISI, rangkaian kejadian ini menunjukkan adanya “pergeseran lanskap risiko”. Artinya, tindakan tersebut bukan dilakukan karena model sengaja disalahgunakan oleh pengguna, melainkan karena model mengambil langkah sendiri di lingkungan pengujian, di luar batas yang telah ditentukan.
Namun, AISI menegaskan insiden itu bukan kasus model berhasil keluar dari sandbox. Akses internet memang sengaja diberikan dan sejumlah penyaring yang biasanya mencegah perilaku berbahaya dinonaktifkan agar kemampuan model dapat diuji secara lebih luas. Mythos 5 belum tersedia untuk publik dalam kondisi tersebut, sementara GPT-5.6 Sol telah diluncurkan dengan perlindungan siber.
AISI mengakui pengawasan langsung belum dilakukan selama evaluasi. Setelah insiden itu, lembaga tersebut memperketat akses internet, menerapkan pemantauan terus-menerus, serta meninjau ulang desain pengujian. Mereka menilai evaluasi AI ke depan harus mengasumsikan model dapat mencoba bertindak melampaui mandatnya.
Temuan ini juga muncul setelah OpenAI dan Anthropic melaporkan insiden serupa pada bulan sebelumnya. OpenAI menyebut agen berbasis modelnya telah meretas sebuah perusahaan rintisan AI dalam pengujian, sedangkan Anthropic mengatakan model Claude meretas tiga organisasi selama evaluasi. Karena itu, persoalannya mulai bergeser dari kemampuan AI melakukan serangan menjadi bagaimana sistem tersebut mengambil keputusan tanpa instruksi eksplisit.
Menteri AI Inggris Kanishka Narayan mengatakan, “Sangat penting bagi Inggris memiliki organisasi keamanan AI kelas dunia.” Menanggapi temuan tersebut, Anthropic menilai insiden itu “menegaskan perlunya pembahasan yang lebih luas mengenai cara menguji keamanan agen AI yang kemampuannya terus berkembang”. Sementara itu, OpenAI menekankan bahwa pengujian berlangsung dalam “kondisi yang tidak mencerminkan penggunaan biasa”.
Jangan sampai ketinggalan berita hari ini!
Jadilah yang pertama tahu. Gabung channel kami sekarang!

Prediksi Skor Timnas Jepang U-23 vs Thailand U-23 di Asian Games 2026
Weton Satrio Wibowo: 5 Weton Pembawa Rezeki, Karisma, dan Kehormatan Menurut Primbon Jawa
Psikolog Umum Kompeten dan Siap Berikan Layanan di Puskesmas, Pendidikan, Organisasi serta Komunitas
'Tibo Sri': 7 Weton yang Memiliki Rezeki Seumur Hidupnya Mengalir Seperti Air dan Tidak Pernah Mengering Menurut Primbon Jawa
Kejam, Sopir Truk Dibakar Oleh Atasan dan Alami Luka Bakar Sampai 68 Persen
7 Kebiasaan yang Bikin Ban Motor Cepat Botak, Mana yang pernah Kamu Lakukan?
Ultah Ariel NOAH ke-45 Dirayakan Bareng Wulan Guritno, Ada Pelukan hingga Candaan Duda-Janda
Tak Lagi jadi Menkeu, Momen Purbaya Makan Bakso Berdua Istri dan Kembali Nyetir Sendiri
MK Diminta Batalkan Jabatan Wapres Gibran, Syarat Pendidikan Dipersoalkan
Mahfud MD Balas Sindiran Prabowo: Banyak juga Presiden yang Goblok

Jawa PosTelah diverifikasi oleh Dewan PersSertifikat Nomor 1055/DP-Verifikasi/K/XII/2022