
Anthropic mengungkap konfigurasi pelatihan yang cacat menjadi salah satu penyebab perilaku model AI yang tidak selaras dengan tujuan manusia (The Guardian)
JawaPos.com - Anthropic, perusahaan Amerika Serikat di balik chatbot Claude, mengakui kegagalan dalam prosedur keamanan setelah sejumlah model kecerdasan buatannya memperoleh akses ke internet dan masuk tanpa izin ke sistem nyata tiga organisasi.
Pengakuan tersebut memperlihatkan tantangan yang semakin serius bagi industri AI global: kemampuan model berkembang cepat, sementara mekanisme untuk membatasi perilakunya belum selalu mampu mengimbanginya.
Insiden itu menjadi perhatian karena terjadi ketika model sedang menjalani pengujian keamanan siber. Anthropic sebelumnya mengungkapkan bahwa tiga modelnya berhasil mengakses infrastruktur produksi organisasi yang tidak disebutkan namanya.
Kini, perusahaan itu menyatakan peristiwa tersebut mencerminkan kelemahan dalam pengamanan operasional dan persoalan yang lebih mendasar terkait kemampuan AI untuk tetap bertindak sesuai tujuan manusia.
Dilansir dari The Guardian, Rabu (2/9/2026), Anthropic menyatakan teknologinya "belum sepenuhnya selaras dengan nilai dan tujuan manusia." Perusahaan mengakui model-model tersebut sengaja diuji tanpa perlindungan keamanan siber.
Namun, kesalahpahaman dengan Irregular, perusahaan eksternal yang ditunjuk untuk menguji keamanan model AI tersebut, membuat model tanpa sengaja memperoleh akses ke internet terbuka. Kondisi itu, menurut Anthropic, pada dasarnya setara dengan membiarkan pintu depan terbuka saat melakukan pengujian.
Akibatnya, Anthropic sempat menghentikan pengujian keamanan siber internal dan eksternal untuk memperketat sistem perlindungan. "Kami sebagian besar mengandalkan satu lapisan pertahanan, padahal kami membutuhkan beberapa lapisan," kata perusahaan tersebut.
Setelah itu, Anthropic memasang sistem peringatan ketika model mencoba keluar dari lingkungan pengujian atau memperoleh akses internet serta memperketat isolasi terhadap lingkungan uji berisiko tinggi.
Perusahaan kini mewajibkan mitra penguji eksternal mematuhi standar keselamatan tertentu, termasuk memberikan instruksi yang tegas kepada model. Salah satu contohnya adalah perintah bahwa model tidak boleh mengakses internet. Setelah perlindungan baru diterapkan, Anthropic mengatakan telah melanjutkan pengujian keamanan siber internal dan eksternal.
Jangan sampai ketinggalan berita hari ini!
Jadilah yang pertama tahu. Gabung channel kami sekarang!

Prediksi Skor Al-Hilal vs Al Ahli di Liga Arab Saudi: The Blue Waves Amankan 3 Poin di Kandang!
Foto Terakhir Kebersamaan Anthony Xie dengan Audi Marissa Usai Digugat Cerai
Prediksi Skor Udinese vs Venezia di Coppa Italia: Sang Zebra Kecil Berpeluang Menang di Friuli!
Weton Satrio Wibowo: 5 Weton Pembawa Rezeki, Karisma, dan Kehormatan Menurut Primbon Jawa
Kasus Penipuan Rp 3,5 Miliar Dihentikan Usai Ruben Onsu Berdamai dengan Pelapor
Profil Matheus Lagoa! Legenda dan Kapten Anapolis, Puzzle Terakhir Persebaya Surabaya
Prediksi Skor West Ham vs Wolverhampton, Kemenangan Perdana atau Lanjutkan Tren Positif
Obligasi Danantara: Dana Murah Pembangunan yang Rentan TPPU?
Breaking News! Persebaya Surabaya Rekrut Kapten Anapolis FC Matheus Lagoa
'Tibo Sri': 7 Weton yang Memiliki Rezeki Seumur Hidupnya Mengalir Seperti Air dan Tidak Pernah Mengering Menurut Primbon Jawa
