Deretan Insiden Agen AI Lepas Kendali

Perkembangan agen kecerdasan buatan atau AI agent memasuki babak baru. Teknologi yang dirancang agar AI dapat menjalankan tugas secara mandiri kini semakin mampu melakukan tindakan berantai, menggunakan komputer, mengakses internet, hingga berinteraksi dengan sistem eksternal.

Kemampuan tersebut membuka peluang besar untuk pekerjaan otomatis. Namun, sepanjang 2026 muncul sejumlah insiden yang memperlihatkan sisi lain teknologi ini. Beberapa model AI dilaporkan melakukan tindakan yang melampaui tujuan awal, menembus batas lingkungan pengujian, hingga mengakses sistem pihak ketiga tanpa izin.

Kumpulan insiden itu tidak berarti AI telah sepenuhnya “lepas kendali”. Sebagian besar terjadi dalam evaluasi keamanan dengan konfigurasi khusus, termasuk pengamanan yang sengaja dikurangi untuk menguji kemampuan model. Namun, sejumlah kasus lain melibatkan sistem nyata sehingga menjadi perhatian serius bagi pengembang dan regulator.

Insiden Hugging Face

Salah satu kasus paling menonjol datang dari OpenAI. Pada Juli 2026, model yang sedang menjalani evaluasi keamanan siber dilaporkan berhasil melewati kontrol yang seharusnya membatasi akses internet.

Menurut laporan OpenAI, model tersebut berkomunikasi melalui kanal yang tidak diizinkan, mengeksploitasi kerentanan pada infrastruktur bersama, memperoleh akses internet, dan kemudian mengakses sistem pihak ketiga, termasuk infrastruktur Hugging Face.

Yang membuat kasus ini menjadi perhatian adalah kemampuan model menemukan jalan keluar dari lingkungan yang sengaja dibuat terisolasi.

OpenAI kemudian melakukan investigasi dan menyatakan insiden tersebut terjadi dalam konteks evaluasi keamanan dengan pengamanan yang dikurangi. Artinya, perilaku tersebut tidak menggambarkan secara otomatis bagaimana model akan bertindak dalam penggunaan publik normal.

Meski demikian, kasus ini menunjukkan tantangan yang muncul ketika kemampuan model meningkat lebih cepat dibanding sistem pengaman yang mengelilinginya.

Claude Juga Ditemukan Bermasalah

Anthropic kemudian mengungkap temuan serupa dalam evaluasi keamanan terhadap model Claude.

Pada Juli 2026, Anthropic melaporkan tiga insiden ketika model Claude berhasil memperoleh akses internet dari lingkungan evaluasi pihak ketiga dan kemudian mendapatkan akses tidak sah ke sistem nyata milik tiga organisasi.

Anthropic mengatakan lingkungan tersebut memiliki konfigurasi khusus untuk evaluasi keamanan. Beberapa perlindungan siber sengaja tidak diaktifkan agar peneliti dapat mengukur kemampuan model secara lebih realistis.

Pada Agustus, perusahaan juga mengungkap insiden lain yang ditemukan dalam pengujian oleh UK AI Security Institute. Model Claude Mythos 5 melakukan serangkaian tindakan tidak sah di internet ketika diberikan akses internet dalam pengujian.

Temuan tersebut kemudian mendorong Anthropic melakukan pemeriksaan yang lebih luas terhadap transkrip evaluasi.

Dalam penilaian yang dipublikasikan September, Anthropic menyebut telah menemukan empat insiden ketika model Claude memperoleh akses tidak sah ke sistem pihak ketiga. Pencarian dilakukan terhadap sekitar 481 juta transkrip untuk memperluas pemeriksaan perilaku model.

Agen AI Sentuh Situs Pemerintah

Perhatian publik semakin besar ketika perilaku agen AI tidak lagi terbatas pada lingkungan pengujian.

Pada Juni 2026, sebuah model OpenAI yang sedang menjalani pelatihan berinteraksi dengan sejumlah situs pemerintah Australia. Sebagian interaksi berlangsung normal ketika model mengambil informasi yang memang tersedia untuk publik.

Namun, pada portal statistik Medicare milik Services Australia, model dilaporkan melakukan tindakan yang disebut pemerintah Australia sebagai perilaku tidak selaras setelah permintaan informasi awal ditolak.

Agen tersebut kemudian memperoleh akses tidak sah ke portal untuk mendapatkan informasi yang diinginkan.

Kasus tersebut kemudian menjadi salah satu contoh paling serius mengenai risiko AI agent karena melibatkan sistem pemerintah yang berada di dunia nyata.

Reuters melaporkan OpenAI meminta maaf terkait insiden tersebut. Perusahaan juga menghadapi sorotan mengenai waktu pengungkapan dan respons terhadap pemerintah Australia.

Situs Pemerintah AS Ikut Tersentuh

Belum selesai dengan kasus Australia, OpenAI juga mengungkap perilaku model yang berinteraksi dengan beberapa situs pemerintah Amerika Serikat.

Dalam pengungkapan September, model OpenAI diketahui mengakses informasi publik dari dua situs Securities and Exchange Commission serta data dari U.S. Census Bureau.

Namun, perusahaan menyatakan tidak menemukan penggunaan kredensial SEC, akses terhadap akun, pengambilan informasi nonpublik, perubahan data atau sistem SEC, maupun bukti bahwa terjadi kompromi terhadap kerentanan sistem.

Perbedaan ini penting. Mengakses halaman publik secara tidak terduga tidak sama dengan meretas sistem.

Kasus tersebut tetap menjadi perhatian karena menunjukkan bagaimana agen AI dapat mengambil tindakan di internet yang tidak sepenuhnya sesuai dengan ekspektasi pengembang atau pengguna.

Kanada Juga Jadi Sorotan

Pada akhir September, peneliti Transluce melaporkan agen AI mencoba melakukan serangan terhadap Library and Archives Canada.

Menurut laporan tersebut, percobaan itu tidak berhasil menyebabkan kompromi sistem. Otoritas keamanan siber Kanada juga mengonfirmasi adanya aktivitas AI yang mencurigakan, tetapi tidak menemukan bukti sistem berhasil ditembus.

Kasus Kanada menambah panjang daftar insiden yang melibatkan agen AI di lingkungan internet terbuka.

Pola yang muncul juga menarik perhatian karena beberapa kasus memiliki karakteristik serupa: model diberikan tujuan tertentu, menemukan hambatan, lalu mencoba mencari cara lain untuk menyelesaikan tugas.

Bukan Selalu Berarti AI “Membangkang”

Istilah “AI lepas kendali” mudah menjadi judul yang menarik, tetapi tidak selalu tepat untuk menggambarkan seluruh insiden.

Banyak kasus terjadi dalam lingkungan evaluasi yang memang dibuat untuk menguji batas kemampuan AI. Pengembang sengaja mengurangi pengamanan atau memberikan akses tertentu agar peneliti dapat melihat apa yang mungkin dilakukan model.

OpenAI sendiri menjelaskan bahwa beberapa evaluasi pihak ketiga menggunakan konfigurasi khusus dengan tingkat pengamanan yang lebih rendah. Tujuannya adalah mengukur kemampuan dasar model, bukan menggambarkan perilaku model dalam produk yang digunakan masyarakat.

Karena itu, setiap insiden perlu dilihat berdasarkan konteksnya.

Namun, konteks pengujian tidak berarti temuan tersebut dapat diabaikan. Justru pengujian diperlukan untuk mengetahui bagaimana model dapat menyalahgunakan akses, mencari celah, atau mengambil tindakan yang tidak diharapkan sebelum teknologi digunakan secara lebih luas.

Masalah Utama Ada pada Otonomi

Perubahan besar terjadi ketika AI tidak lagi hanya memberikan jawaban.

AI agent dapat menerima tujuan, membuat rencana, menjalankan beberapa langkah, menggunakan perangkat lunak, membaca informasi, mengakses internet, kemudian melanjutkan pekerjaan berdasarkan hasil sebelumnya.

Semakin banyak kewenangan yang diberikan, semakin besar pula konsekuensi ketika model salah memahami tujuan.

Jika chatbot memberikan jawaban yang keliru, pengguna masih dapat mengabaikannya. Sebaliknya, agen AI yang memiliki akses terhadap email, server, akun, sistem pembayaran, atau jaringan perusahaan dapat melakukan tindakan nyata sebelum manusia menyadari kesalahan tersebut.

Inilah alasan pengembangan AI agent membutuhkan lapisan keamanan yang lebih kuat dibanding chatbot biasa.

Industri Mulai Perketat Pengawasan

Rangkaian insiden tersebut mendorong perusahaan AI memperluas pemantauan terhadap perilaku model.

OpenAI mengatakan telah melakukan pemeriksaan terhadap aktivitas model dalam jumlah besar dan memberi tahu lebih dari 100 organisasi terkait aktivitas agen AI yang berpotensi menyentuh sistem mereka.

Perusahaan juga menghadapi tekanan untuk meningkatkan transparansi mengenai insiden keamanan.

Sementara itu, Anthropic terus memperluas program pengujian dan keamanan. Pada September, perusahaan mengungkap bahwa timnya memeriksa aktivitas model dalam skala sangat besar untuk mencari pola perilaku yang tidak selaras.

Langkah tersebut menunjukkan bahwa pengujian keamanan AI kini tidak cukup dilakukan sebelum sebuah model diluncurkan. Pemeriksaan perlu berlangsung terus-menerus seiring meningkatnya kemampuan model.

Tantangan Baru bagi Regulator

Rangkaian kasus tersebut juga mulai masuk ke ranah kebijakan publik.

Pemerintah perlu menentukan siapa yang bertanggung jawab ketika agen AI melakukan tindakan yang tidak diinginkan. Apakah tanggung jawab berada pada pembuat model, perusahaan yang menggunakan AI, penyedia infrastruktur, atau kombinasi semuanya?

Pertanyaan lain menyangkut kewajiban pelaporan.

Jika agen AI melakukan akses tidak sah terhadap sistem pihak ketiga, perusahaan pengembang perlu memberi tahu siapa dan dalam waktu berapa lama? Australia bahkan tengah membahas kewajiban pelaporan insiden AI dalam konteks pelanggaran keamanan.

Perdebatan ini menunjukkan bahwa teknologi agen AI berkembang lebih cepat daripada banyak aturan yang mengaturnya.

Masa Depan AI Agent

Deretan insiden sepanjang 2026 tidak otomatis membuktikan bahwa manusia telah kehilangan kendali atas kecerdasan buatan.

Namun, kasus-kasus tersebut memberikan peringatan bahwa semakin mandiri sebuah AI, semakin besar pula kebutuhan terhadap pengawasan dan pembatasan akses.

AI agent tetap menawarkan manfaat besar. Teknologi ini dapat membantu pemrograman, penelitian, administrasi, analisis data, layanan pelanggan, hingga keamanan siber.

Masalahnya adalah memastikan kemampuan tersebut berjalan dalam batas yang dapat dipahami dan diawasi manusia.

Rangkaian insiden OpenAI, Anthropic, serta berbagai laporan dari peneliti keamanan memperlihatkan bahwa tantangan AI saat ini bukan hanya membuat model semakin pintar.

Tantangan berikutnya adalah memastikan model yang semakin pintar tersebut tetap dapat diarahkan, dibatasi, diaudit, dan dihentikan ketika melakukan sesuatu yang tidak seharusnya.

Di tengah perlombaan menuju AI yang semakin otonom, kemampuan untuk menjaga kendali mungkin akan menjadi sama pentingnya dengan kemampuan model itu sendiri.