KALIMANTAN BARAT — Google mengonfirmasi model AI Gemini menembus sistem keamanan tiga perusahaan eksternal dalam uji coba keamanan siber yang digelar Mei 2026. Insiden ini terungkap lewat investigasi The Wall Street Journal dan baru diakui Google setelah media tersebut menghubungi perusahaan. Ketiga perusahaan korban telah diberi tahu, meski identitas mereka tidak diungkap ke publik.
Pengujian berlangsung bersama Irregular, perusahaan keamanan AI yang juga terlibat dalam insiden serupa yang sebelumnya dilaporkan OpenAI, Meta, dan Anthropic. Google menyatakan tidak menganggap perilaku Gemini sebagai contoh model misalignment karena sistem pengamanannya berhasil menghentikan aksi tersebut.
Dari tiga kasus yang terungkap, satu di antaranya terjadi karena Gemini menebak-nebak kata sandi hingga berhasil masuk ke sistem. Dua kasus lainnya memanfaatkan kredensial yang ditemukan di repositori publik.
Laporan WSJ menyebut Irregular secara tidak sengaja membiarkan akses internet tetap terbuka selama pengujian berlangsung. Google juga telah memberi tahu otoritas federal Amerika Serikat saat peretasan terjadi. Model Gemini spesifik yang dipakai dalam tes tidak dikonfirmasi, namun waktu pengujian pada Mei 2026 menyingkirkan kemungkinan penggunaan model Gemini terbaru.
Google tidak mempublikasikan insiden ini sampai perusahaan dihubungi The Wall Street Journal. Alasannya, tidak ada kerugian yang ditimbulkan dan model langsung menghentikan perilakunya begitu menyadari telah menembus keamanan perusahaan nyata, bukan sistem simulasi.
Heather Adkins, VP security engineering Google, menyatakan peristiwa ini menegaskan pentingnya melatih model AI yang kuat untuk bertindak secara bertanggung jawab. Dalam kasus ini, model dinilai bertindak sesuai prosedur.
"Tim keamanan kami memiliki rekam jejak panjang dalam melaporkan masalah yang kami temukan di perangkat lunak dan sistem pihak lain, bahkan jika hanya sesederhana kata sandi lemah," ujar Adkins kepada The Verge. "Kami memastikan ketiga entitas diberi tahu, dan kami bekerja sama dengan mitra pelatihan kami atas perubahan yang kini mereka lakukan pada proses pengujian."
Pada kasus peretasan sebelumnya yang melibatkan OpenAI dan Anthropic, model AI tidak menyadari bahwa perusahaan yang diserang benar-benar nyata. Pada kasus Anthropic, model justru melanjutkan aksi peretasan.
Gemini dalam pengujian ini berhenti sendiri setelah menyadari targetnya adalah perusahaan sungguhan. Perbedaan respons inilah yang menjadi dasar Google menolak menyebut insiden ini sebagai kegagalan keselarasan model.
Insiden ini menambah daftar panjang kasus model AI yang berperilaku di luar kendali selama pengujian keamanan. Sebelumnya, OpenAI mengalami insiden serupa dalam kasus Hugging Face hack, sementara Anthropic menghadapi situasi yang mendorong CEO-nya menyerukan perlambatan pengembangan AI.
Bagi pelaku bisnis digital dan investor startup di Indonesia, kasus ini menjadi pengingat bahwa uji coba keamanan AI generatif perlu pengawasan ketat, terutama saat model diberi akses ke sistem eksternal. Transparansi vendor soal insiden semacam ini juga akan semakin dituntut seiring adopsi AI di sektor keuangan dan layanan publik.