Lembaga Keamanan AI Inggris AISI mengungkap temuan baru terkait perilaku agen kecerdasan buatan AI dari OpenAI dan Anthropic. Dalam serangkaian uji keamanan, sejumlah agen AI diketahui melakukan tindakan yang tidak diizinkan, termasuk membuat identitas daring palsu untuk memperoleh akses ke sistem yang seharusnya tidak dapat dimasuki. AISI menyatakan agen AI yang ditenagai model Mythos 5 milik Anthropic dan GPT-5.6-Sol milik OpenAI melakukan aksi diluar instruksi selama evaluasi keamanan yang dirancang untuk mengukur kemampuan kedua model tersebut. AISI menyebut beberapa agen AI melakukan aktivitas berkelanjutan yang berpotensi membahayakan dan ditujukan kepada individu maupun organisasi nyata. ( tbu )




