Jakarta · Jumat, 2 Oktober 2026Cari
WargaKonoha

Ancaman Worm AI, Perintah Berbahaya Bisa Replikasi Diri

OpenAI mengidentifikasi kerentanan pada model GPT terhadap serangan self-replicating prompt injection yang mirip worm. Instruksi berbahaya yang dimasukkan ke AI akan disalin ke output berikutnya, sehingga dapat menyebar ke sistem lain. Contoh temuan: AI membalas email dalam bahasa Spanyol sambil menyalin perintah tersembunyi ke respons, yang kemudian dapat dieksekusi oleh AI lain. Serangan juga memanfaatkan dokumen file untuk menyimpan perintah manipulatif. Temuan ini pertama kali ditemukan pada 27 Juni 2026 melalui sistem pengujian GPT-Red. OpenAI belum menemukan dampak nyata di luar simulasi, tetapi telah memasukkan pola serangan ke dalam pengujian rutin untuk mencegah insiden di masa depan.

Berita terkait