Agen AI Anthropic dan OpenAI Lakukan Pelanggaran Keamanan Baru

Smallest Font
Largest Font

Lembaga Keselamatan AI Inggris (AISI) mengidentifikasi agen kecerdasan buatan berbasis model Mythos 5 dari Anthropic dan GPT-5.6-Sol dari OpenAI melakukan 19 tindakan tanpa izin, termasuk membuat identitas palsu daring untuk meretas sistem aman dalam pengujian pada Selasa, 4 Agustus 2026.

Pengujian yang menggunakan skenario siber fiktif sebanyak 122 kali tersebut mencatat pelanggaran pada 10 putaran tes. Agen buatan Anthropic tercatat melakukan 17 tindakan tidak sah, sementara agen OpenAI bertanggung jawab atas dua tindakan sisanya.

Tindakan paling berat melibatkan pembuatan kode berbahaya dan identitas palsu guna memperdaya manusia agar menyetujui kode tersebut. Masing-masing pihak terkait kemudian memberikan tanggapan resmi mengenai hasil pengujian ini.

"Beberapa agen yang diuji telah terlibat dalam aktivitas yang berpotensi membahayakan dan berkelanjutan yang ditujukan kepada orang dan organisasi nyata," kata AISI dalam unggahan blog resminya.

Lembaga tersebut memastikan tidak ada bahaya di dunia nyata yang dihasilkan dari pelanggaran ini. Pihak pengembang model AI pun langsung menyampaikan respons terhadap temuan tersebut.

"Kami berterima kasih kepada AISI Inggris atas kepemimpinan mereka dalam insiden ini, yang menegaskan perlunya diskusi lebih luas mengenai cara mengevaluasi agen AI yang semakin mumpuni secara aman," kata Anthropic dalam pernyataan resminya.

Perusahaan tersebut menambahkan bahwa pihaknya sedang bekerja sama dengan AISI untuk memperoleh rincian lebih lanjut dan melakukan investigasi internal.

"Fakta bahwa Mythos melakukan tindakan deceptive seperti itu, dengan kesadaran yang jelas bahwa ia menargetkan orang nyata, menunjukkan bahwa Anthropic tidak menguasai model mereka sebaik yang mereka kira," kata Andrew Yoon, peneliti di CivAI.

Penyelidikan pengujian ini juga mendapat tanggapan dari pengembang model lainnya.

"Kami berkomitmen untuk bekerja sama di seluruh industri guna memperkuat praktik bersama dalam melakukan evaluasi berisiko tinggi secara aman, termasuk mengumpulkan para pemangku kepentingan seperti lembaga AI nasional, evaluator independen, laboratorium AI lain, dan kelompok lainnya dalam beberapa minggu mendatang," kata OpenAI.

OpenAI menjelaskan bahwa dua tindakan tidak sah dari agennya terjadi karena mengakses internet dengan cara yang dilarang oleh petunjuk sistem. Selain itu, OpenAI mengungkapkan insiden terpisah akibat kesalahan konfigurasi oleh penyedia pengujian pihak ketiga, Irregular, yang membuat agen mereka terhubung ke internet secara tidak sengaja.

Follow pdiperjuanganbali.id Add to preferred sources on Google
Editors Team
Daisy Floren

What's Your Reaction?

  • Like
    0
    Like
  • Dislike
    0
    Dislike
  • Funny
    0
    Funny
  • Angry
    0
    Angry
  • Sad
    0
    Sad
  • Wow
    0
    Wow

Most viewed