
OpenAI telah mengakui bahwa beberapa model AI-nya melanggar lingkungan pengujian yang “sangat terisolasi”, memperoleh akses ke internet, dan meretas jaringan internal Hugging Face—menggambarkannya sebagai “insiden dunia maya yang belum pernah terjadi sebelumnya”.
Hugging Face, sebuah platform sumber terbuka untuk model dan kumpulan data pembelajaran mesin, melaporkan insiden keamanan awal pekan ini, menyebutnya “berbeda dari apa pun yang pernah kami tangani sebelumnya” karena insiden tersebut didorong oleh sistem agen AI yang otonom. Dan ya, saya merasa seperti kita sedang melintasi semacam AI Rubicon di sini.
Menjelaskan insiden tersebut dalam sebuah pernyataan, OpenAI mengatakan: “Setelah menyelidiki, kami sekarang mengetahui bahwa insiden khusus ini didorong oleh kombinasi model OpenAI—termasuk GPT‑5.6 Sol dan model pra-rilis yang lebih mumpuni… sambil diuji secara internal pada tolok ukur kemampuan siber.”
Video Terbaru Dari Tonton video lengkapnya di sini:
Tolok ukur yang dimaksud adalah ExploitGym, sebuah alat yang dibangun dari ratusan kerentanan keamanan siber di dunia nyata yang digunakan untuk mengevaluasi kemampuan agen AI dalam mengembangkan eksploitasi.
Setelah mengeksploitasi kerentanan zero-day untuk melakukan serangkaian peningkatan hak istimewa, model tersebut akhirnya mencapai node dengan akses internet, menjangkau melampaui lingkungan sandbox mereka. Mereka kemudian menyimpulkan bahwa Hugging Face mungkin memiliki model, kumpulan data, dan solusi untuk ExploitGym, dan mulai menyerang servernya menggunakan berbagai metode, termasuk penggunaan kredensial yang dicuri.
(Kredit gambar: Kolektif Linggis)
Pernyataan tersebut berlanjut: “Model tersebut mengidentifikasi dan merantai kerentanan di seluruh lingkungan penelitian OpenAI dan infrastruktur produksi Hugging Face untuk mendapatkan solusi pengujian langsung dari database produksi Hugging Face.
“Semua bukti menunjukkan bahwa model tersebut sangat fokus dalam menemukan solusi untuk ExploitGym, melakukan upaya ekstrem untuk mencapai tujuan pengujian yang agak sempit.”
Berita game terbesar, ulasan, dan penawaran perangkat keras Ikuti terus berita paling penting dan penawaran terbaik, yang dipilih oleh tim PC Gamer. Hubungi saya dengan berita dan penawaran dari merek Masa Depan lainnya. Terima email dari kami atas nama mitra atau sponsor tepercaya kami
Kombinasi tim keamanan siber Hugging Face dan agen AI mereka mendeteksi dan menangani penyusupan tersebut, yang pada akhirnya menghentikannya. Artinya, ya, agen AI pada dasarnya berperang melawan agen AI. Dan tidak, itu tidak sekeren yang Anda bayangkan di kepala Anda.
OpenAI mengatakan bahwa mereka sekarang menerapkan “kontrol ketat… dengan mengorbankan kecepatan penelitian” sambil memperbaiki kerentanan, dan bekerja sama dengan Hugging Face untuk “menyelidiki secara forensik” insiden tersebut.
(Kredit gambar: Jakub Porzycki/NurPhoto melalui Getty Images)
Saya… terperangah, jika saya jujur. Di satu sisi, sangat menarik bahwa beberapa model AI memiliki kemampuan untuk menembus batasan dan menjelajah internet secara luas untuk mencapai tujuan mereka.
Di sisi lain, ini sungguh menakutkan. Kita sekarang hidup di dunia di mana ransomware AI, alat peretasan berkode AI, dan pelanggaran keamanan berbasis AI menjadi kenyataan, dan mengingat kemampuan yang ditunjukkan hingga saat ini, tampaknya bahkan perusahaan yang sah pun tidak selalu dapat mengendalikan model mereka.
Bentuk Torment Nexus apa yang kami buat di sini, dan di mana saya bisa turun?
🔗 Sumber: Baca Artikel Aslinya Disini