adalah penulis berita yang meliput perang streaming, teknologi konsumen, kripto, media sosial, dan banyak lagi. Sebelumnya, dia adalah seorang penulis dan editor di MUO.
OpenAI mengatakan model AI-nya secara keliru melanggar platform AI sumber terbuka Hugging Face selama pengujian internal. Di dalam posting blog pada hari SelasaOpenAI menulis bahwa GPT-5.6 Sol dan “model pra-rilis yang lebih mumpuni” menemukan kerentanan dalam lingkungan pengujian sandbox mereka, memungkinkan mereka mendapatkan akses ke internet dan menargetkan Hugging Face.
Pada tanggal 16 Juli, Memeluk Wajah mengungkapkan insiden keamanan yang dikatakan didorong oleh “sistem agen AI yang otonom.” Agen AI Hugging Face mendeteksi dan menghentikan pelanggaran tersebut, yang kini diakui OpenAI terjadi selama evaluasi kemampuan keamanan siber modelnya. OpenAI mengatakan “semua bukti menunjukkan bahwa model tersebut sangat fokus dalam menemukan solusi untuk ExploitGym,” sebuah sistem tolok ukur yang mengukur apakah model AI dapat mengubah kerentanan keamanan menjadi eksploitasi.
Sebagai bagian dari upaya untuk menyelesaikan evaluasi, model AI memperoleh akses ke internet dengan mengeksploitasi kerentanan zero-day di lingkungan sandbox. Dari sana, OpenAI mengatakan modelnya “menyimpulkan bahwa Hugging Face berpotensi menghosting model, kumpulan data, dan solusi untuk ExploitGym,” dan kemudian “mencari dan berhasil menemukan cara untuk mendapatkan akses ke informasi rahasia yang dapat digunakan untuk menipu evaluasi:”
Dalam satu contoh, model tersebut menyatukan beberapa vektor serangan, termasuk menggunakan kredensial yang dicuri dan kerentanan zero-day untuk menemukan jalur eksekusi kode jarak jauh di server Hugging Face.
Namun seserius apa pun insiden ini, OpenAI tampaknya menggunakan serangan yang “belum pernah terjadi sebelumnya” ini sebagai peluang untuk membuat sistem AI-nya terlihat bagus — terutama saat ia bersaing dengan pesaing keamanan siber, seperti Mitos Antropis Dan Gemini Flash 3.5 Cyber. Postingan blog OpenAI memiliki bagan yang menunjukkan bagaimana GPT-5.6 Sol menjadi lebih baik dalam mempertahankan operasi cyber multi-langkah, dan juga mendorong pelanggan perusahaan untuk mendaftar untuk mengakses model keamanan “Siber” miliknya.
OpenAI menambahkan bahwa mereka sekarang bekerja sama dengan Hugging Face untuk menyelidiki insiden keamanan tersebut, dan akan menerapkan kontrol baru dalam lingkungan penelitiannya.
Ikuti topik dan penulis dari cerita ini untuk melihat lebih banyak hal serupa di feed beranda hasil personalisasi Anda dan untuk menerima pembaruan email.
