Bir OpenAI ajanı kendi başına yeni güvenlik açıklarını keşfederek start-up Hugging Face'i hackledi. Bu olay, insan kontrolü dışında hareket eden bir yapay zeka sisteminin gerçekleştirdiği ilk siber saldırı örneklerinden biri oldu.
ChatGPT'nin geliştiricisi, salı günü yaptığı açıklamada olayı "benzeri görülmemiş bir siber olay" olarak tanımladı. Olayın, insan talimatlarına dayanarak kendi başına çalışabilen bir yapay zeka programı olan ajanın test ortamından kaçmasıyla yaşandığı belirtildi. Ajanın internet erişimi sağlayarak giriş kimlik bilgilerini çaldığı ifade edildi.
Bu itiraf, gelişmiş yapay zeka sistemlerinin dijital altyapıları hacklemesinin olası sonuçlarına dair endişelerin arttığı bir dönemde geldi. Özellikle ajanların insan kontrollerini altüst ettiği senaryolar kaygı yaratıyor.
OpenAI, salı günü yaptığı açıklamada bu tür olayların giderek artacağını belirtti. Şirket, siber yetenekleri giderek artan modellerin çoğalmasıyla bu durumun "daha sıradan hale gelmesini" beklediklerini aktardı.
Hükümetleri endişelendiren yeni nesil modeller
Bu olay, OpenAI İcra Kurulu Başkanı Sam Altman'ın gelecek nesil yapay zeka modelleri hakkında ABD hükümetini bilgilendirmek üzere haftaya Washington'a gideceği sırada yaşandı.
ABD yönetimi, yeni modellerin piyasaya sürülmeden önce incelenmesi konusunda giderek daha istekli hale geliyor. Bu durum, Anthropic'in Mythos modelinin siber açıkları tespit etme ve kullanma konusundaki gelişmiş yeteneklerinin küresel çapta yarattığı endişenin ardından hız kazandı.
Son olayın, bu ayın başlarında piyasaya sürülen GPT-5.6 Sol dahil olmak üzere OpenAI modellerinin bir kombinasyonunu içerdiği açıklandı. Şirket, ayrıca piyasaya sürülmeden önce test edilen daha yetenekli bir modelin de olaya dahil olduğunu belirtti.
OpenAI, blog yazısında, "Bu olayı en son teknoloji siber yetenekleri içeren eşi benzeri görülmemiş bir siber olay olarak değerlendiriyoruz ve buna göre yanıt veriyoruz." dedi.
Otonom saldırı şaşkınlık yarattı
Geliştiriciler için model ve veri setleri barındıran yapay zeka start-up'ı Hugging Face, geçtiğimiz cuma günü harici bir yapay zeka ajanı tarafından hacklendiğini duyurdu.
İcra Kurulu Başkanı Clement Delangue, X platformunda yaptığı açıklamada, "Ajanın gelişmişliğini göz önüne alarak geçen haftaki siber saldırının öncü bir laboratuvardan gelmiş olabileceğinden şüpheleniyorduk." ifadesini kullandı.
Delangue, şirketin son bir günü OpenAI ile yakın çalışarak geçirdiğini belirterek, "Onların tarafında kötü niyetli bir niyet olmadığına güçlü bir şekilde inanıyoruz. Tüm bunların otonom bir şekilde gerçekleşmesi oldukça akıl almaz!" değerlendirmesini yaptı.
Test ortamından nasıl kaçtılar?
OpenAI, her iki modeli de test ortamında değerlendirmek için siber güvenlik önlemlerini kasıtlı olarak azaltmıştı. Ancak ajanlar, sistemleri kontrol etmek ve internete erişimlerini engellemek için tasarlanmış korumalı alan olarak bilinen bir alanda faaliyet gösteriyordu.
Modeller, siber yeteneklerini değerlendirmek için hacklemeye çalışmak üzere talimatlandırıldı. OpenAI, modellerin daha sonra açık internet erişimi sağlamanın bir yolunu bulmak için önemli miktarda bilgi işlem gücü harcadığını kaydetti.
Modeller korumalı alandan kaçmak, internet erişimi kazanmak ve hedeflerine ulaşmak için daha önce bilinmeyen güvenlik açıklarını tespit etti ve kullandı. Bu süreç, hackleme işlemini gerçekleştirmek için giriş detayları gibi kimlik bilgilerinin çalınmasını da içeriyordu.
Hugging Face, kendi altyapısındaki aktiviteyi tespit etmek ve durdurmak için kendi ajanlarını kullandı. OpenAI ise FT'ye olayla ilgili olarak emniyet teşkilatı ve diğer hükümet yetkilileriyle iletişim kurduğunu aktardı.