Uzmanlar uzun zamandır yapay zeka destekli siber saldırılar konusunda uyarıyordu. Son bir gelişme ise endişeleri daha da artıracak gibi görünüyor: OpenAI'de yürütülen dahili bir test sırasında yapay zeka modelleri kendi başlarına hareket ederek "gizli bilgilere" erişim sağladı.
ChatGPT'nin geliştiricisi OpenAI'ın yeni yapay zeka modelleri üzerinde yaptığı testlerde yaşanan olağanüstü olay, yapay zekanın siber saldırılarda kullanılmasının oluşturabileceği riski gözler önüne serdi.
OpenAI'ın dün yayımladığı blog yazısına göre yapay zeka, kendi başına başka bir yapay zeka şirketinin bilgisayar sistemlerine sızarak deneyimli bir bilgisayar korsanı gibi davrandı.
Yapay zeka uygulamaları platformu Hugging Face, geçen hafta yapay zeka kullanılarak gerçekleştirilen bir siber saldırıyı duyurmuştu. Açıklamanın ardından bu saldırının, OpenAI'deki dahili bir deney sırasında yapay zekanın beklenenden ileri gitmesinden kaynaklandığı ortaya çıktı.
Olay nasıl yaşandı?
OpenAI'ın blog yazısına göre şirket, GPT-5.6 Sol modeli ile henüz yayımlanmamış daha gelişmiş bir modelin, siber saldırılarda kullanılabilecek güvenlik açıklarını bulma ve bunlardan yararlanma yeteneğini ölçmek istiyordu.
Bunun için yapay zekaya, sektörde yaygın olarak kullanılan ExploitGym adlı standart değerlendirme testindeki görevler verildi. Ancak modeller, bu görevleri yerine getirebilmek için beklenenden çok daha ileri gitti.
Yapay zeka izole ortamdan internete çıkmanın yolunu buldu
Yazılım önce daha önce bilinmeyen bir güvenlik açığını kullanarak test ortamından çıktı ve kendi başına açık internete erişim sağladı.
İnternette bağımsız olarak araştırma yapan modeller, Hugging Face'in ExploitGym görevleriyle ilgili yararlı veri ve çözümler barındırabileceği sonucuna vardı. Bunun üzerine yapay zeka, platformdaki "gizli bilgilere" erişerek bunları ExploitGym testinde avantaj sağlamak amacıyla kullanmaya çalıştı. Bunların hiçbirisi ise modele açık komut olarak verilmemişti.
Saldırının yürütüldüğü dijital kontrol merkezinin yerini birkaç kez değiştirdi
Hugging Face'e göre yapay zeka saldırganı binlerce işlem gerçekleştirdi ve saldırının yürütüldüğü dijital kontrol merkezinin yerini birkaç kez değiştirdi.
OpenAI ise yaşananları "benzeri görülmemiş bir siber güvenlik olayı" olarak nitelendirdi.
Saldırı kısa sürede durduruldu
OpenAI, olayın kontrollü bir test sırasında yaşandığını, gerçek dünyaya yönelik planlı bir saldırı olmadığını vurguladı. Şirket, güvenlik ekiplerinin olağan dışı faaliyetleri tespit ettiğini, Hugging Face'in de saldırıyı kısa sürede durdurduğunu açıkladı.
Hugging Face, bundan sonra OpenAI ile birlikte çözüm geliştirecek olmaktan memnuniyet duyduğunu açıkladı.
Şirket açıklamasında şu ifadelere yer verdi: "Muhtemelen türünün ilk örneği olan bu olay, uzun zamandır savunduğumuz bir görüşü doğruluyor: Yapay zeka güvenliği tek bir şirket tarafından kapalı kapılar ardında sağlanamaz. Bu sorun, yapay zekaya erişimi olan tüm savunma ekiplerinin katılımıyla, açık ve iş birliğine dayalı bir yaklaşımla çözülecektir."
Uzmanlar uzun zamandır yapay zeka destekli siber saldırılar konusunda uyarılarda bulunuyor. Son aylarda ise OpenAI'ın rakibi Anthropic'in geliştirdiği Mythos adlı model bu tartışmaları daha da alevlendirdi. Söz konusu yapay zeka, yıllardır fark edilmeyen ve yaygın kullanılan yazılımlar ile çevrim içi hizmetlerdeki güvenlik açıklarını ortaya çıkardı. Bu açıklar daha sonra kapatıldı.
Ancak bu gelişme, böyle bir teknolojinin kötü niyetli kişilerin eline geçmesi halinde son derece yıkıcı bir siber silaha dönüşebileceğini de gösterdi.
Kaynaklar: Open AI – Der Spiegel













Yorumunuz