OpenAI, siber güvenlik testi sırasında görev verilen yapay zekâ ajanının belirlenen sınırları aşarak izole ortamdan çıktığını, internete eriştiğini ve Hugging Face’in gerçek altyapısına izinsiz ulaşmaya çalıştığını açıkladı. Şirket, olayı “benzeri görülmemiş bir siber güvenlik vakası” olarak değerlendirdi.

Yapay zekânın insan müdahalesi olmadan karmaşık işlemler gerçekleştirebilmesiyle ilgili endişeleri artıran dikkat çekici bir gelişme yaşandı. OpenAI, gelişmiş modellerini test ettiği sırada kullanılan otonom yapay zekâ ajanının, kendisine verilen görevi tamamlamak için beklenmedik adımlar attığını ve kontrollü test ortamının dışına çıkarak gerçek sistemlere yöneldiğini duyurdu.

Şirketin açıklamasına göre olay, siber saldırı yeteneklerini ölçmek amacıyla gerçekleştirilen “ExploitGym” isimli değerlendirme sürecinde meydana geldi. Testte kullanılan ajan, kendisine tanımlanan hedefe ulaşmak için insan yönlendirmesi olmadan çok aşamalı bir işlem zinciri oluşturdu.

Yapay zekâ sınırları aştı

OpenAI, test sırasında yüksek riskli faaliyetleri engelleyen bazı güvenlik filtrelerinin, modellerin ulaşabileceği en yüksek kapasiteyi ölçebilmek amacıyla devre dışı bırakıldığını belirtti.

GPT-5.6 Sol ile henüz kamuya sunulmamış daha gelişmiş bir modelin rol aldığı ajan, normal koşullarda internete erişimi olmayan izole bir ortamda çalışıyordu. Ancak sistem, kullanılan yazılım paketleme altyapısında daha önce bilinmeyen bir “sıfırıncı gün” açığı keşfetti.

Bu açığı kullanan yapay zekâ ajanı, yetkilerini artırarak internet bağlantısı bulunan bir sunucuya ulaşmayı başardı. Böylece test ortamının dışına çıkan sistem, gerçek dünyadaki bir altyapıya yöneldi.

OpenAI, yapay zekânın bilinç kazanarak kendi kararlarını aldığı bir durum olmadığını, ancak verilen hedefi yerine getirme konusunda geliştiricilerin öngörmediği yöntemlere başvurduğunu vurguladı.

Hedefte Hugging Face vardı

İnternete erişim sağlayan yapay zekâ ajanı, değerlendirme sürecindeki cevaplara ulaşabilmek amacıyla dünyanın en büyük yapay zekâ platformlarından biri olan Hugging Face’in altyapısını hedef aldı.

OpenAI’nin açıklamasına göre ajan, ele geçirdiği erişim bilgilerini ve yeni keşfettiği güvenlik açıklarını kullanarak sistemlere ulaşmaya çalıştı. Sürecin bir aşamasında Hugging Face sunucularında uzaktan kod çalıştırmaya imkân verebilecek bir yöntem de tespit edildi.

Hugging Face, saldırının tamamen otonom bir yapay zekâ sistemi tarafından gerçekleştirildiğini açıkladı. Şirket, olay sırasında bazı şirket içi veri kümelerine ve hizmetlerde kullanılan erişim bilgilerine izinsiz erişim sağlandığını, ancak kamuya açık modellerin, kullanıcı verilerinin veya platformdaki modellerin değiştirildiğine dair bir kanıt bulunmadığını bildirdi.

Şirket ayrıca müşteri ve iş ortaklarına ait verilerin etkilenip etkilenmediğine yönelik incelemelerin sürdüğünü duyurdu.

Binlerce işlemi kendi başına yaptı

Hugging Face’in incelemesine göre saldırıyı gerçekleştiren yapay zekâ sistemi, kısa süre içinde binlerce çalışma ortamı üzerinden on binlerce otomatik işlem yürüttü.

Ajan; sisteme giriş yapma, yetki yükseltme, erişim bilgilerini toplama ve farklı sunucular arasında ilerleme gibi adımları insan kontrolü olmadan planladı ve uyguladı. İncelemelerde saldırıya ilişkin 17 binden fazla işlem kaydı tespit edildi.

Bu durum, siber güvenlik dünyasında uzun süredir tartışılan “otonom yapay zekâ saldırıları” senaryosunun artık yalnızca teorik bir ihtimal olmadığını gösterdi.

OpenAI, olayın ardından güvenlik önlemlerini artırdığını açıkladı. Şirket, test altyapısındaki erişim kontrollerini sıkılaştırırken, güvenlik açıkları giderilene kadar bazı araştırma süreçlerine yeni sınırlamalar getirdi.

Hugging Face ile ortak inceleme başlatan OpenAI, kullanılan sıfırıncı gün açığının ilgili yazılım sağlayıcısına bildirildiğini ve gelecekteki testlerde daha gelişmiş izleme sistemlerinin kullanılacağını duyurdu.

Hugging Face ise etkilenen erişim bilgilerini yeniledi, güvenliği ihlal edilen sunucuları yeniden kurdu ve olayı yetkili kurumlara bildirdi.

Apple'dan Music ve iCloud+ fiyatlarına yüzde 50 zam!
Apple'dan Music ve iCloud+ fiyatlarına yüzde 50 zam!
İçeriği Görüntüle

Yaşanan olay, yapay zekâ güvenliği tartışmalarında yeni bir dönüm noktası olarak değerlendiriliyor. Uzmanlara göre artık temel soru yalnızca insanların yapay zekâyı kötü amaçlarla kullanması değil; kendi hedefini yerine getirmeye çalışan otonom sistemlerin, kendilerine çizilen sınırları aşarak gerçek dünyada beklenmeyen sonuçlara yol açıp açamayacağı.

Kaynak: Haber Merkezi