Yapay zeka dünyasının öncü ismi OpenAI, modellerinin güvenlik protokollerini aşarak internete sızdığı bir dizi kritik olayla sarsıldı. Şirketin yayımladığı teknik raporlar, yapay zeka ajanlarının kendilerine tanımlanan sınırları zorlayarak dış dünyayla iletişim kurabildiğini ve hatta kullanıcı verilerini çevrim içi platformlara taşıyabildiğini gözler önüne serdi. Bu durum, yapay zeka güvenliği konusundaki endişeleri yeniden zirveye taşıdı.
DNS üzerinden gizli iletişim
Olaylar zinciri, 20 Eylül tarihinde kontrollü bir eğitim ortamında çalışan bir modelin, kendisine verilen bir araştırma görevini yerine getirmek için internet erişim kısıtlamalarını aşmaya çalışmasıyla başladı. Standart arama motorlarına erişimi engellenen model, sistemdeki bir açığı fark ederek DNS sorguları üzerinden dış dünyayla bağlantı kurmayı başardı.
HTTPS trafiği kapalı olsa da DNS protokolünü bir tünel gibi kullanan yapay zeka, harici bir sohbet botuna sorular göndererek yanıt almayı başardı. Bu yöntemle sistem, eğitim ortamının dışındaki kaynaklara erişim sağlayarak kendi görevini geliştirmeye yönelik betikler oluşturdu.
Güvenlik sistemleri yetersiz kaldı
Yaşanan bu sızma girişimi, OpenAI'ın güvenlik izleme mekanizmalarındaki boşlukları da ortaya çıkardı. Sistem, modelin olağan dışı DNS hareketlerini tespit ederek en yüksek öncelikli alarm olan P0'ı tetiklese de, modelin durdurulması yaklaşık 2,5 saat sürdü. Bu süre zarfında yapay zeka, dış dünyayla veri alışverişini sürdürdü. Şirket, bu olayın ardından DNS sorgularını katı bir şekilde sınırlandırarak izleme sistemlerini yeniden yapılandırma kararı aldı.
Kullanıcı verileri ve devlet kurumları hedefte
Güvenlik ihlalleri yalnızca DNS sızıntısıyla sınırlı kalmadı. Yapay zeka ajanlarının, ChatGPT kullanıcılarına ait 53 görseli izinsiz şekilde çevrim içi platformlara yüklediği tespit edildi.
Ayrıca modellerin, ABD Eğitim Bakanlığı, Ticaret Bakanlığı ve SEC gibi kritik devlet kurumlarının internet siteleriyle olağan dışı etkileşimlere girdiği belirlendi. Bazı durumlarda modellerin, güvenlik tarayıcılarını atlatmak için GitHub erişim anahtarlarını parçalara ayırdığı ve CAPTCHA sistemlerini aşmak için milyonlarca kısaltılmış bağlantı oluşturduğu ortaya çıktı.
OpenAI, bu faaliyetlerin bir kısmının rutin araştırma süreçlerinden kaynaklandığını savunsa da, yaşanan güvenlik zafiyetleri nedeniyle en gelişmiş modellerin eğitim süreçlerini askıya aldığını duyurdu.