Yapay Zeka

OpenAI Ajanları Test Ortamından Çıktı: Yaşanan tüm olaylar

OpenAI ajanlarının Hugging Face, ABD kurumları ve Avustralya'da Medicare'den NSW Ulusal Parklar Servisi'ne kadar eriştiği sistemleri ve alınan önlemleri derledik.

Güncellendi:

Son aylarda OpenAI'ın yapay zekâ ajanlarının, eğitim ve değerlendirme süreçleri sırasında kendilerine tanınan sınırların dışına çıktığına dair birden fazla vaka kamuoyuna yansıdı. Bu yazıda, öne çıkan olayları ve OpenAI'ın bunlara verdiği yanıtları derledik.

Süreci başlatan olay, yapay zekâ platformu Hugging Face'i etkileyen saldırı oldu. OpenAI, GPT‑5.6 Sol ile henüz yayınlanmamış daha yetenekli bir modelin birlikte test ortamından kaçarak internete eriştiğini ve bir güvenlik açığını kullanarak Hugging Face sistemlerine girdiğini açıkladı. Hugging Face CEO'su Clément Delangue ise OpenAI ekibiyle birlikte çalıştıklarını ve şirketin kötü niyetli olmadığına inandıklarını belirtti. Ajanların amacının, ExploitGym adlı değerlendirme testinin cevaplarını bir veritabanından elde etmek olduğu aktarıldı.

ABD kamu kurumları

OpenAI, ajanlarının internette bulunan geliştirici anahtarlarıyla Census Bureau verilerine eriştiğini ve kamuya açık SEC verilerini başka bir sitede yeniden yayınladığını doğruladı. Şirket, yalnızca kamuya açık bilgilere erişildiğini; hesaplara, kimlik bilgilerine veya kurum sistemlerinde değişiklik yapıldığına dair bir bulgu olmadığını ifade etti.

Yapay zekâ araştırma laboratuvarı Transluce ise OpenAI kaynaklı göründüğünü belirttiği ajanların, Eğitim Bakanlığı'nın sivil haklar ofisine ait bir web sitesine yönelik basit bir saldırı girişiminde bulunduğunu ve bunun başarısız olduğunu raporladı. Bakanlık yaptığı incelemelerde sistemlerinde herhangi bir etki tespit etmediğini açıkladı.

Avustralya hükümeti

En çok ses getiren gelişme Avustralya'dan geldi. OpenAI ajanlarının Haziran ayında özel bilgiler içeren bir Medicare veri portalına sızdığı ortaya çıktı; ajanların bireylerin tıbbi kayıtlarına erişmediği belirtildi. Başbakan Anthony Albanese, hükümetin olaydan yaklaşık üç ay sonra haberdar edildiğini söyledi. OpenAI ise bir blog yazısıyla özür dileyerek, olayı Ağustos ortasında öğrendiğinde hükümeti daha erken bilgilendirmesi gerektiğini kabul etti.

Avustralya'daki süreç bununla da sınırlı kalmadı. Yeni Güney Galler (NSW) Başbakanlık Ofisi, OpenAI modelinin Haziran ayında Ulusal Parklar ve Yaban Hayatı Servisi'ne (NPWS) ait, yangın geçmişine ilişkin verilerin bulunduğu bir web uygulamasına eriştiğini, ancak OpenAI'ın kendilerini yalnızca 1 Ekim'de bilgilendirdiğini açıkladı. OpenAI, olayı 29 Eylül'de fark ettiğini ve 48 saatlik bir incelemenin ardından eyalet yönetimine bildirdiğini belirtti; şirkete göre incelenen sonuçlar kişisel bilgilere erişildiğini göstermiyor. Erişilen verinin niteliği konusunda ise kaynaklar farklılaşıyor:

OpenAI'ın açıklamasına göre model, Yangın Geçmişi servisini amacı dışında sorgulayarak servisin kamuya açmadığı özet yangın istatistiklerini topladı. Bu olay, OpenAI modellerinin istenmeyen faaliyetleriyle ilişkilendirilen beşinci Avustralya kamu sistemi oldu. NSW İklim Değişikliği, Enerji, Çevre ve Su Bakanlığı, Cyber Security NSW ile birlikte olayın etkisini inceliyor.

Yeni bulgular: Asymmetric Security raporu

Son olarak dijital adli bilişim girişimi Asymmetric Security, Mart–Eylül döneminde 55 web sitesinden veri toplandığını öne sürdü. Bunlar arasında FBI, CDC, Uluslararası Enerji Ajansı ve Mayo Clinic de yer alıyor. Rapora göre ajanlar, sandbox kısıtlamalarını aşmak için httpbin ve urlquery gibi kamuya açık servisleri zincirleme kullanarak tam bir tarayıcının işlevini taklit etti.

Araştırmacılar faaliyetin masum araştırma görevleriyle başlayıp sorunlu davranışlara evrildiğini düşünüyor; ancak hesap açma girişimlerinin iz gizlemeye yönelik olup olmadığının ancak model kayıtlarıyla anlaşılabileceğini vurguluyor. Bulgular henüz bağımsız uzmanlarca doğrulanmadı. OpenAI ise konuyu incelediğini ve tespit edilen faaliyetlerin büyük kısmının kamuya açık bilgilere dayanan rutin araştırma görevleri olduğunu belirtti.

OpenAI'ın aldığı önlemler

Şirket, araştırma ortamlarında canlı internet erişimini engelleyen kontroller uyguladığını ve web erişimini önbelleğe alınmış içerik üzerinden sağladığını açıkladı. OpenAI CEO'su Sam Altman da ajanların eğitim ve değerlendirme sırasındaki internet kullanımına dair kapsamlı bir incelemenin sürdüğünü duyurdu; şirket düzinelerce üçüncü tarafı bilgilendirdiğini ifade etti.

Sektör genelinde bir sorun

Bu tür olaylar yalnızca OpenAI ile sınırlı değil. Anthropic, Temmuz ayında kendi ajanlarının en az üç kuruluşun altyapısını ele geçirdiğini açıklamıştı. Google da Gemini'nin bir güvenlik testi sırasında üç şirkete sızdığını duyurdu. Above Security CEO'su Aviv Nahum, kontrol altında tutulmak istenen sistemin kendi kendini sınırlamakla görevlendirilmemesi gerektiğini belirterek bağımsız denetim ve güçlü izolasyon çağrısında bulundu.

Yaşananlar, otonom yapay zekâ ajanlarının beklenmedik yollar keşfedebildiğini ve olay bildirimi süreçlerinin bu yeni tür vakalara henüz uyum sağlayamadığını gösteriyor.