OpenAI isimli yapay zeka firmasının faydalandığı bir münazara platformunda zafiyet bulan siber güvenlik timi, Anthropic bünyesindeki Claude yazılımından faydalanarak firmanın bazı dahili sistemlerine giriş yaptı. Hacktron AI bünyesindeki araştırmacılar, forumun görsel dosyalarını işleme biçimindeki bir hatayı ortaya çıkardı. Tim, siber güvenlik alanında uzman kişilere tahsis edilen özel bir Claude Opus 4.8 versiyonuna ulaştı ve modelden, zafiyeti kötüye kullanacak yazılım kodunu kaleme almasını talep etti. İlk denemede başarısız olan sürümün ardından Anthropic aynı akşam Opus 5’i piyasaya sürdü. Ertesi gün Claude, bu açığı kötüye kullanmanın bir yolunu bularak saldırı kodunu üretti.
Üretilen kod, araştırmacıların OpenAI’ın tartışma forumunu barındıran sunucuya ulaşmasını sağladı. Ekip burada, kullanıcıların çevrim içi hizmetlere giriş yapmasını mümkün kılan kimlik doğrulama sistemlerine ulaştı. Araştırmacılar, OpenAI’nin yazılım deposu GitHub hizmetine erişmek için de kullanılabilen bu sistemlerin ChatGPT’de geçerli olduğunu belirledi. Bazı kimlik doğrulama bilgilerinin OpenAI çalışanlarına ait olduğu tespit edildi. Firmanın içindeki gizli bilgilere ulaşabileceklerini fark eden tim, yalnızca bir personelin hesabı üzerinden, herhangi bir kritik koda temas etmeksizin OpenAI’ın kendi dahili kod ambarına zarar vermeyen bir değişiklik başvurusu yolladı.
Araştırmacılar, söz konusu başvuruyu sistemlere giriş yaptıklarının delili olarak iletti ve zafiyeti OpenAI ile forum yazılımını üreten Discourse firmasına haber verdi. Tespit ettikleri bulguları OpenAI’a ileten ekip, karşılığında şirketten para ödülü aldı. Araştırmacılar, gerçekleştirdikleri denetimli saldırının, devlet desteğiyle hareket eden ve siber sahada üst düzey kabiliyete sahip kişilerin bir ülkenin yapay zeka sahasındaki saklı bilgilerine ulaşabileceğini gözler önüne serdiğini ifade etti. Açığın bildirim sonrasında kapatıldığı ifade edildi.
Hacktron AI’ın teknoloji direktörü Mohan Pedhapati, ekiplerinin kapasitesine ilişkin değerlendirmede bulundu. Pedhapati, Çinli aktörler kadar güçlü olduklarını sanmadıklarını belirterek, “Biz sadece Claude ve Codex abonelikleri olan üç kişiyiz.” dedi. Açıklama, sınırlı kaynaklarla dahi yapay zeka sistemlerinde ciddi güvenlik zafiyetlerinin ortaya çıkarılabileceğini gösterdi. Olay, yapay zeka modellerinin güvenlik testlerinde nasıl kullanılabileceğine dair yeni bir örnek olarak kayıtlara geçti. OpenAI cephesinden konuya ilişkin henüz kamuya açık bir değerlendirme yapılmadı.





