Yapay zekâ teknolojilerinin hızla gelişmesiyle birlikte, bu teknolojilerin siber saldırılardaki rolü de giderek önem kazanıyor. Bu kez, sektörün iki devi olan OpenAI ve Anthropic arasında, yapay zekâ gücünün sınırlarını zorlayan bir olay yaşandı. Siber güvenlik uzmanları olan Hacktron AI’dan oluşan üç kişilik ekip, Anthropic’in Claude Opus 5 modelini kullanarak OpenAI’nin sistemlerine sızmayı başardı.

Olayın merkezinde, OpenAI’nin topluluk forumunda bulunan Discourse yazılımındaki bir güvenlik açığı yatıyordu. Araştırmacılar, bu açık sayesinde görsel dosyaları işlerken kullanılan bir bileşende bellek hatası tespit etti. HEIC ve HEIF formatındaki görüntülerin işlenme biçimi, uzaktan kod çalıştırma potansiyeli sunarken, Claude Opus 4.8 modelinin bu hatayı kullanmakta başarısız olmasına rağmen, yeni Claude Opus 5 modelinin bu açığı kullanarak çalışan bir istismar kodu oluşturması dikkat çekici bir gelişmeyi işaret etti.

Bu durum, yapay zekânın sadece kod yazabilme yeteneğini değil, aynı zamanda eski modellerin aşamadığı karmaşık saldırı zincirlerini çalışır hale getirebilme kapasitesini ortaya koydu. Ek olarak, forum sunucusuna erişim sağlandıktan sonra, OpenAI’nin oturum açma altyapısındaki bir yapılandırma hatası nedeniyle ChatGPT ve Codex hesaplarına da erişim elde edildi. Bu durum, kurumsal hesapların şirket içindeki diğer sistemlere erişim yetkisi taşıması nedeniyle saldırının potansiyel etkisini daha da artırdı.

Araştırmacılar, özel kod deposuna erişim sağlayarak şirketin kaynak kodlarına doğrudan müdahalede bulunmadıklarını, yalnızca bir değişiklik talebi göndererek bu seviyeye ulaşabileceklerini belirttiler. Ancak, özel depodaki dokümantasyon dosyasına değişiklik yapabilme yetenekleri, saldırının ne kadar derinlere uzandığını gösteriyor. Olayın ardından OpenAI, güvenlik açıklarını giderdi ve ilgili geliştiricilere bilgi aktardı. Bu olay, yapay zekânın siber güvenlik alanındaki potansiyelini ve bu potansiyelin risklerini bir kez daha gözler önüne serdi.