Yapay zeka teknolojilerinin hızla geliştiği bu dönemde, büyük şirketlerin dijital güvenliği konusunda karşılaştığı riskler göz ardı edilemez hale geldi. Hacktron AI adlı siber güvenlik firmasının uzmanları, OpenAI'ın kullandığı bir platformdaki bir zayıflığı tespit ederek, bu durumu olağanüstü bir şekilde değerlendirdi. Anthropic firmasının geliştirdiği Claude modelini kullanarak OpenAI'ın sistemlerine sızma girişimi, yapay zeka güvenliğinin ne kadar kritik olduğunu bir kez daha ortaya koydu.
Araştırmacıların, Claude modelini kullanarak OpenAI'ın tartışma forumundaki bir güvenlik açığını istismar etmesi, dikkat çekici bir gelişme oldu. Bu süreçte, Claude modeline özel bir sürüm üzerinde çalıştırılarak, siber saldırı kodları oluşturulması sağlandı. İlk denemelerde başarısız olan bu girişim, Anthropic firmasının daha sonraki bir hamlesiyle (Opus 5'in piyasaya sürülmesi) hız kazandı ve Claude'un açığı istismar etme yeteneği ortaya konuldu. Sonuç olarak, araştırmacılar OpenAI'ın sunucularına erişim sağlayarak, kimlik doğrulama sistemlerine sızma girişiminde bulundular.
Bu sızma girişimi, yalnızca OpenAI'ın sistemlerine değil, aynı zamanda ChatGPT'nin temelindeki güvenlik mekanizmalarına da zarar verme potansiyeli taşıyordu. Araştırmacılar, OpenAI'ın yazılım deposu GitHub'a erişim sağlayarak, şirketin iç kodlarına ulaşma imkanı buldular. Bu durum, OpenAI çalışanlarının hesaplarına da erişebildikleri tespit edildi. Şaşırtıcı bir gelişme olarak, araştırmacılar, herhangi bir kod değişikliği yapmadan, sadece bir çalışanın hesabından OpenAI'ın sistemlerine