Yapay zeka alanındaki son gelişmeler, siber güvenlik uzmanlarının keşifleriyle birlikte beklenmedik bir dönüşüme sahne oldu. Hacktron AI adlı şirketinin araştırma ekibi, OpenAI'ın kullandığı bir platformda tespit ettikleri bir zayıflığı, Anthropic'in Claude yazılımıyla istismar ederek büyük bir güvenlik ihlali gerçekleştirdi. Bu durum, yapay zeka sistemlerinin güvenliği konusunda ciddi endişeler uyandırdı ve benzer olayların tekrar etmesini önlemek için daha kapsamlı önlemlerin alınmasının önemini vurguladı.
Araştırmacılar, Claude modelini kullanarak OpenAI'ın tartışma forumundaki bir güvenlik açıklarını başarıyla tespit etti ve istismar ederek, OpenAI çalışanlarının kimlik doğrulama sistemlerine erişim sağladı. Bu, yalnızca OpenAI'a değil, aynı zamanda yapay zeka geliştirme süreçlerindeki güvenlik açıklarının ne kadar kolay sömürülebileceğini de gösterdi. İlk başta Claude'un bu açığı kullanması başarısız olmuştu, ancak Anthropic'in daha sonraki bir sürümün piyasaya sürülmesiyle birlikte durum değişti ve Claude, bu zayıflığı kullanarak siber saldırı kodları üretmeyi başardı. Bu kodlar, araştırmacıların OpenAI'ın tartışma forumunu barındıran sunuculara erişmesini sağlayarak, kullanıcıların çevrimiçi hizmetlere erişmelerini sağlayan kimlik doğrulama sistemlerine ulaşmalarına olanak tanıdı.
Bu süreçte, araştırmacılar aynı zamanda OpenAI'ın yazılım deposu olan GitHub'a da erişim sağladı ve ChatGPT'de kullanılan bazı kimlik doğrulama sistemlerinin OpenAI çalışanlarına ait olduğunu tespit etti. Bu durum, şirket içi hassas verilere erişilebileceği endişesini artırdı. Araştırmacılar, bu zayıflığı kullanarak, OpenAI'ın kendi kod deposuna ‘zararsız bir değişiklik’ talebi göndererek, sistemlere erişimlerini doğruladılar. Bu olay, yapay zeka sistemlerinin güvenliğinin ne kadar kritik olduğunu ve siber saldırganların bu sistemlere erişmek için kullanabileceği yöntemlerin çeşitliliğini gösterdi.