OpenAI'nin kullandığı tartışma forumunda tespit edilen bir güvenlik açığının, Anthropic'in Claude modeliyle istismar edildiği bildirildi. Hacktron AI adlı siber güvenlik ekibi, 18 Eylül'de bulgularını OpenAI'ye iletti; şirket, açığın giderildiğini ve sorumluluk bildirimi için araştırmacılara 6.500 dolar ödendiğini duyurdu. Bilgiler TRT Haber'in AA kaynaklı haberinde ve araştırmacıların paylaşımlarında yer aldı.

Araştırmacıların aktardığına ve ABD basınında yer alan haberlere göre ekip, forumun bazı görsel dosyalarını işleme biçimindeki bir yazılım hatasını hedef aldı. Ekip önce nitelikli güvenlik uzmanlarına sunulan Claude Opus 4.8 sürümünü denedi ancak sonuç alamadı; aynı akşam Anthropic Opus 5'i çıkardı ve ertesi gün Claude, söz konusu açığı istismar edecek kodu üretti.

Claude'un oluşturduğu saldırı kodu, OpenAI'nin forumunu barındıran sunucuya erişim sağladı. Araştırmacılar burada çevrim içi hizmetlere girişte kullanılan kimlik doğrulama sistemlerine ulaştı. Bu kimlik doğrulama verilerinin bir bölümünün ChatGPT'de geçerli olduğunu ve bazılarının OpenAI çalışanlarına ait olduğunu tespit ettiklerini açıkladılar. Elde ettikleri yetkilerle, şirketin yazılım deposu GitHub'da, bir çalışanın hesabı üzerinden "zararsız bir değişiklik" talebi (pull request) gönderdiklerini ve hassas koda dokunmadıklarını belirttiler.

Hacktron AI ekibi, bulgularını OpenAI'ye ve forum yazılımını geliştiren Discourse şirketine bildirdi. OpenAI, "Araştırmacılara bizimle iletişime geçerek bulgularını paylaştıkları için teşekkür ediyoruz. Topluluk forumundaki oturum açma tokenlarının yetkilerini sınırlandırdık ve etkilenen tokenları ve oturumları iptal ettik." açıklamasını yaptı. Şirket, açığın kapatıldığını bildirdi.

Hacktron AI'ın teknoloji direktörü Mohan Pedhapati, bu çalışmanın "kontrollü bir saldırı" olduğunu ve devlet destekli, ileri düzey yetkin aktörlerin bir ülkenin yapay zekâ alanındaki gizli bilgilerine erişebileceğini gösterdiğini söyledi. Pedhapati, "Biz sadece Claude ve Codex abonelikleri olan üç kişiyiz" ifadesini kullandı. Anthropic ise konuya ilişkin yorum talebini geri çevirdi.

Haberde, sürecin büyük ölçüde araştırmacıların açıklamaları ve ABD basınındaki haberler üzerinden aktarıldığı belirtiliyor. OpenAI'nın ödül ödemesi ve forumdaki yetki sınırlandırmaları şirketin açıklamasına dayanıyor. Discourse'un yama sürecine ilişkin ayrıca bir ayrıntı paylaşılmadı.