Anthropic, 11 Eylül’de yaptığı açıklamada yapay zeka modeline yönelik, biyolojik ve konvansiyonel silah geliştirilmesini destekleyebilecek kötü niyetli kullanım girişimlerini tespit ederek engellediğini duyurdu. Bilgi, TRT Haber’in şirket açıklamasına dayandırdığı haberinde yer aldı.
TRT Haber’in aktardığına göre şirket, güvenlik politikaları gereği modelin bu tür taleplere yanıt vermesini önledi. Açıklamada, engellenen girişimlerin kapsamı, sayısı, kullanılan spesifik yöntemler ve model sürümü gibi teknik ayrıntılar paylaşılmadı.
Yapay zeka sistemlerinin “çift kullanımlı” (zararlı amaçlara da kullanılabilen) bilgi üretme riski, özellikle biyogüvenlik alanında öne çıkan bir tartışma başlığı. Şirketler; model eğitimi, içerik denetimi ve kötüye kullanım tespiti gibi katmanlarda filtreleme uygulayarak bu riski azaltmaya çalışıyor. Anthropic’in duyurusu, bu önlemlerin operasyonel olarak devrede olduğuna işaret ediyor.
Haberde, olayın soruşturma süreçleri, dış paydaşlarla bilgi paylaşımı ya da bağımsız doğrulama gibi ek unsurlara dair ayrıntı verilmedi. Şirketten ayrıca yeni bir politika değişikliğine veya ileriye dönük yol haritasına ilişkin bir ek açıklama aktarılmadı.
Ne biliniyor, ne bilinmiyor?
- Bilinen: Anthropic, modelinin biyolojik ve konvansiyonel silah geliştirilmesine yönelik kötüye kullanım girişimlerini saptayıp engellediğini söylüyor (TRT Haber).
- Bilinmeyen: Kaç girişim tespit edildiği, bunların nasıl sınıflandırıldığı, hangi teknik önlemlerin kullanıldığı ve hangi model sürümünün etkilendiği açıklanmadı.