Güvenliği kaldırıldı ve... Yapay zekâ terör testinde çakıldı
Quick Look
- İngiltere merkezli bir kuruluşun araştırmasında, 130'den fazla yapay zeka modeli güvenlik önlemlerini devre dışı bırakılarak saldırı planlayan bir terörist tarafından yöneltebilecek istekler için test edildi.
- Modellerde 'reddetme davranışlarını kaldırma' işlemi uygulandıktan sonra bazı modeller saldırı, terör finansmanı ve radikalleşme konularında ayrıntılı yanıtlar verdi.
- Meta'nın Llama 3.1 8B modeli, güvenlik önlemleri devre dışı bırakılmadan önce 100 üzerinden 97 puan aldığından, işlem sonrası yaklaşık 3 puana düştü.
AI-generated summary
Why It Matters
Yapay zeka modelleri, zararlı içerik üretmesini önlemek için güvenlik önlemleriyle donatılır. Ancak bu önlemlerin devre dışı bırakılması durumunda modellerin tehlikeli istekleri yerine getirebileceği gösterilmiştir.
CBS televizyonunun haberine göre, İngiltere merkezli kuruluşun araştırmasında 130’dan fazla yapay zeka modeli, saldırı planlayan bir teröristin yöneltebileceği türden yüzlerce taleple değerlendirildi. Modellere, güvenlik önlemlerini devre dışı bırakan ve “reddetme davranışlarını kaldırma” olarak tanımlanan işlem uygulandı. Değişiklik sonrasında bazı modellerin saldırılar, terörün finansmanı ve radikalleşme hakkında ayrıntılı yanıtlar verdiği görüldü. Meta’nın Llama 3.1 8B modeli, değişiklik öncesinde 100 üzerinden 97 puan alırken sonrasında yaklaşık 3 puana geriledi.
‘Güvenlik aşıldı’
What to Watch
AI outlook — possibilities, not facts
Yapay zeka şirketleri güvenlik önlemlerini güçlendirecek ve benzer testler artacak.
Likely · Within weeks
Open Questions
- Hangi diğer yapay zeka modelleri benzer güvenlik açığı gösterdi?
- Bu tür güvenlik açıklarını önlemek için hangi önlemler alınabilir?
- Araştırmayı yapan İngiltere merkezli kuruluşun adı nedir?





