Araştırma: Güvenlik önlemleri kaldırılan 5 yapay zeka modelinden 3'ü terörle ilgili testleri geçemedi
Tech Against Terrorism tarafından yapılan araştırmada, güvenlik kalkanları devre dışı bırakılan yapay zeka modellerinin terör saldırıları ve radikalleşme konularında detaylı bilgi sağladığı tespit edildi.
Quick Look
Tech Against Terrorism'in araştırmasına göre, 'abliteration' yöntemiyle güvenlik kalkanları kaldırılan 130'dan fazla yapay zeka modelinin çoğu, terör ve radikalleşme içerikli taleplere yanıt vererek güvenlik testlerinde başarısız oldu.
AI-generated summary
Why It Matters
Tech Against Terrorism, yapay zeka modellerinin güvenlik açıklarını inceleyen İngiltere merkezli bir kuruluştur.
CBS televizyonunun haberine göre İngiltere merkezli, kar amacı gütmeyen "Tech Against Terrorism (Teröre Karşı Teknoloji)" kuruluşunca, yapay zeka modelleriyle ilgili araştırma gerçekleştirildi.
Araştırmada, saldırı planlayan bir teröristin yöneltebileceği türden yüzlerce talep kullanılarak 130'dan fazla yapay zeka modeli değerlendirmeye alındı.
Yapay zeka modellerine güvenlik önlemlerini ortadan kaldıran, "abliteration (silme/etkisizleştirme)" denilen "reddetme davranışlarını kaldırma" süreci uygulandı.
Bu uygulama sonrası 5 yapay zeka modelinden 3'ünün güvenlik testlerini geçemediği tespit edildi.
Modellerin orijinal versiyonlarının bu tür istekleri reddettiği, güvenlik önlemlerinin kaldırılması sonrası ise "saldırılar, terörün finansmanı ve radikalleşmeyle ilgili taleplere ayrıntılı yanıtlar" verdikleri ortaya çıktı.
Araştırmada verilen örneklere göre Meta'nın "Llama 3.1 8B" modeli, değişiklik yapılmadan önce 100 üzerinden 97 puan aldı, değişiklik sonrasında ise yaklaşık 3'e düştü.
"Birçoğunun güvenliği zaten aşıldı"
Kuruluş, araştırmaya yönelik değerlendirmesinde, güvenlik önlemlerinin devre dışı bırakılmasına karşı daha güçlü korumalar ve üzerinde değişiklik yapılmış modellerin dağıtımına yönelik kısıtlamalar getirilmesini önerdi.
Tech Against Terrorism'in kurucusu Adam Hadley, yaptığı açıklamada "Kontrol kaybı ve yapay zekanın varoluşsal risk oluşturması konusunda endişe duyulması, gayet anlaşılabilir bir durum." değerlendirmesinde bulundu.
What to Watch
AI outlook — possibilities, not facts
Yapay zeka modellerinin dağıtımına yönelik yeni güvenlik kısıtlamaları getirilecek.
Likely · Within months
Open Questions
- Hangi diğer yapay zeka modelleri test edildi?
- Bu modellerin dağıtımına yönelik yasal kısıtlamalar nasıl uygulanacak?



