Anthropic'ten Yapay Zeka Modellerinin Kötüye Kullanımı Raporu
Anthropic, Aralık 2025-Ağustos 2026 döneminde Claude modellerinin siber operasyonlar, konvansiyonel silah geliştirme ve etki operasyonlarında kötüye kullanımını raporladı.
Quick Look
Anthropic, Aralık 2025-Ağustos 2026 döneminde Claude modellerinin siber operasyonlar, konvansiyonel silah geliştirme, etki operasyonları ve yasa dışı damıtma faaliyetlerinde kötüye kullanıldığını açıkladı.
AI-generated summary
Why It Matters
Anthropic, yapay zeka modellerinin kötüye kullanımına karşı yürüttüğü tehdit istihbaratı çalışmalarına ilişkin kapsamlı bir rapor yayımladı.
Anthropic tarafından, modellerinin kötüye kullanımının tespitine ve buna karşı önlem alınmasına yönelik rapor yayımlandı.
Raporda, Aralık 2025-Ağustos 2026 arasında siber operasyonlar, etki operasyonları, gözetleme, dolandırıcılık ve konvansiyonel silah geliştirme gibi kötüye kullanma örneklerine yer verildi.
Söz konusu kötüye kullanım eylemlerine girişenler arasında devlet destekli olduğundan şüphelenilen gruplar, maddi çıkar güden suçlular ve devlet propaganda kurumlarının yer aldığı belirtilen raporda, bu faaliyetlerde genellikle "Claude Haiku", "Sonnet" ve "Opus" modellerinin kullanıldığı kaydedildi.
Konvansiyonel silahlar
Raporun "konvansiyonel silahlar" başlıklı kısmında ateşli silahlar, füzeler, silahlı insansız hava araçları (SİHA), bombalar ve diğer mühimmatın yanı sıra bunları çalıştıran hedefleme ve kontrol sistemleri dahil geleneksel silahların yazılımlarının geliştirilmesinde Claude'un kullanıldığının tespit edildiği aktarıldı.
Şirketin tehdit istihbaratı ekibinin, geçen yıl silah tasarımı ve geliştirme için yazılım geliştirmek ya da silah programlarının dayandığı istihbarat toplama ve tedarik faaliyetlerini desteklemek için Claude'u kullanan çok sayıda aktörü araştırdığı ve faaliyetlerini engellediği aktarılan raporda, bunlardan üçünün Çin'de, ikisinin Rusya'da, birinin de Yemen'de olduğu kaydedildi.
Raporda, Anthropic'in Yemen'in kuzeyinde faaliyet gösteren bir grubun güdümlü roket ve çeşitli füzeler dahil üç farklı silah geliştirme programında Claude Code'u kullandığını tespit ettiği belirtildi.
Grubun bunu araçları yönlendirmek, navigasyon ve dengeleme yazılımlarını geliştirmek, simülasyon yapmak ve bunları test etmek için kullandığının tespit edildiği belirtilen raporda, grubun operasyonel bir silahı başarıyla geliştirdiğine dair kanıt bulamadığı kaydedildi.
Raporda, grubun ilgili hesaplarının engellendiği ve elde edilen bilgilerin kamu ve özel sektör kuruluşlarıyla paylaşıldığı kaydedildi.
Öte yandan rapordaki diğer vaka örneğinde ise Çin merkezli bir aktörün, bir anti-torpido silah sistemi geliştirmek için Claude'u kullandığı belirtildi.
Aktörün silah sisteminin ateş kontrol yazılımının bazı bölümlerini geliştirmek, test planı hazırlamak ve sistemi ABD'nin anti-torpido ve denizaltı savunma programlarıyla karşılaştırmak için Claude'dan yararlandığı aktarıldı.
Siber saldırılar
Siber operasyonlar konusunda verilen örnekler arasında Rusya'ya ait casusluk örnekleri yer alırken, söz konusu faaliyetlerin çoğunlukla Ukrayna ve Avrupa hükümetlerindeki askeri istihbaratın hedef alındığı kaydedildi.
Başka bir casusluk örneğinde ise Çin'de yaşadığı düşünülen aktörlerin üretim sistemlerine yönelik sızma girişimlerinin yanı sıra Orta Doğu, Avrupa ve Güneydoğu Asya'daki yabancı hükümetlere ait ağlara yönelik keşif faaliyetleri yürütüldüğü ortaya konuldu.
Başka bir örnekte ise mali amaçlı ve şantaj yöntemini kullanan çok sayıda siber suç faaliyetinin tespit edildiği ve bunların engellendiği bildirildi.
Raporda ayrıca, Fransa'da bir kişinin Claude'u kullanarak Avrupa'daki siyasi partileri, medya kuruluşlarını ve düşünce kuruluşlarını hedef aldığının tespit edildiği aktarıldı.
Gözetleme operasyonları İran ve Basra Körfezi'ni hedef aldı
Gözetleme operasyonları kapsamında ise Haziran 2026'da, İran ve Basra Körfezi bölgelerini hedef alan bir hesabın belirlendiği kaydedildi.
Buna göre, bölgedeki kullanıcıların sosyal medya faaliyetlerini analiz etmek, sınıflandırmak ve profillerini çıkarmak amacıyla bir gözetim platformu kuran hesabın yasaklandığı belirtildi.
Yapılan soruşturma sonucunda ise söz konusu hesabın "S2T Unlocking Cyberspace" adlı bir kuruluş tarafından veya bu kuruluş adına yürütüldüğü ortaya çıkarken, açık kaynak araştırmaları kuruluşun İsrail-Singapur menşeli bir istihbarat sağlayıcısı olduğuna işaret etti.
Başka bir gözetleme operasyonunun da Çin merkezli olduğu kaydedilen raporda, Claude'un otomatik bir "kamuoyu izleme" aracı olarak kullanıldığı ifade edildi.
Flört uygulamalarında yapay zeka kullanıldı
Dolandırıcılık ve sahtekarlık uygulamalarına da yer verilen raporda, Çin merkezli bir uygulama stüdyosunun Claude yardımıyla 20'den fazla flört uygulamasından oluşan bir ağ oluşturduğu belirtildi.
Bu stüdyonun, hizmetlerin tamamen insanlar tarafından sunulduğunun iddia edilmesine rağmen kullanıcılarla sohbet etmek için yapay zeka karakterler geliştirdiği ifade edildi.
Raporda, yalnızca 2 haftalık bir süre içinde, en az 25 bin farklı kişiyle sohbet eden 4 bin 700'den fazla yapay zeka karakter tespit edildiği kaydedildi.
Anthropic'in modelleri yasa dışı "damıtma" için kullanılmış
Raporda, daha gelişmiş yapay zeka modeli çıktılarından yararlanarak, daha düşük kapasiteli bir modelin eğitilmesi anlamına gelen "damıtma" yöntemine ilişkin örneklere de yer verildi.
Çin'in önde gelen e-ticaret ve teknoloji şirketi Alibaba bağlantılı aktörlerin bu kapsamda, yapay zeka modellerinin yeteneklerini yasa dışı yollarla kopyalamaya çalıştığının tespit edildiği belirtildi.
Çinli yapay zeka şirketi Moonshot AI'ın da faaliyetlerine yer verilen raporda, şirketin kullanıcı taleplerini kendi modeli olan "Kimi" yerine Claude'a ilettiğinin tespit edildiği belirtildi.
Çinli yapay zeka şirketi DeepSeek'in de Moonshot'a benzer faaliyetlerde bulunduğu kaydedildi.
Çinli akıllı telefon ve elektronik cihaz üreticisi Xiaomi tarafından da yasa dışı "damıtma faaliyeti" gerçekleştirildiği belirtildi.
Claude'un "etki operasyonları"nda kullanılması
"Etki operasyonları" başlıklı bölümde ise bu faaliyetlerin kaynağını gizleyerek bilgi ortamını manipüle etmeye yönelik çabalar olduğu belirtildi.
Orta Afrika Cumhuriyeti'nde Rusya'ya bağlı bir "Yabancı Bilgi Manipülasyonu ve Müdahale (FIMI)" operasyonunun içerik üretim altyapısını sağlayan ve Bangui'de Rusça konuşan bir aktör tarafından yönetilen hesabın kaldırıldığı aktarıldı.
Open Questions
- Engellenen hesapların tam sayısı nedir?
- Diğer yapay zeka şirketleri benzer tehditlerle nasıl mücadele ediyor?






