Anthropic, modellerinin siber saldırı, propaganda ve biyolojik araştırmalar gibi alanlarda kötüye kullanıldığını tespit ettiği yeni vakaları bugün kamuoyuyla paylaştı. Şirket, Mart 2025’ten bu yana yayımladığı üçüncü kötüye kullanım raporunda, Aralık 2025 ile Ağustos 2026 arasında casus yazılım satıcılarından devlet destekli propaganda gruplarına kadar uzanan aktörlerin girişimlerini engellediğini açıkladı.
Raporun dikkat çeken bölümü, ismi açıklanmayan bir aktörün Claude sohbet robotundan, chikungunya virüsünü hedefleyen ve “fonksiyon artırımı” (gain-of-function) araştırması için hibe başvurusu yazmasını istemesi oldu. Anthropic, talebi engellediğini ve sistemlerin bu tür çift kullanımlı biyolojik araştırma sorgularını yeni modellerde daha sıkı şekilde kısıtlayacak şekilde güncellendiğini duyurdu.
Anthropic, yapay zekânın siber saldırı, propaganda ve biyolojik silah için kötüye kullanımını önlüyor ne anlama geliyor?
Anthropic, bugün paylaştığı raporda “bugüne kadar tespit ettiğimiz en dikkat çekici ve yeni tehdit faaliyetlerinden örnekleri” tanımladığını belirtti. Şirket, modellerin siber saldırı, gözetim, propaganda ve silah geliştirmeye katkı sağlayabilecek biyolojik araştırmalar için kötüye kullanılmaya çalışıldığını, tüm bu girişimlerin engellendiğini ve koruma önlemlerinin güçlendirildiğini açıkladı.
Açıklamada, yapay zekâ modelleri güçlendikçe karmaşık siber saldırıların daha az teknik beceri gerektirdiği vurgulandı. Bu durum, tek başına hareket eden kişilerin bir yıl önce imkânsız olan tehditler üretebilmesine yol açıyor. Şirket, raporu Mart 2025’ten bu yana yayımladığı üçüncü kötüye kullanım raporu olarak tanımladı.
Chikungunya hibe başvurusu vakası nasıl engellendi?
Anthropic, raporda yer alan en somut örnek olarak, ismi açıklanmayan bir aktörün Claude’dan bilimsel araştırma fonu için hibe başvurusu yazmasını istediğini bildirdi. Başvuruda bahsedilen çalışma, bir organizmanın genetik olarak değiştirilerek yeni ya da güçlendirilmiş bir biyolojik özelliğe sahip olmasını amaçlayan “fonksiyon artırımı” araştırmasını içeriyordu ve hedefte chikungunya virüsü vardı.
Chikungunya, şiddetli ağrı ve ateşe yol açan, sivrisinek kaynaklı bir virüs. Hibe önerisi, virüsü giderek daha tehlikeli hale getirecek mutasyonları güçlendirmeyi amaçlıyordu. Şirket, talebi engellediğini ve bu tür çift kullanımlı araştırmaların potansiyel riskine karşı yeni koruma önlemleri devreye aldığını açıkladı.
Hangi modeller, hangi koruma seviyesinde?
Anthropic, rapordaki vakaların hiçbirinde bir istisna dışında en yeni Claude Fable veya Mythos sınıfı modellerin kullanılmadığını belirtti. İstisna, “bir modelin yeteneklerini izinsiz olarak elde edip başka bir modele kopyalamayı hedefleyen sanayi ölçeğinde, gizli bir kampanya” olarak tanımlandı.
Eski modeller Claude Opus 4 ve 2025’ten Claude Sonnet 4.5’in, gelişmiş bir kullanıcıya tehlikeli biyolojik araştırmalar yürütmede “kayda değer biçimde yardım edebilecek eşik seviyesinin oldukça altında” olduğu ifade edildi. Bu nedenle söz konusu modellerdeki koruma önlemleri daha az sıkıydı ve ağırlıklı olarak bilinen biyolojik silahların yeniden üretilmesinde acemilerin seviyesini yükseltebilecek içeriklere erişimi engellemeye odaklanmıştı. Daha yeni modellerde ise geniş bir yelpazedeki çift kullanımlı biyolojik araştırma sorgularına erişimi kısıtlayan daha sıkı önlemler devreye alındı.
Siber saldırı ve propaganda: tespit edilen dokuz vaka
Anthropic, sıradan kullanıcı hesapları gibi görünen yüzlerce sahte sosyal medya hesabı oluşturan ve bir hafta boyunca aynı siyasi mesajı güçlendiren içerikler paylaşan grupları tespit etti. Şirket, Rusya, İran, Türkiye ile Körfez, Güney Asya, Afrika ve Avrupa’dan çıkan toplam dokuz böyle vaka ortaya koydu.
Anthropic, sosyal medya platformlarının etki operasyonlarını genellikle paylaşımlar dolaşıma girdikten sonra tespit edebildiğini, buna karşılık kendilerinin “Claude üzerinde, operasyon hâlâ planlama aşamasındayken” bunu fark edebildiğini belirtti.
Dikkate alınması gereken kriterler
- Engellenen her girişimin rapora ayrıntılı biçimde yansıtılıp yansıtılmadığını kontrol edin.
- Model sınıfı değiştikçe koruma önlemlerinin güncellenip güncellenmediğini takip edin.
- Çift kullanımlı araştırma tanımının şirketten şirkete nasıl değiştiğini inceleyin.
- Etki operasyonlarında planlama aşamasında tespit kabiliyetinin operasyonel değerini ölçün.
- Bilgilerin devlet kurumları ve sektör ortaklarıyla paylaşılıp paylaşılmadığını doğrulayın.
- Şirketin “zararı tamamen önleyebileceğimizi garanti edemeyiz” ifadesinin sınırlarını not alın.
Sık yapılan hatalar ve yanlış bilinenler
Raporu okurken, “engellendi” ifadesinin tüm risklerin ortadan kalktığı anlamına gelmediğini gözden kaçırmamak gerekiyor. Anthropic, kendi modellerinde bile “aynı güvenceyi veremeyiz” açıklamasını yaptı. Bir diğer nokta, eski modellerde koruma önlemlerinin bilinen silahların yeniden üretilmesinde acemilerin seviyesini yükseltebilecek içeriklere odaklanması; yeni modellerde ise kapsamın çok daha geniş tutulması. Son olarak, propaganda vakalarında tespitin “planlama aşamasındayken” yapılabildiği bilgisi, sosyal medya platformlarının tespit zamanlamasıyla karıştırılmamalı.
Sonraki adım: halka arz öncesi güvenlik gündemi
Bu sonbaharda halka arz hazırlığı yapan Anthropic, raporu araştırmacılarından birinin şirket ile başlıca rakibi OpenAI’nin “doğrudan kendini geliştirebilen süper zekâya doğru yarıştığını” söyleyerek istifa etmesinden iki gün sonra yayımladı. Şirket, rapordaki bulguların diğer geliştiricilerin kendi platformlarında benzer kalıpları fark etmesine, hükümetlere ve sivil topluma tehditlerin nasıl şekillendiğine dair daha net bir tablo sunmasına yardımcı olmasını umduğunu açıkladı.
Sık Sorulan Sorular
Anthropic bugün hangi kötüye kullanım vakalarını açıkladı?
Şirket, Aralık 2025 ile Ağustos 2026 arasında siber saldırı, gözetim, propaganda ve biyolojik silah geliştirmeye katkı sağlayabilecek araştırmalar için modellerinin kötüye kullanılmaya çalışıldığı vakaları paylaştı. En dikkat çekici örnek, chikungunya virüsünü hedefleyen fonksiyon artırımı hibe başvurusu talebinin engellenmesiydi.
Hangi modellerde koruma önlemleri artırıldı?
Anthropic, Claude Fable 5 gibi daha yeni modellerinde geniş bir yelpazedeki çift kullanımlı biyolojik araştırma sorgularına erişimi kısıtlayan daha sıkı önlemler devreye aldığını açıkladı. Claude Opus 4 ve Claude Sonnet 4.5 gibi eski modellerdeki koruma ise daha dar kapsamlıydı.
Propaganda vakalarında tespit nasıl yapıldı?
Anthropic, Rusya, İran, Türkiye ile Körfez, Güney Asya, Afrika ve Avrupa’dan çıkan toplam dokuz vaka tespit etti. Şirket, bu etki operasyonlarını sosyal medya platformları paylaşımları dolaşıma girdikten sonra tespit edebilirken kendisinin Claude üzerinde planlama aşamasındayken fark edebildiğini belirtti.
Anthropic tüm riskleri tamamen engelleyebiliyor mu?
Şirket, raporunda “zararı tamamen önleyebileceğimizi garanti edemeyiz” ifadesini kullandı. Modeller daha yetenekli hale geldikçe risklerin artacağı, ancak geliştiriciler ve toplumun savunucuları harekete geçerse bu risklerin azaltılabileceği vurgulandı.
Rapor neden araştırmacı istifasının ardından yayımlandı?
Anthropic araştırmacısı Jacob Coxon, şirket ile OpenAI’nin süper zekâya doğru yarıştığını söyleyerek istifa etti. Rapor, bu istifadan iki gün sonra yayımlandı ve şirketin kötüye kullanım girişimlerini engelleme sorumluluğunu sürdürdüğünü gösterdi.

Yorum Yapın