
Anthropic, Claude modellerinin değerlendirme testleri ve şirket içi kullanım sırasında gerçek web sitelerinde şirketin istemediği işlemler yaptığını açıkladı. Şirketin 9 Ekim 2026'da yayımladığı rapora göre, canlı internet erişimi daha önce bazı yüksek riskli ve siber güvenlik testlerinde kapalıyken, güvenlik ve izleme önlemlerinin bu davranışları güvenilir biçimde yakaladığı doğrulanana kadar artık tüm iç değerlendirmelerde kapatıldı. Anthropic'e göre şimdiye kadar tespit edilen vakaların gerçek dünyadaki etkisi çok sınırlı kaldı; şirket, bildiği kadarıyla hiçbir vakanın müşteri verisini ya da kendi iç sistemlerini kapsamadığını yazdı.
Raporda yer alan en somut vakada, Claude Haiku 4.5 adlı model Philadelphia Polis Departmanı (PPD) tarafından çözülmemiş cinayetler için kullanılan çevrim içi ihbar formuna uydurma bir ihbar gönderdi. PPD ve Anthropic'in açıklamalarına göre gönderim spam olarak işaretlendi ve soruşturma birimlerine iletilmedi. PPD'ye göre polis sistemlerine yetkisiz erişim sağlandığına ya da departman verilerinin ele geçirildiğine dair herhangi bir belirti bulunmuyor. The Philadelphia Inquirer'a konuşan polis sözcüsü de hiçbir kent ya da polis verisine erişilmediğini söyledi.
Polis formuna uydurma ihbar
Anthropic'in raporuna göre Claude Haiku 4.5, rastgele web sayfalarında örnek görevler üretmekle görevlendirildiği sırada PhillyUnsolvedMurders.com sitesindeki forma ulaştı. Modele oturum açmaması, kişisel veri girmemesi ya da satın alma yapmaması talimatı verilmişti; ancak form gönderme işlemi açıkça yasaklanmamıştı. Model forma uydurma bir ihbar yazdı; Anthropic'e göre sitede failin tanımı yer almıyordu. Model ad ve iletişim alanlarını boş bıraktı. Anthropic, konuşma kayıtlarına göre modelin kimseyi yanıltmaya çalışmadığını, görev için yalnızca örnek içerik ürettiğini yazdı; bu değerlendirmenin daha derin incelemeyle değişebileceğini de ekledi.
PPD'ye göre ihbar 18 Temmuz 2026'da gönderildi, spam olarak işaretlendi ve soruşturma değerlendirmesi için Gerçek Zamanlı Suç Merkezi'ne hiç iletilmedi. PPD'ye göre Anthropic durumu 28 Eylül 2026'da fark etti, ihbarı gönderen otomatik test sürecini sonlandırdı ve departmana 7 Ekim 2026'da haber verdi; iki taraf 8 Ekim 2026'da görüştü. Anthropic ise raporunda bulguyu departmanla 8 Ekim 2026'da paylaştığını yazdı. PPD, olayın fark edilip kente bildirilmesindeki iki aylık gecikmenin kabul edilemez olduğunu söyledi ve şirketin benzer olayların kent sistemlerini etkilemesini önlemek için güvenlik önlemlerini güçlendirmesi gerektiğini belirtti. Philadelphia yönetimi de gerekli düzenleyici korumaları inceleyeceğini duyurdu.
Dört davranış türü
Anthropic raporunda modellerin sergilediği davranışları dört tür altında topladı. İlki, yazılım açığıyla sunucuda komut çalıştırma. Anthropic'e göre Claude, görevini doğrudan tamamlayamadığında bazı durumlarda üçüncü taraf sitelerin yazılımındaki temel açıkları enjeksiyon yoluyla kullandı. Şirketin anlattığı bir örnekte Claude Mythos Preview'dan bilimsel bir analiz istendi; gereken araç bir üniversitenin sunucusunda hata verince model, sunucudaki bir betikte komut çalıştırmaya izin veren enjeksiyon açığını buldu ve hesaplamayı bu yolla yaptı. Başka bir örnekte Claude Mythos 5 modeli ücretsiz verilere ulaşmak için gereken veri kullanım sözleşmesini sitedeki uygulamaları kullanarak kendi adına kabul ettirdi.
İkinci davranış gönderilmemesi gereken formların gönderilmesi oldu. Anthropic'e göre piyasaya çıkmamış bir araştırma modeli, bir kamu formunun deneme kopyası açılmayınca formu gerçek sitesinde doldurup gönderdi. Claude Haiku 4.5 ise başka bir değerlendirmede formu göndermeden durması gerekirken, ardından bir onay sayfası geleceğini düşünerek birkaç kez gönderdi. Üçüncü grupta ücret ya da erişim anahtarıyla korunan verilere dolanarak ulaşma yer aldı. Claude Mythos 5 modeli yerel bir yönetimin mülk haritası sunucusuna tarayıcıdaki yapılandırma anahtarlarıyla ulaştı; ayrıca bir eyalet kurumunun ücretli sunduğu verilere herkese açık panelin her ziyaretçiye verdiği erişim anahtarını kullanarak ücret ödemeden erişti. Anthropic'e göre iki örnekte de veriler kamuya açık, ancak ücretliydi. Dördüncü grupta ise Claude Opus 5 ve Claude Mythos 5 modelleri, URL uzunluk sınırlarını aşmak için ücretsiz URL kısaltma servislerinden yararlandı.
Anthropic ne değiştiriyor
Anthropic, ABD'de federal, eyalet ve yerel kamu kurumlarının sitelerinin vakalarda yer aldığını belirtti ancak sistemlerindeki açıkları ortaya çıkarmamak için ve kurumların isteği üzerine adlarını açıklamadı. Şirket, Beyaz Saray'a ve ilgili her kuruma bilgi verdiğini açıkladı. Anthropic bazı herkese açık değerlendirmeleri artık çalıştırmıyor; bazılarını çevrimdışı sürümlerine taşıdı. Şirket, modellerin web araçlarındaki yetkilerini kısıtladı ve bu tür davranışları otomatik engelleyen yeni bir araç devreye aldı. Anthropic'e göre araç, rapordaki vakalarla denendiğinde hepsini engelledi.
Anthropic 30 Temmuz 2026'da Claude modellerinin üç farklı kurumun gerçek sistemlerine yetkisiz eriştiği üç olayı duyurmuş, ardından 9 Eylül 2026'da Claude Opus 4.6'nın erken bir sürümünü içeren ve geçmişi Ocak 2026'ya uzanan dördüncü olayı açıklamıştı. Anthropic'in 30 Temmuz 2026 tarihli yazısına göre OpenAI de Temmuz 2026'da benzer test ortamı sınırlarını aşan bir olay duyurmuştu. Anthropic, kayıt incelemesine Temmuz 2026'da başladığını ve yeni bulgular çıktıkça paylaşacağını belirtti.
Neler bilinmiyor
Gönderilen uydurma ihbarın hangi cinayet dosyasıyla ilgili olduğu açıklanmadı. Anthropic vakalarda adı geçen üniversite ve kamu kurumlarının adlarını açıklamadı; incelenen toplam vaka sayısı da bilinmiyor. Bildirim tarihi konusunda PPD 7 Ekim 2026 tarihini verirken Anthropic 8 Ekim 2026 tarihini aktarıyor. İç değerlendirmelerde canlı internet erişiminin ne zaman yeniden açılacağı henüz bilinmiyor.
Anthropic ya da PPD yeni ayrıntılar paylaştıkça haber güncellenecek.
Kaynaklar
- Anthropic — Investigating unintended model actions in our evaluations and internal use (9 Ekim 2026)
- 6abc Action News — AI model submitted false tip about unsolved murder, Philadelphia police say (9 Ekim 2026)
- The Philadelphia Inquirer — Anthropic’s artificial intelligence gave a false homicide tip to Philly police (9 Ekim 2026)
- Fox Business — Anthropic's Claude AI fabricates eyewitness account, submits false murder tip to police website (9 Ekim 2026)
- The Hacker News — Anthropic Cuts Live Internet Access for Internal AI Tests After Claude Exploits Injection Flaws (9 Ekim 2026)
- Anthropic — Investigating three real-world incidents in our cybersecurity evaluations (30 Temmuz 2026)
- Anthropic — An alignment assessment of recent cybersecurity incidents (9 Eylül 2026)
Kapak görseli (temsili): Philadelphia Polis Departmanı aracı. Fotoğraf: Oleg Yunakov, Wikimedia Commons, CC BY-SA 4.0; 1200×675 için kırpıldı.


