Anthropic: Claude, şirketin yapay zekâ Ar-Ge işlerinin yüzde 26’sında lider rol üstleniyor

Anthropic, sınır düzeyindeki yapay zekâ laboratuvarlarının gelişim hızını kamuoyuna daha görünür kılmak amacıyla üç ölçüm önerdi. Şirket; yapay zekânın kendi halefini geliştirme sürecindeki payını, ajan eylemlerinin ne ölçüde denetlendiğini ve yapay zekâ Ar-Ge hesaplama kaynaklarının nasıl dağıtıldığını raporlamaya başladı.

Anthropic’in Ağustos 2026 verilerine göre Claude, ölçülen yapay zekâ Ar-Ge işlerinin yüzde 26’sında yüksek seviyeli bir komuttan sonra görevin büyük bölümünü uçtan uca yürüten “lider” seviyesinde çalıştı. İşlerin yüzde 90’dan fazlasında ise yapay zekâ en az insanla iş birliği yapan seviyeye ulaştı. Şirket, ölçülen hiçbir iş grubunda Claude’un tamamen otonom çalışmadığını özellikle belirtiyor.

Denetim tarafında Anthropic, en yoğun kullanılan şirket içi platformunda aynı anda yaklaşık 30 bin araştırma ve mühendislik ajanının görev yaptığını açıkladı. Bu ajanların eylemlerinin tamamı uygulanmadan önce çevrim içi izleyiciden geçiyor ve işlem sonrasında çevrim dışı denetim sistemine aktarılıyor. Ağustos ayında incelenen bir milyardan fazla kararda çevrim içi izleyicinin engelleme oranı yüzde 0,002, yani yaklaşık 47 bin kararda bir olarak ölçüldü.

Şirketin bir haftalık hesaplama kaynağı incelemesinde, yapay zekâ Ar-Ge için kullanılan işlem gücünün yaklaşık yüzde 6’sının güvenlik çalışmalarına ayrıldığı bildirildi. Yapay zekâ tarafından yürütülen Ar-Ge işlerine ayrılan hesaplama içinde güvenlik payı yaklaşık yüzde 12 oldu. Anthropic, bu oranların yalnız bir haftalık anlık görüntü olduğunu ve güvenlik çalışmalarını sınıflandırmanın yorum farklarına açık olduğunu vurguluyor.

Rapor, laboratuvarlar arasında karşılaştırılabilir bir standart oluşturmuş değil; ölçümlerin önemli bölümü Anthropic’in kendi modelleri ve sınıflandırıcılarıyla hazırlanıyor. Şirket bu nedenle bağımsız üçüncü taraf değerlendiricilere iç süreç, sistem ve verilere erişim vermeyi; ölçümlerin zaman içinde dışarıdan doğrulanabilir biçimde yayımlanmasını öneriyor. Kurumsal kullanıcılar açısından öne çıkan nokta, ajan sayısından çok eylem kapsamı, inceleme gecikmesi, engelleme oranı ve insan eskalasyonu gibi denetim ölçülerinin düzenli raporlanmasıdır.

Kaynaklar

Sık sorulan sorular

Claude, Anthropic’in Ar-Ge işlerinde ne kadar lider rol alıyor?

Anthropic’in Ağustos 2026 verilerine göre Claude, ölçülen yapay zekâ Ar-Ge işlerinin yüzde 26’sında yüksek seviyeli bir komuttan sonra görevin büyük bölümünü uçtan uca yürüten “lider” seviyesinde çalıştı.

Claude tamamen otonom mu çalışıyor?

Şirket, ölçülen hiçbir iş grubunda Claude’un tamamen otonom çalışmadığını özellikle belirtiyor. İşlerin yüzde 90’dan fazlasında yapay zekâ en az insanla iş birliği yapan seviyeye ulaştı.

Ajan eylemleri nasıl denetleniyor?

En yoğun kullanılan şirket içi platformunda aynı anda yaklaşık 30 bin araştırma ve mühendislik ajanı görev yapıyor; eylemlerin tamamı uygulanmadan önce çevrim içi izleyiciden geçiyor ve işlem sonrasında çevrim dışı denetim sistemine aktarılıyor.

Çevrim içi izleyicinin engelleme oranı nedir?

Ağustos ayında incelenen bir milyardan fazla kararda çevrim içi izleyicinin engelleme oranı yüzde 0,002, yani yaklaşık 47 bin kararda bir olarak ölçüldü.

Güvenlik çalışmalarına ayrılan hesaplama payı nedir?

Bir haftalık incelemede yapay zekâ Ar-Ge işlem gücünün yaklaşık yüzde 6’sı güvenlik çalışmalarına ayrıldı; yapay zekâ tarafından yürütülen Ar-Ge işlerine ayrılan hesaplama içinde güvenlik payı yaklaşık yüzde 12 oldu. Anthropic bunların yalnız bir haftalık anlık görüntü olduğunu vurguluyor.