Temsili sunucu/altyapı fotoğrafı — editoryal stok; OpenAI damıtım kampanyası olay görseli değildir

OpenAI, 30 Eylül 2026 tarihli güvenlik duyurusunda modellerinden «korunan muhakeme» (protected reasoning) çıkarmaya yönelik eşgüdümlü bir kampanyayı tespit edip bozduğunu açıkladı. Şirket, faaliyetin Temmuz’un ilk haftasında başladığını; bunun karşıt damıtım (adversarial distillation) ile uyumlu olduğunu yazdı: bir modelin çıktılarının veya muhakemesinin, başka bir modeli eğitmek, kopyalamak veya geliştirmek için sistematik ve yetkisiz kullanımı.

OpenAI’ye göre operatörler şifrelemeyi kırmadı, bir veritabanını ele geçirmedi veya saklı kullanıcı sohbetlerine doğrudan erişmedi. Bunun yerine model etkileşimlerini manipüle ederek korunan muhakemenin talep edene görünür biçimlerde, ölçekli ve hizmet şartlarını ihlal eden şekilde yeniden üretilmesini sağladılar. Şirket, tekniğin yalnızca OpenAI modellerine özgü olmadığını; Frontier Model Forum üzerinden sektör ortaklarıyla bilgi paylaştığını belirtti.

Ne gözlendi?

Duyuruya göre operatörler, bir sohbetteki şifreli muhakemeyi kopyalayıp başka bir sohbetteki modele çözdürerek / yazdırarak çıkarma denemeleri yaptı. Bağımsız güvenlik araştırmacıları da ilgili çapraz model ve sohbet sıkıştırma yollarını sorumlu açıklama ile bildirdi; OpenAI bu yolları doğruladığını ve azaltımları hızlandırdığını yazdı.

Faaliyet 1 Temmuz’da düşük hacimle başladı; 24–25 Temmuz’da ilgili çıkarma kalıbıyla 4.000’den fazla kullanıcıdan gelen yaklaşık 16.000 isteklik yüksek hacimli sıçramalar görüldü. İlişkili istem kalıbı 15.000’den fazla kullanıcılık bir kümede izlendi ve 28 Temmuz’a kadar tamamen bozulduğu belirtildi.

Atıf değerlendirmesi

OpenAI, gözlenen tüm operatörlerin tek bir aktörden geldiğinin net olmadığını; ancak faaliyetin çekirdek kümesini Kimi’nin geliştiricisi Moonshot AI ile ilişkili kişilere atfettiğini açıkladı.

Neden önemli ve yanıt

Şirket, karşıt damıtımın güvenlik ve ulusal güvenlik riskleri taşıdığını; çıkarılan muhakemenin, orijinal modelin kullanıcıya dönük çıktılarındaki korumalar korunmadan başka bir modeli eğitmek için kullanılabileceğini savundu. Ölçekte damıtımın, aynı güvenlik yatırımını yapmadan ileri yeteneklerin aktarımını hızlandırabileceğini ekledi.

Yanıtta hesap yaptırımı, teknik kontroller ve ortak koordinasyonu bir arada kullandıklarını yazdı: sahte hesapların yasaklanması veya kısıtlanması, kayıt ve altyapı kontrollerinin güçlendirilmesi, izlemenin genişletilmesi; ayrıca başka kullanıcının şifreli muhakemesini yeniden oynatıp içeriğini kurtaran bir yolun kapatılması ve muhakemeyi ifşa edebilecek akışlı çıktının yakalanması. Üçüncü taraf hizmetler üzerinden geçen ilgili faaliyet için sağlayıcılarla çalışıldığı; bulguların Frontier Model Forum ve uygun kamu bilgi paylaşım kanallarına aktarıldığı belirtildi.

OpenAI, karşıt damıtım denemelerinin frontier modeller geliştikçe daha sofistike hale gelmesini beklediğini; ortak barındırmalı dağıtımlar ve araç çıktısı saldırıları için ek korumaların sürdüğünü duyurdu.

Kaynak: OpenAI — Disrupting a coordinated model-distillation campaign (30 Eylül 2026).

Kaynaklar