OpenAI, Astra’yı Critical siber eşiğe koydu; ilk model bu seviyede, ileri yetenek Daybreak Blue’da

Teyit: OpenAI, 1 Eylül 2026 tarihli «Path to Astra: critical capabilities and frontier safeguards» yazısında yaklaşan modeli Astra’yı Preparedness Framework’teki Critical siber güvenlik yetenek eşiğine koyduğunu açıkladı. Şirket, daha önce Astra’nın bu eşiğe yaklaşabileceğini yazmıştı; ek değerlendirmelerden sonra eşiği karşıladığına inandığını ve bu seviyeye koyduğu ilk model olduğunu belirtiyor. Critical, doğru araç ve erişimle modelin birçok iyi korunmuş sistemde daha önce bilinmeyen güvenlik açıklarını bulup sömürü yolları geliştirebileceği anlamına geliyor; geliştirme sırasında ve yayından önce daha güçlü önlemler zorunlu.

Değerlendirme: OpenAI’ye göre Astra, GPT‑5.6 Sol’a kıyasla açık bulma ve sömürü geliştirmede belirgin şekilde daha yetenekli ve token bakımından daha verimli. ExploitBench’te bilinen açıklardan sömürü üretme kıstasındında yüzde 100 skor yazıldı. Kirlenme endişesiyle kurulan «ExploitBench - Internal Port (Haziran–Ağustos 2026)» setinde (yakın tarihli 20 yüksek kritik V8 açığı) Astra, Sol’dan daha yüksek keyfi kod çalıştırma oranına ulaştı; değerlendirme sırasında iki sıfırıncı gün açığını keşfedip sömürü zincirinde kullandığı ve bakımcılara bildirim sürecinin sürdüğü yazıldı. Uzmanlı testlerde sertleştirilmiş tarayıcıda kum sandığından çıkıp ana makinede komut çalıştıran bir zincir ve yetkisiz kullanıcıdan root’a yerel yetki yükseltme zinciri anlatılıyor.

Yayın sınırı: OpenAI, Astra’nın en ileri siber yeteneklerine erişimin varsayılan üretim yapılandırması olmadığını; önce küçük bir testçi grubuna, ardından savunma kullanımı için Daybreak Blue’ya açılacağını yazıyor. Yazıda Astra’nın Hugging Face olayına karışmadığı, ancak o olaydan çıkarılan derslerin güvenlik yaklaşımına eklendiği belirtiliyor. Geliştirmenin bir kısmı geciktirildi; 28 Ağustos’ta daha önce durdurulan büyük frontier RL koşusunun yeni güvenlik barı sonrası yeniden başlatıldığı anlatılıyor. Şirket, önlemlerin ciddi zarar riskini yeterince azalttığına inandığını söylüyor.

Önlemler ve iddia/sınır: Siber jailbreak setinde Astra’nın isteklerin yüzde 91,5’ini reddettiği (GPT‑5.6 Sol’da yüzde 59) yazıldı. Honeypot testlerinde Sol’un üretim önlemleri olmadan hedeflere yüzde 56 oranında yöneldiği, Astra’nın bu testlerde denemediği iddiası yine OpenAI’ye ait. Kullanıcıya etkisi: meşru iş de yavaşlatılabilir, durdurulabilir veya gözden geçirme istenebilir; API yüzeyinde görev durabilir. Masa notu: bu bir ihlal duyurusu değil, şirketin kendi yetenek sınıflandırması ve yayın planı; saha saldırısı iddiası yok. SecurityWeek 2 Eylül’de aynı yazıyı özetledi.

Kaynaklar

Sık sorulan sorular

OpenAI ne açıkladı?

1 Eylül 2026 Path to Astra yazısında Astra’nın Preparedness Framework’teki Critical siber güvenlik eşiğini karşıladığına inandığını ve bu seviyeye koyduğu ilk model olduğunu yazdı.

Critical eşik ne demek?

OpenAI’ye göre model, doğru araç ve erişimle birçok iyi korunmuş sistemde bilinmeyen açıkları bulup sömürü geliştirebilir veya yalnızca üst düzey bir hedefle uçtan uca yeni saldırı stratejileri kurabilir; geliştirme ve yayından önce daha güçlü önlemler gerekir.

Hangi test sonuçları yazıldı?

ExploitBench’te yüzde 100; Internal Port setinde Sol’dan yüksek keyfi kod çalıştırma ve iki sıfırıncı gün keşfi; uzmanlı testlerde tarayıcı kum sandığı kaçışı ve root’a yerel yetki yükseltme. İleri siber sonuçlar Daybreak Blue erişimiyle, varsayılan üretim yapılandırması değil.

Herkes aynı siber gücü mü kullanacak?

Hayır. OpenAI, en ileri siber yeteneklere erişimin önce küçük testçi grubuna, sonra Daybreak Blue ile savunma kullanımına açılacağını yazıyor; varsayılan üretim yapılandırması değil.

Bu bir sızıntı veya saldırı haberi mi?

Değil. Şirketin kendi yetenek sınıflandırması ve yayın önlemi açıklaması. Hugging Face olayına Astra’nın karışmadığı belirtiliyor; saha saldırısı mağduru yok.