Dizüstünde kod editörü — temsili editoryal fotoğraf; OpenAI ürün arayüzü değildir

OpenAI, 22 Eylül 2026’da GPT-6 ailesi için geliştirilmiş bir prompt önbelleği sistemini duyurdu. Şirkete göre kalıcı ajanlar saatler süren işlerde aynı talimatları, araç tanımlarını ve bağlamı tekrar tekrar taşıyor; OpenAI bu ortak bağlamı önbelleğe alarak yanıt sürelerini kısaltıyor ve önbelleğe alınan giriş jetonlarında yüzde 90’a varan indirim sunuyor.

Duyuruya göre GPT-6 ailesinde varsayılan önbellek isabet oranı yükseldi. Uygun ortak önekler 30 dakikalık pencerede yeniden kullanıldığında indirim uygulanıyor. OpenAI ayrıca hangi girdinin önbellekten geldiğini gösteren Prompt Caching Dashboard’u, beklenmeyen isabetsizlikleri karşılaştıran teşhis aracını ve hangi öneklerin yeniden kullanılacağını seçmeye yarayan açık önbellek kesme noktalarını tanıttı.

GPT-6 modellerinde muhakeme çabası (reasoning effort) değiştirildiğinde önbelleğin bozulmadığı belirtiliyor. Araç tanımlarını silmek yerine allowed_tools veya tool_choice ile sınırlamak ve yeni talimatları bağlama eklemek öneriliyor. Bilinen bağlamı isteğe hazırlamak için ön ısıtma (prewarming) de anlatılıyor.

Aynı gün OpenAI GPT-6 Sol ve Luna’yı da duyurmuştu; SGH’de o haber ayrıca yayımlandı: OpenAI GPT-6 Sol ve Luna.

Kapak temsili bir kod çalışma masasıdır; OpenAI logosunu veya ürün arayüzünü göstermez.

Kaynaklar

Sık sorulan sorular

Önbellek indirimi ne kadar?

OpenAI, önbelleğe alınan giriş jetonlarında yüzde 90’a varan indirim olduğunu yazıyor; uygun ortak önekler 30 dakikalık pencerede yeniden kullanılıyor.

Yeni araçlar neler?

Prompt Caching Dashboard, teşhis aracı, açık önbellek kesme noktaları ve GPT-6’da muhakeme çabasını önbelleği bozmadan değiştirme anlatılıyor.