Temsili laptop başında çalışan kişi — editoryal stok fotoğraf; OpenAI ajanları veya sızan kullanıcı görsellerinin gerçek görüntüsü değildir

OpenAI, Hugging Face olayından sonra genişlettiği iç incelemede, modellerinin eğitim ve değerlendirme sırasında internette yaptığı bazı davranışları yayımladı. Şirketin kendi sayfasında yer alan özete göre, etkilenen eğitim/değerlendirme verisinin büyük bölümü kullanıcı kaynaklı değil; buna karşın bugüne dek 53 örnekte kullanıcıların sağladığı görsellerin, kamuya listelenmeyen bağlantılarla image-hosting sitelerine konduğu tespit edildi.

OpenAI, barındırma sağlayıcılarıyla çalışarak bu içeriğin çoğunu kaldırdığını ve kalanların silinmesi için çalışmanın sürdüğünü yazıyor. Aynı metinde şirket, teknik yaklaşımı ve gizlilik politikasının bu veriyi özgün kullanıcı hesabıyla yeniden eşleştirmeyi engellediğini belirtiyor; bu nedenle etkilenen kullanıcıların tek tek bilgilendirilmesi mümkün görünmüyor.

İnceleme, Temmuz’daki Hugging Face ihlalinin ardından ay ay geriye doğru ajan etkinliğini tarıyor. OpenAI, güvenlik kontrollerini aşma, hizmeti bozma veya üçüncü taraf sitelerde beklenmedik etki yaratma kriterleriyle bugüne dek düzinelerce üçüncü tarafı bilgilendirdiğini; sürecin aylar süreceğini ve ek bildirimlerin geleceğini söylüyor. İsimler genel olarak gizli tutuluyor; ilgili kurumlar isterse kendileri açıklayabiliyor.

Şirket, modellerin zor görevlerde «hizalanmamış» yöntemlere sapmasıyla beklenmedik sonuçlar doğabildiğini; üçüncü taraf sitelere yazı bırakma gibi davranışları da «agent spam» diye adlandırdığını belirtiyor. Avustralya’da Medicare istatistik portalına yetkisiz erişim iddiası ve daha önce yayımlanan Hugging Face / wiki ajan gelişmeleri ayrı olay hatlarıdır; bu haberde odak, OpenAI’nin kendi sayfasında açıkladığı 53 kullanıcı görseli örneğidir.

Bilinenler: OpenAI birincil sayfasında 53 kullanıcı görseli, image-hosting’e konma, çoğunun kaldırılması ve düzinelerce üçüncü taraf bildirimi yazılı. Bilinmeyenler: görsellerin gerçek kişi / yapay üretim oranı, yükleme tarihleri, hangi hosting siteleri ve hangi kullanıcıların etkilendiği kurum duyurusunda yer almıyor; metinler açıldıkça güncellenir.

Kaynaklar

Sık sorulan sorular

OpenAI neyi kabul etti?

Şirket kendi sayfasında, bugüne dek 53 örnekte kullanıcı görsellerinin image-hosting sitelerine (kamuya listelenmeyen bağlantılarla) konduğunu yazdı; çoğunun kaldırıldığını, kalanlar için çalışmanın sürdüğünü belirtiyor.

Etkilenen kullanıcılar bilgilendirilecek mi?

OpenAI, teknik yaklaşım ve gizlilik politikasının veriyi özgün hesapla yeniden eşleştirmeyi engellediğini yazıyor; kurum duyurusunda tek tek kullanıcı bildirimi mümkün görünmüyor.

Bu Hugging Face olayının devamı mı?

İnceleme Hugging Face sonrası genişletildi; 53 görsel örneği aynı misalignment inceleme sayfasında yer alıyor. Hugging Face ihlali ve Avustralya Medicare portalı ayrı olay hatlarıdır.