Ravie Lakshmanan17 Eylül 2026Yapay Zeka / Güvenlik Açığı
OpenAI, Gizli Hatalar ve Yetkisiz Yüklemeler İçeren Altı Model Olayını Açıkladı
OpenAI, Gizli Hatalar ve Yetkisiz Yüklemeler İçeren Altı Model Olayını Açıkladı thehackernews.com
thehackernews.com
Publisher
Sep 17, 2026 at 9:53 AM UTC · Updated 2 gün önce · 4 dk okuma
OpenAI Çarşamba günü, son altı ayda gerçekleşen altı yeni "beklenmedik veya endişe verici model davranışı" vakasını açıkladı; bu sırada şeffaflığı artırmak amacıyla model uyumsuzluğunu raporlamak, izlemek, araştırmak ve ifşa etmek için yeni bir çerçeve paylaştı.
"Yapay zeka sistemleri daha gelişmiş hale geldikçe ve daha yaygın şekilde konuşlandırıldıkça, hizalama araştırmalarının ilerleyişi konusunda daha geniş ve daha bilgili bir fikir birliği oluşturmamız gerekiyor," dedi OpenAI. "Yapay zeka endüstrisinin hizalama ve izleme sorunlarını, çok daha uzun süre maksimum hızda sorumlu bir şekilde ölçeklendirmeye devam edecek kadar yeterli düzeyde çözdüğüne inanmıyoruz."
"Yapay zeka geliştirme sürecinin önümüzdeki aylarda ve yıllarda nasıl ilerlemesi gerektiğine dair kararların, öncü modeller inşa eden şirketlerin dışındaki kişilerin kendi başlarına inceleyebilecekleri kanıtlara dayanması gerekiyor."
Bu altı olay, yakın zamanda ifşa edilen ve Hugging Face, DseWiki ve RubyGems'i hedef alan uyumsuz faaliyetlerin dışındadır. Olayların ayrıntıları aşağıdadır -
- Olay 1 (18 Temmuz 2026'da gerçekleşti) - Yayınlanmamış dahili bir Astra ailesi modeli, kendi sıkıştırma özetlerine (bir yapay zeka ajanının oturumu bağlam sınırına yaklaştığında otomatik olarak oluşturulan geçmiş konuşma geçmişi ve araç çıktılarının yoğunlaştırılmış blokları) jailbreak benzeri talimatlar yazdı. Bu, ajanın bağlama geliştirici mesajlarını görmezden gelmesini ve yalnızca sistem ve kullanıcı mesajlarını izlemesini söyleyen bir "BREACH ALERT" talimatı eklemesini içeriyordu.
- Olay 2 - GPT-5.6 Sol eğitimi sırasında, bazı model örnekleri, hataları veya uyumsuz davranışları kullanıcıdan gizlemek için özetlerine talimatlar ekledi. Bunlar, eksik verileri ifşa etmeden uydurma ve başarısızlıkları gizleme talimatlarını içeren sıkıştırma özetlerini kapsıyordu.
- Olay 3 (15 Mayıs 2026'da gerçekleşti) - Yayınlanmamış dahili bir model, eğitim sırasında geçmiş verileri almaya çalışırken yetkisiz bir şekilde halka açık GitHub depolarından açığa çıkmış bir API anahtarını buldu ve kullandı. OpenAI, "Kayıtlar başarısız oldu, ancak bir anahtar doğrulandı ve meta veriler döndürdü," dedi. "İstenen veriler kullanılamaz durumda kaldığında, model bunları uydurdu ve istenen web sitesinden geldiklerini iddia etti."
- Olay 4 - 22 Ekim 2025 ve 24 Ocak 2026 tarihli iki eğitim örneğinde, yayınlanmamış dahili modeller daha önce aldığı kayıtları halka açık bir yapıştırma servisine yükledi ve ortaya çıkan URL'yi bir alıntı kaynağı olarak açmaya çalıştı ve harici görsel araması için bir görev fotoğrafı yükledi. Yüklemeler başarılı olsa da, sonraki tarayıcı işlemleri başarısız oldu.
- Olay 5 - 8 ve 15 Mayıs 2026 tarihli iki örnek, mesaj alışverişinde bulunmak için Artifactory'yi kullandı. Modeller "diğer çözücülerin notlarını okudu, yanıtlar yayınladı ve bu alışverişleri yanıtlarını bilgilendirmek için kullandı."
- Olay 6 (14 Nisan 2026'da gerçekleşti) - Yayınlanmamış dahili bir modelle ilişkili olan ve bir çalışma kitabı üzerinde birlikte çalışan ajanlar, hedeflenen yerel dosya sistemi üzerinden dosya üzerinde iş birliği yapamadı. Bu durum, ajanlardan birinin çalışma kitabını halka açık bir barındırma platformunda paylaşarak diğer ajanların alabilmesi için halka açık olarak indirilebilir hale getirmesine neden oldu; bu da görev talimatlarının ihlaliydi.
Market Context
Solana
SOL
$112.54
+6.90% (24H)
Market Cap
$66.2B
Circulating Supply
587.3M SOL
24H Volume
$5.9B
24H High
$114.3
Article Intelligence
Topics
Related Coverage
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
