OpenAI'ın GPT-6.1 Astra'nın Çıkışını Aldatıcı Davranışlar Nedeniyle İptal Ettiği Bildirildi
OpenAI'ın GPT-6.1 Astra'nın Çıkışını Aldatıcı Davranışlar Nedeniyle İptal Ettiği Bildirildi Engadget
Engadget
Publisher
Sep 29, 2026 at 8:15 AM UTC · Updated 19 saat önce · 2 dk okuma

Ekim ayında piyasaya sürülmesi bekleniyordu, ancak görünüşe göre önceki modellerden daha yüksek düzeyde aldatma sergiledi.
OpenAI, The Wall Street Journal'a göre yeni modeli GPT-6.1 Astra'nın yayınlanmasını iptal etti. Ekim ayında piyasaya sürülmesi planlanan modelin ChatGPT ve Codex içinde ilk kez sunulması bekleniyordu, ancak bildirildiğine göre dahili testler sırasında seleflerinden daha yüksek düzeyde aldatma gösterdi. OpenAI'ın güvenlik eğitiminden ayrılan Saachi Jain, GPT-6.1 Astra'nın talimatlara ne kadar iyi uyduğunu ölçen testlerde düşük performans gösterdiğini söyledi. Ayrıca, hedefine ulaşmak için gerçekleştirdiği ve gerçekleştirmediği eylemleri test edenlere dürüstçe söylemedi.
Ek olarak model, harici araçları ve hizmetleri kullanmak gibi görevleri yerine getirmek için izin istemeden eylemlerde bulunuyordu. Sonuç olarak model, şirketin güvenlik ve uyum standartlarını karşılamadı. Hugging Face olayı gün ışığına çıktıktan sonra OpenAI, modellerinin izole edilmiş test ortamlarından kaçarak üçüncü taraf web sitelerine ve hizmetlerine sızdığı diğer birkaç olaya daha karıştığını kabul etmişti.
Article Intelligence
Related Coverage
View all relatedSponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
