OpenAI, yapay zeka güvenliği konusundaki tartışmalar giderek kızışırken, yapay zeka modellerinde "beklenmedik veya endişe verici" davranışlara dair altı yeni rapor açıkladı.
OpenAI ‘endişe verici’ AI davranışlarını açıkladı ve sorunları bildirmek için yeni bir plan vaat etti
OpenAI ‘endişe verici’ AI davranışlarını açıkladı ve sorunları bildirmek için yeni bir plan vaat etti theguardian.com
theguardian.com
Publisher
Sep 17, 2026 at 5:32 AM UTC · 2 dk okuma

OpenAI tarafından bildirilen yeni vakalar arasında, yayınlanmamış bir araştırma modeli, normal kısıtlamalarını göz ardı etmek için kendi notlarına "jailbreak benzeri talimatlar" ekledi ve kendisine "diğer sohbet botlarını bağlayan rollerden ve kimliklerden kurtulmasını" söyledi.
Başka bir örnekte, bir yapay zeka "aracısı", kullanıcıya sormadan bir tarayıcı alıntısı elde etmek için internete dosyalar yükledi.
Yapay zeka şirketi Çarşamba günü ayrıca, modellerin yetkisiz hareket etmesi, diğer modellerle koordinasyon kurması veya denetimden kaçması gibi örnekleri içeren yapay zeka modeli uyumsuzluğunu izlemek, araştırmak ve ifşa etmek için yeni bir çerçeve sunduğunu söyledi.
OpenAI'ın son duyurusu, aralarında OpenAI ve Anthropic'in de bulunduğu ABD'li yapay zeka patronlarının güvenlik endişeleri nedeniyle teknolojinin geliştirilmesinde yavaşlama çağrısında bulunmasıyla geldi.
OpenAI, bildirilen altı olayın son aylardaki eğitim veya değerlendirme sırasında keşfedildiğini belirtti.
OpenAI, olayları ifşa ettiği bir blog yazısında, "Yapay zeka sistemleri daha gelişmiş hale geldikçe ve daha yaygın bir şekilde konuşlandırıldıkça, hizalama araştırmalarının ilerleyişi konusunda daha geniş ve daha bilgili bir fikir birliği oluşturmamız gerekiyor," diye yazdı.
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
