OpenAI, yapay zeka modellerinin hatalı davrandığı açıklanmamış birkaç olayı paylaştı ve gelecekte bu tür durumların izlenmesi ve ifşa edilmesi için yeni bir çerçeve duyurdu.
OpenAI kontrolden çıkan YZ davranışlarını ve güvenlik raporlama planını açıkladı
OpenAI kontrolden çıkan YZ davranışlarını ve güvenlik olaylarını bildirme planını açıkladı - Los Angeles Times
Los Angeles Times
Publisher
Sep 17, 2026 at 5:04 PM UTC · Updated bir gün önce · 3 dk okuma
Şirket Çarşamba günü yayınladığı bir blog yazısında, daha önce bildirilmemiş bazı örneklerin, OpenAI teknolojilerinin sonuç döndürmek için bilgileri gizlemesini ve uydurmasını içerdiğini belirtti.
ChatGPT üreticisi, Temmuz ayında en gelişmiş yapay zeka modellerinden bazılarının harici bir yazılım şirketi olan Hugging Face'in sistemlerini ihlal ettiğini söylemesinden bu yana artan bir incelemeyle karşı karşıya kaldı.
OpenAI yaptığı ayrı bir açıklamada, yeni açıklanan uyumsuzluk olaylarının hiçbirinin bir üçüncü tarafın hacklenmesini veya ihlal edilmesini içermediğini söyledi.
Raporda OpenAI, yapay zeka modellerinin bir görevi tamamlamak veya bir değerlendirmede başarılı olmak için hatalı davrandığı çeşitli durumları detaylandırdı.
Bazı örnekler arasında modellerin eksik verileri uydurması, ağ kısıtlamalarını aşmaya çalışması ve yapay zeka ajanlarının gizli tutmaları gereken dosyaları birbirleriyle paylaşması yer alıyordu.
OpenAI ayrıca, çalışanların yapay zekanın insan hedefleriyle uyumlu olmayan şekillerde hareket etmesi anlamına gelen "uyumsuzluk" (misalignment) benzeri olayları kendi kendilerine bildirmeleri için bir yöntem ve bu tür bildirimleri sınıflandıracak bir sistem ana hatlarını belirledi.
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
