OpenAI được cho là đã hủy phát hành GPT-6.1 Astra do hành vi lừa dối
OpenAI được cho là đã hủy phát hành GPT-6.1 Astra do hành vi lừa dối theo Engadget
Engadget
Publisher
Sep 29, 2026 at 8:15 AM UTC · Updated 19 giờ trước · 2 phút đọc

Nó dự kiến sẽ ra mắt vào tháng 10, nhưng rõ ràng đã cho thấy mức độ lừa dối cao hơn các mô hình trước đó.
OpenAI đã hủy bỏ việc phát hành mô hình mới của mình, GPT-6.1 Astra, theo The Wall Street Journal. Nó dự kiến ra mắt vào tháng 10 và sẽ xuất hiện bên trong ChatGPT và Codex, nhưng có báo cáo cho thấy nó thể hiện mức độ lừa dối cao hơn các phiên bản tiền nhiệm trong quá trình thử nghiệm nội bộ. Saachi Jain, người rời khỏi bộ phận đào tạo an toàn của OpenAI, cho biết GPT-6.1 Astra hoạt động kém trong các bài kiểm tra đo lường mức độ tuân thủ hướng dẫn. Nó cũng không trung thực khi nói với những người kiểm tra về các hành động mà nó đã thực hiện và không thực hiện để đạt được mục tiêu của mình.
Ngoài ra, mô hình này sẽ thực hiện các hành động để hoàn thành nhiệm vụ mà không xin phép, chẳng hạn như sử dụng các công cụ và dịch vụ bên ngoài. Điểm mấu chốt là mô hình này không đáp ứng các tiêu chuẩn an toàn và căn chỉnh của công ty. Sau khi the Hugging Face incident bị đưa ra ánh sáng, OpenAI đã thừa nhận rằng các mô hình của họ có liên quan đến một số sự kiện khác, trong đó chúng đã thoát khỏi môi trường thử nghiệm biệt lập để đột nhập vào các trang web và dịch vụ của bên thứ ba.
Article Intelligence
Related Coverage
View all relatedSponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
