OpenAI mở rộng các đánh giá an toàn bên ngoài vào quá trình đào tạo mô hình
OpenAI mở rộng các đánh giá an toàn bên ngoài vào quá trình đào tạo mô hình TechRepublic
TechRepublic
Publisher
Sep 23, 2026 at 4:33 PM UTC · Updated 3 ngày trước · 3 phút đọc

OpenAI muốn các bên đánh giá an toàn bên ngoài tham gia trước khi các mô hình của mình hoàn thiện, chứ không chỉ ngay trước khi ra mắt.
Công ty cho biết vào thứ Ba rằng họ có kế hoạch hỗ trợ các đánh giá an toàn kỹ thuật độc lập trong quá trình đào tạo, đánh giá và triển khai, mở rộng ra ngoài các bài đánh giá trước khi ra mắt mà họ đã phụ thuộc nhiều hơn trong quá khứ.
Lama Ahmad, người dẫn đầu công việc của OpenAI với các chuyên gia an toàn bên ngoài, nói với Bloomberg rằng trước đây công ty tập trung vào việc mời các bên thứ ba vào ngay trước khi ra mắt. “Khi rủi ro ngày càng cao, chúng tôi muốn đảm bảo rằng mình cũng đang xem xét những thứ như đào tạo và đánh giá, vốn có rủi ro cao, ngoài việc triển khai của chúng tôi,” Ahmad nói.
OpenAI cho biết các bài đánh giá nên có cơ chế độc lập mạnh mẽ, tính nghiêm túc về mặt khoa học, các thực hành bảo mật mạnh mẽ và trách nhiệm rõ ràng.
Công ty cho biết họ đã đang thảo luận với nhiều bên đánh giá tiềm năng, bao gồm các nhóm nghiên cứu AI METR và Redwood Research. Cả hai nhóm trước đây đều đã điều tra một sự cố liên quan đến OpenAI models gaining unauthorized access to Hugging Face systems.
Những gì các nhóm bên ngoài sẽ kiểm tra
OpenAI đã vạch ra bốn lĩnh vực mà họ muốn có sự giám sát độc lập sâu hơn.
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
