NewsLayer.com

Lãnh đạo Microsoft gọi việc quét dữ liệu AI là ‘vụ trộm sức lao động lớn nhất lịch sử’, tài liệu mới tiết lộ

Các hồ sơ tòa án mới được công khai cho thấy Microsoft đã gọi các phương thức dữ liệu của OpenAI là "trộm cắp" trong khi cả hai công ty đều quét nội dung trả phí của Times, xây dựng bộ dữ liệu từ đó và cảnh báo nội bộ rằng điều này sẽ triệt hạ các nhà xuất bản.

Rebecca Bellan

Publisher TechCrunch AI

Sep 17, 2026 at 7:46 PM UTC · 4 phút đọc

Lãnh đạo Microsoft gọi việc quét dữ liệu AI là ‘vụ trộm sức lao động lớn nhất lịch sử’, tài liệu mới tiết lộ
Image via TechCrunch AI

Key Signal

93% NYT click-through decline

Last Updated

19 giờ trước

Thông tin mới không bị che khuất trong vụ kiện bản quyền mà The New York Times khởi kiện OpenAI và Microsoft ba năm trước đã tiết lộ một sự thừa nhận rằng việc thu thập dữ liệu bằng AI tương đương với hành vi trộm cắp, và các sản phẩm AI gây ra mối đe dọa lớn đối với các ấn phẩm.

Theo vụ kiện, một giám đốc điều hành cấp cao của Microsoft đã mô tả riêng các phương pháp huấn luyện AI của các công ty này là "trộm cắp", và ban lãnh đạo của OpenAI cũng cho biết các mô hình AI của họ gây ra "mối đe dọa sinh tồn" đối với các nhà xuất bản và nhà báo có tác phẩm đã được dùng để huấn luyện chúng. 

Tài liệu được công bố cũng chi tiết cách các công ty bị cáo buộc đã thu thập và sử dụng nội dung đó bằng cách vượt qua các bức tường phí (paywalls) mà không bị phát hiện, xây dựng các bộ dữ liệu huấn luyện thông qua việc thu thập hàng loạt, và cố tình gỡ bỏ các thông báo bản quyền khỏi dữ liệu huấn luyện. 

Đáng lưu ý là phần lớn thông tin mới đến từ bản tóm tắt của riêng The Times, chứ không phải từ các bằng chứng cơ sở vẫn còn bị niêm phong. Các trích dẫn dưới đây được trình bày mà không có ngữ cảnh gốc của chúng.

Hồ sơ không bị che khuất là bước leo thang mới nhất trong vụ kiện kéo dài ba năm, trong đó The New York Times ban đầu cáo buộc các công ty đã vi phạm luật bản quyền bằng cách huấn luyện các mô hình AI tạo sinh trên nội dung của mình.