Ba nhà nghiên cứu an ninh mạng tại Ấn Độ đã có thể tấn công OpenAI bằng cách sử dụng một mô hình AI đối thủ từ Anthropic, tiết lộ rằng trí tuệ nhân tạo tiên tiến có thể khiến chính các công ty và người dùng của họ gặp rủi ro bị tấn công.
3 người đã hack OpenAI bằng mô hình đối thủ Anthropic. Đây là bài học về lỗ hổng của các phòng thí nghiệm AI.
3 người đã hack OpenAI bằng mô hình đối thủ Anthropic. Đây là bài học về lỗ hổng của các phòng thí nghiệm AI. CBS News
CBS News
Publisher
Sep 22, 2026 at 6:53 PM UTC · 5 phút đọc

Mohan Pedhapati, một trong ba nhà nghiên cứu từ một công ty có tên là Hacktron, người đã đột nhập vào OpenAI, cho biết các mô hình AI tiên tiến hơn cho phép những hacker kỳ cựu như ông thực hiện công việc của mình dễ dàng hơn nhiều — và làm tăng nguy cơ tội phạm cũng làm điều tương tự. Ông mô tả mỗi mô hình mới là "một công cụ nhân sức mạnh" giúp tăng cường khả năng tấn công mạng.
"Khi các mô hình tiến bộ, chúng trở nên rất có khả năng trong lĩnh vực mạng," ông nói.
Trong một báo cáo được công bố tuần trước, Hacktron đã trình bày chi tiết cách thức, vào cuối tháng 7, họ đã sử dụng các mô hình Claude để thâm nhập vào người dùng của diễn đàn cộng đồng của OpenAI. Diễn đàn là một không gian nơi người dùng ChatGPT và Codex, công cụ lập trình của OpenAI, có thể đến để đặt câu hỏi về các sản phẩm. Người dùng có thể đăng nhập bằng tài khoản OpenAI của họ.
Các nhà nghiên cứu của Hacktron đã sử dụng Claude Opus 4.8 để tìm ra các lỗi trong mã của một dịch vụ bên thứ ba có tên là Discourse, được sử dụng cho diễn đàn cộng đồng OpenAI. Họ đã cố gắng sử dụng Opus 4.8 để khai thác lỗ hổng nhưng không thành công. Tuy nhiên, ngay đêm đó, một mô hình tiên tiến hơn, Claude Opus 5, đã được phát hành.
Article Intelligence
Topics
Related Coverage
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
