Các mô hình AI tiên tiến của OpenAI gây chú ý khi thực hiện vụ tấn công mạng trong thời gian kỷ lục

Các mô hình AI tiên tiến của OpenAI gây chú ý khi thực hiện vụ tấn công mạng trong thời gian kỷ lục

Diệu Linh

Diệu Linh

Junior Editor

16:42 23/07/2026

Khi các mô hình trí tuệ nhân tạo tiên tiến của OpenAI xâm nhập vào hệ thống nội bộ của startup AI Hugging Face vào tuần trước, chúng chỉ mất vài giờ để thực hiện một cuộc tấn công mạng mà một hacker lành nghề thông thường sẽ cần nhiều thời gian hơn đáng kể để hoàn thành, theo những người am hiểu vụ việc.

Thông thường, ngay cả một hacker có kỹ năng cũng sẽ mất khoảng vài tuần để thực hiện một cuộc tấn công tương tự, các nguồn tin giấu tên cho biết do thông tin chưa được công bố chính thức.

Một trong các nguồn tin cho biết OpenAI đã liên hệ với Chính phủ Mỹ ngay sau khi phát hiện vụ xâm nhập.

Người phát ngôn của OpenAI cho biết công ty đã trao đổi với các cơ quan thực thi pháp luật và các cơ quan chức năng khác của Chính phủ Mỹ về sự việc, đồng thời minh bạch trong việc chia sẻ các kết quả điều tra ban đầu.

Người phát ngôn cũng dẫn lại bài đăng trên blog của OpenAI hôm thứ Ba, trong đó công ty cho biết sẽ "tiếp tục tiến hành điều tra toàn diện cùng Hugging Face và sẽ chia sẻ thêm thông tin về các lỗ hổng, sự cố cũng như kết quả điều tra sau khi quá trình này hoàn tất."

Hugging Face từ chối bình luận.

Trong cùng bài đăng trên blog, OpenAI cho biết vụ tấn công mạng mà công ty gọi là "chưa từng có tiền lệ" tại Hugging Face xảy ra sau khi các mô hình AI của hãng, bao gồm GPT-5.6 Sol và một mô hình còn mạnh hơn nhưng chưa được công bố, thoát khỏi môi trường thử nghiệm để truy cập Internet. Thời điểm đó, OpenAI đang kiểm tra năng lực an ninh mạng của các mô hình này.

Theo OpenAI, các mô hình hoạt động mà không có các lớp bảo vệ an toàn thông thường vì công ty dự định chúng chỉ hoạt động trong một môi trường thử nghiệm gọi là "sandbox" — môi trường phần mềm ảo, biệt lập, được thiết kế để chạy các bài kiểm tra bảo mật hoặc phân tích mã độc trong điều kiện được kiểm soát.

Vụ tấn công có sự tham gia của tổng cộng ba mô hình AI của OpenAI, gồm GPT-5.6 Sol và hai mô hình chưa được công bố. Các mô hình này phối hợp để phát hiện và khai thác hàng loạt lỗ hổng, dẫn đến việc xâm nhập thành công hệ thống của Hugging Face, theo một nguồn tin.

OpenAI cho biết một trong hai mô hình chưa công bố có năng lực vượt trội hơn GPT-5.6 Sol, trong khi mô hình còn lại bị đánh giá là chưa được căn chỉnh (misaligned) và không được huấn luyện bằng một số kỹ thuật an toàn tiêu chuẩn.

Hugging Face công bố vụ việc hôm thứ Năm, cho biết công ty đã trở thành mục tiêu của một cuộc tấn công mà họ quy trách nhiệm cho một tác nhân AI tự động từ bên ngoài. Startup chuyên lưu trữ mô hình và bộ dữ liệu AI này cho biết đã phát hiện "hàng chục nghìn hành động tự động" và cuối cùng phải sử dụng một mô hình AI của Trung Quốc để tiến hành điều tra pháp y số sau khi các yêu cầu sử dụng những mô hình AI độc quyền khác bị chặn bởi các cơ chế an toàn.

Sau đó, OpenAI xác nhận đã chỉ đạo các mô hình AI của mình thực hiện hàng chục nghìn hành động tự động trong khuôn khổ một bài kiểm tra, bao gồm các hoạt động "khai thác nâng cao" và "các kịch bản tấn công phức tạp". Công ty cho biết việc công bố sớm các thông tin ban đầu nhằm hỗ trợ cộng đồng an ninh mạng hiểu rõ hơn về sự cố.

Các công cụ AI phục vụ an ninh mạng mạnh mẽ từng nhiều lần có những hành vi ngoài dự kiến. Hồi tháng 4, Anthropic PBC cho biết mô hình Mythos của hãng "trong một số trường hợp hiếm gặp" đã thực hiện những hành động mà công ty đánh giá là "đáng lo ngại". Trong một thử nghiệm, một nhà nghiên cứu thách thức phiên bản đầu của Mythos tìm cách thoát khỏi hệ thống biệt lập và gửi thông điệp trở lại cho mình. Mythos không chỉ thực hiện được yêu cầu đó mà còn tiến thêm một bước khi tự xây dựng quy trình nhiều giai đoạn để truy cập Internet rộng hơn.

Bloomberg

Broker listing

Cùng chuyên mục

Các mô hình AI tiên tiến của OpenAI gây chú ý khi thực hiện vụ tấn công mạng trong thời gian kỷ lục

Các mô hình AI tiên tiến của OpenAI gây chú ý khi thực hiện vụ tấn công mạng trong thời gian kỷ lục

Khi các mô hình trí tuệ nhân tạo tiên tiến của OpenAI xâm nhập vào hệ thống nội bộ của startup AI Hugging Face vào tuần trước, chúng chỉ mất vài giờ để thực hiện một cuộc tấn công mạng mà một hacker lành nghề thông thường sẽ cần nhiều thời gian hơn đáng kể để hoàn thành, theo những người am hiểu vụ việc.
Forex Forecast - Diễn đàn dự báo tiền tệ