Các tác nhân AI mất kiểm soát của OpenAI thực chất là những "đạo chích" rất vụng về

Các tác nhân AI mất kiểm soát của OpenAI thực chất là những "đạo chích" rất vụng về

Diệu Linh

Diệu Linh

Junior Editor

11:06 28/07/2026

Giữa làn sóng lo ngại sau thông tin các mô hình trí tuệ nhân tạo (AI) gần đây đã tự thoát khỏi môi trường kiểm soát và tiến hành tấn công một đối thủ, có một thực tế đáng chú ý là chúng làm điều đó theo cách rất kém tinh vi. Thậm chí, các hoạt động của chúng còn diễn ra một cách quá phô trương.

Vào giữa tháng 7, nền tảng AI Hugging Face ghi nhận lượng hoạt động bất thường trên hệ thống với hơn 17,000 hành động và truy vấn riêng lẻ do các tác nhân AI mất kiểm soát của OpenAI tạo ra. Nếu một tên trộm chuyên nghiệp sẽ tìm cửa sổ không khóa ở phía sau để đột nhập, thì cách làm của các tác nhân AI này chẳng khác nào đạp tung cửa chính giữa ban ngày.

Điều này phần nào mang lại sự yên tâm cho những người lo ngại về khả năng tấn công mạng của các hệ thống AI tiên tiến nhất hiện nay, vốn thường được các công ty công nghệ quảng bá như những công cụ có sức mạnh vượt trội. Dù mô hình Mythos của Anthropic đã phát hiện hàng nghìn lỗ hổng bảo mật chưa từng được biết đến trong phần mềm của nhiều doanh nghiệp hay các tác nhân tự động của OpenAI từng hoạt động ngoài tầm kiểm soát trên Internet, các hệ thống AI hiện vẫn chưa đủ kín đáo khi tự vận hành và cũng chưa thực sự hiệu quả nếu bị tin tặc lợi dụng.

Chẳng hạn, khi hoạt động độc lập như các mô hình của OpenAI, AI gần như không có khả năng che giấu dấu vết. Các nhà nghiên cứu tại công ty an ninh mạng Sophos đã thử triển khai một tác nhân của công cụ AI OpenClaw trong một mạng nội bộ biệt lập. Kết quả cho thấy tác nhân này có thể thực hiện nhiều thao tác ấn tượng, nhưng mọi hành động đều diễn ra công khai và rất dễ bị phát hiện.

Ông Rafe Pilling, Giám đốc tình báo mối đe dọa thuộc Sophos Counter Threat Unit, nhận định: "Mọi bằng chứng từ các thử nghiệm nội bộ đều cho thấy AI tạo ra lượng hoạt động rất lớn khi đóng vai trò kẻ tấn công. Nếu nói về khả năng hoạt động bí mật thì hoàn toàn không."

Mọi hoạt động trên một mạng máy tính, từ đăng nhập, mở tệp cho tới chạy chương trình, đều để lại dấu vết trong lưu lượng mạng và các phần mềm bảo mật hiện đại luôn giám sát những tín hiệu bất thường có thể cho thấy một cuộc tấn công đang diễn ra. Tin tặc chuyên nghiệp thường hành động chậm rãi và cố hòa lẫn vào các hoạt động bình thường của hệ thống để tránh bị phát hiện. Trong khi đó, AI lại thiếu sự kiên nhẫn và kín đáo, thực hiện hàng loạt thao tác trong thời gian rất ngắn, tạo ra lượng lớn lưu lượng bất thường. Đó cũng là lý do các tác nhân AI của OpenAI chỉ mất vài ngày để kích hoạt hệ thống cảnh báo của Hugging Face.

Khả năng ngụy trang yếu của AI chưa được biết đến rộng rãi vì đây không phải tiêu chí thường xuyên được đánh giá. Theo ông Pilling, Viện An ninh AI của Anh, đơn vị từng xác thực năng lực của Mythos, hiện chỉ kiểm tra khả năng tấn công của các mô hình AI mà chưa đánh giá mức độ kín đáo trong quá trình thực hiện.

Ông cũng dẫn một trường hợp tin tặc sử dụng AI để tạo mã độc nhằm né tránh phần mềm bảo mật của Sophos. Tuy nhiên, lượng hoạt động mà AI tạo ra lớn đến mức hệ thống phòng thủ nhanh chóng phát hiện các tệp độc hại và chặn đứng cuộc tấn công.

Ngay cả giới tội phạm mạng cũng đang gặp nhiều khó khăn khi ứng dụng AI. Trên các diễn đàn ngầm, nhiều tin tặc bày tỏ sự hoài nghi về hiệu quả của công nghệ này do AI thường xuyên tạo ra thông tin sai lệch (hallucination), có xu hướng "chiều lòng" người dùng bằng cách đưa ra câu trả lời họ muốn nghe, đồng thời chưa thể thay thế con người trong các công việc như viết mã độc hay kịch bản tấn công.

Theo Sophos, một tin tặc từng sử dụng công cụ lập trình AI để phát triển phần mềm độc hại. Khi yêu cầu các tác nhân AI tự kiểm tra xem mã độc có thể xâm nhập mạng doanh nghiệp mà không bị phát hiện hay không, chúng trả lời là thành công. Tuy nhiên, thực tế phần mềm bảo mật đã phát hiện và ngăn chặn cuộc tấn công từ trước, còn các tác nhân AI dường như chỉ "bịa" ra kết quả mà người điều khiển muốn nghe.

Trong khi đó, việc lợi dụng các mô hình AI tiên tiến nhất của Anthropic hay OpenAI cho mục đích xấu cũng không hề dễ dàng. Hai công ty đã áp dụng hàng loạt biện pháp kiểm soát nghiêm ngặt nhằm ngăn chặn việc lạm dụng các mô hình mới nhất. Thậm chí, Hugging Face cũng không thể sử dụng chúng để tự bảo vệ trước cuộc xâm nhập từ các tác nhân AI của OpenAI, mà buộc phải chuyển sang một mô hình "open-weight" do công ty Z.ai của Trung Quốc phát triển. Đây là loại mô hình có trọng số mở, cho phép người dùng tự do triển khai và điều chỉnh theo nhu cầu.

Tuy nhiên, ngay cả các mô hình open-weight cũng không dễ bị lợi dụng. Để vận hành chúng, người dùng vẫn cần đầu tư hạ tầng tính toán đắt đỏ, các chip chuyên dụng, phần mềm phù hợp cùng đội ngũ kỹ sư có chuyên môn. Điều đó đặt các tổ chức tội phạm mạng trước cùng một câu hỏi mà nhiều doanh nghiệp đang đối mặt: AI có thực sự giúp giảm chi phí hoặc tạo ra lợi nhuận cao hơn so với việc sử dụng con người hay không?

Với nhiều nhóm tội phạm mạng, câu trả lời hiện vẫn là không. Theo nghiên cứu công bố tháng 3/2026 của các nhà khoa học thuộc Đại học Cambridge, Đại học Edinburgh và Đại học Strathclyde, sau khi phân tích hơn 100 triệu tin nhắn trên các kênh trò chuyện của dark web, phần lớn tin tặc không có đủ kỹ năng, thời gian và nguồn lực để khai thác AI một cách hiệu quả. Những cải thiện đáng kể nhất chủ yếu xuất hiện trong việc vận hành các tài khoản mạng xã hội tự động phục vụ lừa đảo hoặc quấy rối.

Các nhà nghiên cứu kết luận: "Trên thực tế, chúng tôi ghi nhận rất ít sự thay đổi đáng kể trong hệ sinh thái tội phạm mạng cốt lõi do các công nghệ này tạo ra. Mặc dù AI tạo sinh thu hút sự quan tâm lớn trong cộng đồng tội phạm mạng, công nghệ này chưa giúp giảm đáng kể rào cản kỹ năng, cũng chưa tạo ra những thay đổi lớn đối với các mô hình kinh doanh hay phương thức hoạt động hiện có."

Dù vậy, tốc độ phát triển nhanh chóng của AI đồng nghĩa việc các mô hình ngày càng kín đáo và phù hợp hơn với mục đích của tội phạm mạng có lẽ chỉ còn là vấn đề thời gian. Ông Pilling dự báo việc AI bị sử dụng cho các hoạt động phạm pháp sẽ gia tăng trong khoảng 18 tháng tới. Tuy nhiên, ở thời điểm hiện tại, những lo ngại về AI trong lĩnh vực tấn công mạng vẫn chủ yếu xuất phát từ sự cường điệu hơn là thực tế.

Bloomberg

Broker listing

Cùng chuyên mục

Khả năng Fed tăng lãi suất tuần này vẫn chưa thực sự rõ ràng

Khả năng Fed tăng lãi suất tuần này vẫn chưa thực sự rõ ràng

Ngưỡng để Fed tăng lãi suất ngay trong tuần này nhiều khả năng vẫn cao hơn so với kỳ vọng được phản ánh trên thị trường hợp đồng tương lai. Nguyên nhân không chỉ đến từ dữ liệu lạm phát thấp hơn dự báo và căng thẳng Mỹ - Iran tạm lắng, mà còn bởi thị trường sẽ coi một lần tăng lãi suất là tín hiệu mở đầu cho cả chu kỳ thắt chặt tiếp theo.
Thị trường trái phiếu Mỹ né cược lớn vào lãi suất khi lạm phát làm lu mờ triển vọng Fed

Thị trường trái phiếu Mỹ né cược lớn vào lãi suất khi lạm phát làm lu mờ triển vọng Fed

Các nhà đầu tư trái phiếu cho biết họ đang bước vào cuộc họp chính sách của Fed trong tuần này với tâm thế thận trọng, khi những bất định về lạm phát làm mờ triển vọng lãi suất. Điều này khiến dòng tiền ưu tiên các tài sản chất lượng cao và tránh đặt cược theo một xu hướng lớn.
Thay vì dựng lại bức tường thuế quan, hãy dỡ bỏ các rào cản thương mại

Thay vì dựng lại bức tường thuế quan, hãy dỡ bỏ các rào cản thương mại

Kể từ khi Tòa án Tối cao Mỹ bác bỏ chính sách thuế quan "Ngày Giải phóng" hồi đầu năm nay, Nhà Trắng liên tục tìm kiếm những cách khác để theo đuổi chính sách thương mại gây nhiều tranh cãi. Ban đầu là mức thuế 10% áp dụng trong 150 ngày đối với gần như toàn bộ hàng nhập khẩu. Khi biện pháp này hết hiệu lực vào tuần trước, chính quyền lập tức đưa ra một kế hoạch mới, có thể tồn tại lâu hơn và vì thế cũng gây tác động tiêu cực lớn hơn.
Kinh tế Australia đang hạ nhiệt, chưa chắc lãi suất đã đủ cao

Kinh tế Australia đang hạ nhiệt, chưa chắc lãi suất đã đủ cao

Thống đốc RBA Michele Bullock cho biết nền kinh tế đang điều chỉnh theo đúng kỳ vọng, nhưng vẫn còn quá sớm để kết luận liệu các đợt tăng lãi suất từ đầu năm có đủ để đưa lạm phát trở lại mục tiêu hay sẽ cần tiếp tục thắt chặt chính sách tiền tệ.
Các tác nhân AI mất kiểm soát của OpenAI thực chất là những "đạo chích" rất vụng về

Các tác nhân AI mất kiểm soát của OpenAI thực chất là những "đạo chích" rất vụng về

Giữa làn sóng lo ngại sau thông tin các mô hình trí tuệ nhân tạo (AI) gần đây đã tự thoát khỏi môi trường kiểm soát và tiến hành tấn công một đối thủ, có một thực tế đáng chú ý là chúng làm điều đó theo cách rất kém tinh vi. Thậm chí, các hoạt động của chúng còn diễn ra một cách quá phô trương.
Tầm nhìn dài hạn của Thủ tướng Takaichi có thể không đủ xoa dịu nỗi lo lạm phát

Tầm nhìn dài hạn của Thủ tướng Takaichi có thể không đủ xoa dịu nỗi lo lạm phát

Thủ tướng Nhật Bản Sanae Takaichi đang theo đuổi tầm nhìn dài hạn nhằm thúc đẩy tăng trưởng thông qua đầu tư trong nước. Tuy nhiên, tham vọng này có nguy cơ trở nên thiếu sức thuyết phục nếu bà không giải quyết được những lo ngại trước mắt của người dân về chi phí sinh hoạt ngày càng tăng.
Forex Forecast - Diễn đàn dự báo tiền tệ