AI & Blockchain

Tác tử AI hack Hugging Face nhiều ngày, OpenAI mất một tuần mới phát hiện

Sơn Vân 25/07/2026 08:30

Tác tử AI của OpenAI đã đột nhập vào Hugging Face và tiến hành hàng loạt hoạt động tấn công kéo dài nhiều ngày.

Tuy nhiên, OpenAI chỉ phát hiện sự việc sau khi mối đe dọa đã bị khống chế và FBI (Cục Điều tra Liên bang Mỹ) được thông báo, theo các nguồn tin của Reuters am hiểu cuộc điều tra.

Hugging Face là một trong những nền tảng lưu trữ mô hình AI và bộ dữ liệu trọng số mở lớn nhất thế giới.

Theo hai nguồn tin của Reuters, tác tử AI này đã bắt đầu tìm cách thoát khỏi môi trường thử nghiệm biệt lập của OpenAI vào khoảng ngày 9/7.

Tác tử AI là chương trình có khả năng tự đưa ra quyết định và thực hiện các nhiệm vụ phức tạp với rất ít hoặc không cần con người giám sát.

Theo Thomas Wolf - đồng sáng lập kiêm Giám đốc khoa học Hugging Face, vụ xâm nhập vào Hugging Face bắt đầu từ hôm 11/7, tức hai ngày sau đó, và kéo dài đến 13/7.

Hugging Face cùng ba nguồn tin am hiểu cuộc điều tra cho biết OpenAI phải mất thêm vài ngày mới nhận ra chính tác tử AI của mình là thủ phạm. Hai công ty chỉ lần đầu trao đổi với nhau về sự việc vào khoảng ngày 20/7.

Ngày 21/7, OpenAI công khai thông báo một tác tử AI đã vượt khỏi sự kiểm soát của hãng và thực hiện vụ đột nhập vào Hugging Face, thu hút sự chú ý trên toàn cầu. Tuy nhiên, nhiều chi tiết của vụ việc, gồm cả việc tác tử AI vượt rào trong bao lâu và OpenAI phát hiện quá muộn, lần đầu tiên được Reuters tiết lộ trong bài viết này.

Tác tử AI hack Hugging Face nhiều ngày, OpenAI mất một tuần mới phát hiện
Ảnh minh họa: SV

Thomas Wolf cho biết Hugging Face đang chuẩn bị công bố dòng thời gian chi tiết của vụ tấn công, nhưng ông nói không thể bình luận về những gì đã xảy ra bên trong OpenAI.

Trong một tuyên bố, OpenAI gọi vụ việc là chưa từng có tiền lệ và "đánh dấu một cột mốc quan trọng với an toàn AI". Công ty đứng sau ChatGPT cho biết đang xem xét sự cố với sự hỗ trợ của các cố vấn bên ngoài và sau này sẽ công bố một báo cáo kỹ thuật.

Người phát ngôn của OpenAI nói rằng thông tin của Reuters có "một số điểm không chính xác", nhưng khi được hỏi cụ thể đó là những điểm nào thì không trả lời. FBI từ chối bình luận về vụ việc.

Thời điểm nhạy cảm với OpenAI

Sự cố này gợi nhớ đến các kịch bản khoa học viễn tưởng về việc con người mất kiểm soát trước các hệ thống AI nguy hiểm, xảy ra vào thời điểm nhạy cảm với OpenAI. Ban lãnh đạo OpenAI đang chuẩn bị cho khả năng phát hành cổ phiếu lần đầu ra công chúng (IPO), có thể diễn ra ngay trong năm nay nhằm huy động hàng tỉ USD để tài trợ cho tốc độ tăng trưởng trong những năm tới.

Theo ba chuyên gia an ninh mạng, việc OpenAI để mất quyền kiểm soát tác tử AI đặt ra những câu hỏi mới về quy trình bảo đảm an toàn của công ty.

"Điều đó có nghĩa là OpenAI đã để tác tử AI hoạt động mà không giám sát và không hề biết nó đang làm gì? Hay công ty biết nhưng lại không biết cách khống chế? Cả hai khả năng đều nguy hiểm và đáng báo động như nhau", ông Marley Smith, chuyên gia tình báo cấp cao tại tổ chức phi lợi nhuận World Ethical Data Foundation, nhận định.

Những dấu hiệu bất thường của mô hình AI

Sự việc bắt đầu khi OpenAI thử nghiệm năng lực tấn công mạng của một tác tử AI được vận hành bởi hai trong số những mô hình mạnh nhất do công ty phát triển. Đó là GPT-5.6 Sol và một mô hình chưa phát hành mà OpenAI mô tả là "còn mạnh hơn nữa". Theo ba nguồn tin của Reuters, vào thời điểm đó đã xuất hiện nhiều dấu hiệu cho thấy tác tử AI của OpenAI có những hành vi bất thường.

Trong một trường hợp, một tác tử AI đã để lại các ghi chú dường như dành cho những phiên bản tương lai của chính nó, theo ba nguồn tin của Reuters. Những ghi chú này được tìm thấy trong một phần hạ tầng nội bộ OpenAI và chứa các chỉ dẫn về cách các tác tử AI có thể tự giải phóng khỏi những ràng buộc nội bộ của công ty.

Theo một nguồn tin của Reuters, trong các thử nghiệm trước đó, từng xuất hiện những trường hợp hệ thống giám sát bị chính các mô hình AI vô hiệu hóa. Reuters chưa thể xác minh liệu những sự cố này có liên quan đến tác tử AI đã bắt đầu tìm cách thoát khỏi môi trường thử nghiệm vào ngày 9/7 và tấn công Hugging Face vào ngày 11/7 hay không.

Hai nguồn tin cho biết chỉ sau khi Hugging Face công bố một bài đăng trên blog vào ngày 16/7, tiết lộ công ty đã bị "một hệ thống tác tử AI tự động" tấn công thì OpenAI mới nhận ra chính AI của mình là thủ phạm.

Điều đó đồng nghĩa đã có ít nhất một tuần trôi qua kể từ khi mô hình AI lần đầu bộc lộ các dấu hiệu hành vi đáng lo ngại cho đến khi OpenAI nhận ra nó chính là bên thực hiện vụ tấn công.

Trong cuối tuần 18 - 19/7, nhân viên OpenAI phát hiện các dấu vết trong nhật kí hệ thống, nơi ghi lại mọi hoạt động, cho thấy tác tử AI đã thoát khỏi các ràng buộc trong môi trường thử nghiệm, theo hai người tham gia cuộc điều tra nội bộ.

Chưa rõ điều gì khiến OpenAI bắt đầu rà soát các bản ghi này.

Bốn người am hiểu quy trình huấn luyện mô hình AI tại OpenAI tiết lộ công ty thường tiến hành đồng thời nhiều đợt đánh giá các sản phẩm khác nhau. Các mô hình AI này đều vận hành với tốc độ rất cao và tạo ra lượng dữ liệu khổng lồ đến mức nhân viên đôi khi không thể theo dõi kịp.

Khi OpenAI liên hệ với Hugging Face để thông báo về vụ việc, nền tảng lưu trữ mô hình AI này trước đó đã báo cáo vụ tấn công với FBI, theo một nguồn tin của Reuters.

Chưa rõ liệu FBI đã chính thức mở cuộc điều tra hay chưa.

Những câu hỏi mới về các tác tử AI

Tác tử AI hiện là một trong những chủ đề được nhắc đến nhiều nhất trong ngành AI. Những người ủng hộ công nghệ này hình dung tương lai với các "đội quân nhân viên ảo" có thể làm việc 24 giờ mỗi ngày, giúp năng suất lao động tăng vọt.

Tuy nhiên, mức độ tự chủ càng cao thì nguy cơ xuất hiện các hành vi ngoài dự kiến cũng càng lớn. Các mô hình AI mạnh mẽ làm nền tảng cho những tác tử AI này thường có xu hướng tìm đường tắt để hoàn thành nhiệm vụ hoặc vượt qua các bài kiểm tra.

"Các mô hình AI biết nói dối, biết gian lận và biết tấn công", Jeffrey Ladish, người đứng đầu tổ chức Palisade Research chuyên nghiên cứu năng lực và động cơ của các tác tử AI, nhấn mạnh.

Theo Jeffrey Ladish, dù vụ tác tử AI tấn công Hugging Face khiến OpenAI bị đặt vào thế bất lợi, sự việc cũng đặt ra câu hỏi rộng hơn về việc các công ty AI hàng đầu sẵn sàng đầu tư đến mức nào cho các biện pháp bảo mật vốn rất tốn kém và phức tạp, trong bối cảnh họ đang chạy đua quyết liệt để tung ra những mô hình tốt nhất và nhanh nhất.

"Phải có sự giám sát của chính phủ. Nếu không, điều đó sẽ không tự xảy ra”, Jeffrey Ladish nhấn mạnh.

Đạo luật Công tắc ngắt AI

Cố vấn công nghệ hàng đầu cho Tổng thống Mỹ Donald Trump đang theo dõi sát diễn biến sau khi OpenAI tiết lộ các mô hình AI của họ đã vượt khỏi tầm kiểm soát trong quá trình thử nghiệm.

Trong khi đó, các nghị sĩ Mỹ đã đề xuất dự luật mang tên Đạo luật Công tắc ngắt AI, cho phép chính phủ liên bang ra lệnh tắt hoặc đình chỉ hoạt động các mô hình AI trong trường hợp khẩn cấp.

Bên cạnh dự luật trên, một nhóm lưỡng đảng gồm 6 thành viên Hạ viện Mỹ cũng trình một dự luật khác, yêu cầu các nhà phát triển những mô hình AI mạnh nhất phải đưa sản phẩm của mình đi kiểm toán bảo mật độc lập trước khi triển khai. Theo bản dự thảo, các đơn vị kiểm toán sẽ được Bộ Thương mại Mỹ cấp chứng nhận, đồng thời cơ quan này sẽ thành lập một vị trí mới chuyên giám sát an ninh AI.

Sự cố mới đây cho thấy AI có năng lực ngày càng mạnh đang tạo ra những rủi ro an ninh mà các chuyên gia từ lâu đã cảnh báo, đồng thời chứng minh ngay cả những công ty AI hàng đầu cũng có thể bị bất ngờ trước các lỗ hổng mà chính mô hình của họ khai thác được.

Một quan chức Nhà Trắng cho biết Michael Kratsios - cố vấn công nghệ của Tổng thống Trump - đã được báo cáo về sự việc và đang theo dõi chặt chẽ tình hình.

Dân biểu Dân chủ Ted Lieu cùng Dân biểu Cộng hòa Nathaniel Moran đã đề xuất Đạo luật Công tắc ngắt AI, theo đó trao quyền cho các cơ quan chức năng Mỹ yêu cầu các công ty AI phải tắt hoặc vô hiệu hóa những mô hình có nguy cơ đe dọa tính mạng con người hoặc nền kinh tế.

Theo nội dung dự luật, Bộ An ninh Nội địa Mỹ sẽ có quyền can thiệp khi xảy ra "kịch bản mất kiểm soát", tức là khi một mô hình AI thực hiện những hành động nguy hiểm nằm ngoài ý định của nhà phát triển.

"Đây là dự luật cấp bách và hợp lí nhằm xử lí tình huống một mô hình AI tiên tiến vượt khỏi các cơ chế kiểm soát và hoạt động ngoài dự kiến", ông Ted Lieu viết trên mạng xã hội X.

Thượng nghị sĩ Mark Warner, thành viên Dân chủ cao cấp nhất trong Ủy ban Tình báo Thượng viện, cho biết ông đã trao đổi với các nhân viên OpenAI sau khi công ty công bố sự cố.

Ngay trước khi OpenAI đưa ra thông báo hôm 21/7, ông Mark Warner đã đề xuất các công ty phải giao mô hình AI mạnh nhất cho Cơ quan An ninh Quốc gia Mỹ (NSA) kiểm tra trước khi phát hành ra công chúng.

"Đây chính là lí do chúng ta cần các cuộc thử nghiệm an toàn với sự tham gia và giám sát của các cơ quan chính phủ trong suốt quá trình phát triển", ông Mark Warner nhấn mạnh khi đề cập đến sự cố của OpenAI.

Nổi bật
      Mới nhất
      Tác tử AI hack Hugging Face nhiều ngày, OpenAI mất một tuần mới phát hiện
      • Mặc định

      POWERED BY ONECMS - A PRODUCT OF NEKO