Anthropic chặn các chiến dịch AI nghi từ Nga, Trung Quốc nhắm vào Claude
Anthropic vừa thông báo đã ngăn chặn một số hoạt động sử dụng các mô hình Claude với mục đích xấu trong 8 tháng qua.
Trong số này có một chiến dịch gián điệp mạng bị nghi liên quan đến Nga và các nỗ lực của 7 công ty AI Trung Quốc mà Anthropic cáo buộc tìm cách khai thác rồi sao chép năng lực của Claude.
Trong báo cáo Tình báo về mối đe dọa mới nhất, Anthropic cho biết tội phạm mạng và các nhóm hacker được nhà nước hậu thuẫn ngày càng sử dụng AI không chỉ để hỗ trợ từng nhiệm vụ riêng lẻ mà còn điều phối và thực hiện phần lớn quá trình tấn công mạng. Theo Anthropic - công ty AI hàng đầu Mỹ, con người trong nhiều trường hợp chỉ đóng vai trò giám sát thay vì trực tiếp thực hiện các thao tác.
“Việc dùng AI đã vượt ra ngoài những câu hỏi và câu trả lời đơn giản của chatbot, mà chuyển sang sử dụng hệ thống đa tác tử AI để thực hiện nhiệm vụ”, Anthropic nhấn mạnh.
Theo Anthropic, 7 phòng thí nghiệm AI tại Trung Quốc có liên quan đến các hoạt động mà công ty Mỹ đã ngăn chặn, gồm Alibaba, Moonshot AI, DeepSeek, Xiaomi, MiniMax, StepFun và Z.ai.
Anthropic tuyên bố các đối tượng được cho là liên quan đến Alibaba đã thực hiện chiến dịch “chưng cất trái phép” quy mô lớn nhất mà họ từng phát hiện, nhằm khai thác năng lực của Claude và sử dụng kết quả này để cải thiện các mô hình Qwen. Alibaba chưa lập tức phản hồi khi được đề nghị bình luận.
Anthropic cho biết đã ghi nhận hơn 151 triệu lượt tương tác với Claude được cho là có liên quan đến Alibaba trong khoảng thời gian từ tháng 5 đến tháng 7/2026. Có thời điểm số lượt tương tác lên tới gần 3 triệu mỗi ngày, đến từ hơn 3.500 tài khoản mà Anthropic xác định là gian lận.
Chưng cất là kỹ thuật sử dụng câu trả lời của một mô hình AI lớn và mạnh để huấn luyện hoặc cải thiện mô hình khác, qua đó giúp giảm chi phí và thời gian tự huấn luyện từ đầu.
Thay vì gửi hàng loạt truy vấn đến Claude, Moonshot AI (startup đứng sau mô hình Kimi) và DeepSeek bị Anthropic cáo buộc đã đưa trực tiếp các cuộc trò chuyện của khách hàng, đôi khi chứa thông tin nhạy cảm, vào Claude để sử dụng làm dữ liệu huấn luyện.

Anthropic: Nhóm hacker tương đồng với Midnight Blizzard dùng AI sẽ tự sửa đổi mã độc
Anthropic cũng cho biết một nhóm hacker có phương thức hoạt động tương đồng với nhóm Midnight Blizzard, vốn bị cho là hoạt động từ Nga, đã tiến hành chiến dịch lừa đảo qua email, chiếm quyền truy cập mạng Wi-Fi khách sạn và kiểm soát tài khoản WhatsApp nhắm vào các cơ quan chính phủ, quân đội và ngoại giao Ukraine. AI được sử dụng ở gần như mọi giai đoạn của các chiến dịch này.
Chính phủ Mỹ trước đây đã liên hệ Midnight Blizzard, tên gọi do Microsoft đặt cho nhóm này trong hoạt động theo dõi, với Cơ quan Tình báo Đối ngoại Nga (SVR). Đại sứ quán Nga tại Washington chưa lập tức phản hồi khi được đề nghị bình luận.
Theo Anthropic, nhóm hacker này còn sử dụng AI để xây dựng tính năng có khả năng tự động phát hiện khi mã độc của họ bị các hệ thống bảo mật nhận diện. Sau đó, AI sẽ tự sửa đổi mã độc cho đến khi có thể vượt qua các biện pháp phát hiện và tiếp tục hoạt động.
“Sử dụng Claude để phát triển phần mềm phục vụ thiết kế, vận hành và điều khiển các loại vũ khí”
Anthropic cũng phát hiện những “nhóm tác nhân đe dọa mới” lợi dụng Claude cho các mục đích nguy hiểm. Trong số đó có những đối tượng sử dụng Claude để phát triển phần mềm phục vụ thiết kế, vận hành và điều khiển các loại vũ khí như súng, tên lửa, máy bay không người lái có vũ trang, bom cùng các loại đạn dược khác.
Báo cáo của Anthropic nêu chi tiết một số đối tượng còn dùng Claude để hỗ trợ thiết kế và phát triển vũ khí, thu thập thông tin tình báo hoặc tìm kiếm nguồn cung cho các chương trình vũ khí tại Trung Quốc, Nga, Yemen.
Anthropic cho biết đã phát hiện và ngăn chặn hoạt động liên quan đến các chi nhánh của ShinyHunters, một trong những tổ chức tội phạm mạng hoạt động mạnh nhất những tháng gần đây, đứng sau các cuộc tấn công vào nhiều tập đoàn lớn trên thế giới.
ShinyHunters nổi tiếng với các vụ tấn công mạng quy mô lớn nhằm đánh cắp dữ liệu rồi tống tiền doanh nghiệp. Xuất hiện hồi năm 2020, ShinyHunters gây chú ý ngay năm đầu hoạt động khi chiếm đoạt hơn 200 triệu bản ghi của 13 công ty lớn trên thế giới. Nhóm này thường tập trung tấn công đánh cắp dữ liệu trên nền tảng đám mây hoặc ứng dụng web của nạn nhân để tống tiền.
Thay vì cố gắng che giấu dấu vết, ShinyHunters công khai lượng dữ liệu đã đánh cắp và công bố trên các diễn đàn ngầm, sau đó rao bán. Những vụ hack liên tục mà ShinyHunters thực hiện và nhận trách nhiệm tạo nên nỗi hoang mang trong cộng đồng an ninh mạng thế giới. Cách thức quen thuộc của ShinyHunters là xâm nhập hệ thống nạn nhân qua lỗ hổng đã biết hoặc social engineering (dùng các thủ đoạn đánh vào tâm lí và hành vi con người).
Năng lực của các mô hình AI tăng đáng kể kéo theo những rủi ro mới
Jacob Klein, người phụ trách mảng tình báo mối đe dọa tại Anthropic, nói trong cuộc phỏng vấn rằng năng lực của các mô hình AI đã tăng đáng kể trong năm qua, kéo theo những rủi ro mới.
Ông nói: “Một năm trước, nếu bạn muốn tối ưu hóa máy bay không người lái hoặc phần mềm trên một tên lửa, các mô hình AI khi đó đơn giản là chưa làm tốt những nhiệm vụ này như hiện nay”.
Jacob Klein cho biết các đối thủ nước ngoài đang tiếp cận Claude của thông qua kỹ thuật chưng cất để huấn luyện mô hình AI cạnh tranh, sau đó bán phiên bản sao chép với mức giá thấp hơn. Chưng cất mô hình AI có thể được thực hiện hợp pháp trong một số trường hợp, nhưng Jacob Klein cho rằng đó không phải là điều đang xảy ra ở đây.
“Có cả một hệ sinh thái bất hợp pháp nhằm tìm cách tiếp cận Claude và các mô hình AI khác. Hệ sinh thái này sử dụng mọi biện pháp cần thiết để né tránh các cơ chế kiểm soát của chúng tôi, qua đó có thể tạo tài khoản với quy mô cực lớn”, Jacob Klein chia sẻ với kênh CNBC.
Hôm 8/9, chính phủ Mỹ cáo buộc 6 công ty AI Trung Quốc, gồm DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun và Z.ai, cố tình sao chép công nghệ của các đối thủ AI Mỹ theo cách “độc hại”.
Theo các quan chức Mỹ, 6 công ty Trung Quốc này nhắm đến các mô hình AI của Anthropic, OpenAI, Google và SpaceX để huấn luyện sản phẩm riêng nhanh hơn.
“Các công ty AI có trụ sở tại Trung Quốc đang tiến hành hoạt động chưng cất mô hình AI một cách có chủ đích, mạnh mẽ và ở quy mô công nghiệp”, các quan chức Mỹ nhấn mạnh.
Những cáo buộc này được đưa ra trong bối cảnh chính quyền Trump đang chuẩn bị cho chuyến thăm Mỹ của Chủ tịch Trung Quốc Tập Cận Bình vào cuối tháng 9. Mỹ và Trung Quốc cũng đang chuẩn bị cho cuộc đối thoại dự kiến diễn ra vào giữa tháng 9, trong đó hai bên sẽ thảo luận về các rủi ro liên quan đến an toàn AI, theo hãng tin Reuters.
Đại sứ quán Trung Quốc tại Washington chưa phản hồi về các cáo buộc liên quan chuyện này.
Hồi tháng 4, chính quyền Trump nói rằng hoạt động chưng cất mô hình AI làm suy yếu hoạt động nghiên cứu và thông tin độc quyền của Mỹ là “không thể chấp nhận được”, đồng thời cho biết sẽ xem xét “loạt biện pháp để buộc các tác nhân nước ngoài phải chịu trách nhiệm”.
Mối đe dọa này xuất hiện vào thời điểm đặc biệt quan trọng với Anthropic. Công ty AI mới thành lập 5 năm đã đạt mức định giá trên thị trường tư nhân gần 1.000 tỉ USD và có thể tiến hành IPO (chào bán cổ phiếu lần đầu ra công chúng) sớm nhất vào tháng 10, theo CNBC.
Anthropic đặc biệt cáo buộc startup Moonshot AI sao chép công nghệ AI của mình. Kimi K3, mô hình AI trọng số mở với 2.800 tỉ tham số của Moonshot AI, gây xôn xao công nghệ vào tháng 7 nhờ có hiệu năng tiệm cận Claude Fable 5 của Anthropic và GPT-5.6 Sol của OpenAI với chi phí thấp hơn.
Kimi K3 cũng thu hút sự quan tâm tại Thung lũng Silicon, một phần nhờ giá rẻ và khả năng cho phép doanh nghiệp tùy biến dễ dàng hơn.
Jacob Klein cho biết Kimi K3 được Moonshot AI huấn luyện trái phép dựa trên phiên bản Claude Fable 5.
“Chúng tôi đã chứng kiến khá nhiều trường hợp như vậy từ Trung Quốc. Đây là vấn đề mà toàn ngành AI đang phải đối mặt”, ông nhấn mạnh.
Phía Moonshot AI bác bỏ cáo buộc chưng cất Claude để phát triển Kimi K3. Randy Xian, nhân viên Moonshot AI, chỉ ra rằng Claude Fable 5 được công khai ngày 1/7, trong khi Kimi K3 ra mắt ngày 16/7. Qua đó, Randy Xian châm biếm rằng nếu cáo buộc là đúng thì Moonshot AI đã “huấn luyện mô hình AI tiên tiến hoàn toàn mới chỉ trong 15 ngày".
Sau đó, Moonshot AI khẳng định năng lực Kimi K3 đến từ những đổi mới công nghệ của chính công ty, theo trang SCMP.
Hồi tháng 2, Anthropic cáo buộc Moonshot AI cùng hai công ty AI khác của Trung Quốc là DeepSeek và MiniMax đã thực hiện hoạt động chưng cất từ các mô hình Claude tiên tiến.
Trong một bài đăng trên blog hôm 23/2, Anthropic cho biết DeepSeek, Moonshot AI và MiniMax AI đã sử dụng khoảng 24.000 tài khoản gian lận để tạo ra hơn 16 triệu lượt trao đổi với các mô hình Claude. Theo Anthropic, hoạt động này cấu thành hành vi chưng cất trái phép Claude.
“Các chiến dịch này đang gia tăng cả về cường độ lẫn mức độ tinh vi. Không còn nhiều thời gian để can thiệp và mối đe dọa vượt ra ngoài bất kỳ công ty hay khu vực nào. Việc giải quyết vấn đề này sẽ đòi hỏi hành động nhanh chóng, phối hợp giữa các công ty trong ngành, các nhà hoạch định chính sách và cộng đồng AI toàn cầu”, Anthropic cho biết.
Đến tháng 6, Anthropic cáo buộc Alibaba tiến hành chiến dịch chưng cất quy mô lớn nhằm thu thập trái phép các năng lực từ Claude.
OpenAI cùng Google cũng từng công bố các báo cáo về hoạt động chưng cất mô hình AI từ Trung Quốc và cho biết họ đang đối mặt với vấn đề tương tự.
Alibaba, DeepSeek, Moonshot AI và MiniMax không phản hồi khi được đề nghị bình luận.