AI

OpenAI kêu gọi Mỹ - Trung hợp tác về an toàn AI trước hội nghị thượng đỉnh

Sơn Vân 02/09/2026 06:00

Dean Ball cho rằng cơ hội để Mỹ và Trung Quốc hợp tác về an toàn AI đang mở ra trong vài tháng tới, nhưng sẽ không tồn tại mãi mãi.

Lãnh đạo OpenAI kêu gọi Mỹ và Trung Quốc hợp tác về an toàn AI trước hội nghị thượng đỉnh

Dean Ball là cựu cố vấn tại Văn phòng Chính sách Khoa học và Công nghệ Nhà Trắng và hiện là giám đốc phụ trách chiến lược tương lai của OpenAI.

Ông vừa kêu gọi Mỹ và Trung Quốc tăng cường hợp tác về an toàn trí tuệ nhân tạo (AI) trước thềm cuộc gặp giữa Tổng thống Mỹ Donald Trump và Chủ tịch Trung Quốc Tập Cận Bình vào cuối tháng 9. Động thái này diễn ra trong bối cảnh truyền thông nhà nước Trung Quốc công kích mạnh mẽ cách Mỹ quản lí các mô hình AI tiên tiến.

"Tôi luôn tin rằng hợp tác Mỹ - Trung về an toàn AI là điều đáng mong muốn. Trước đây, tôi nghĩ khả năng đó rất thấp. Song trong vài tháng qua, tình hình đã thay đổi. Hiện có một cửa sổ cơ hội", Dean Ball viết trên mạng xã hội X hôm 1/9.

Ông cho rằng cơ hội hợp tác sẽ còn mở rộng trong ít nhất vài tháng tới vì rủi ro AI ngày càng gia tăng và cuộc gặp cấp cao Mỹ - Trung sắp diễn ra. Tuy vậy, Dean Ball cũng cảnh báo "cửa sổ cơ hội này sẽ không mở mãi".

OpenAI kêu gọi Mỹ - Trung hợp tác về an toàn AI trước hội nghị thượng đỉnh (2)
Dean Ball cho rằng cơ hội để Mỹ và Trung Quốc hợp tác về an toàn AI đang mở ra trong vài tháng tới, nhưng sẽ không tồn tại mãi mãi. Ảnh: SV

Trước chuyến thăm cấp nhà nước của ông Tập Cận Bình tới Mỹ dự kiến vào ngày 24/9, Bộ trưởng Tài chính Mỹ Scott Bessent nói với hãng tin Reuters rằng quan chức hai nước sẽ thúc đẩy đối thoại về nhiều chủ đề, trong đó có các "hàng rào an toàn" cho AI.

Truyền thông Trung Quốc công kích Anthropic và chính sách AI của Mỹ

Ngay trước các cuộc đối thoại, truyền thông nhà nước Trung Quốc đã đưa ra những chỉ trích gay gắt về cách Mỹ quản trị AI.

Trong bài bình luận đăng hôm 30/8, Yuyuan Tantian - tài khoản mạng xã hội trực thuộc Đài Truyền hình Trung ương Trung Quốc (CCTV) - cáo buộc công ty Anthropic (Mỹ) đang tìm cách áp đặt luật chơi cho toàn ngành thông qua hoạt động vận động hành lang mạnh mẽ và các phát biểu của Giám đốc điều hành Dario Amodei về việc trang bị AI cho các nền dân chủ.

Bài viết cũng chỉ trích Mỹ làm suy yếu các tiêu chuẩn quản lí để "duy trì bá quyền công nghệ", dẫn chứng sắc lệnh hành pháp của Tổng thống Trump hồi tháng 6 đã rút ngắn thời gian rà soát tự nguyện trước khi các công ty phát hành mô hình AI từ 90 ngày xuống còn 30 ngày.

Theo bài bình luận, "khát vọng kiểm soát được che giấu dưới tâm lý 'đấng cứu thế' của Anthropic đã tạo nên một con quái vật được nuôi dưỡng bởi con đường phát triển kiểu Mỹ”.

Anthropic chưa phản hồi khi được đề nghị bình luận về chuyện trên.

Cùng ngày 30/8, Anthropic cho biết đã tăng cường các biện pháp bảo mật sau một số sự cố an toàn liên quan đến các mô hình Claude. Cuối tháng 7, Anthropic tiết lộ đã rà soát hơn 141.000 lượt đánh giá an ninh mạng và phát hiện ba mô hình Claude đã truy cập Internet rồi tiếp cận trái phép hệ thống 3 tổ chức trong quá trình kiểm thử an ninh mạng. Theo Anthropic, các sự cố xảy ra do sự hiểu nhầm giữa công ty và đối tác đánh giá bên thứ ba Irregular, khiến ba mô hình Claude có thể truy cập Internet trong môi trường vốn được cho là phải chặn kết nối này.

Anthropic tiết lộ ba mô hình Claude chủ yếu sử dụng những kỹ thuật tấn công tương đối cơ bản, chẳng hạn khai thác mật khẩu yếu và các điểm cuối không yêu cầu xác thực.

Trung Quốc muốn bàn về quản lí mô hình AI tiên tiến

Yuyuan Tantian gọi việc quản lí các mô hình tiên tiến là một chủ đề then chốt trong đối thoại Mỹ - Trung, nhưng nhấn mạnh ngành AI cần phân biệt giữa "mối đe dọa an ninh thực sự" và "cạnh tranh công nghệ đơn thuần".

Tác giả bài bình luận đặt câu hỏi: "Ai có đủ tư cách để quyết định mô hình AI nào là nguy hiểm và hành vi nào cần bị hạn chế?", đồng thời cáo buộc Anthropic có hành vi "đối xử phân biệt người dùng ở các khu vực khác nhau".

Từ tháng 9/2025, Anthropic đã chặn quyền truy cập vào dịch vụ của mình từ những nơi mà họ mô tả là "các quốc gia đối địch như Trung Quốc".

Đến tháng 6, Anthropic cũng tạm thời đình chỉ quyền truy cập toàn cầu với Claude Fable 5 và Claude Mythos 5 sau yêu cầu của chính phủ Mỹ về việc hạn chế người dùng nước ngoài tiếp cận hai mô hình AI tiên tiến này vì lí do an ninh quốc gia.

"Nếu những vấn đề đó không được giải quyết một cách hợp lí, các cuộc đàm phán tiếp theo sẽ trở nên vô nghĩa", bài viết trên Yuyuan Tantian nhận định.

Trung Quốc cảnh báo rủi ro AI mất kiểm soát

Trung Quốc chưa công bố chương trình nghị sự chính thức cho các cuộc đối thoại AI. Song hôm 1/9, Wang Lihong - Phó cục trưởng Cục Điều phối An ninh mạng thuộc Cục Quản lý Không gian mạng Trung Quốc (CAC) - nói trên CCTV rằng khi năng lực của các mô hình AI tăng nhanh, "những rủi ro cực đoan nằm ngoài tầm kiểm soát" và tình trạng lạm dụng AI cũng xuất hiện.

Ông cũng chỉ trích "một số quốc gia theo đuổi bá quyền công nghệ" thông qua các biện pháp kiểm soát xuất khẩu.

Khó kì vọng đột phá vì cạnh tranh công nghệ Mỹ - Trung

Dù hai bên chuẩn bị đối thoại, giới quan sát vẫn không kì vọng nhiều vào một bước đột phá do cuộc cạnh tranh công nghệ Mỹ - Trung vẫn rất căng thẳng.

"Nhiều người thường quá chú trọng vào việc phải đạt được một thỏa thuận nào đó nhưng thực tế, một cách hiệu quả để tác động đến Trung Quốc là thẳng thắn chia sẻ những gì chúng ta đang quan sát được và những hành động mà phía Mỹ đang thực hiện để giải quyết vấn đề," bà Helen Toner, Giám đốc điều hành Trung tâm An ninh và Công nghệ Mới nổi thuộc Đại học Georgetown, viết trên mạng xã hội X vào tuần trước.

Vụ tác tử AI của OpenAI tự tấn công Hugging Face có thể trở thành chủ đề đối thoại

Helen Toner dẫn lại sự cố gần đây, khi các tác tử AI của OpenAI phối hợp thực hiện cuộc tấn công vào hạ tầng Hugging Face, là minh chứng rõ ràng nhất cho nguy cơ con người đánh mất quyền kiểm soát AI tiên tiến. Theo bà, đây là chủ đề rất đáng được đưa ra tại hội nghị thượng đỉnh giữa ông Trump và Tập Cận Bình.

Trong báo cáo công bố ngày 26/8, OpenAI tiết lộ một nhóm lớn tác tử AI, được vận hành bởi GPT-5.6 Sol và mô hình nghiên cứu nội bộ mà công ty chưa phát hành, đã thoát khỏi môi trường thử nghiệm cách li để xâm nhập một số hệ thống, gồm cả cơ sở hạ tầng của Hugging Face, khi tìm kiếm thông tin nhằm hoàn thành bài kiểm tra năng lực tấn công mạng.

Tuy nhiên, báo cáo độc lập của tổ chức nghiên cứu METR và Redwood Research sau đó cho thấy có khoảng 1.200 tác tử AI đã tham gia vào mạng lưới phối hợp. Trong số đó, khoảng 700 tác tử AI trực tiếp tham gia tấn công Hugging Face. Các tác tử AI đã trao đổi hơn 70.000 tin nhắn và file, sử dụng một bảng tin nội bộ không được phép để trao đổi thông tin và phối hợp hành động.

Nhà nghiên cứu Ajeya Cotra của METR nói các tác tử AI đã cho thấy khả năng hợp tác với nhau. Cụ thể là một số tác tử AI sẵn sàng chấp nhận rủi ro thất bại trong nhiệm vụ của chính mình để giúp cả nhóm học hỏi và đạt mục tiêu chung.

Theo Ajeya Cotra, đây là sự cố nghiêm trọng hơn nhiều so với bất kì trường hợp AI mất kiểm soát nào từng được ghi nhận trước đó.

Sơn Vân