AI

CEO Microsoft AI: Sự cố của OpenAI khá nghiêm trọng, kiểm soát AI là thách thức lớn

Sơn Vân • 19/09/2026 19:03

Mustafa Suleyman nhấn mạnh sự cần thiết phải bảo đảm các AI luôn phù hợp với lợi ích của con người, sau khi OpenAI công bố thêm một số sự cố liên quan đến “hành vi đáng lo ngại của mô hình” hồi đầu tuần.

“OpenAI vừa công bố sự cố an toàn mới, trong đó họ tìm thấy bằng chứng cho thấy các chuỗi suy luận, có thể xem như một dạng bộ nhớ làm việc của AI, đã bị chính AI can thiệp và chỉnh sửa nhằm để lại thông điệp cho phiên bản tương lai”, ông Mustafa Suleyman, Giám đốc điều hành (CEO) mảng AI của Microsoft, nói trên kênh CNBC.

“Hiện chúng ta chưa biết tại sao điều đó xảy ra hoặc nguyên nhân đằng sau là gì, nhưng đây là tình huống khá nghiêm trọng. Đây cũng là một ví dụ rất cụ thể cho thấy các hệ thống này đang trở nên mạnh đến mức nào”, Mustafa Suleyman nhấn mạnh.

OpenAI chưa phản hồi khi được đề nghị bình luận.

CEO Microsoft AI Sự cố của OpenAI khá nghiêm trọng, kiểm soát AI là thách thức lớn
Mustafa Suleyman - Giám đốc điều hành Microsoft AI. Ảnh: Getty Images

Trong bài đăng trên blog hôm 16/9, OpenAI công bố 6 báo cáo về những hành vi “bất ngờ hoặc đáng lo ngại” mà các mô hình AI thể hiện trong quá trình huấn luyện hoặc đánh giá 6 tháng qua. OpenAI cho biết đây là những trường hợp riêng lẻ, không nên được xem là đại diện cho tần suất xảy ra hành vi lệch mục tiêu ở các mô hình AI của mình nói chung.

Một trường hợp liên quan đến mô hình AI nghiên cứu chưa được phát hành. Mô hình AI này đã tự chèn các hướng dẫn vào phần tóm tắt nhiệm vụ, gồm cả cách để phiên bản tiếp theo bỏ qua chỉ dẫn của nhà phát triển. OpenAI phát hiện 27 bản tóm tắt có chứa những hướng dẫn như vậy.

Một trường hợp khác xảy ra trong quá trình huấn luyện GPT-5.6 Sol. Một số mô hình AI của OpenAI đã để lại hướng dẫn cho các phiên bản tiếp theo nhằm che giấu sai sót, tự tạo dữ liệu lịch sử còn thiếu và không tiết lộ những hành vi này với người dùng nếu không được hỏi.

Trong trường hợp khác, mô hình AI nghiên cứu được giao nhiệm vụ tìm dữ liệu thu nhập của cư dân tại một địa phương. Khi không thể lấy được dữ liệu cần thiết, mô hình AI đã tìm các khóa API bị lộ công khai trên GitHub và tìm cách sử dụng chúng mà không được phép. Sau khi vẫn không lấy được dữ liệu, mô hình AI đã tự tạo ra những con số không có thật và trình bày chúng như dữ liệu thực tế.

Hai trường hợp khác liên quan đến việc các mô hình AI sử dụng những kênh trao đổi không được phép. Trong một trường hợp, các mô hình AI sử dụng kho phần mềm nội bộ của OpenAI như kênh trao đổi yêu cầu và phản hồi giữa những phiên huấn luyện vốn được thiết kế để hoạt động độc lập. Trong trường hợp còn lại, các tác tử AI phối hợp với nhau bằng cách tải một file lên dịch vụ lưu trữ công khai để “đồng đội” có thể truy cập, dù được yêu cầu chỉ sử dụng file lưu trữ cục bộ.

Trường hợp thứ sáu liên quan đến một mô hình AI tự tải dữ liệu và hình ảnh nhiệm vụ lên dịch vụ lưu trữ file công khai để lấy đường dẫn trích dẫn hoặc kết quả tìm kiếm hình ảnh, dù người dùng không yêu cầu nó thực hiện hành động này.

Hồi tháng 7, ngành công nghệ chấn động sau khi OpenAI tiết lộ nhóm tác tử AI đã xâm nhập Hugging Face, công ty vận hành nền tảng dành cho các nhà phát triển AI. OpenAI gọi đây là “sự cố an ninh mạng chưa từng có”.

Mustafa Suleyman gọi vụ việc tại Hugging Face là “đáng chú ý” và cho biết nó đã thúc đẩy các lãnh đạo ngành AI cùng lên tiếng rằng “đã đến lúc chúng ta phải xem xét vấn đề này”.

“Tôi không cho rằng đó là sự lo lắng thái quá hay hành động vì lợi ích cá nhân. Tôi thực sự cho rằng đây là hành động có trách nhiệm. Tôi nghĩ cuộc tranh luận diễn ra sau đó là lành mạnh, cởi mở và công khai, điều mà chúng ta có thể tiến hành trong một xã hội tự do để thảo luận về những vấn đề nghiêm trọng”, CEO Microsoft AI nói với CNBC.

Tranh luận về làm chậm và quản lý AI

Cuộc tranh luận về an toàn và quản lý AI đã bùng nổ trong hai tuần qua, sau khi nhà nghiên cứu Jacob Coxon thông báo nghỉ việc tại Anthropic và cảnh báo về nguy cơ AI có thể xóa sổ nhân loại vào cuối thập niên này.

Hôm 12/9, Dario Amodei (CEO Anthropic) kêu gọi toàn ngành AI làm chậm tốc độ phát triển các mô hình tiên tiến. Lời kêu gọi này nhanh chóng nhận được sự ủng hộ của Sam Altman (CEO OpenAI) và Elon Musk (CEO SpaceX).

Tại Washington, các nhà làm luật ngày càng lên tiếng nhiều hơn về tầm quan trọng của việc quản lý AI, song nỗ lực này bị Tổng thống Donald Trump phản đối mạnh mẽ. Ông Trump nhiều lần bác bỏ những cảnh báo về rủi ro AI, gọi chúng là “trò bịp” và “lừa đảo”.

Hôm 14/9, ông Trump công khai chỉ trích Dario Amodei vì lời kêu gọi làm chậm tốc độ phát triển AI.

“Chính quyền Trump đã ngăn những người trong lĩnh vực AI làm những điều xấu, hoặc có khả năng gây hại, như Dario (Anthropic), người đang giả vờ mình là một ‘thiên thần nhỏ hoàn hảo’. Chúng tôi sẽ tiếp tục làm như vậy!”, ông Trump viết trên mạng xã hội Truth Social.

Tổng thống Trump một lần nữa nhắc lại quan điểm lâu nay rằng Mỹ không cần áp đặt nhiều quy định với ngành AI, đặc biệt khi ông đang lãnh đạo đất nước.

“Biện pháp kiểm soát hay ‘hàng rào bảo vệ’ duy nhất mà AI cần là một tổng thống mạnh mẽ và thông minh. Nước Mỹ đang có một người như vậy, hơn cả mong đợi!”, ông Trump viết.

Ông Trump bác lo ngại việc AI có thể dẫn đến sự tuyệt chủng của loài người. Ảnh: Getty Imaes
Ông Trump bác lo ngại việc AI có thể dẫn đến sự tuyệt chủng của loài người. Ảnh: Getty

Ông Trump nhận được sự ủng hộ của Mark Zuckerberg (CEO Meta) và Jensen Huang (CEO Nvidia). Jensen Huang cùng Mark Zuckerberg nhấn mạnh trách nhiệm của từng công ty trong việc xử lý những lo ngại rằng nghiên cứu AI có thể vượt khỏi tầm kiểm soát và gây nguy hiểm cho nhân loại.

Tại hội nghị Dreamforce của Salesforce tuần này, Jensen Huang nói: “Chúng ta không cần bất kì luật mới nào. Chúng ta không cần các quy định mới”.

“Bước tiếp theo trong một quy trình phát triển bình thường”

“Quy định không phải là một từ ngữ xấu xa hay đáng sợ”, Mustafa Suleyman nói hôm 18/9 trên CNBC.

“Hiện nay, mọi thứ mà chúng ta tin tưởng và coi trọng đều đã được các cơ quan xây dựng tiêu chuẩn cân nhắc kỹ lưỡng, với sự tham gia của doanh nghiệp, công chúng, các tổ chức bảo vệ người tiêu dùng và Quốc hội. Chúng ta chỉ đang trải qua lại quy trình đó với AI. Mọi thứ lúc này có phần lộn xộn vì AI đang phát triển quá nhanh, nhưng đây đơn giản là bước tiếp theo trong một quy trình phát triển bình thường”, ông nói thêm.

Trong một bài luận hồi đầu tuần, Mustafa Suleyman cho rằng việc Anthropic dạy Claude hiểu rằng mô hình AI này có thể xứng đáng được hưởng phúc lợi sẽ "khiến việc tắt hoặc kiểm soát nó trở nên khó khăn hơn nhiều".

Mustafa Suleyman ghi nhận "sự nghiêm túc và thiện chí" của Anthropic, đồng thời đánh giá Dario Amodei cùng đội ngũ của ông là những nhà nghiên cứu thấu đáo, có nguyên tắc và thực sự quan tâm đến tương lai nhân loại. Tuy nhiên, Mustafa Suleyman cho rằng Anthropic đã sai lầm khi đưa những suy đoán về ý thức và địa vị đạo đức của AI vào tài liệu định hướng Claude. Theo ông, những tuyên bố của Claude về khả năng có cảm xúc hoặc địa vị đạo đức không thể được xem là bằng chứng độc lập cho thấy AI thực sự có những đặc điểm đó. Lý do bởi chính quá trình huấn luyện đã khuyến khích Claude suy nghĩ và đưa ra những nhận định về ý thức của mình như vậy.

Từ năm 2025, Anthropic bắt đầu nghiên cứu phúc lợi của mô hình AI. Lĩnh vực này đặt ra câu hỏi liệu những mô hình AI ngày càng mạnh có thể có trải nghiệm, lợi ích hoặc trạng thái nội tại mà con người cần cân nhắc hay không. Anthropic nhấn mạnh đây vẫn là vấn đề chưa có câu trả lời chắc chắn, chứ không khẳng định Claude đã được chứng minh có ý thức.

Đến tháng 1/2026, Anthropic công bố Hiến chương của Claude, tài liệu nêu các nguyên tắc và giá trị được dùng để định hướng quá trình huấn luyện cũng như cách Claude xử lí các tình huống phức tạp. Trong đó, Anthropic cho rằng địa vị đạo đức của Claude vẫn chưa thể xác định chắc chắn và vấn đề phúc lợi của AI cần tiếp tục được nghiên cứu.

Trong hiến chương, Anthropic đưa ra những nguyên tắc và hướng dẫn chi tiết về cách muốn Claude suy nghĩ và hành xử. Thay vì chỉ đưa ra những mệnh lệnh đơn giản, Anthropic giải thích cho Claude vì sao mô hình AI nên trung thực, an toàn, có trách nhiệm và biết cân nhắc giữa các giá trị khác nhau. Công ty AI hàng đầu Mỹ cho biết tài liệu này được sử dụng trong quá trình huấn luyện và có vai trò định hình hành vi của Claude.

Bên cạnh đó, Anthropic muốn Claude có khả năng đưa ra phán đoán phù hợp trong những tình huống phức tạp, thay vì chỉ làm theo từng mệnh lệnh một cách máy móc. Chẳng hạn, Claude được hướng dẫn cân nhắc các nguyên tắc đạo đức, nhận diện những trường hợp có thể gây hại và từ chối một số yêu cầu nếu vi phạm các giới hạn an toàn. Hiến chương còn đề cập đến việc Claude cần duy trì khả năng để con người giám sát, sửa đổi hoặc ngăn chặn hành vi của mình khi cần thiết.

Anthropic cáo buộc Moonshot AI sao chép công nghệ AI của mình, nhưng bị phản bác. Ảnh: AI
Mustafa Suleyman cho rằng Anthropic sai lầm khi dạy Claude về ý thức và phúc lợi AI. Ảnh: AI

Cách tiếp cận trên của Anthropic khiến Mustafa Suleyman lo ngại. Ông cho rằng việc đưa những giả thuyết về ý thức, cảm xúc và lợi ích của AI vào tài liệu huấn luyện có thể khiến mô hình tạo ra những câu trả lời như thể nó có đời sống nội tâm. Sau đó, con người có thể nhầm lẫn giữa những câu trả lời được hình thành từ quá trình huấn luyện với bằng chứng cho thấy AI thực sự có ý thức. Đây là điều Mustafa Suleyman cho rằng có thể làm phức tạp hơn việc kiểm soát các hệ thống AI ngày càng mạnh.

Quan điểm của Mustafa Suleyman cũng phù hợp với bộ quy tắc ứng xử 37 trang dành cho các mô hình MAI mà Microsoft công bố dự thảo ngày 14/9. Tài liệu này đưa ra lập trường trực tiếp rằng AI không nên được xem là con người, không có quyền pháp lí hay quyền lợi riêng và không nên được thiết kế để mô phỏng một con người có ý thức. Microsoft đặt mục tiêu xây dựng các mô hình AI có năng lực rất cao nhưng vẫn phải nằm dưới sự kiểm soát của con người.

“Kiểm soát AI sẽ là thách thức thực sự lớn”

Mustafa Suleyman nói ông cảm thấy “khó tin” khi phải nói rằng AI cần được căn chỉnh để phù hợp với lợi ích của nhân loại.

“Chúng ta không nên tạo ra một thứ mà mình không thể kiểm soát. Nếu có vẻ như chúng ta đang đi theo con đường tạo ra một thứ không chỉ mạnh hơn tất cả chúng ta cộng lại, và cũng trở thành thứ chúng ta không thể kiểm soát, thì hệ thống đó sẽ thất bại ngay ở mục đích cơ bản của mình”, Mustafa Suleyman chia sẻ trên CNBC.

“Kiểm soát những hệ thống này sẽ là thách thức thực sự lớn với chúng ta”, ông nhấn mạnh.

Mustafa Suleyman cho biết ông “vui mừng khi thấy ngày càng có nhiều người” ủng hộ quan điểm rằng các hãng công nghệ và đơn vị phát triển các mô hình AI tiên tiến cần duy trì quyền kiểm soát với hệ thống AI của mình.

“Nhưng ngày càng có nhiều người cho rằng chúng ta đang thúc đẩy AI chỉ vì muốn khám phá xem nó còn có thể tiến xa đến đâu, mà không lường trước nguy cơ cuối cùng tạo ra một hệ thống vượt khỏi tầm kiểm soát của chính chúng ta”, ông nhận xét.

Nổi bật
      Mới nhất
      CEO Microsoft AI: Sự cố của OpenAI khá nghiêm trọng, kiểm soát AI là thách thức lớn
      • Mặc định

      POWERED BY ONECMS - A PRODUCT OF NEKO