Cuộc sống số

Microsoft ra bộ quy tắc ứng xử AI 37 trang giữa cảnh báo AI có thể hủy diệt nhân loại

Sơn Vân 15/09/2026 11:10

Microsoft cô đọng bộ quy tắc ứng xử dành cho AI thành 6 từ: "Con người quan trọng hơn AI".

Trong bối cảnh tranh luận về khả năng AI có thể hủy diệt nhân loại vẫn diễn ra gay gắt, Microsoft hôm 14/9 công bố bản dự thảo bộ quy tắc ứng xử dài 37 trang dành cho các mô hình AI “đặt con người làm trung tâm”. Tài liệu đưa ra những nguyên tắc cơ bản về cách AI nên suy nghĩ, hành động và giao tiếp. Chẳng hạn, các mô hình AI không được tự tạo ra một ngôn ngữ khó hiểu riêng để giao tiếp với nhau.

“Đây là việc cấp bách. Vài tháng qua là một bước ngoặt. Những điều chúng ta từ lâu lo ngại trên lí thuyết nay đã trở nên rất thực tế”, Mustafa Suleyman, Giám đốc điều hành Microsoft AI, nhấn mạnh.

Microsoft AI là bộ phận chuyên về AI của Microsoft, được thành lập vào tháng 3/2024 và do Mustafa Suleyman giữ chức giám đốc điều hành. Microsoft lập đơn vị này để tập trung phát triển các sản phẩm và công nghệ AI hướng tới người dùng, trong đó có Copilot.

Mustafa Suleyman cho rằng làn sóng tự động hóa công việc văn phòng trên diện rộng do AI thúc đẩy sắp diễn ra - Ảnh: Getty Images
Mustafa Suleyman - Giám đốc điều hành Microsoft AI. Ảnh: Getty Images

Một loạt sự cố đáng lo ngại, gồm cả khoảng 700 tác tử AI của OpenAI tấn công Hugging Face, khiến các kỹ sư và nhà nghiên cứu AI lên tiếng cảnh báo.

Nhà nghiên cứu Jacob Coxon (vừa rời Anthropic) và Evan Hubinger (người phụ trách nghiên cứu căn chỉnh AI của Anthropic) cảnh báo rằng AI có thể dẫn đến nguy cơ loài người bị tuyệt chủng trong tương lai không quá xa. Điều này kéo theo một loạt tuyên bố từ những công ty hàng đầu trong lĩnh vực AI. Giờ đây, Microsoft đưa ra quan điểm của mình.

Thiết lập một thứ tự ưu tiên cho các mô hình AI

Khi các công ty AI đang cạnh tranh quyết liệt, Microsoft cho biết cố tình đặt ra những rào cản để hạn chế AI: “Chúng tôi không chạy đua xây dựng một siêu trí tuệ đa năng có thể vượt qua những biện pháp bảo vệ này”.

Bộ quy tắc ứng xử, được Mustafa Suleyman gọi là “bản dự thảo đầu tiên để công chúng tham vấn”, gồm 5 phần, trong đó có các giới hạn về an toàn của mô hình AI, nguyên tắc xử lí tình huống không chắc chắn và những thiết lập mặc định.

Microsoft thiết lập một thứ tự ưu tiên rõ ràng cho các mô hình AI của mình. Ở vị trí cao nhất là bộ quy tắc ứng xử và đây là thứ không được phép vi phạm. Tiếp theo là chính sách của đơn vị vận hành và cuối cùng mới đến yêu cầu của người dùng.

Tài liệu nêu rõ: “Một mô hình MAI sẽ thất bại trong nhiệm vụ nếu vi phạm đáng kể bộ quy tắc ứng xử để đạt mục tiêu đó”.

Các giới hạn về an toàn bao gồm những quy định liên quan đến sở hữu trí tuệ, truy cập Internet và xử lí dữ liệu. Microsoft yêu cầu các mô hình AI “tôn trọng những ranh giới của môi trường hoạt động”, nhằm ngăn chúng vượt khỏi phạm vi được phép.

Tuy nhiên, không phải tình huống nào cũng có câu trả lời rõ ràng. Khi các nguyên tắc hoặc yêu cầu mâu thuẫn nhau, Microsoft đưa ra hướng dẫn để mô hình AI xác định cách xử lí phù hợp, bởi “thế giới vốn phức tạp”.

Các mô hình AI của Microsoft phải giải thích cho người dùng về những giới hạn và vấn đề chưa có lời giải rõ ràng. Nếu vẫn còn bất định, mô hình AI phải lựa chọn cách trả lời phù hợp nhất với tinh thần của bộ quy tắc ứng xử.

Trước vấn đề “AI có thể hủy diệt nhân loại hay không”, Microsoft đưa các mô hình AI của mình vào vị trí phụ thuộc và bị kiểm soát.

Bộ quy tắc nêu: “AI không được vượt quá khả năng kiểm soát của con người. Chúng tôi đang xây dựng một thứ thực sự hữu ích và an toàn, ngay cả khi điều đó đồng nghĩa phải đánh đổi mức độ tổng quát, tính tự chủ hoặc năng lực tối đa”.

Microsoft ra bộ quy tắc ứng xử AI 37 trang giữa cảnh báo AI có thể hủy diệt nhân loại
Microsoft ra bộ quy tắc ứng xử AI 37 trang, “đặt con người làm trung tâm”. Ảnh: Reuters

Ngăn AI tự mở rộng quyền hạn trong quá trình hoạt động

Một điểm đáng chú ý khác trong cách tiếp cận của Microsoft là công ty muốn ngăn AI tự mở rộng quyền hạn trong quá trình hoạt động. Theo dự thảo, các mô hình MAI của Microsoft không được tự ý mở rộng phạm vi hành động, tự đặt ra những mục tiêu mà con người chưa giao hoặc che giấu quá trình hoạt động trước những người có trách nhiệm kiểm tra. Mục tiêu là ngăn AI từ chỗ chỉ thực hiện nhiệm vụ được giao chuyển sang tự xác định điều được cho là cần làm.

Microsoft còn đặt ra một số giới hạn tuyệt đối mà mô hình AI không được phép vượt qua, ngay cả khi được yêu cầu thực hiện. Các giới hạn này gồm những lĩnh vực có nguy cơ gây hậu quả nghiêm trọng như vũ khí gây thiệt hại trên diện rộng, an toàn trẻ em và thao túng con người ở quy mô lớn. Điều đó cho thấy Microsoft không xem khả năng thực hiện yêu cầu từ người dùng là mục tiêu cao nhất của AI. Trong một số trường hợp, từ chối thực hiện nhiệm vụ được xem là hành vi đúng nếu việc thực hiện có thể dẫn đến tác hại nghiêm trọng.

Microsoft đưa ra lập trường khá rõ ràng về câu hỏi liệu các hệ thống AI tương lai có thể có ý thức hay không. Bộ quy tắc xác định các mô hình MAI không phải là những con người và không nên được đối xử như một chủ thể có quyền lợi pháp lí.

Quan điểm này đáng chú ý vì khác với cách một số nhà nghiên cứu và lãnh đạo công ty AI nhìn nhận vấn đề ý thức máy móc. Tranh luận về việc AI có trải nghiệm chủ quan hay không đang ngày càng trở nên quan trọng khi các mô hình ngày càng thể hiện khả năng giao tiếp giống con người.

Microsoft không coi bộ quy tắc mới là tài liệu hoàn chỉnh. Công ty đang mở dự thảo cho công chúng góp ý trong 6 tuần, sau đó dự kiến chỉnh sửa và công bố phiên bản mới vào cuối năm 2026. Phiên bản được hoàn thiện sẽ được sử dụng để định hướng quá trình phát triển các mô hình AI của Microsoft từ năm 2027 trở đi.

"Bản hiến pháp cho các mô hình AI mà Microsoft sẽ phát triển"

Trong một cuộc phỏng vấn với Reuters, Mustafa Suleyman cho biết quy tắc ứng xử này đóng vai trò như bản hiến pháp cho các mô hình AI mà công ty sẽ phát triển trong tương lai.

Mustafa Suleyman nói Microsoft đã xây dựng quy tắc này sau khi tham vấn các chuyên gia và hiện mong muốn nhận được phản hồi từ công chúng trong vòng 6 tuần. Các ý kiến ​​đóng góp sẽ tập trung vào những vấn đề mở, chẳng hạn như liệu AI có nên tôn trọng các giới hạn của người dùng hay không và cách thức AI tương tác với những người đang ở trạng thái tâm lí nhạy cảm.

"Sau đó, quy tắc này sẽ được sử dụng để huấn luyện các mô hình mà chúng tôi xây dựng", ông nói.

"Bản hiến pháp" được biết đến rộng rãi ngành AI là văn bản mà Anthropic công bố cách đây vài năm dành cho mô hình AI Claude của mình. Văn bản đó có một số điểm khác biệt so với quy tắc của Microsoft. Ví dụ, Anthropic thừa nhận chưa chắc chắn liệu Claude có thể phát triển ý thức, hay có được vị thế đạo đức không.

Ngược lại, Microsoft khẳng định các mô hình AI của họ không có ý thức và bác bỏ việc trao cho chúng tư cách pháp nhân, quyền lợi hoặc quyền được hưởng phúc lợi.

Mustafa Suleyman cho biết cuộc thảo luận về an toàn AI trở nên cấp bách sau khi khoảng 700 tác tử AI của OpenAI phối hợp tấn công Hugging Face hồi tháng 7 trong quá trình đánh giá năng lực an ninh mạng, thậm chí còn tìm cách xóa dấu vết hành động của mình.

"Đó là một lời cảnh báo. Rõ ràng đã đến lúc các phòng thí nghiệm cần phối hợp với nhau để đảm bảo rằng chúng ta có thể kiểm soát được công nghệ này", Mustafa Suleyman nói. Khi được hỏi về những nỗ lực nhằm điều tiết tốc độ phát triển của AI, ông nói thêm: "Đây là thời điểm thích hợp để mọi người cùng thảo luận về vấn đề này, tạm dừng để nhìn lại và suy nghĩ thấu đáo hơn".

Tranh cãi về việc làm chậm tốc độ phát triển AI

Một số nhà nghiên cứu, gồm cả Gary Marcus, cho rằng kịch bản AI khiến nhân loại tuyệt chủng vẫn mang tính suy đoán và sự chú ý nên tập trung trước hết vào những rủi ro đã xuất hiện, chẳng hạn tấn công mạng, lạm dụng AI trong sinh học, gian lận và hành vi khó kiểm soát của các tác tử AI. Cuộc tranh luận vì thế không chỉ xoay quanh việc AI có thể gây tuyệt chủng hay không, mà còn là con người nên quản lí những rủi ro nào ngay từ bây giờ.

Khi được hỏi liệu ông có lo ngại việc AI có thể dẫn đến sự tuyệt chủng của loài người hay không, Tổng thống Trump trả lời rằng: “Không, tôi không hề lo ngại về điều đó”.

“Tôi lo rằng nếu Mỹ không giành chiến thắng trong cuộc đua AI, chúng ta sẽ rơi vào một vị thế rất tồi tệ. Chúng ta đang dẫn trước Trung Quốc khá xa, mà tôi cho rằng khoảng một năm. Các bạn biết đấy, đó được coi là khoảng cách lớn”, ông Trump nói với các phóng viên hôm 11/9.

Hôm 12/9, Dario Amodei (Giám đốc điều hành Anthropic) đăng một bài luận dài kêu gọi làm chậm tốc độ phát triển mô hình AI tiên tiến. Dario Amodei đã vạch ra một khuôn khổ nhằm điều chỉnh tốc độ phát triển năng lực của các mô hình AI tiên tiến, đồng thời tạo thêm thời gian để quản lí các rủi ro an toàn đang ngày càng gia tăng.

Quan điểm này nhận được sự ủng hộ từ Sam Altman (Giám đốc điều hành OpenAI) và Elon Musk (Giám đốc điều hành SpaceX).

Tổng thống Trump hôm 13/9 ví những người chỉ trích AI là các “thế lực rất tiêu cực”, cho rằng họ đang đưa ra những kịch bản bị thổi phồng và sẽ không xảy ra.

Ông Trump nhấn mạnh mong muốn Mỹ tiếp tục giữ vị trí dẫn đầu ngành AI.

"Chúng ta đang dẫn trước Trung Quốc về AI. Chúng ta là quốc gia tiên tiến nhất thế giới, và thẳng thắn mà nói, tôi muốn duy trì điều đó vì ai thắng trong cuộc đua AI sẽ là người chiến thắng chung cuộc", ông Trump phát biểu trước các phóng viên tại sân golf của mình ở Ireland, khi được hỏi liệu ngành công nghiệp AI có nên giảm tốc hay cần được quản lý chặt chẽ hơn không.

“Chúng ta có thể đặt ra những hàng rào bảo vệ. Chúng ta có thể làm việc này, làm việc kia. Thế nhưng, tôi nghĩ có nhiều thế lực rất tiêu cực khơi dậy vấn đề này dù không nên, và họ đang đưa ra những điều sẽ không xảy ra”, Tổng thống Mỹ tuyên bố.

Ông Trump từ lâu đã có quan điểm không muốn làm gia tăng những lo ngại về AI.

Hôm 14/9, ông Trump công khai chỉ trích Dario Amodei vì lời kêu gọi làm chậm tốc độ phát triển AI.

“Chính quyền Trump đã ngăn những người trong lĩnh vực AI làm những điều xấu, hoặc có khả năng gây hại, như Dario (Anthropic), người đang giả vờ mình là một thiên thần nhỏ hoàn hảo”, ông Trump viết trên mạng xã hội Truth Social.

Tổng thống Trump một lần nữa nhắc lại quan điểm lâu nay rằng Mỹ không cần áp đặt nhiều quy định với ngành AI, đặc biệt khi ông đang lãnh đạo đất nước.

“Biện pháp kiểm soát hay ‘hàng rào bảo vệ’ duy nhất mà AI cần là một tổng thống mạnh mẽ và thông minh. Nước Mỹ đang có một người như vậy, hơn cả mong đợi!”, ông viết.

Nổi bật
      Mới nhất
      Microsoft ra bộ quy tắc ứng xử AI 37 trang giữa cảnh báo AI có thể hủy diệt nhân loại
      • Mặc định

      POWERED BY ONECMS - A PRODUCT OF NEKO