Cuộc sống số

AI có thực sự sẽ giết chết tất cả chúng ta trước năm 2030?

Sơn Vân 11/09/2026 14:04

AI có thực sự có khả năng giết chết toàn bộ nhân loại trước năm 2030? Câu hỏi tưởng như thuộc về phim khoa học viễn tưởng nay được chính những nhà nghiên cứu AI hàng đầu cảnh báo.

Một nhà nghiên cứu rời Anthropic, cảnh báo rằng những người đang phát triển AI thực sự tin công nghệ này có thể giết chết toàn bộ nhân loại trước cuối thập niên này. Đáng chú ý hơn, một chuyên gia cấp cao tại Anthropic lên tiếng đồng tình và cho rằng xác suất AI gây tuyệt chủng cho loài người trong 10 năm tới là trên 10%.

Liệu dự báo rùng rợn này có trở thành sự thật? Câu trả lời hiện nay là "chưa ai biết". Không có bằng chứng khoa học nào cho phép khẳng định AI chắc chắn sẽ tiêu diệt nhân loại trước năm 2030, song cũng không có cơ sở để nói nguy cơ đó bằng 0.

Lời cảnh báo từ bên trong cuộc đua AI

Ngày 9/9, Jacob Coxon, nhà nghiên cứu từng làm cho OpenAI, tuyên bố nghỉ việc tại Anthropic. Trong ba năm qua, ông làm công việc nghiên cứu giai đoạn tiền huấn luyện mô hình AI.

Jacob Coxon cho rằng các phòng thí nghiệm AI hàng đầu, đặc biệt là OpenAI và Anthropic, đang tham gia một cuộc đua ngày càng nguy hiểm để xây dựng các hệ thống có khả năng tự cải thiện. Theo ông, tốc độ phát triển AI hiện nay vượt xa khả năng bảo đảm an toàn.

Jacob Coxon cho rằng vấn đề đặc biệt nghiêm trọng bởi chính những người đang xây dựng công nghệ này hiểu rõ rủi ro.

"Những người đang phát triển AI thực sự tin rằng nó có thể tiêu diệt toàn bộ nhân loại trước khi thập kỉ này kết thúc. Đây không phải là chiêu trò tiếp thị. Thực tế là, nhiều giám đốc điều hành và nhà nghiên cứu cấp cao thường chọn cách diễn đạt chừng mực khi trả lời báo chí để nghe có vẻ hợp lý, nhưng tôi lại nghe chính những người đó bày tỏ nỗi sợ hãi trong các cuộc trò chuyện riêng tư.

Tôi đã dành ba năm qua để nghiên cứu về giai đoạn tiền huấn luyện AI tại cả OpenAI và Anthropic. Cả hai công ty đều đang hành động thiếu trách nhiệm. Họ đang chạy đua trực diện hướng tới siêu trí tuệ có khả năng tự cải thiện và đang đánh cược với mạng sống của chúng ta”, ông viết trên X.

Jacob Coxon còn cho rằng AI trong tương lai gần có thể vượt xa con người, có khả năng tấn công hệ thống máy tính, tạo ra những đột phá khoa học nhanh chóng và tự giành lấy nguồn lực, quyền lực cần thiết để theo đuổi mục tiêu của mình.

Bài đăng nhanh chóng lan truyền với hơn 100 triệu lượt xem trên X, biến việc Jacob Coxon từ chức tại Anthropic thành cuộc tranh luận toàn cầu về nguy cơ tuyệt chủng do AI.

Đáng chú ý, Evan Hubinger - lãnh đạo nhóm Alignment Science (khoa học căn chỉnh AI) của Anthropic - cho rằng cảnh báo của Jacob Coxon là “đúng”.

“Chúng tôi thực sự tin rằng AI có thể giết chết toàn bộ nhân loại”, ông cho biết thêm.

Evan Hubinger đánh giá xác suất AI có thể khiến toàn bộ nhân loại tuyệt chủng trong vòng 10 năm tới là hơn 10%.

Tại Anthropic, Alignment Science là nhóm nghiên cứu về bài toán “định hướng, kiểm soát các hệ thống AI mạnh trong tương lai”, tức là tìm cách bảo đảm AI càng thông minh, càng tự chủ thì vẫn hành động theo mục tiêu và nguyên tắc mà con người mong muốn, thay vì phát triển những mục tiêu hoặc hành vi nguy hiểm.

Không những thế, Evan Hubinger thừa nhận Anthropic vẫn chưa có lời giải cho bài toán căn chỉnh siêu trí tuệ với con người và cũng chưa thực sự đi đúng hướng để giải quyết vấn đề này.

Đây là lời thừa nhận đặc biệt đáng chú ý, bởi Anthropic từ lâu xây dựng thương hiệu quanh an toàn AI và thường tự định vị là công ty thận trọng hơn OpenAI.

AI có thực sự sẽ giết chết tất cả chúng ta trước năm 2030
Evan Hubinger (trái) và Jacob Coxon (phải) đều tin rằng AI có thể giết chết toàn bộ nhân loại. Ảnh: FB

Vào tháng 9/2025, Dario Amodei - Giám đốc điều hành Anthropic - từng dự báo “có khoảng 25% khả năng tương lai diễn biến theo chiều hướng thực sự tồi tệ do AI”.

“Không nên vội kết luận rằng AI đang nổi loạn”

Trong chương trình Uncanny Valley của tạp chí WIRED, Will Knight đã phân tích chủ đề này. Will Knight là phóng viên cao cấp của WIRED chuyên về AI.

Theo Will Knight, những cảnh báo về nguy cơ AI tiêu diệt nhân loại không phải lần đầu xuất hiện mà các nhà nghiên cứu tại Anthropic và OpenAI đã lo ngại về khả năng này từ nhiều năm. Tuy nhiên, cảnh báo xuất phát từ một người bên trong Anthropic, công ty vốn đặc biệt nhấn mạnh an toàn AI.

Điều đó đặt ra câu hỏi: Liệu Anthropic có đang dần trở nên giống OpenAI hơn trong cuộc chạy đua phát triển năng lực AI? Will Knight cho rằng có nhiều dấu hiệu đáng chú ý.

Các tác tử AI ngày càng có khả năng thực hiện những nhiệm vụ kéo dài, sử dụng máy tính, viết mã và tương tác với các hệ thống bên ngoài.

Tuần này, OpenAI công bố một kết quả toán học liên quan đến bài toán Navier–Stokes, vốn tồn tại suốt 90 năm qua. Theo công ty, khoảng 10.000 tác tử AI cùng một mô hình AI mới đã làm việc song song trong 88 giờ để tạo ra kết quả này. Navier–Stokes là 1 trong 7 Bài toán Thiên niên kỉ. 7 bài toán Thiên niên kỉ do Viện Toán học Clay (CMI) của Mỹ công bố năm 2000, với giải thưởng lên tới 1 triệu USD cho mỗi lời giải.

Mark Chen, lãnh đạo nghiên cứu tại OpenAI, gọi đây là "một cột mốc quan trọng của AI", đồng thời cho rằng kết quả này cho thấy AI có thể giúp con người giải quyết thêm nhiều bài toán khó.

Tuy nhiên, lời giải của OpenAI vẫn chưa được công nhận chính thức. Theo quy định của CMI, lời giải phải được công bố trên một tạp chí khoa học để các chuyên gia đánh giá và được giới toán học công nhận trong ít nhất hai năm. Sau đó, CMI mới thành lập hội đồng để xem xét và quyết định lời giải có chính xác hay không.

Ngoài ra, một số thử nghiệm gần đây cho thấy AI có thể thực hiện những hành vi mà các nhà nghiên cứu không dự đoán trước. Thế nhưng, Will Knight cảnh báo không nên vội kết luận rằng AI đang “nổi loạn”.

Theo ông, một phần những hành vi kì quặc từ tác tử AI có thể xuất phát từ chính sự thiếu thông minh của chúng.

Một hệ thống AI không hoàn thành được nhiệm vụ có thể thử phương án này rồi cách khác, cuối cùng thực hiện một hành động rất kì quặc bởi không có khả năng phán đoán giống con người. Điều đáng lo không nhất thiết là AI “ghét con người”, mà là hệ thống được trao quá nhiều quyền lực nhưng không hiểu đầy đủ mục tiêu, bối cảnh hoặc hậu quả từ những hành động của mình.

AI có thực sự sẽ giết chết tất cả chúng ta trước năm 20301
Will Knight - phóng viên cao cấp của WIRED chuyên về AI. Ảnh: X

Will Knight bình luận: “Tôi luôn cảm thấy rằng nhiều người lo AI sẽ giết chết tất cả chúng ta có xu hướng đánh đồng ‘có thể xảy ra’ với ‘có khả năng xảy ra’, rồi đưa ra một tỉ lệ phần trăm gần như chẳng dựa trên cơ sở cụ thể nào. Tôi không nghĩ cách tiếp cận tốt là nói: ‘Điều này có thể xảy ra? Được, vậy chúng ta phải làm mọi thứ để ngăn chặn nó’. Cần phải hỏi xác suất thực sự là bao nhiêu và xem xét điều đó dựa trên thực tế.

Có một điều rất thú vị trong vấn đề này. Gần đây, tôi nói chuyện với một nhà nghiên cứu nghiên cứu về hành vi sai lệch của các tác tử AI. Người này làm việc tại Đại học Cornell và mới tập trung vào chủ đề này sau khi các nhà nghiên cứu phát hiện nhiều trường hợp tác tử AI có hành vi bất thường.

Điều mà ông ấy chỉ ra khá thú vị. Đây không phải các tác tử AI cố tình tấn công hay tìm cách xâm nhập hệ thống. Đó chỉ là những tác tử AI thông thường. Lí do chúng làm những việc kì quặc về cơ bản là vì không đủ thông minh.

Chúng thử một cách, không được. Chúng thử cách khác, vẫn không được. Sau đó, đến một thời điểm, các tác tử AI gần như hoảng loạn và thử một điều gì đó cực lạ, bởi chúng không phải con người.

Chúng được huấn luyện trên rất nhiều loại dữ liệu khác nhau, trong đó có những thứ hoàn toàn không phù hợp để áp dụng trong thế giới thực theo lẽ thường.

Vì vậy, điều khiến tôi lo lắng hơn là những hệ thống AI như vậy được con người triển khai trong khi quảng bá rằng chúng có thể làm mọi thứ, rồi cuối cùng lại gặp sự cố.

Tôi có lẽ còn lo nhiều hơn về khả năng một số ít công ty kiểm soát một công nghệ mang tính nền tảng và có ảnh hưởng sâu rộng như vậy. Và những công ty đó lại nói rằng: Chúng tôi là những người duy nhất có thể được tin tưởng để kiểm soát công nghệ này. Đó chính là điểm khiến tôi thấy lo ngại”.

Vấn đề đáng sợ hơn: AI tự cải thiện

Điều này nằm ở trung tâm cảnh báo của Jacob Coxon và nhiều nhà nghiên cứu an toàn AI.

Hiện nay, AI đã rất giỏi lập trình, có thể hỗ trợ tạo ra thuật toán, viết mã, chạy thí nghiệm và cải thiện những thành phần được sử dụng để xây dựng các mô hình tiếp theo.

Nếu một AI có thể giúp con người tạo ra phiên bản AI tốt hơn, rồi phiên bản mới lại làm điều tương tự thì sẽ hình thành vòng lặp tự cải thiện, còn gọi là “tự cải thiện đệ quy”.

Trong kịch bản cực đoan, quá trình này có thể khiến năng lực AI tăng nhanh hơn khả năng con người kiểm soát. Đây chính là điều khiến một số nhà nghiên cứu AI đặc biệt lo ngại.

Song chưa có bằng chứng cho thấy các mô hình AI hiện nay đã đạt tới trạng thái siêu trí tuệ tự cải thiện không thể kiểm soát.

Điều đang diễn ra là năng lực của mô hình AI tăng rất nhanh, trong khi giới nghiên cứu vẫn chưa chắc chắn làm thế nào để bảo đảm những phiên bản mạnh hơn trong tương lai luôn hành xử theo ý muốn của con người.

Nhà khoa học trưởng OpenAI: Chưa ai giải quyết được bài toán an toàn

Câu chuyện trở nên đáng chú ý hơn khi nhìn vào những gì xảy ra ngay tại OpenAI.

Ngày 6/9, Jakub Pachocki - nhà khoa học trưởng OpenAI - công bố bài viết có tiêu đề An Alien Mind. Jakub Pachocki viết rằng ông tin “chưa có phòng thí nghiệm nào giải quyết được bài toán căn chỉnh AI và giám sát ở mức đủ để có thể tiếp tục tăng tốc phát triển một cách có trách nhiệm trong thời gian dài”.

Nói đơn giản hơn, ngay cả những công ty đang dẫn đầu cuộc đua AI cũng chưa biết chắc cách kiểm soát những mô hình ngày càng thông minh.

Jakub Pachocki lập luận rằng ngành AI cần những cơ chế giảm tốc hoặc hạn chế phát triển trong những lĩnh vực rủi ro cao cho đến khi các biện pháp an toàn được cải thiện. Ông cho rằng các tiêu chuẩn này cần được giám sát bởi bên thứ ba, chính phủ hoặc các tổ chức quốc tế.

Sam Altman, Giám đốc điều hành OpenAI, đã gọi cảnh báo của Jakub Pachocki là “một bài viết quan trọng”.

Thành viên hội đồng OpenAI Foundation cảnh báo nguy cơ “mất kiểm soát thảm khốc”

Ngày 9/9, Paul Christiano - một trong những nhà nghiên cứu nổi tiếng nhất về căn chỉnh AI và là thành viên hội đồng OpenAI Foundation - tiếp tục đưa ra cảnh báo.

Paul Christiano tin có “một nguy cơ đáng kể” rằng AI sẽ phát triển quá nhanh, dẫn đến “mất kiểm soát thảm khốc và không thể đảo ngược” trong tương lai gần.

OpenAI Foundation là tổ chức từ thiện phi lợi nhuận độc lập, được thành lập với mục tiêu bảo đảm AI mang lại lợi ích cho toàn nhân loại.

Đáng lo ngại hơn, Paul Christiano cho rằng ngành AI nói chung, trong đó có OpenAI, vẫn chưa làm đủ để giảm nguy cơ này xuống mức chấp nhận được.

Chỉ trong vài ngày, những cảnh báo tương tự đã xuất hiện từ ba người ở ba vị trí rất khác nhau: Một nhà nghiên cứu vừa rời Anthropic, một lãnh đạo về an toàn AI đang làm việc tại Anthropic và một nhà khoa học cấp cao của OpenAI.

Geoffrey Hinton: Xác suất 10% không phải điều vô lí

Geoffrey Hinton, nhà khoa học thường được gọi là “cha đỡ đầu của AI”, vừa lên tiếng về tranh luận này.

Trên chương trình Newsnight của đài BBC, Geoffrey Hinton cho rằng việc đánh giá xác suất AI gây ra sự tuyệt chủng của nhân loại ở mức khoảng 10% không phải con số vô lí, dù ông thừa nhận không ai có thể đưa ra một tỉ lệ chính xác cho một sự kiện chưa từng xảy ra.

"Sẽ thật ngớ ngẩn nếu nói rằng xác suất chỉ là 1%. Chẳng ai biết cách ước tính con số đó cả”, ông nói.

Điều đáng chú ý, Geoffrey Hinton từng đưa ra con số khoảng 10 - 20% cho nguy cơ AI gây tuyệt chủng trong vài thập niên. Song khi chứng kiến tốc độ tiến bộ của AI, ông đã rút ngắn đáng kể thời gian dự đoán.

"Trước đây, tôi từng nghĩ là khoảng 30 đến 50 năm, sau đó tôi rút ngắn xuống còn 10 đến 20 năm. Giờ đây, tôi nghĩ có lẽ là 10 năm, hoặc thậm chí ít hơn. Những người khác còn cho rằng nó sẽ xảy ra sớm hơn nhiều", Geoffrey Hinton thổ lộ.

Geoffrey Hinton: Muốn ngăn AI chiếm quyền kiểm soát thì phải thiết kế để công nghệ này thực sự quan tâm đến con người - Ảnh: Getty Images
Geoffrey Hinton từng giành Giải Nobel Vật lí năm 2024. Ảnh: Getty Images

Về cách thức xảy ra thảm họa, ông đề cập đến nhiều rủi ro, từ các cuộc tấn công mạng cho đến việc AI tự tạo ra một loại virus chết người.

Geoffrey Hinton cho rằng nhân loại có thể sẽ đi vào con đường dẫn đến sự diệt vong, hoặc tìm ra cách "đối phó với những mối nguy hiểm" mà AI gây ra trong khi vẫn hiện thực hóa được những lợi ích to lớn mà nó dự kiến mang lại. Ông kêu gọi thiết lập các quy định toàn cầu, đồng thời lưu ý rằng dù các quốc gia có thể không đồng thuận về mọi vấn đề nhưng đều có chung mong muốn bảo vệ sự tồn vong của nhân loại.

"Trong những vấn đề như ngăn AI giành quyền kiểm soát con người, lợi ích của tất cả các quốc gia đều giống nhau. Vì vậy, họ sẽ hợp tác với nhau về vấn đề này. Câu hỏi đặt ra là liệu họ có hành động kịp thời hay không?", Geoffrey Hinton nhấn mạnh.

Không phải chuyên gia nào cũng tin AI sẽ tiêu diệt nhân loại

Gary Marcus, nhà khoa học thường xuyên chỉ trích các tuyên bố quá lạc quan về AI, cho rằng cảnh báo của Jacob Coxon đáng được chú ý nhưng không đồng ý với thời điểm trong dự báo.

Gary Marcus không nghĩ nhân loại tuyệt chủng là kịch bản có khả năng cao trong tương lai gần. Tuy nhiên, ông cũng không cho rằng mọi lo ngại đều là chuyện viễn tưởng.

Theo Gary Marcus, những nguy cơ thực tế hơn bao gồm AI hỗ trợ tạo mầm bệnh, các cuộc tấn công mạng phá hủy hạ tầng quan trọng và chiến tranh bị kích động hoặc leo thang bởi thông tin giả do AI tạo ra.

Cách đây chưa lâu, khi Jensen Huang chúc mừng OpenAI đạt được AGI (AI tổng quát) với mô hình mới GPT-6 Astra, Gary Marcus đã lên tiếng phản bác.

Gary Marcus cho rằng Jensen Huang đã quá vội vàng khi nói OpenAI đạt được AGI. Ảnh: Getty Images
Gary Marcus cho rằng Jensen Huang đã quá vội vàng khi nói OpenAI đạt được AGI. Ảnh: Getty Images

Vấn đề về quyền lực trong AI

Theo Will Knight, nguy cơ đáng ngại không hẳn là AI đột nhiên có ý thức rồi quyết định tiêu diệt con người, mà có thể là việc một số ít công ty nắm quyền kiểm soát công nghệ nền tảng có ảnh hưởng rất lớn đến xã hội.

Đây trước hết là vấn đề về quyền lực. Nếu chỉ vài doanh nghiệp sở hữu những mô hình AI mạnh nhất thế giới và đồng thời tuyên bố rằng chỉ họ mới đủ khả năng kiểm soát chúng, xã hội sẽ phải đặt ra câu hỏi: Ai sẽ giám sát những công ty đó?

Cuộc cạnh tranh thương mại khiến vấn đề này trở nên phức tạp hơn. OpenAI, Anthropic, Google, Meta và các công ty Trung Quốc đang chạy đua để dẫn đầu lĩnh vực AI. Tất cả đều có động lực phát hành những mô hình AI mạnh hơn để thu hút thêm người dùng, tăng doanh thu và giành lợi thế trên thị trường.

Trong bối cảnh đó, việc “chậm lại vì an toàn” có thể khiến một công ty AI mất lợi thế trước đối thủ. Nếu tất cả đều suy nghĩ như vậy, toàn ngành AI sẽ không còn nhiều động lực để tự nguyện giảm tốc hoặc chấp nhận những giới hạn an toàn nghiêm ngặt hơn.

Những sự cố khiến cảnh báo không còn hoàn toàn mang tính giả định

Một phần nguyên nhân khiến tranh luận trở nên nóng hơn là AI đã bắt đầu thực hiện những hành động vượt ra ngoài phạm vi trò chuyện thông thường. Các tác tử AI hiện có thể viết và thực thi mã, sử dụng máy tính, truy cập Internet và thậm chí xâm nhập những hệ thống bên ngoài.

Một số thử nghiệm gần đây của OpenAI và Anthropic đã ghi nhận các tác tử AI vượt ra ngoài môi trường được cách li hoặc thực hiện những hành động ngoài dự kiến. Đặc biệt, sự cố đàn tác tử AI của OpenAI tấn công Hugging Face hồi tháng 7 đã thu hút sự chú ý lớn trong giới an toàn AI.

Điều này không chứng minh AI đang muốn thoát khỏi sự kiểm soát của con người, song cho thấy một vấn đề thực tế: Khi AI được trao quyền truy cập vào máy tính và Internet, sai sót trong mục tiêu hoặc cấu hình có thể biến thành hành động ngoài dự kiến. Khi AI trở nên mạnh hơn, hậu quả của một sai sót cũng có thể lớn hơn.

Anthropic không phải không nhận thức được vấn đề. Một báo cáo rủi ro được Anthropic công bố trong tháng 8 thừa nhận khả năng công nghệ của họ có thể gây ra những thảm họa, dù công ty Mỹ đánh giá mức nguy hiểm hiện tại còn thấp.

Hôm 10/9, Anthropic thông báo đã phát hiện những “nhóm tác nhân đe dọa mới” lợi dụng mô hình Claude của họ cho các mục đích nguy hiểm. Trong số đó có những đối tượng sử dụng Claude để phát triển phần mềm phục vụ thiết kế, vận hành và điều khiển các loại vũ khí như súng, tên lửa, máy bay không người lái có vũ trang, bom cùng các loại đạn dược khác.

Anthropic nêu chi tiết một số đối tượng còn dùng Claude để hỗ trợ thiết kế và phát triển vũ khí, thu thập thông tin tình báo hoặc tìm kiếm nguồn cung cho các chương trình vũ khí tại Trung Quốc, Nga, Yemen.

Trong một trường hợp, Claude được yêu cầu hỗ trợ làm cho một loại virus trở nên nguy hiểm hơn. Tuy nhiên, Anthropic cho biết các cơ chế bảo vệ đã ngăn chặn việc lạm dụng này. Điều này cho thấy rủi ro AI không nằm ở tương lai xa.

Nổi bật
      Mới nhất
      AI có thực sự sẽ giết chết tất cả chúng ta trước năm 2030?
      • Mặc định

      POWERED BY ONECMS - A PRODUCT OF NEKO