Mệt mỏi vì mô hình AI khi Anthropic, OpenAI, Meta, Google liên tục tung phiên bản mới
Tuần qua, Anthropic giới thiệu Claude Fable 5.1 và Mythos 5.1. Sau đó, Meta và Google trình làng bản cập nhật mô hình AI. OpenAI cũng nhanh chóng theo sau, khi phát hành GPT-6 Astra.
Chỉ trong một tuần, hàng loạt công ty đã liên tục tung ra các bản cập nhật và nâng cấp mô hình với tốc độ chóng mặt, trong cuộc đua giữ vị trí dẫn đầu về công nghệ AI.
Sam Altman, Giám đốc điều hành OpenAI, nói với kênh CNBC hôm 3/9 rằng “tất cả chúng ta đang chuyển sang chu kì phát hành nhanh hơn”, một phần do mọi người đã “trở lại sau kì nghỉ hè”. Tuy nhiên, với người sử dụng mô hình và dịch vụ AI, tốc độ này đang tạo ra không ít sự phức tạp và hỗn loạn. Các CEO và quản lý CNTT phải dành một lượng thời gian và nguồn lực lớn hơn đáng kể để so sánh chi phí, năng lực của từng mô hình AI nhằm tránh bị bỏ lại phía sau.
“Tình trạng mệt mỏi vì mô hình AI là có thật”
“Tôi cảm thấy tình trạng mệt mỏi vì mô hình AI là có thật. Đừng hiểu lầm tôi, tôi cực kì hào hứng với tất cả những đổi mới đang diễn ra. Thế nhưng, tôi thực sự nghĩ rằng chúng ta đang ở trong một môi trường có quá nhiều sự cạnh tranh và cường điệu đến mức các công ty buộc phải tạo ra tiếng vang để thu hút sự chú ý”, Zhen Lu, Giám đốc điều hành startup AI Runpod, nhận xét.
Ahmed Abbasi, giáo sư tại Trường Kinh doanh Mendoza thuộc Đại học Notre Dame (Mỹ) và là người có 25 năm kinh nghiệm trong lĩnh vực AI, cho rằng các nhà phát triển mô hình “đều đang tranh giành phần ngân sách mà khách hàng dành cho AI”. Họ chạy đua để bắt kịp nhau và liên tục nhắc nhở các nhà phát triển rằng mình đang đổi mới ít nhất cũng nhanh như đối thủ.
Đặc biệt, Anthropic cùng OpenAI đang đẩy nhanh tốc độ khi hướng tới thị trường đại chúng và mỗi công ty hiện đã được các nhà đầu tư tư nhân định giá gần 1.000 tỉ USD. Google và Meta cũng có những chiến lược riêng, trong khi cộng đồng AI nguồn mở ngày càng phát triển với Nvidia ngày càng tham gia sâu vào lĩnh vực này.
Tất cả đang cạnh tranh để giành một phần trong khoản chi tiêu AI mà công ty nghiên cứu Gartner dự báo sẽ lên tới 2.590 tỉ USD trong năm 2026, tăng 47% so với 2025. Theo báo cáo công bố hồi tháng 5 của Gartner, hơn một nửa số tiền này sẽ được đổ vào hạ tầng AI, trong khi hơn 1.000 tỉ USD sẽ dành cho dịch vụ, phần mềm, an ninh mạng, mô hình và các công cụ khác.
Anthropic mở màn cho cuộc đua AI trong tuần qua hôm 1/9 khi phát hành Claude Fable 5.1 và Claude Mythos 5.1, được công ty mô tả là “những mô hình tiên tiến nhất thế giới dành cho lập trình và công việc tri thức”.
Ngày 2/9, Meta công bố Muse Spark 1.3, còn Google giới thiệu Gemini 3.8 Flash. Cả hai gã khổng lồ công nghệ Mỹ đều nhấn mạnh những cải tiến trong lập trình và tác vụ mang tính tác tử AI.
Đến 3/9, OpenAI tung ra GPT-6 Astra, mô hình AI tập trung vào năng lực an ninh mạng và khả năng thao tác máy tính. Công ty đứng sau ChatGPT cho biết đây là kết quả của “nhiều năm nghiên cứu và những khoản đầu tư lớn”.
OpenAI gọi GPT-6 Astra là “mô hình AI thông minh và được căn chỉnh tốt nhất thế giới”, đồng thời xem đây là “bước chuyển lớn trong công việc chuyên môn”. Thậm chí, ông Greg Brockman, Chủ tịch OpenAI, cho rằng GPT-6 Astra có thể đã đạt AI tổng quát (AGI), cột mốc mà ngành AI khao khát.
OpenAI cho biết GPT-6 Astra sẽ cải thiện khả năng sử dụng máy tính của ChatGPT. Nhân viên OpenAI nói với trang Insider hồi tháng 8 rằng công cụ này, có khả năng tự thực hiện tác vụ trên máy tính để bàn hoặc trình duyệt web của người dùng, đang đạt đến một bước ngoặt.
Theo bài viết trên blog của OpenAI, GPT-6 Astra có thể điền biểu mẫu, định dạng tài liệu, đặt lịch hẹn và vận hành phần mềm.
Dù việc tạo ra các tác tử AI có khả năng sử dụng máy tính hiệu quả là mục tiêu lâu dài của OpenAI và các gã khổng lồ công nghệ khác, nhưng công nghệ này rất phức tạp do tính đa dạng trong công việc trên máy tính mỗi người. Đến nay, các công cụ dạng này vẫn hoạt động tương đối chậm.
“Bất cứ việc gì bạn có thể làm trên máy tính, GPT-6 Astra đều có thể làm thay bạn và thực hiện rất nhanh”, OpenAI viết trên mạng xã hội X.
Trước đó, OpenAI cho biết đã trì hoãn việc phát hành GPT-6 Astra đến tháng 9 sau khi phát hiện những cải thiện đáng kể trong năng lực an ninh mạng của mô hình AI này.
OpenAI cho biết đây là mô hình AI đầu tiên của hãng đạt ngưỡng nghiêm trọng (Critical) về năng lực an ninh mạng theo Preparedness Framework (Khung sẵn sàng). Với công cụ và quyền truy cập phù hợp, GPT-6 Astra có thể tìm ra các lỗ hổng bảo mật chưa từng được biết đến và phát triển phương thức khai thác trên nhiều hệ thống được bảo vệ tốt mà không cần con người hướng dẫn từng bước.
Cũng trong ngày 6/9, Đại học Mohamed bin Zayed về AI ở Abu Dhabi (thủ đô UAE) công bố dòng mô hình K2 Horizon của riêng mình cho cộng đồng nguồn mở, qua đó cho thấy hoạt động nghiên cứu và đầu tư AI đang diễn ra trên quy mô toàn cầu.
Không muốn bị bỏ lại phía sau, Nvidia - công ty có giá trị lớn nhất thế giới và là nhà sản xuất chip đứng ở trung tâm của cơn sốt AI - đã đồng ý mua nền tảng AI Hugging Face với giá hơn 12,9 tỉ USD.
Nvidia cũng liên tục phát hành các mô hình AI trọng số mở, trong đó có Nemotron 3.5 Lightning ra mắt tháng trước. Công ty cho biết đây là mô hình AI nhẹ, có thể chạy trên một GPU (bộ xử lí đồ họa) duy nhất trên laptop hoặc desktop (máy tính để bàn).
Tốc độ cập nhật chóng mặt, cộng với sự thiếu rõ ràng trong các quy định về AI, đang làm gia tăng lo ngại về những nguy cơ từ các mô hình AI tiên tiến khi chúng liên tục trở nên mạnh hơn.
Những tuần gần đây, các mô hình AI của OpenAI, Anthropic và Meta đều đã xâm nhập những trang web bên thứ ba mà đáng lẽ chúng không được phép tiếp cận. Trong khi đó, các tác tử AI của OpenAI hồi tháng 7 đã tự tấn công mạng Hugging Face, một sự cố gây chấn động trong toàn ngành.
.jpg)
“Hoàn toàn hỗn loạn”
Sự phát triển quá nhanh của các tác tử AI đặc biệt khiến chuyên gia như Ahmed Abbasi lo ngại, nhất là khi “những năng lực này đang được triển khai dễ dàng đến mức nào”.
“Khi các tác tử AI không chỉ hoạt động trên máy tính mà còn có thể truy cập và thực hiện tác vụ trên web, phạm vi các nguy cơ và lỗ hổng bảo mật sẽ lớn hơn rất nhiều. Nếu không cẩn trọng, mọi thứ có thể trở nên hoàn toàn hỗn loạn”, Ahmed Abbasi nhận xét.
Ông cho rằng “không phải ngẫu nhiên” mà tất cả nhà phát triển mô hình AI lớn đều công bố bản cập nhật trong cùng một tuần. Noah Faro, Giám đốc công nghệ của startup tài chính AI Farsight, cũng đồng tình với nhận định này.
Noah Faro cho biết các công ty có nhiều cách để nắm bắt thông tin về kế hoạch của đối thủ. Một trong số đó là theo dõi mức độ sẵn có của tài nguyên điện toán trên đám mây, bởi tất cả công ty đều đang cạnh tranh để giành những năng lực tính toán rất lớn từ cùng một số ít nhà cung cấp.
Ngoài ra, trong ngành AI còn có rất nhiều thông tin được trao đổi không chính thức. Noah Faro nói thêm rằng “chỉ một chút manh mối nhỏ cũng có thể lan đi với tốc độ một triệu dặm một giờ”.
Meta và Google không bình luận về thông tin trên. Đại diện của Anthropic, OpenAI và Google cũng không phản hồi khi được đề nghị bình luận.
Không phải mọi bản cập nhật mô hình AI đều như nhau
Noah Faro cho biết, khác với GPT-6 Astra, các đợt ra mắt mô hình AI trong tuần qua của Anthropic, Meta và Google chỉ là "phiên bản nâng cấp từ sản phẩm hiện có".
Theo Noah Faro, hai mô hình AI gần đây thực sự tạo ra khác biệt đáng kể là Claude Fable 5 ra mắt hồi tháng 6 và Kimi K3 của Moonshot AI tại Trung Quốc trình làng vào tháng 7.
Tuy vậy, Suresh Vasudevan, Giám đốc điều hành startup AI doanh nghiệp Clockwork Systems, cho rằng ngay cả những cập nhật nhỏ cũng có ý nghĩa, xét đến tốc độ AI đang làm thay đổi hoạt động kinh doanh và phát triển phần mềm.
“Mỗi phiên bản mới đều xuất sắc đến mức khó mà nhận ra đâu là bước ngoặt đột phá nữa. Ai cũng hiểu rằng khi đang ở trên một đường cong tăng trưởng theo cấp số nhân, bạn sẽ không nhận ra điều đó cho đến khi lùi lại và so sánh vị trí hiện tại với điểm xuất phát ban đầu”, Suresh Vasudevan bình luận.
Ông thừa nhận rằng việc theo dõi từng bản cập nhật mô hình AI mới là một cơn đau đầu, đặc biệt khi liên quan đến những tài nguyên điện toán đắt đỏ.
Theo Suresh Vasudevan, nếu muốn đánh giá 10 mô hình AI cho một nhiệm vụ cụ thể, Clockwork Systems có thể sẽ chỉ chọn 5 cái tên để thử nghiệm.
“Thực sự rất khó để đánh giá hết từng mô hình AI đang được tung ra vào lúc này”, ông nhấn mạnh.