Biren trình làng kiến trúc AI mới, tham vọng phá thế thống trị của Nvidia
Cuộc cạnh tranh trong ngành AI không còn chỉ xoay quanh việc ai sở hữu con chip mạnh hơn mà đang chuyển sang cuộc đua kiến trúc AI.
Tại Hội nghị Trí tuệ nhân tạo Thế giới (WAIC) 2026 ở Thượng Hải, hãng thiết kế chip Trung Quốc Biren Technology đã giới thiệu thế hệ kiến trúc AI mới sử dụng kết nối quang học, mở đường cho các cụm AI quy mô lớn và trực tiếp thách thức vị thế của Nvidia trong lĩnh vực hạ tầng AI.

Biren đặt cược vào kiến trúc AI mới
Khi các mô hình trí tuệ nhân tạo ngày càng phát triển với quy mô hàng nghìn tỉ tham số, việc nâng cấp hiệu năng của từng GPU riêng lẻ không còn đủ đáp ứng nhu cầu tính toán. Thay vào đó, bài toán lớn nhất của ngành AI hiện nay là làm sao kết nối hàng nghìn GPU thành một hệ thống thống nhất có khả năng hoạt động như một "siêu bộ não". Đó cũng là hướng đi mà Biren Technology lựa chọn.
Phát biểu tại WAIC 2026, ông Ding Yunfan, Phó chủ tịch phụ trách kiến trúc nền tảng AI của Biren, cho biết hiệu năng của từng GPU đã không còn là yếu tố quyết định. Thách thức cốt lõi hiện nay là xây dựng những cụm GPU khổng lồ có thể trao đổi dữ liệu với tốc độ cực cao mà không bị giới hạn bởi hạ tầng phần cứng.
Theo ông, các kết nối điện sử dụng dây đồng truyền thống đang dần chạm tới giới hạn vật lí. Với kiến trúc hiện nay, số GPU có thể kết nối hiệu quả trong một máy chủ thường chỉ dừng ở khoảng 128 bộ xử lí, tạo thành nút thắt lớn đối với các trung tâm dữ liệu AI.
Để vượt qua rào cản này, Biren đã giới thiệu kiến trúc "supernode" phân tán mới kết hợp công nghệ Near-Packaged Optics (NPO).
Khác với kết nối điện truyền thống, NPO đưa các sợi cáp quang đến gần chip xử lí hơn, giúp tín hiệu truyền đi nhanh hơn, giảm tiêu hao năng lượng và hạn chế suy hao dữ liệu. Nhờ đó, hệ thống của Biren có thể mở rộng quy mô lên tới 1.024 GPU trong cùng một cụm xử lí. "Liên kết quang học là lựa chọn tất yếu để phá vỡ nút thắt hiện nay", ông Ding nhấn mạnh.
Đây được xem là bước tiến quan trọng khi ngành AI đang bước vào giai đoạn phát triển các mô hình ngôn ngữ và AI Agent có quy mô chưa từng có. Những hệ thống này yêu cầu hàng nghìn GPU phải hoạt động đồng bộ, khiến khả năng truyền dữ liệu giữa các chip trở thành yếu tố quyết định hiệu năng tổng thể.
Giới chuyên gia nhận định cuộc cạnh tranh trong tương lai sẽ không chỉ là ai sở hữu GPU mạnh nhất mà là ai xây dựng được hệ thống kết nối hiệu quả nhất giữa hàng nghìn GPU.
Cuộc đua "supernode" nóng lên, Trung Quốc tăng tốc cạnh tranh với Nvidia
Biren không phải doanh nghiệp duy nhất theo đuổi chiến lược này. Nhiều hãng AI Trung Quốc như MetaX, Enflame hay Alibaba cũng đang đầu tư mạnh vào các nền tảng supernode nhằm cạnh tranh trực tiếp với Nvidia, doanh nghiệp đang thống trị thị trường hạ tầng AI toàn cầu.
Hiện Nvidia dẫn đầu với các hệ thống NVL72 và thế hệ mới NVL144, được thiết kế dành riêng cho việc huấn luyện và vận hành các mô hình AI khổng lồ.
Đáp lại, các doanh nghiệp Trung Quốc liên tiếp giới thiệu những giải pháp mới tại WAIC 2026. Huawei lần đầu tiên trình diễn công khai hệ thống Atlas 950 SuperPoD sau khi ra mắt vào năm ngoái.
Nền tảng này sử dụng giao thức kết nối Lingqu do Huawei tự phát triển, hỗ trợ cụm lên tới 1.024 GPU và đạt hiệu năng khoảng 1 exaflop ở chuẩn tính toán FP8.
Đơn vị exaflop được dùng để đo sức mạnh của các siêu máy tính và những hệ thống AI hiệu năng cao, tương đương một tỉ tỉ phép tính dấu phẩy động mỗi giây.
Trong khi đó, MetaX giới thiệu hệ thống Xijing S600 với khả năng kết nối 64 GPU trong cùng một giá máy. Công ty cho biết việc loại bỏ nhiều dây cáp bên ngoài giúp giảm đáng kể suy hao tín hiệu và nâng cao hiệu quả truyền dữ liệu.
Một doanh nghiệp khác có trụ sở tại Thượng Hải là Enflame cũng công bố nền tảng CloudBlazer ESL64-O được phát triển cùng tập đoàn viễn thông ZTE.
Hiện giải pháp này vẫn sử dụng kết nối điện truyền thống, song Enflame cho biết đang thử nghiệm nguyên mẫu hệ thống NPO quang học với mục tiêu hỗ trợ các cụm trên 512 GPU.
Việc hàng loạt doanh nghiệp cùng lúc công bố các nền tảng supernode cho thấy trọng tâm cạnh tranh của ngành AI đang dịch chuyển từ chip xử lí sang toàn bộ kiến trúc hạ tầng.
Trong nhiều năm, Nvidia duy trì lợi thế không chỉ nhờ GPU mạnh mà còn nhờ hệ sinh thái kết nối tốc độ cao như NVLink và InfiniBand, giúp hàng nghìn GPU vận hành như một hệ thống thống nhất.
Các doanh nghiệp Trung Quốc hiện muốn xây dựng hệ sinh thái tương tự nhằm giảm phụ thuộc vào công nghệ Mỹ trong bối cảnh các lệnh kiểm soát xuất khẩu chip ngày càng siết chặt.
Tuy nhiên, chính Biren cũng thừa nhận công nghệ kết nối quang học vẫn đang ở giai đoạn đầu. Ông Ding Yunfan cho biết ngành bán dẫn mới chỉ bước vào giai đoạn thử nghiệm nguyên mẫu và cần thêm nhiều quá trình kiểm chứng trong môi trường thực tế trước khi triển khai đại trà.
Theo dự báo của Biren, các hệ thống NPO thương mại quy mô lớn có thể bắt đầu xuất hiện từ năm 2028. Dù còn nhiều thách thức, việc các doanh nghiệp Trung Quốc đồng loạt đầu tư vào công nghệ supernode cho thấy tham vọng rất lớn trong việc xây dựng hạ tầng AI thế hệ mới. Cuộc cạnh tranh với Nvidia vì thế sẽ không chỉ diễn ra trên từng con chip, mà còn ở khả năng kết nối hàng nghìn bộ xử lí thành những "siêu máy tính AI" đủ sức vận hành các mô hình trí tuệ nhân tạo mạnh nhất thế giới.