Google tung loạt mô hình Gemini mới giá rẻ, tăng tốc AI và đối đầu trực diện Anthropic
Google vừa mở rộng dòng mô hình Gemini với ba phiên bản mới, tập trung vào giảm chi phí vận hành, tăng hiệu suất và bổ sung mô hình chuyên về an ninh mạng nhằm cạnh tranh trực tiếp với Anthropic.
Google vừa công bố ba mô hình AI Gemini mới, đánh dấu bước đi mới trong chiến lược cạnh tranh bằng hiệu quả vận hành và chi phí thấp thay vì chỉ chạy đua về sức mạnh xử lý. Động thái diễn ra ngay trước khi Alphabet công bố kết quả kinh doanh quý và trong bối cảnh các đối thủ AI từ Trung Quốc tăng tốc mạnh mẽ.
Đáng chú ý nhất là Gemini 3.5 Flash Cyber, mô hình AI chuyên biệt dành cho lĩnh vực an ninh mạng, được thiết kế để phát hiện và vá các lỗ hổng phần mềm. Trong giai đoạn đầu, Google chỉ triển khai phiên bản này thông qua chương trình thử nghiệm giới hạn dành cho các cơ quan chính phủ và đối tác đáng tin cậy.
Theo Google, Flash Cyber có chi phí tính theo token thấp hơn các mô hình AI cỡ lớn hiện nay, đồng thời được kỳ vọng sẽ giúp hãng thu hẹp khoảng cách với Anthropic - công ty đang dẫn đầu mảng AI phòng thủ mã nguồn nhờ mô hình Mythos.
Bên cạnh Flash Cyber, Google cũng giới thiệu Gemini 3.6 Flash - phiên bản nâng cấp tập trung vào hiệu suất và khả năng tiết kiệm tài nguyên.
Theo hãng, mô hình mới cải thiện khả năng lập trình, xử lý đa phương thức (multimodal) và các tác vụ tri thức, đồng thời sử dụng ít hơn tới 17% số lượng token so với thế hệ trước.
Điều này đồng nghĩa chi phí triển khai AI cho các doanh nghiệp sẽ giảm đáng kể, đặc biệt đối với những ứng dụng có lưu lượng truy cập lớn hoặc cần xử lý khối lượng dữ liệu khổng lồ.

Google cho biết Gemini 3.6 Flash hiện có chi phí thấp hơn nhiều đối thủ trên thị trường khi so sánh theo từng tác vụ AI.
Theo dữ liệu của Artificial Analysis, Gemini Flash vốn đã có lợi thế về giá so với các mô hình của OpenAI, Anthropic cũng như nhiều công ty AI Trung Quốc. Với Gemini 3.6 Flash, Google cho biết chi phí xử lý tiếp tục thấp hơn GPT-5.6 Terra Max, Kimi K3 và Qwen 3.7 Max.
Mô hình thứ ba là Gemini 3.5 Flash-Lite, được Google giới thiệu là phiên bản nhanh nhất và rẻ nhất trong dòng Gemini 3.5.
Flash-Lite được tối ưu cho các tác vụ khối lượng lớn, phù hợp với các hệ thống AI Agent cần thực hiện hàng triệu yêu cầu mỗi ngày hoặc xử lý các tác vụ nhỏ bên trong những quy trình AI phức tạp.
Việc tung ra Flash-Lite cho thấy Google đang đặt cược vào lợi thế về chi phí và tốc độ để mở rộng khả năng tiếp cận AI tới nhiều doanh nghiệp hơn.
Đối đầu trực diện Anthropic và các đối thủ Trung Quốc
Loạt mô hình mới được công bố trong bối cảnh cuộc cạnh tranh AI ngày càng gay gắt.
Ngoài Anthropic với các mô hình nổi bật về lập trình và an ninh mạng, các công ty AI Trung Quốc cũng đang tăng tốc rất nhanh.
Moonshot AI vừa gây chú ý khi mô hình Kimi K3 thu hút lượng người dùng lớn đến mức phải tạm hạn chế đăng ký mới và giới hạn quyền truy cập API do thiếu năng lực xử lý.
Trong khi đó, Alibaba cũng đang chuẩn bị ra mắt Qwen 3.8 Max, được hãng tuyên bố chỉ đứng sau mô hình Fable 5 của Anthropic về hiệu năng tổng thể.
Điều này khiến Google không chỉ phải cạnh tranh về chất lượng mô hình mà còn phải chứng minh khả năng triển khai AI với chi phí thấp và quy mô lớn.
Một trong những lợi thế lớn nhất của Google nằm ở việc sở hữu toàn bộ chuỗi công nghệ từ phần cứng đến phần mềm.
Hãng đang sử dụng các chip AI tự thiết kế cùng hạ tầng Google Cloud để tối ưu hiệu suất của Gemini.
Theo CNBC, Google còn phát triển một dòng chip chuyên biệt mới có khả năng giúp Gemini hoạt động hiệu quả hơn gấp khoảng 10 lần, qua đó giảm đáng kể chi phí phục vụ các mô hình AI quy mô lớn.
Đại diện Google Cloud cho biết công ty liên tục thử nghiệm nhiều công nghệ mới nhằm tối ưu hiệu năng và hiệu quả vận hành.
Theo Google, việc đồng thiết kế phần cứng và phần mềm ngay từ đầu giúp các hệ thống AI được tối ưu cho các tác vụ thực tế, thay vì chỉ tập trung vào điểm số đánh giá hiệu năng.
Gemini 4 cũng đang được chuẩn bị
Song song với việc tung ra các mô hình mới, Google cũng tiết lộ thêm về lộ trình phát triển Gemini nhằm giải đáp những lo ngại gần đây về việc chậm tiến độ.
Hiện Gemini 3.5 Pro đã được gửi tới một số đối tác để thử nghiệm trước khi phát hành rộng rãi.
Ngoài ra, Google xác nhận đã bắt đầu đợt huấn luyện tiền xử lý (pretraining) lớn nhất từ trước đến nay cho Gemini 4, mẫu AI được kỳ vọng sẽ trở thành nền tảng chủ lực tiếp theo của hãng.
Việc liên tiếp ra mắt các mô hình mới ngay trước thời điểm Alphabet công bố báo cáo tài chính cho thấy Google đang muốn gửi thông điệp rõ ràng tới thị trường: hãng không chỉ chạy đua về năng lực AI mà còn hướng đến mục tiêu xây dựng các mô hình có chi phí thấp hơn, hiệu quả hơn và đủ khả năng cạnh tranh trước làn sóng AI ngày càng mạnh từ Anthropic và các công ty Trung Quốc.


