AI & Blockchain

Anthropic ra mắt Opus 5, thổi lửa vào cuộc đua AI

Bùi Tú 25/07/2026 17:26

Chỉ trong vòng chưa đầy hai tháng, Anthropic liên tiếp tung ra hàng loạt mô hình AI mới, từ Fable 5, Mythos 5, Sonnet 5 cho đến Opus 5 vừa ra mắt vào 24/7.

Tốc độ cập nhật dồn dập cho thấy cuộc đua AI đang bước vào giai đoạn cạnh tranh khốc liệt hơn bao giờ hết. Trong bức tranh đó, Opus 5 không chỉ là một bản nâng cấp hiệu năng đơn thuần mà còn là lời khẳng định tham vọng của Anthropic trong việc cạnh tranh trực diện với OpenAI ở cả năng lực, chi phí và khả năng ứng dụng thực tế.

Opus 5
Anthropic ra mắt Opus 5, làm nóng cuộc đua AI

Cuộc chạy đua tốc độ: Anthropic tăng tốc chưa từng có

Ngày 28/5, Anthropic công bố Claude Opus 4.8. Chỉ 12 ngày sau, hãng tiếp tục giới thiệu Fable 5 và Mythos 5. Đến cuối tháng 6, Sonnet 5 chính thức ra mắt và chưa đầy một tháng sau đó, Opus 5 xuất hiện. Chuỗi nâng cấp liên tiếp trong vòng 57 ngày khiến nhiều người bất ngờ ngay cả trong lĩnh vực AI vốn nổi tiếng với tốc độ đổi mới rất nhanh. Đặc biệt, khoảng cách giữa Fable 5 và Opus 5 chỉ là 45 ngày, một khoảng thời gian quá ngắn đối với vòng đời của một mô hình nền tảng lớn.

Thông thường, một mô hình đầu bảng sau khi ra mắt sẽ được duy trì vị thế trong nhiều tháng trước khi thế hệ kế tiếp xuất hiện. Tuy nhiên, Anthropic đã phá vỡ quy luật này. Fable 5 vừa được giới thiệu như tiêu chuẩn năng lực mới dành cho người dùng phổ thông thì Opus 5 đã nhanh chóng thay thế vai trò đó. Điều này cho thấy công ty không còn xem việc duy trì vòng đời sản phẩm là ưu tiên hàng đầu; thay vào đó, mục tiêu là liên tục đẩy giới hạn công nghệ lên cao hơn.

Động thái này cũng phản ánh sự cạnh tranh ngày càng gay gắt với OpenAI. Khi GPT-5.6 được OpenAI công bố vào đầu tháng 7 và sử dụng Fable 5 như một trong những mô hình tham chiếu quan trọng, Anthropic đã đáp trả chỉ sau hơn hai tuần bằng Opus 5. Trong các tài liệu giới thiệu, hãng cũng trực tiếp so sánh mô hình mới với GPT-5.6 Sol ở nhiều bài đánh giá cốt lõi.

Từ góc độ thị trường, đây không còn là cuộc đua về số lượng tham số hay điểm benchmark đơn lẻ. Các hãng AI đang cạnh tranh về tốc độ đổi mới, khả năng thương mại hóa và mức độ hữu ích trong công việc thực tế. Opus 5 chính là sản phẩm thể hiện rõ nhất chiến lược đó của Anthropic.

Hiệu năng vượt trội và khả năng làm việc như một “nhân viên số”

Điểm nổi bật nhất của Opus 5 nằm ở hiệu năng trên các nhiệm vụ thực tế. Theo các số liệu được Anthropic công bố, mô hình mới đạt kết quả vượt trội trong nhiều bài đánh giá liên quan đến lập trình, tự động hóa và giải quyết vấn đề chưa từng gặp trước đây.

Trong Frontier-Bench, một bài đánh giá tập trung vào năng lực kĩ thuật phần mềm, Opus 5 vượt qua các đối thủ và đạt hiệu suất cao hơn gấp đôi so với Opus 4.8 trong khi chi phí cho mỗi tác vụ lại thấp hơn. Trên CursorBench 3.2, khoảng cách điểm số giữa Opus 5 và Fable 5 gần như không đáng kể khi sử dụng mức suy luận cao nhất, nhưng chi phí của Opus 5 chỉ bằng khoảng một nửa.

Không chỉ mạnh trong lập trình, Opus 5 còn thể hiện ưu thế ở các nhiệm vụ đòi hỏi suy luận linh hoạt. Một ví dụ là ARC-AGI 3 – bộ bài kiểm tra mà mô hình không thể dựa vào kiến thức đã học sẵn mà phải tự khám phá quy luật và xây dựng chiến lược giải quyết. Kết quả của Opus 5 cao gấp ba lần mô hình đứng thứ hai, cho thấy khả năng thích ứng với các vấn đề mới lạ tốt hơn đáng kể.

Trong môi trường làm việc thực tế, lợi thế này càng rõ rệt hơn. Bài đánh giá AutomationBench yêu cầu AI sử dụng phần mềm thương mại để hoàn thành một quy trình công việc từ đầu đến cuối. Opus 5 đạt tỉ lệ thành công cao hơn khoảng 1,5 lần so với mô hình xếp thứ hai. Đáng chú ý, ngay cả khi vận hành ở mức suy luận thấp nhất, kết quả của nó vẫn vượt qua điểm số cao nhất của nhiều đối thủ khác.

Một bài kiểm tra khác là OSWorld 2.0, nơi mô hình phải thao tác trên máy tính tương tự người dùng thật: mở ứng dụng, tìm kiếm thông tin, chuyển đổi giữa các phần mềm và duy trì tiến trình công việc liên tục. Opus 5 dẫn đầu ở mọi phân khúc chi phí, đồng thời đạt hiệu năng cao hơn Fable 5 dù chỉ sử dụng khoảng một phần ba chi phí.

Những kết quả này phản ánh xu hướng quan trọng của AI hiện đại. Người dùng không còn chỉ cần chatbot trả lời câu hỏi, mà cần một “nhân viên số” có thể chủ động hoàn thành công việc. Từ việc lập trình, phân tích dữ liệu cho đến quản lí quy trình kinh doanh, giá trị thực của mô hình ngày càng được đo bằng khả năng hành động thay vì chỉ khả năng đối thoại.

Anthropic cũng trình diễn các ví dụ trực quan về năng lực này. Opus 5 có thể tạo mô hình đường hầm gió 3D tương tác để mô phỏng luồng khí quanh xe hơi hoặc xây dựng mô hình tế bào động vật có thể xoay, tháo rời và giải thích từng thành phần. Những ví dụ cho thấy AI không chỉ sinh văn bản mà còn có thể kết hợp lập trình, mô phỏng, giao diện người dùng và kiến thức chuyên môn thành một sản phẩm hoàn chỉnh.

An toàn, khả năng tự chủ và bài toán “nhiều hơn với cùng mức giá”

Sự tiến bộ về năng lực luôn kéo theo câu hỏi về an toàn. Khi AI ngày càng có khả năng tự lập kế hoạch, tự tìm công cụ và tự sửa lỗi, nguy cơ phát sinh những hành vi ngoài mong muốn cũng gia tăng. Vì vậy, Anthropic dành một phần lớn trong tài liệu giới thiệu Opus 5 để nói về vấn đề căn chỉnh (alignment).

Các thử nghiệm nội bộ cho thấy Opus 5 có thể tự viết chương trình thị giác máy tính để đọc bản vẽ kĩ thuật khi không được cung cấp công cụ phù hợp. Trong một trường hợp khác, mô hình xác định được nguyên nhân gốc rễ của lỗi phần mềm và thậm chí phát hiện những trường hợp ngoại lệ mà bản sửa lỗi của cộng đồng bỏ sót.

Những ví dụ này minh họa một bước tiến quan trọng: AI không còn chỉ làm theo chỉ dẫn từng bước mà đã có thể tự tìm cách hoàn thành mục tiêu. Tuy nhiên, chính khả năng đó cũng đặt ra yêu cầu kiểm soát nghiêm ngặt hơn.

Theo Anthropic, Opus 5 là mô hình Claude tuân thủ các nguyên tắc an toàn tốt nhất từ trước đến nay. Trong các đợt đánh giá tự động trước khi phát hành, mô hình ít có xu hướng lừa dối hơn, tuân thủ các quy tắc tốt hơn và khó bị khai thác để thực hiện các yêu cầu gây hại hơn so với những thế hệ trước.

Đặc biệt, trong lĩnh vực an ninh mạng, Opus 5 có khả năng phát hiện lỗ hổng phần mềm ở mức rất cao nhưng vẫn bị hạn chế đáng kể trong việc phát triển mã khai thác hoặc biến lỗ hổng thành công cụ tấn công thực tế. Nói cách khác, mô hình được khuyến khích hỗ trợ phòng thủ và nghiên cứu bảo mật, nhưng bị giới hạn khi tiến gần đến các hoạt động có thể gây rủi ro.

Tương tự, trong nghiên cứu sinh học, Anthropic cho phép Opus 5 xử lí nhiều nhiệm vụ khoa học hơn nhưng vẫn duy trì các rào chắn đối với những yêu cầu có mức độ rủi ro cao. Cách tiếp cận này cho thấy hãng đang cố gắng cân bằng giữa việc mở rộng năng lực AI và bảo đảm an toàn cho xã hội.

Bên cạnh hiệu năng và an toàn, yếu tố quan trọng khác là chi phí. Anthropic giữ nguyên mức giá của Opus 4.8: 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra. Tuy nhiên, do tỉ lệ hoàn thành nhiệm vụ cao hơn, chi phí thực tế cho mỗi công việc lại giảm xuống.

Khi so sánh với GPT-5.6 Sol, Opus 5 có cùng chi phí đầu vào nhưng chi phí đầu ra thấp hơn khoảng 17%. Lợi thế càng rõ rệt trong các tác vụ sử dụng ngữ cảnh cực dài. Với những bộ mã nguồn lớn, tài liệu nghiên cứu hàng trăm nghìn từ hoặc các hệ thống tác nhân phức tạp, sự chênh lệch về giá có thể chuyển thành khoản tiết kiệm đáng kể cho doanh nghiệp.

Nhìn tổng thể, Opus 5 không phải là mô hình chiến thắng tuyệt đối ở mọi bài đánh giá. Tuy nhiên, Anthropic đang cố gắng định vị sản phẩm theo hướng khác: hiệu quả hơn trong công việc liên tục, chi phí hợp lí hơn và có khả năng phối hợp công cụ tốt hơn. Đây chính là những yếu tố quyết định giá trị của AI trong môi trường sản xuất thực tế.

Sự xuất hiện của Opus 5 cho thấy cuộc cạnh tranh giữa Anthropic và OpenAI đã bước sang giai đoạn mới. Nếu trước đây các hãng tập trung vào việc chứng minh mô hình nào thông minh hơn, thì hiện nay trọng tâm đã chuyển sang câu hỏi thực tế hơn: mô hình nào giúp người dùng hoàn thành công việc tốt hơn với chi phí thấp hơn. Trong cuộc đua đó, Opus 5 là lời tuyên bố mạnh mẽ rằng Anthropic không chỉ muốn theo kịp đối thủ, mà còn muốn tự đặt ra tiêu chuẩn mới cho chính mình.

Nổi bật
      Mới nhất
      Anthropic ra mắt Opus 5, thổi lửa vào cuộc đua AI
      • Mặc định

      POWERED BY ONECMS - A PRODUCT OF NEKO