Claude Opus 5 ra mắt: giá bằng nửa Fable 5, mạnh cỡ nào?
Anthropic vừa bổ sung Claude Opus 5 vào dòng Claude 5 ngày 24/7/2026, và điểm đáng chú ý không nằm ở chỗ mô hình này mạnh nhất, mà ở chỗ nó tiệm cận năng lực của Fable 5 với chi phí chỉ bằng một nửa. Đây là mô hình thứ tư trong dòng Claude 5 ra mắt trong chưa đầy hai tháng, cho thấy cuộc đua AI đã chuyển từ những màn ra mắt hoành tráng sang việc liên tục siết chặt ba yếu tố năng lực, chi phí và tốc độ.
Anthropic liên tục mở rộng dòng Claude 5 trong năm 2026. Nguồn: YouTube
Anthropic ra mắt Claude Opus 5 ngày 24/7/2026, định vị là mô hình xử lý công việc văn phòng hằng ngày với chi phí hợp lý. Giá API là 5 USD mỗi triệu token đầu vào và 25 USD mỗi triệu token đầu ra, giữ nguyên so với Opus 4.8 nhưng chỉ bằng khoảng một nửa Fable 5. Mô hình có cửa sổ ngữ cảnh 1 triệu token và tối đa 128 nghìn token đầu ra. Opus 5 đạt 43,3% trên Frontier-Bench về lập trình agentic và 1.861 Elo trên GDPval-AA v2 về công việc tri thức, nhưng vẫn xếp sau Mythos 5 ở các tác vụ an ninh mạng. Đây là mô hình mặc định trên Claude Max và mạnh nhất trên Claude Pro.
Anthropic công bố Claude Opus 5 ngày 24/7/2026, bổ sung thêm một mắt xích vào dòng Claude 5 vốn đã khá đông đúc. Điều khiến lần ra mắt này đáng chú ý không phải là một cột mốc năng lực mới, mà là bài toán chi phí. Theo mô tả của hãng, Opus 5 tiệm cận năng lực biên của Claude Fable 5 nhưng có giá chỉ bằng khoảng một nửa, và được định vị rõ ràng cho nhóm công việc văn phòng hằng ngày thay vì các tác vụ nghiên cứu cực đoan.
| Ngày ra mắt | 24/7/2026 |
| Giá đầu vào | 5 USD mỗi triệu token |
| Giá đầu ra | 25 USD mỗi triệu token |
| Cửa sổ ngữ cảnh | 1 triệu token |
| Đầu ra tối đa | 128 nghìn token |
| Gói có sẵn | Mặc định trên Max, cao nhất trên Pro |
Giá giữ nguyên nhưng vị thế thay đổi
Về con số, Opus 5 tính 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra, giữ nguyên mức giá của Claude Opus 4.8. Nhìn qua thì đây là chuyện bình thường, nhưng đặt trong tương quan năng lực thì ý nghĩa khác hẳn. Mô hình mới có năng lực cao hơn đáng kể mà không tăng giá, và quan trọng hơn, nó đứng ở khoảng một nửa chi phí so với Fable 5, mô hình đầu bảng của hãng.
Với các đội ngũ đang xây dựng sản phẩm dựa trên API, đây là kiểu thay đổi ảnh hưởng trực tiếp tới bài toán vận hành. Một tính năng trước đây phải dùng mô hình đắt tiền mới đạt chất lượng chấp nhận được thì nay có thể chuyển sang Opus 5 và cắt gần một nửa hóa đơn. Anthropic còn cho biết chi phí có thể giảm thêm tới 90% nhờ bộ nhớ đệm prompt và khoảng 50% khi xử lý theo lô, hai kỹ thuật khá phổ biến trong triển khai thực tế.
Hai mức tốc độ và đánh đổi đi kèm
Một chi tiết đáng chú ý trong cách Anthropic đóng gói Opus 5 là việc tách hai mức tốc độ. Chế độ tiêu chuẩn dùng mức giá gốc. Chế độ fast mode chạy nhanh hơn khoảng 2,5 lần nhưng tính phí gấp đôi, tức khoảng 10 USD đầu vào và 50 USD đầu ra mỗi triệu token. Cách làm này biến tốc độ thành một tham số có thể mua thêm, thay vì một thuộc tính cố định của mô hình.
Trong thực tế, lựa chọn giữa hai chế độ phụ thuộc vào loại ứng dụng. Với trợ lý trò chuyện hoặc công cụ hỗ trợ viết mã theo thời gian thực, độ trễ ảnh hưởng trực tiếp tới cảm nhận của người dùng, nên trả thêm để nhanh hơn là hợp lý. Ngược lại, với các tác vụ chạy nền như tóm tắt tài liệu hàng loạt hay phân tích dữ liệu định kỳ, không ai chờ kết quả theo từng giây, và chế độ tiêu chuẩn tiết kiệm hơn nhiều.
Cộng đồng nhà phát triển thường thử nghiệm mô hình mới ngay sau khi ra mắt. Nguồn: YouTube
Điểm số nói gì và không nói gì
Anthropic cho biết Opus 5 đạt mức tốt nhất hiện tại trên các bài đánh giá về lập trình và công việc tri thức. Cụ thể, mô hình đạt 43,3% trên Frontier-Bench, bộ đánh giá đo khả năng lập trình theo hướng agentic, tức là tự thực hiện chuỗi tác vụ thay vì chỉ gợi ý từng dòng mã. Ở mảng công việc tri thức, mô hình đạt 1.861 Elo trên GDPval-AA v2.
Tuy nhiên, cần đọc các con số này một cách thận trọng. Chính Anthropic thừa nhận Opus 5 vẫn xếp sau Mythos 5 ở nhóm tác vụ an ninh mạng, cho thấy không có mô hình nào dẫn đầu ở mọi khía cạnh. Bên cạnh đó, điểm benchmark phản ánh năng lực trên tập bài kiểm tra cụ thể, không đảm bảo hiệu quả tương ứng trong quy trình làm việc thực tế của từng doanh nghiệp. Cách tiếp cận thực dụng nhất vẫn là chạy thử trên chính dữ liệu và tác vụ của mình trước khi chuyển đổi toàn bộ hệ thống.
Cửa sổ 1 triệu token và điều ít người để ý
Opus 5 có cửa sổ ngữ cảnh 1 triệu token, tương đương hàng nghìn trang văn bản. Điều này cho phép đưa trọn một codebase cỡ vừa, một bộ hồ sơ hợp đồng hay nhiều báo cáo dài vào cùng một phiên làm việc mà không phải cắt nhỏ rồi ghép kết quả. Với các tác vụ cần hiểu bối cảnh xuyên suốt, chẳng hạn rà soát tính nhất quán giữa nhiều tài liệu, đây là khác biệt lớn về chất chứ không chỉ về lượng.
Chi tiết ít được nhắc tới là 1 triệu token vừa là mức mặc định vừa là mức tối đa, không có phiên bản ngữ cảnh nhỏ hơn với giá rẻ hơn để chọn. Cách đóng gói này đơn giản hóa việc lựa chọn nhưng cũng đồng nghĩa người dùng không thể tối ưu chi phí bằng cách hạ ngữ cảnh xuống. Giới hạn đầu ra là 128 nghìn token, đủ cho hầu hết nhu cầu sinh nội dung dài trong một lần gọi.
Bốn mô hình trong chưa đầy hai tháng
Opus 5 là mô hình thứ tư thuộc dòng Claude 5 mà Anthropic phát hành trong chưa đầy hai tháng. Nhịp độ này phản ánh một thay đổi rõ rệt trong ngành: các phòng thí nghiệm AI không còn dồn toàn bộ nguồn lực vào một lần ra mắt lớn mỗi năm, mà liên tục tung ra các biến thể tối ưu cho từng điểm cân bằng khác nhau giữa năng lực, chi phí và tốc độ. Người hưởng lợi trực tiếp là người dùng cuối, khi mức giá cho cùng một năng lực giảm nhanh hơn nhiều so với dự đoán cách đây hai năm.
Cuộc đua này không diễn ra một chiều. OpenAI cũng vừa giới thiệu bộ ba GPT-5.6, còn các phòng thí nghiệm Trung Quốc tiếp tục gây áp lực giảm giá toàn ngành nhờ hiệu quả trên chi phí. Chúng tôi đã phác họa bức tranh tổng thể trong bài cuộc đua AI nửa cuối 2026 giữa GPT-5.6, Gemini, Claude và GLM. Với người dùng Việt Nam, hệ quả thực tế là chi phí tích hợp AI vào sản phẩm đang rẻ dần, mở ra khả năng cho các nhóm nhỏ triển khai những tính năng mà trước đây chỉ doanh nghiệp lớn kham nổi. Nếu bạn muốn so sánh với mô hình cùng dòng ra mắt trước đó, bài Claude Sonnet 5 ra mắt với định hướng agentic cung cấp góc nhìn về cách Anthropic phân tầng sản phẩm.