Anthropic vừa ra mắt Claude Opus 5.5, mô hình AI mới được hãng định vị ở phân khúc cao cấp. Không chỉ cải thiện khả năng lập trình, Opus 5.5 còn có giá API thấp hơn đáng kể so với Fable 5.1, đồng thời được tăng giới hạn sử dụng cho người dùng trả phí.
Claude Opus 5.5 ra mắt với định hướng tiết kiệm hơn
Ngày 22/9, Anthropic chính thức giới thiệu Claude Opus 5.5, đồng thời cho biết đây là mô hình mạnh nhất mà hãng từng thử nghiệm. Mô hình mới đã được triển khai trên ứng dụng Claude dành cho web và di động, thông qua API với mã claude-opus-5-5, cũng như trên Amazon Web Services, Google Cloud và Microsoft Azure.
Điểm đáng chú ý nằm ở cách Anthropic định vị Opus 5.5 trong danh mục sản phẩm. Theo hãng, mô hình mới có thể xử lý phần lớn công việc ở mức tương đương Claude Fable 5.1, mẫu AI cao cấp vừa được giới thiệu trước đó. Tuy nhiên, Opus 5.5 lại có lợi thế về chi phí vận hành và tốc độ phản hồi.
Ở các tác vụ thông thường, chi phí vận hành Opus 5.5 được cho là thấp hơn khoảng 40% so với Opus 5. Trong khi đó, tốc độ tạo phản hồi nhanh hơn hơn 30%. Điều này khiến mô hình mới hướng nhiều hơn đến các doanh nghiệp và lập trình viên cần sử dụng AI với khối lượng lớn.

Giá API Claude Opus 5.5 thấp hơn đáng kể
Một trong những điểm nổi bật nhất của Claude Opus 5.5 là mức giá API. Anthropic niêm yết 4 USD cho mỗi một triệu token đầu vào và 20 USD cho mỗi một triệu token đầu ra. Để dễ hình dung, mức giá này thấp hơn đáng kể so với Fable 5.1, vốn có giá 10 USD cho một triệu token đầu vào và 50 USD cho một triệu token đầu ra.
| Mô hình | 1 triệu token đầu vào | 1 triệu token đầu ra |
|---|
| Claude Opus 5.5 | 4 USD | 20 USD |
| Claude Opus 5 | 5 USD | 25 USD |
| Claude Fable 5.1 | 10 USD | 50 USD |
Theo các số liệu được công bố, giá token cơ bản của Opus 5.5 thấp hơn khoảng 60% so với Fable 5.1. Với những ứng dụng AI xử lý lượng lớn dữ liệu hoặc tạo nhiều nội dung, chênh lệch này có thể tác động đáng kể đến chi phí vận hành.
Chi phí bộ nhớ đệm cũng được giảm. Mỗi một triệu token đọc từ bộ nhớ đệm có giá 0,2 USD. Người dùng cần tốc độ phản hồi cao hơn có thể lựa chọn chế độ Fast, nhưng mức giá sẽ tăng gấp đôi, lên 8 USD cho đầu vào và 40 USD cho đầu ra.
Claude Opus 5.5 vượt Fable 5.1 ở nhiều bài kiểm tra lập trình
Khả năng lập trình là một trong những điểm được Anthropic nhấn mạnh khi giới thiệu Opus 5.5. Trên Terminal-Bench 4.0, bài kiểm tra khả năng tự sử dụng dòng lệnh để hoàn thành nhiệm vụ, Opus 5.5 đạt 66,4%.
Con số này cao hơn mức 55,8% của Fable 5.1 và 52,3% của Opus 5. Trên CursorBench 4.0, Opus 5.5 đạt 57,8%, trong khi Fable 5.1 đạt 51,8%. Ở FrontierCode v1.1, khoảng cách nhỏ hơn nhưng Opus 5.5 vẫn dẫn trước với 54,4%, so với 50,3% của Fable 5.1.
Không chỉ lập trình, mô hình mới còn cho kết quả tốt trong các công việc văn phòng. Trên GDPval-AA v2.1, Opus 5.5 đạt 1.846 điểm Elo, cao hơn Fable 5.1 với 1.735 điểm và Opus 5 với 1.708 điểm. Tuy nhiên, Anthropic cũng lưu ý rằng khi các mô hình đã đạt trình độ cao, sự khác biệt về điểm benchmark không phải lúc nào cũng phản ánh chính xác khoảng cách trong trải nghiệm sử dụng thực tế.

Viết ít code hơn nhưng vẫn cần kiểm tra kỹ
Một đánh giá độc lập từ Sonar cho thấy hiệu quả lập trình của Opus 5.5 có nhiều khía cạnh đáng chú ý. Trong 544 tác vụ lập trình có kiểm thử, mô hình đạt tỷ lệ vượt qua 87,68%, gần với mức 88,6% của Opus 5.
Điểm đáng chú ý hơn là Opus 5.5 tạo ra ít code hơn 27,5% và sử dụng ít hơn 40% token đầu ra. Tổng số vấn đề được phát hiện cũng giảm 42%. Tuy nhiên, điều đó không có nghĩa code do mô hình tạo ra hoàn toàn ít lỗi hơn. Mật độ lỗi tăng 12%, lên 644 lỗi trên mỗi một triệu dòng code. Đặc biệt, nhóm lỗi liên quan đến xử lý đồng thời tăng 44%.
Đây là vấn đề đáng lưu ý với các dự án phần mềm có nhiều luồng xử lý song song. Những lỗi dạng này thường khó tái hiện và khó phát hiện trong quá trình kiểm thử thông thường.
Ở chiều tích cực, số lỗ hổng bảo mật nghiêm trọng nhất giảm 53%. Vì vậy, Opus 5.5 cho thấy khả năng tạo code gọn hơn và tiết kiệm token, nhưng lập trình viên vẫn cần kiểm tra, chạy thử và đánh giá mã nguồn trước khi đưa vào môi trường thực tế.
Opus 5.5 có một số thay đổi mà lập trình viên cần lưu ý
Bên cạnh hiệu năng, Anthropic cũng thay đổi cách Opus 5.5 hoạt động trong một số tình huống kỹ thuật. Đáng chú ý nhất là chế độ suy luận Thinking luôn được bật và không thể tắt. Việc ép mô hình gọi một công cụ cụ thể cũng có thể phát sinh lỗi. Những ứng dụng đang hiển thị đoạn văn bản giữa các lần gọi công cụ để báo tiến độ có thể cần được điều chỉnh để tương thích với mô hình mới.
Đây là những thay đổi không quá lớn với người dùng thông thường nhưng có thể ảnh hưởng đến các ứng dụng AI phức tạp, đặc biệt là hệ thống sử dụng API và thực hiện nhiều bước tự động liên tiếp.
Về an toàn, Opus 5.5 sử dụng cơ chế bảo vệ tương tự Fable 5.1 trong một số lĩnh vực nhạy cảm như sinh học và an ninh mạng. Một số yêu cầu liên quan đến an ninh mạng có thể được chuyển sang Opus 4.8 để xử lý. Cách vận hành này giúp Anthropic duy trì các lớp kiểm soát an toàn, nhưng đồng thời cũng đặt ra yêu cầu mới với những hệ thống AI tự động nhiều bước.
Trong trường hợp một quy trình có thể gọi nhiều mô hình khác nhau, nhà phát triển cần hiểu rõ mô hình nào đang xử lý từng yêu cầu để tránh những khác biệt không mong muốn về năng lực hoặc giới hạn an toàn.

Anthropic nới giới hạn sử dụng cho người dùng trả phí
Cùng với việc phát hành Opus 5.5, Anthropic cũng điều chỉnh giới hạn sử dụng dành cho người đăng ký các gói Pro, Max, Team và Enterprise. Giới hạn được tính theo chu kỳ 5 giờ và người đăng ký còn được tặng một lượt đặt lại giới hạn, có thể sử dụng bất kỳ thời điểm nào trước khi chương trình kết thúc vào ngày 22/10.
Anthropic cũng xác nhận Sonnet 5.5 và Haiku 5.5 sẽ tiếp tục được ra mắt trong vài tuần tới. Điều này cho thấy hãng đang mở rộng thế hệ mô hình mới thay vì chỉ tập trung vào dòng Opus cao cấp.
Với Claude Opus 5.5, Anthropic không chỉ tập trung vào việc tăng điểm benchmark mà còn nhấn mạnh bài toán chi phí và hiệu suất sử dụng. Mô hình mới có giá API thấp hơn đáng kể so với Fable 5.1, đồng thời thể hiện kết quả tốt ở nhiều bài kiểm tra lập trình.
Dù vậy, những đánh giá độc lập cho thấy Opus 5.5 vẫn có các nhóm lỗi cần lưu ý, đặc biệt trong xử lý đồng thời. Vì vậy, lợi thế của mô hình nằm nhiều ở khả năng cân bằng giữa năng lực, tốc độ và chi phí thay vì chỉ dựa trên điểm số benchmark. Với doanh nghiệp và lập trình viên đang xây dựng ứng dụng AI qua API, đây có thể là yếu tố đáng quan tâm khi lựa chọn mô hình cho các tác vụ lập trình, tự động hóa và xử lý công việc chuyên môn.
