← Tất cả bài viết
23.09.2026

Anthropic ra mắt Claude Opus 5.5: Giá giảm 20%, chi phí thực tế giảm khoảng 40%

Anthropic ra mắt Claude Opus 5.5: Giá giảm 20%, chi phí thực tế giảm khoảng 40%
Nguyễn Ngọc Hải 11 phút đọc

Ngày 22/9/2026, Anthropic công bố Claude Opus 5.5, mô hình đầu tiên của dòng Claude 5.5 [1]. Điểm nhấn của bản phát hành này không phải là một mô hình lớn hơn, mà là cùng một mức năng lực nhưng rẻ hơn và nhanh hơn: theo Anthropic, Opus 5.5 đạt mức tương đương Claude Fable 5.1 ở phần lớn công việc, trong khi tốn ít chi phí vận hành hơn khoảng 40% so với Opus 5 trên các tác vụ thông thường và tạo kết quả nhanh hơn 30% [1].

Bản phát hành diễn ra cùng ngày OpenAI ra mắt GPT-6 Sol và GPT-6 Luna với giá thấp hơn đáng kể so với thế hệ trước, khiến giới quan sát gọi đây là một cuộc chiến giá trên thị trường mô hình AI [11].

Ba thay đổi chính so với Opus 5

Thứ nhất, giá API giảm trên mọi hạng mục. Giá token đầu vào giảm từ 5 USD xuống 4 USD cho mỗi triệu token, token đầu ra giảm từ 25 USD xuống 20 USD, đều tương đương mức giảm 20%. Chi phí đọc cache giảm mạnh nhất, từ 0,50 USD xuống 0,20 USD, tức giảm 60% [2][9]. Xử lý theo lô (batch) có giá bằng một nửa mức tiêu chuẩn [2].

Thứ hai, hiệu năng trên các benchmark agentic tăng rõ rệt. Trên Terminal-Bench 4.0, Opus 5.5 đạt 66,4% so với 52,3% của Opus 5; FrontierCode v1.1 đạt 54,4% so với 48,0%; CursorBench 4.0 đạt 57,8% so với 46,6% [1]. Với nhóm công việc tri thức, điểm GDPval-AA v2.1 tăng từ 1708 lên 1846 Elo, còn AutomationBench tăng từ 26,9% lên 40,0% [1].

Thứ ba, cách mô hình suy luận thay đổi. Chế độ "thinking" luôn bật và không thể tắt. Thay vào đó, lập trình viên điều chỉnh độ sâu suy luận qua tham số effort với năm mức: low, medium, high, xhigh, max. Mức mặc định giảm từ high (ở Opus 5) xuống medium [2][3].

Thông số kỹ thuật

Hạng mụcClaude Opus 5.5
Mã mô hình (API)claude-opus-5-5
Cửa sổ ngữ cảnh1 triệu token
Đầu ra tối đa128.000 token
Mốc kiến thức đáng tin cậyTháng 6/2026
Suy luậnAdaptive, luôn bật, mặc định effort: medium
Giá tiêu chuẩn4 USD đầu vào / 20 USD đầu ra cho mỗi triệu token
Chế độ nhanh (fast mode)8 USD / 40 USD, chỉ có trên Claude API, đang ở dạng beta

Nguồn: tài liệu chính thức của Claude Platform [2][4].

Mô hình có mặt trên Claude API, Amazon Bedrock, Google Cloud và Microsoft Foundry [2]. Với người dùng ứng dụng Claude, Opus 5.5 có trên các gói Pro, Max, Team và Enterprise tính theo ghế; Anthropic đồng thời nâng giới hạn sử dụng theo chu kỳ 5 giờ và bổ sung tính năng cho phép người dùng chủ động đặt lại giới hạn khi cần [1][10]. Anthropic cho biết Claude Sonnet 5.5 và Claude Haiku 5.5 sẽ ra mắt trong vài tuần tới [1][5].

Kết quả từ các đơn vị dùng thử trước

Anthropic công bố một số kết quả từ khách hàng thử nghiệm sớm, đây là số liệu do các bên này cung cấp [1][6][9]:

  • GitHub: hoàn thành các tác vụ terminal trong VS Code với số bước và số token ít hơn Opus 5 [1][7].
  • Box: dùng khoảng một phần ba lượng token so với Opus 5 mà vẫn giữ được độ chính xác [7].
  • Lovable: giảm từ một phần ba đến một nửa số bước so với các mô hình trước [1].
  • Optiver: giảm 40 đến 50% chi phí cho lập trình agentic [1].
  • Clio: hoàn thành một tác vụ chạy liên tục 18 giờ không cần giám sát, ít phải làm lại [1].
  • Trong một bài kiểm tra chuyển mã nguồn HAProxy từ C sang Rust, Opus 5.5 hoàn thành trong 9,5 giờ, so với 12 giờ của Fable 5.1 và chi phí thấp hơn 51% [6][9].

An toàn: chặt hơn, nhưng đánh đổi bằng việc định tuyến sang mô hình cũ

Anthropic mô tả Opus 5.5 là mô hình có kết quả kiểm toán hành vi tự động tốt nhất từ trước tới nay của hãng, với số lần mô hình tìm cách vượt qua các ranh giới được đặt ra thấp hơn khoảng 85% so với Opus 5, cùng khả năng chống prompt injection tốt hơn [1][6]. Mô hình được hai đơn vị bên ngoài là Frontier Design và METR đánh giá trước khi phát hành [1][9]. Anthropic cũng lưu ý việc phát hiện mọi lỗi trước khi triển khai vẫn là bài toán chưa giải được [6].

Đi kèm là ba cơ chế bảo vệ đáng chú ý:

  • Preserved thinking: phần suy luận được giữ lại xuyên suốt các vòng gọi công cụ và không thể tắt, đây cũng là biện pháp chống chưng cất mô hình (distillation) [1][2].
  • Phân loại theo lĩnh vực nhạy cảm: mọi hành động được một bộ phân loại kiểm tra trước khi thực thi, với các nhóm từ chối mới gồm sinh học và trích xuất suy luận [1][2].
  • Định tuyến sang mô hình cũ hơn: phần lớn tác vụ liên quan an ninh mạng được chuyển sang Opus 4.8 xử lý [1].

Cơ chế cuối cùng có hệ quả thực tế mà đội kỹ thuật cần biết. Theo The New Stack, trong một luồng agent nhiều bước, từng yêu cầu riêng lẻ có thể được xử lý bởi các mô hình có năng lực khác nhau mà phía gọi API không nhận ra, dẫn tới kết quả không đồng nhất so với lúc thử nghiệm [7]. Chính Anthropic cũng thừa nhận cơ chế an toàn đã can thiệp trong một số bài đánh giá, chuyển các tác vụ liên quan an ninh mạng và sinh học sang mô hình yếu hơn, và điều này nhiều khả năng đã kéo điểm số của Opus 5.5 xuống ở đúng những bài kiểm tra đó [8].

Những thay đổi bắt buộc khi nâng cấp từ Opus 5

Đây là điểm quan trọng với các đội đang gọi API Claude trong sản phẩm. Tài liệu chính thức liệt kê một số thay đổi phá vỡ tương thích [2][3]:

Thay đổiCần làm gì
Không thể tắt thinkingBỏ thinking: {"type": "disabled"}, chuyển sang đặt effort
Không hỗ trợ ép gọi công cụThay tool_choice: "any" hoặc "tool" bằng "auto" kèm strict: true
Khối thinking gắn với từng mô hình và từng hội thoạiGiữ hội thoại ở dạng chỉ thêm mới, không sửa lại nội dung cũ
Bỏ công cụ computer_20251124 trên Claude API và Google CloudChuyển sang computer_toolset_20260801
Văn bản giữa các lần gọi công cụ trả về dưới dạng khối thinkingĐặt thinking.display nếu muốn hiển thị tiến trình cho người dùng
Mức effort mặc định đổi từ high sang mediumChạy lại các bài đo để chọn mức phù hợp

Nói cách khác, đổi tên mô hình trong cấu hình là chưa đủ. Một hệ thống đang chạy ổn định trên Opus 5 có thể gặp lỗi 400 nếu giữ nguyên các tham số cũ.

Cần thận trọng

  • Số liệu benchmark do nhà cung cấp tự công bố. Toàn bộ điểm số trong bài đến từ Anthropic. VentureBeat lưu ý hiện chưa có kết quả so sánh công khai giữa Opus 5.5 và các mô hình GPT-6 mới trên cùng một môi trường chạy, nên mọi kết luận về tỉ lệ chi phí trên hiệu năng lúc này đều là sớm [6].
  • Mức effort cao không phải lúc nào cũng tốt hơn. Lập trình viên Simon Willison thử nghiệm độc lập và ghi nhận Opus 5.5 ở mức suy luận tối đa đã dùng hết giới hạn 128.000 token đầu ra cho một yêu cầu tạo hình SVG đơn giản mà không cho ra kết quả, tốn 2,56 USD cho một lần chạy [11].
  • Mức giảm 40% là ước tính cho tải công việc điển hình, không phải cam kết cho mọi trường hợp. Chi phí thực tế phụ thuộc vào mức effort, tỉ lệ tái sử dụng cache và số bước mà agent cần để hoàn thành việc [1][6].
  • Chế độ nhanh đắt gấp đôi. Fast mode có giá 8 USD đầu vào và 40 USD đầu ra cho mỗi triệu token, hiện chỉ có trên Claude API ở dạng beta [1][2].

Ý nghĩa với chúng ta

Với phần lớn nhân viên dùng Claude qua ứng dụng, thay đổi dễ thấy nhất là tốc độ phản hồi và giới hạn sử dụng cao hơn; không cần thao tác gì thêm.

Với các đội có tích hợp AI vào sản phẩm hoặc quy trình nội bộ, có ba điểm đáng lưu tâm:

  • Cách đo chi phí đang đổi. Thay vì so giá trên mỗi triệu token, thước đo hợp lý hơn là chi phí cho mỗi công việc hoàn thành, gồm số token tiêu thụ, tỉ lệ dùng lại cache và số lần phải chạy lại [6]. Một mô hình đắt hơn trên bảng giá vẫn có thể rẻ hơn nếu hoàn thành việc trong ít bước hơn.
  • Cơ chế định tuyến sang mô hình cũ cần được tính tới khi kiểm thử. Nếu hệ thống có các tác vụ chạm tới chủ đề an ninh mạng, kết quả có thể không đồng nhất giữa các lần gọi [7]. Nên ghi log mô hình thực tế trả lời và có nhánh xử lý cho trường hợp bị từ chối.
  • Việc nâng cấp phiên bản cần kế hoạch, không chỉ đổi cấu hình. Các thay đổi phá vỡ tương thích ở trên đủ để làm hỏng một tích hợp đang chạy nếu nâng cấp vội [3].

Lưu ý an toàn dữ liệu: giá rẻ hơn không làm thay đổi nguyên tắc nội bộ. Không đưa dữ liệu khách hàng, thông tin giao dịch hay tài liệu nội bộ của VNPAY vào công cụ AI chưa được phê duyệt. Với các tích hợp qua API, đội kỹ thuật nên rà lại điều khoản lưu trữ dữ liệu, trong đó Anthropic có tuỳ chọn không lưu dữ liệu (zero data retention) cho khách hàng đủ điều kiện [1]. Đây là gợi ý chung, các yêu cầu cụ thể cần xác nhận với bộ phận Pháp chế và An toàn thông tin.

Điểm đáng chú ý nhất của bản phát hành này không nằm ở bảng điểm. Khi một mô hình mạnh hơn lại rẻ hơn và tiêu tốn ít token hơn thế hệ trước, rào cản để đưa AI vào các quy trình chạy dài, nhiều bước sẽ thấp dần. Câu hỏi cho các đội dự án vì thế chuyển từ "có đủ ngân sách để thử không" sang "quy trình nào đáng để giao cho AI chạy tự động, và kiểm soát chất lượng ra sao".


References

  1. Anthropic — Introducing Claude Opus 5.5 (22/09/2026). Available at: https://www.anthropic.com/claude-opus-5-5 (Accessed: 23/09/2026).
  2. Claude Platform Docs — What's new in Claude Opus 5.5. Available at: https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5 (Accessed: 23/09/2026).
  3. Claude Platform Docs — Migrating to Claude Opus 5.5. Available at: https://platform.claude.com/docs/en/models/opus-5-5/migration-guide (Accessed: 23/09/2026).
  4. Claude Platform Docs — Models overview. Available at: https://platform.claude.com/docs/en/models/overview (Accessed: 23/09/2026).
  5. Brandom, R. — TechCrunch, Anthropic releases Opus 5.5 with lower prices and Fable-level performance (22/09/2026). Available at: https://techcrunch.com/2026/09/22/anthropic-releases-opus-5-5-with-lower-prices-and-fable-level-performance/ (Accessed: 23/09/2026).
  6. Franzen, C. — VentureBeat, Anthropic releases Claude Opus 5.5, beating Fable 5.1 on key agentic benchmarks at 60% cheaper API price (22/09/2026). Available at: https://venturebeat.com/technology/anthropic-releases-claude-opus-5-5-beating-fable-5-1-on-key-agentic-benchmarks-at-60-cheaper-api-price (Accessed: 23/09/2026).
  7. Caswell, A. — The New Stack, Anthropic releases Opus 5.5 and cuts pricing by 20%. Your agent calls might secretly get routed to an older model (22/09/2026). Available at: https://thenewstack.io/claude-opus-5-5-release/ (Accessed: 23/09/2026).
  8. OfficeChai — Anthropic Releases Claude Opus 5.5, Beats GPT-6 Astra On Most Benchmarks (22/09/2026). Available at: https://officechai.com/ai/claude-opus-5-5-benchmarks/ (Accessed: 23/09/2026).
  9. Tolomia, C. — Quartz, Anthropic launches Claude Opus 5.5 at lower cost, higher performance (22/09/2026). Available at: https://qz.com/anthropic-claude-opus-55-cost-performance-092226 (Accessed: 23/09/2026).
  10. Hall, Z. — 9to5Mac, Anthropic upgrades Claude with new Opus 5.5 model, details here (22/09/2026). Available at: https://9to5mac.com/2026/09/22/anthropic-upgrades-claude-with-new-opus-5-5-model-details-here/ (Accessed: 23/09/2026).
  11. Willison, S. — Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war (22/09/2026). Available at: https://simonwillison.net/2026/Sep/22/opus-and-sol-and-luna/ (Accessed: 23/09/2026).