← Tất cả bài viết
27.07.2026

Claude Opus 5 vừa ra mắt: mạnh gần bằng model đắt nhất của Anthropic, giá chỉ bằng một nửa

Claude Opus 5 vừa ra mắt: mạnh gần bằng model đắt nhất của Anthropic, giá chỉ bằng một nửa
Lê Nam Khánh 13 phút đọc

Ngày 24/7/2026, Anthropic phát hành Claude Opus 5. Nó thông minh hơn hẳn phiên bản cũ, nhưng cũng "khó tính" hơn hẳn: tự đi kiểm tra lại công việc của chính mình, bám sát từng chữ trong yêu cầu, và làm hỏng nhiều quy trình cũ.

Nếu bạn đang dùng Claude cho công việc, hoặc mới định thử, thì tuần vừa rồi có một thay đổi đáng chú ý. Đây là những gì bạn cần biết về Opus 5.

1. Claude ra mắt Opus 5

Ngày 24/7/2026, Anthropic (công ty làm ra Claude) công bố model mới tên Claude Opus 5, là bản nâng cấp của Opus 4.8, hứa hẹn sẽ trở thành đối trọng trực tiếp của GPT Sol 5.6 [1].

Ba điểm chính từ thông báo chính thức [1]:

  • Opus 5 tiệm cận mức thông minh của Fable 5, model mạnh nhất đang mở công khai của Anthropic, nhưng chỉ tốn khoảng một nửa chi phí.
  • Nó trở thành model mặc định trên gói Claude Max, và là model mạnh nhất mà gói Claude Pro được dùng.
  • Giá qua API giữ nguyên như phiên bản trước (Opus 4.8): 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra.

Một thay đổi kỹ thuật đáng chú ý: Opus 5 có cửa sổ ngữ cảnh 1 triệu token, vừa là mức mặc định vừa là mức tối đa, và chế độ "suy nghĩ" (thinking) được bật sẵn thay vì phải bật thủ công như trước [3]. Hiểu nôm na: nó nhớ được lượng tài liệu rất lớn trong một cuộc hội thoại, và mặc định sẽ dừng lại suy nghĩ trước khi trả lời.

2. Opus 5 mạnh đến đâu?

Anthropic công bố Opus 5 dẫn đầu trên các bài kiểm tra về lập trình và công việc tri thức như Frontier-Bench và GDPval-AA, dù vẫn xếp sau model Mythos 5 ở mảng an ninh mạng [1]. Một vài con số cụ thể hơn:

  • Trên Zapier AutomationBench, bài kiểm tra xem model có hoàn thành trọn vẹn một tác vụ nghiệp vụ hay không, tỷ lệ vượt qua của Opus 5 cao gấp khoảng 1,5 lần model tốt thứ hai với cùng mức chi phí [1].
  • Trên ARC-AGI 3, bài kiểm tra khả năng giải bài toán hoàn toàn mới, điểm của Opus 5 cao gấp ba lần model đứng kế tiếp [1].
  • Box, công ty lưu trữ tài liệu doanh nghiệp, báo cáo Opus 5 vượt Opus 4.8 khoảng 8% trên nội dung doanh nghiệp nói chung, 11% ở phân tích dữ liệu và 17% ở quy trình thẩm định hồ sơ [1].

Anthropic cũng cho biết đây là model đạt điểm an toàn tốt nhất của họ tính đến nay: trong bài kiểm tra hành vi tự động trước khi phát hành, Opus 5 đạt 2,3 điểm về hành vi lệch chuẩn, mức thấp nhất trong các model gần đây, và ít bị lừa để dùng sai mục đích nhất [1].

Lưu ý quan trọng: phần lớn số liệu ở trên do chính Anthropic hoặc các đối tác thương mại của họ công bố. Nên đọc như thông tin tham khảo, không phải kết luận độc lập.

3. "Tính cách" của Opus 5

Đây là điểm thú vị nhất của đợt ra mắt này, và cũng là điều bạn nghe đồn nhiều nhất. Điều đặc biệt là chính Anthropic đã ghi nhận nó trong tài liệu hướng dẫn chính thức [2]. Bốn điều bạn cần biết về model mới này:

3.1 Nó tự kiểm tra lại công việc của mình mà không cần ai bảo. Tài liệu của Anthropic khuyên các nhà phát triển hãy gỡ bỏ những câu như "hãy kiểm tra lại kết quả" ra khỏi prompt cũ, vì Opus 5 vốn đã tự làm việc đó rồi, và nhắc thêm chỉ khiến nó kiểm tra quá đà và tốn chi phí vô ích [2]. Trong một bài kiểm thử, khi được yêu cầu dựng mô hình 3D từ một bản vẽ mà lại cố tình không cho phép nhìn thấy bản vẽ đó, Opus 5 đã tự viết ra một chương trình thị giác máy tính để đọc hình học từ các điểm ảnh thô, rồi dựng lại toàn bộ chi tiết máy [1].

3.2 Nó bám sát từng chữ trong yêu cầu của bạn. Đây chính là điều nhiều người mô tả là "quá máy móc". Anthropic nói thẳng: nếu prompt của bạn ghi "chỉ báo cáo lỗi nghiêm trọng" hoặc "hãy dè dặt", model có thể hiểu theo nghĩa đen và báo cáo ít hẳn đi. Khuyến nghị của họ là bảo nó báo cáo hết, rồi lọc ở một bước riêng [2].

3.3 Nó hay tự mở rộng phạm vi công việc. Opus 5 có thể tự thêm các bước không ai yêu cầu, hoặc tự phán đoán lại xem "việc này thực ra nên là gì" [2]. Với người mới, điều này dễ gây hụt hẫng: bạn nhờ sửa một câu, nó viết lại cả đoạn.

3.4 Nó nói nhiều hơn. Câu trả lời mặc định dài hơn các đời Opus trước, nó tường thuật nhiều hơn trong lúc làm việc, và nó cũng hay tự đính chính lại những gì mình vừa nói [2].

Gộp lại, đây là một trợ lý cẩn thận đến mức tỉ mỉ, thích tự lần mò kiểm chứng cho tới khi chắc chắn, và hiểu yêu cầu rất sát nghĩa đen. Rất mạnh khi bạn giao một việc lớn và để yên cho nó làm. Khá phiền khi bạn chỉ cần một việc nhỏ và nhanh.

4. Người kiểm thử độc lập nói gì?

Phản ứng của cộng đồng chia làm hai phe rõ rệt, và cả hai phe đều đúng theo cách của mình.

Phe thất vọng. Dan Shipper, CEO của hãng truyền thông công nghệ Every, cùng đội của mình đã thử Opus 5 suốt một tuần trước ngày ra mắt. Kết luận của họ: đây là một model khó ưa, nó cãi lại hướng dẫn, dừng giữa chừng khi việc chưa xong, và không hợp với các skill và plugin mà họ đã dựng cho các model cũ [4]. Ông gọi nó là một phiên bản Fable dành cho người ít tiền, có nhiều nét tính cách của Fable nhưng không có sự xuất sắc của Fable [5].

Nhưng phần quan trọng nhất nằm ở đoạn sau: khi đội của ông xóa hết các skill cũ và làm lại từ đầu, kết quả tốt lên rõ rệt. Một đồng nghiệp của ông còn phát hiện rằng để mức suy luận thấp hoặc trung bình lại cho kết quả tốt hơn là để mức cao [5]. Điều này khớp chính xác với tài liệu của Anthropic: các hướng dẫn "hãy kiểm tra kỹ" trong skill cũ sẽ cộng dồn với thói quen sẵn có của model và gây phản tác dụng [2].

Phe bị thuyết phục. Claire Vo, tác giả chuỗi đánh giá "How I AI", mô tả Opus 5 là một model có tính cách lo lắng thái quá, rụt rè và hay xin lỗi, đến mức có lần nó từ chối động vào một xung đột merge chỉ một dòng [6][7]. Vậy mà trong bài kiểm tra mù (không biết đang chấm model nào) với bảy model khác nhau, chính cô lại xếp Opus 5 trên tất cả các model còn lại [6]. Tóm gọn cảm nhận của cô: làm việc cùng thì khó chịu, nhưng kết quả thì tốt nhất.

Đội CodeRabbit, một công ty làm công cụ review code tự động, cũng đo được bức tranh hai mặt tương tự: Opus 5 cho ra tập nhận xét đáng hành động sạch hơn (độ chính xác 39,3% so với 35,2% của baseline), nhưng lại bỏ sót nhiều lỗi đã biết hơn và tạo ra gấp bốn lần số nhận xét vụn vặt [8].

Theo tóm tắt của bản tin công nghệ The Neuron, nhà sáng tạo nội dung Nick Saraev sau khi tự chạy thử đã đưa ra lời khuyên gọn gàng: dùng Opus 5 cho những việc khó có dùng công cụ và cần chất lượng, rồi chỉ mua đúng lượng suy luận mà công việc cần, bắt đầu từ mức thấp và tăng dần [9].

5. Opus 5 hay Fable 5, chọn cái nào?

Cả bài đến giờ đều nhắc chuyện "gần bằng Fable với nửa giá", nên hãy đặt hai model cạnh nhau. Fable 5 là model ở bậc cao hơn Opus, ra mắt ngày 9/6/2026, và là model mạnh nhất mà Anthropic mở công khai [10].

Tiêu chí Claude Opus 5 Claude Fable 5
Giá qua API (mỗi triệu token vào / ra) 5 / 25 USD [1] 10 / 50 USD [10]
Trên gói thuê bao (từ 20/7/2026) Mặc định trên gói Max, và là model mạnh nhất mà gói Pro được dùng [1] Gói Max và Team Premium dùng được ở mức 50% hạn mức tuần. Gói Pro và Team Standard phải mua thêm usage credit [11][12]
Sức mạnh tổng thể Dẫn đầu các bài kiểm tra lập trình và công việc tri thức [1] Nhỉnh hơn một chút ở đỉnh cao. Trên CursorBench, Opus 5 chỉ kém 0,5% nhưng tốn nửa chi phí [1]
Yêu cầu lưu trữ dữ liệu Không có ràng buộc với truy cập thông thường [1] Bắt buộc lưu dữ liệu 30 ngày, không hỗ trợ chế độ không lưu trữ [10]
Mức độ bị chặn nhầm Bộ lọc an ninh mạng kích hoạt ít hơn Fable khoảng 85% [1] Chặt hơn. Khi bị từ chối, hệ thống trả về mã báo lỗi riêng cần xử lý [10]
Điểm an toàn (alignment) Tuân thủ Luật của Claude tốt hơn Fable 5, tỷ lệ hành vi lừa dối thấp nhất [1] Xếp sau Opus 5 ở hạng mục này [1]
Phù hợp nhất với Việc hàng ngày: báo cáo, phân tích, soạn tài liệu, lập trình [1] Số ít bài toán khó nhất mà Opus 5 đã bó tay

Với công việc thường ngày của phòng, Opus 5 là lựa chọn mặc định hợp lý hơn. Ba lý do rất thực tế:

  1. Rẻ đúng một nửa mà gần như không kém. Chính Anthropic mô tả Opus 5 là model "để dùng mỗi ngày", còn Fable dành cho việc khó nhất [1].
  2. Chuyện lưu trữ dữ liệu. Fable 5 bắt buộc lưu dữ liệu 30 ngày và không có tùy chọn không lưu trữ [10]. Với một công ty fintech, đây là điểm cần bộ phận bảo mật xác nhận trước khi đưa bất kỳ dữ liệu công việc nào vào.
  3. Ít bị chặn nhầm hơn. Bạn sẽ ít gặp cảnh đang làm việc bình thường thì bị từ chối [1].

Chỉ nên tìm đến Fable 5 khi bạn đã thử Opus 5 ở mức suy luận cao nhất mà vẫn không giải được bài toán, và tài khoản của bạn thuộc gói Max.

<details> <summary><strong>Thông số kỹ thuật chi tiết (dành cho ai làm việc với API)</strong></summary>

Thông số Opus 5 Fable 5
Ngày ra mắt 24/7/2026 [1] 9/6/2026 [10]
Cửa sổ ngữ cảnh 1M token, vừa là mặc định vừa là tối đa [3] 1M token mặc định [10]
Đầu ra tối đa mỗi lần 128k token [3] 128k token [10]
Chế độ thinking Bật sẵn, tắt được nếu để effort từ high trở xuống [3] Luôn bật, không tắt được [10]
Chuỗi lý luận Trả về thinking blocks [3] Không bao giờ trả chuỗi lý luận thô, chỉ bản tóm tắt hoặc để trống [10]
Xử lý khi bị từ chối Tự động chuyển về Opus 4.8 [1] Trả stop_reason: "refusal" kèm tên bộ lọc, cần code xử lý riêng [10]
Fast mode Có, nhanh gấp khoảng 2,5 lần, giá gấp đôi [1] Không nêu trong tài liệu
Độ dài prompt tối thiểu để cache 512 token [3] Không nêu trong tài liệu

</details>

6. Điều này có nghĩa gì với công việc hàng ngày của bạn?

Bạn không cần hiểu benchmark để dùng được thông tin này. Bốn điều thực tế:

  1. Giao một việc trọn vẹn thay vì chia nhỏ. Anthropic khuyên nên đưa đầy đủ yêu cầu ngay từ đầu rồi để model tự chạy, vì Opus 5 mạnh nhất ở các tác vụ dài hơi nhiều bước [2]. Ví dụ: thay vì hỏi từng câu, hãy dán cả bảng xuất từ Jira kèm mẫu báo cáo tiến độ của phòng và mô tả rõ bốn mục cần có.
  2. Đừng thêm câu "hãy kiểm tra lại kỹ" vào prompt. Nó đã tự làm rồi. Thêm vào chỉ khiến câu trả lời dài dòng và chậm hơn [2].
  3. Nếu bạn có prompt hoặc quy trình cũ đang chạy tốt, hãy thử lại trước khi tin. Kinh nghiệm của đội Every cho thấy các skill dựng cho model cũ có thể khiến Opus 5 dừng giữa chừng hoặc bỏ sót hướng dẫn [4][5]. Với các automation trên n8n hay quy trình báo cáo định kỳ, nên chạy thử song song một kỳ rồi mới chuyển hẳn.
  4. Với việc nhỏ, hạ mức suy luận xuống thấp. Nghe phản trực giác, nhưng cả tài liệu Anthropic lẫn trải nghiệm của đội Every đều chỉ về cùng một hướng: mức suy luận thấp và trung bình cho chất lượng tốt với chi phí và thời gian thấp hơn nhiều [2][5].
  5. Hãy hiểu chính xác những gì mình cần làm. Opus 5 có thể làm các bước dư thừa trong quá trình trả kết quả, bạn hãy theo dõi kĩ để tránh Opus 5 xử lí thừa thãi

Nếu bạn thấy câu trả lời quá dài dòng, chỉ cần nói thẳng: "trả lời ngắn gọn, đi thẳng vào ý chính". Anthropic xác nhận một câu nhắc ngắn như vậy là đủ hiệu quả [2].

Tài liệu tham khảo

[1] Anthropic. "Introducing Claude Opus 5" (24/07/2026). https://www.anthropic.com/news/claude-opus-5

[2] Claude Platform Docs. "Prompting Claude Opus 5". https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5

[3] Claude Platform Docs. "What's new in Claude Opus 5". https://platform.claude.com/docs/en/about-claude/models/whats-new-opus-5

[4] Dan Shipper và Katie Parrott, Every. "Vibe Check: Claude Opus 5 Is Brilliant in Flashes, Frustrating in Practice" (24/07/2026). https://every.to/vibe-check/opus-5

[5] Dan Shipper (@danshipper), bài đăng trên X (24/07/2026). https://x.com/danshipper/status/2080700057892815114

[6] Claire Vo (@clairevo), bài đăng trên X (24/07/2026). https://x.com/clairevo/status/2080703735878336983

[7] Lenny's Newsletter, chuyên mục How I AI. "Claude Opus 5 review: this model is brilliant (but annoying)" (25/07/2026). https://www.lennysnewsletter.com/p/claude-opus-5-review-this-model-is

[8] Hendrik Krack, CodeRabbit. "Claude Opus 5 Benchmarks for AI Code Review" (24/07/2026). https://www.coderabbit.ai/blog/opus-5-model-review

[9] The Neuron. "OpenAI Sandbox Escape and Open-Weight AI Fight" (27/07/2026), phần tóm tắt đánh giá của Nick Saraev. https://www.theneurondaily.com/p/nvidia-microsoft-all-in-on-open-source

[10] Claude Platform Docs. "Introducing Claude Fable 5 and Claude Mythos 5". https://platform.claude.com/docs/en/about-claude/models/introducing-claude-fable-5-and-claude-mythos-5

[11] Dawn, dẫn thông báo chính thức từ tài khoản @claudeai. "Anthropic to add Claude's Fable 5 model to Max, Team Premium plans at 50pc of usage limits" (18/07/2026). https://www.dawn.com/news/2016483

[12] Android Authority. "Claude Fable 5 promotion extended after backlash over early cutoff" (07/2026). https://www.androidauthority.com/claude-fable-5-free-extension-3685103/

Xem thêm (video đánh giá của cộng đồng, quan điểm cá nhân của tác giả):

  • Every. "We Tested Claude Opus 5. It's Frustrating with Flashes of Brilliance." https://www.youtube.com/watch?v=tqF8Ffv7tDs
  • Nate Herk. "I Tested Opus 5 vs. Fable 5. What You Need to Know." https://www.youtube.com/watch?v=2J3uX8iRNng