Claude Opus 5 ra mắt: mạnh hơn Fable 5, giá bằng một nửa
Anthropic vừa chính thức phát hành Claude Opus 5 vào ngày 24/07/2026. Nếu bạn đang cân nhắc chuyển đổi, câu trả lời ngắn gọn là: có, đặc biệt cho các workflow đòi hỏi tính tự trị (agentic) cao.
Đây không chỉ là một bản cập nhật tăng tiến mà là sự tối ưu hóa tỷ lệ suy luận trên mỗi token (reasoning-to-token ratio), cho phép Claude Opus 5 tiệm cận hoặc vượt qua Fable 5 ở các tác vụ phức tạp nhất với chi phí vận hành chỉ còn một nửa.
Fable 5 hiện đã bị đẩy xuống phân khúc model chỉ dùng qua credit (credits-only) và chịu sự kiểm soát xuất khẩu nghiêm ngặt từ chính phủ Mỹ, nên Opus 5 đang trở thành lựa chọn mặc định cho các kỹ sư hệ thống cần cân bằng giữa hiệu suất và quyền riêng tư dữ liệu.

Claude Opus 5 là gì và có gì mới?
Trong dải sản phẩm Claude 5 (bao gồm Mythos, Fable, Opus, Sonnet và Haiku), Opus 5 được định vị là model chủ lực cho các tác vụ tri thức doanh nghiệp và tự động hóa dài hạn.
Thông số kỹ thuật bạn cần lưu ý:
- Context Window: mặc định và tối đa là 1 triệu (1M) token, không có các biến thể nhỏ hơn. Anthropic khẳng định hiệu suất duy trì ổn định trên toàn bộ cửa sổ ngữ cảnh.
- Giới hạn đầu ra: tối đa 128k token trên Messages API. Nếu dùng Message Batches API, bạn có thể
đạt mức 300k token bằng cách thêm beta header
output-300k-2026-03-24. - Cơ chế Thinking (tư duy): hiện tại được bật mặc định. Trường
thinking: {"type": "adaptive"}vẫn hợp lệ nhưng không còn bắt buộc. - Tham số Effort (nỗ lực): đây là biến điều khiển then chốt. Bạn có các mức
low,medium,high,xhighvàmax. Mức nỗ lực càng cao, model càng tiêu tốn nhiều token suy nghĩ để xử lý các logic đa tầng. - Giá thành: duy trì ở mức $5/triệu token đầu vào và $25/triệu token đầu ra, tương đương Opus 4.8.
Opus 5 so với Fable 5: benchmark nói gì?
Dữ liệu benchmark cho thấy Opus 5 đã vượt qua Fable 5 ở hầu hết các hạng mục thực tế:
- Frontier-Bench v0.1 (agentic coding): Opus 5 đạt 43.3%, vượt qua Fable 5 (33.7%) và GPT-5.6 Sol (34.4%).
- ARC-AGI-3 (problem solving): đây là chỉ số quan trọng nhất khi Opus 5 đạt 30.2%, gần gấp 4 lần kỷ lục cũ, trong khi GPT-5.6 Sol chỉ đạt 7.8%.
- SWE-bench Verified: đạt mức kỷ lục 96.0%.

Opus 5 thể hiện khả năng "tự giác" khi tự viết pipeline thị giác máy tính (computer vision) để trích xuất hình học từ pixel thô, trong tình huống được yêu cầu dựng mô hình 3D FreeCAD từ một bản vẽ mà nó không có quyền xem trực tiếp. Model này tìm ra lỗi gốc (root-cause) hiệu quả hơn các phiên bản trước, thay vì chỉ xử lý phần bề nổi.
Giá và hiệu năng: vì sao Fable 5 vẫn đắt gấp đôi?
Sự chênh lệch giá không nằm ở độ thông minh thuần túy mà ở định vị an toàn và chính sách. Fable 5 hiện là model chỉ dành cho credit (credits-only), được thiết kế cho các dự án tự trị kéo dài nhiều ngày. Model này chịu sự giám sát chặt chẽ của chính phủ Mỹ sau các sự cố jailbreak và yêu cầu lưu trữ dữ liệu 30 ngày để kiểm soát an toàn.

Ngược lại, Opus 5 không lưu trữ dữ liệu người dùng, cung cấp quyền riêng tư cao hơn cho doanh nghiệp. Chuyển từ Fable sang Opus 5 giúp cắt giảm 50% chi phí trong khi vẫn giữ được khả năng xử lý agentic tương đương, thậm chí ổn định hơn (ít biến thiên hơn 22% so với Opus 4.7 theo Lovable).
Lập trình viên cần đổi gì trong code?
Để triển khai Opus 5 vào production, hãy thực hiện các thay đổi sau:
- Model ID: cập nhật thành
claude-opus-5. - Loại bỏ prompt thừa: xóa các câu lệnh yêu cầu model "tự kiểm tra" (self-verification) vì Opus 5 đã tích hợp sẵn cơ chế này. Giữ lại các prompt này chỉ gây lãng phí token (over-verification).
- Beta headers:
- Thay đổi tool giữa hội thoại (không mất cache):
mid-conversation-tool-changes-2026-07-01. - Chế độ fallback mặc định của Anthropic:
server-side-fallback-2026-07-01.
- Thay đổi tool giữa hội thoại (không mất cache):
- Logic Thinking/Effort: nếu bạn cố tình tắt tư duy (
thinking: {"type": "disabled"}) nhưng lại đặt mức Effort làxhighhoặcmax, API sẽ trả về lỗi 400. Nếu muốn tắt Thinking, bạn phải giới hạn Effort ở mứchighhoặc thấp hơn. - Prompt caching: ngưỡng tối thiểu để cache đã hạ xuống còn 512 token, giúp tiết kiệm chi phí cho cả những request trung bình.

Cộng đồng đánh giá Opus 5 ra sao?
Phản hồi từ Hacker News và các đơn vị kiểm thử như CodeRabbit chỉ ra hai mặt của model:
- Tích cực: độ biến thiên (variance) rất thấp. Các CEO từ Lovable, Zapier và Box đều ghi nhận hiệu suất tăng từ 8% đến 22% trong các tác vụ phân tích dữ liệu và due-diligence (thẩm định doanh nghiệp).
- Tiêu cực: vấn đề "nhiễu" (noise) trong code review. Opus 5 có xu hướng tạo ra nhiều nit (góp ý
nhỏ nhặt) hơn gấp 4 lần so với các model cũ. Cơ chế suy nghĩ sâu cũng khiến token đầu ra tăng mạnh,
có thể gây đội chi phí nếu không giới hạn
max_tokensvà mức Effort hợp lý.
Nên chọn Opus 5 hay Fable 5?
Quyết định dựa trên tính chất bảo mật và mục tiêu công việc:
- Chọn Opus 5 cho: lập trình hàng ngày, phân tích dữ liệu quy mô lớn và nghiên cứu khoa học. Đặc biệt, Opus 5 được bỏ chặn cho các tác vụ tìm kiếm lỗ hổng trong mã nguồn (source code vulnerability finding). Rào cản an toàn của nó lỏng hơn 85% so với Fable 5 ở mảng này.
- Chọn Fable 5 (hoặc Mythos): cho các tác vụ an ninh mạng đặc thù liên quan đến quét binary (binary scanning) hoặc phát triển mã khai thác (exploit generation) — những phần mà Opus 5 vẫn bị chặn nghiêm ngặt.
Lời khuyên thực tế: hãy chuyển các workflow agentic chính sang Opus 5 ngay. Việc tối ưu hóa reasoning-to-token ratio và khả năng tự sửa lỗi khiến nó trở thành model hiệu quả nhất về chi phí hiện nay cho các kỹ sư AI.
Điểm chính
- Tiết kiệm 50% chi phí: giữ mức giá $5/$25 trên 1M token nhưng tối ưu hóa reasoning-to-token ratio vượt xa Fable 5.
- Tư duy agentic dẫn đầu: đạt 43.3% trên Frontier-Bench v0.1 và 30.2% trên ARC-AGI-3, bỏ xa GPT-5.6 Sol (7.8%).
- Cơ chế Thinking và Effort: tư duy bật mặc định, cho phép tinh chỉnh độ sâu suy nghĩ để kiểm soát chi phí.
- Cấu trúc API linh hoạt: đổi tool giữa phiên, hạ ngưỡng prompt caching xuống 512 token, mở rộng output lên 300k.
Tài liệu tham khảo
- Introducing Claude Opus 5 — Anthropic
- What's new in Claude Opus 5 — Claude Platform Docs
- Anthropic launches Opus 5 — TechCrunch
- Anthropic releases Claude Opus 5: Here's how it's different than what's already out there — Fortune
- Claude Opus 5 Outscores Fable 5 on Most Benchmarks—At Half the Price — Decrypt
- Meet the New Claude Opus 5: Frontier-Class Agentic Coding and Computer Use at Unchanged Opus Pricing — MarkTechPost
- Claude Opus 5 Benchmarks for AI Code Review — CodeRabbit
- Claude Opus 5 — Hacker News
- Anthropic debuts Opus 5 model as company preps for IPO later this year — Yahoo Finance
Bài viết được đăng lần đầu trên camnangai.com.
All rights reserved