Claude Opus 5 là gì?
Claude Opus 5 là mô hình tầng Opus mới nhất của Anthropic, phát hành ngày 24/07/2026, hướng tới agent chạy dài, lập trình và công việc nhiều bước.
Anthropic định vị Opus 5 là mô hình "cẩn trọng nhưng chủ động": nó có thể duy trì một mục tiêu qua nhiều lượt, tự gọi công cụ, tự kiểm tra kết quả rồi quay lại sửa nếu chưa đạt. Knowledge cutoff của model là tháng 05/2026. Đầu ra lõi là văn bản, nhưng trong hệ thống có công cụ, nó vẫn đọc được ảnh, PDF và tạo artifact qua code.
| Thuộc tính |
Thông tin |
| Nhà phát triển |
Anthropic |
| Model ID |
claude-opus-5 |
| Ngày phát hành |
24/07/2026 |
| Knowledge cutoff |
Tháng 05/2026 |
| Giá chuẩn |
5 USD input / 25 USD output (mỗi 1 triệu token) |
| Fast mode |
Nhanh hơn ~2,5 lần, giá ~gấp đôi mức chuẩn |
| Nền tảng |
Claude.ai, Claude API, Claude Code, Claude Cowork |
Một điều Anthropic không công bố: số tham số, kiến trúc chi tiết và một con số context window cố định áp dụng cho mọi API call. Các bài eval có dùng ngân sách tới 1 triệu token, nhưng đó là cấu hình đánh giá, không phải cam kết sản phẩm. Nếu bạn thấy bài nào khẳng định chắc nịch "Opus 5 có context 1 triệu token trên mọi gói", hãy đọc lại nguồn.
Claude Opus 5 có gì khác so với Opus 4.8?
Khác biệt lớn nhất là Opus 5 chuyển từ mô hình trả lời sang mô hình thực thi: tìm nguyên nhân gốc, đọc nhiều file, tự tạo kiểm thử và giữ trạng thái công việc lâu hơn.
Nói cho dễ hình dung: Opus 4.8 giống một chuyên gia trả lời email rất tốt. Opus 5 giống chuyên gia đó nhưng chịu ngồi mở terminal, chạy thử, thấy sai thì sửa lại. Mức chênh trên các bài đo công việc dài rất rõ:
| Benchmark |
Opus 4.8 |
Opus 5 |
| FrontierBench v0.1 |
21,1 |
43,3 |
| OSWorld 2.0 (computer use) |
55,7 |
70,6 |
| GDPval-AA v2 (Elo) |
1593 |
1861 |
| AA-Briefcase (Elo) |
1346 |
1720 |
| AutomationBench |
17,0% |
26,0% |
| SWE-bench Multimodal |
38,4% |
59,4% |
| ARC-AGI-3 |
1,5% |
30,2% |
Hai thay đổi khác đáng để ý. Thứ nhất, khả năng chống prompt injection trong coding, computer use và browser use được cải thiện rất mạnh. Thứ hai, ở chiều ngược lại, System Card ghi nhận Opus 5 chính xác hơn tổng thể nhưng ảo giác dữ kiện hơi nhiều hơn Opus 4.8, và đôi lúc nói rất tự tin về điều nó không chắc. Đây là lý do bạn vẫn phải yêu cầu trích dẫn và kiểm tra lại số liệu.
Claude Opus 5 mạnh nhất ở những việc gì?
Opus 5 dẫn đầu rõ nhất ở computer use, agentic search, tự động hóa nghiệp vụ và công việc tri thức dài hơi kéo dài qua nhiều giai đoạn.
Computer use. Trên OSWorld 2.0 (agent thao tác Ubuntu bằng chuột và bàn phím), Opus 5 đạt 70,57%, so với Fable 5 66,1%, GPT-5.6 Sol 62,6% và Opus 4.8 55,7%. Đây là một trong những kết quả nổi bật nhất của model.
Tìm kiếm và nghiên cứu. BrowseComp: Opus 5 đạt 90,8%, nhỉnh hơn GPT-5.6 Sol (90,4%) và Fable 5 (87,4%). DeepSearchQA đạt khoảng 95,0 F1 ở cấu hình cao nhất.
Tự động hóa. AutomationBench mô phỏng công việc qua 47 ứng dụng như CRM, Slack, Google Workspace. Opus 5 đạt 26,0% ở max effort, gấp rưỡi Opus 4.8 (17,0%) và GPT-5.6 Sol (18,1%). Con số 26% nghe thấp, nhưng nó nói lên rằng automation phức tạp vẫn là bài khó với mọi model. Đừng để ai bán cho bạn giấc mơ "AI thay cả phòng vận hành" trong tháng này.
Công việc chuyên nghiệp. GDPval-AA v2 gồm 220 nhiệm vụ từ 44 nghề thuộc 9 ngành: Opus 5 đạt Elo 1861, vượt Fable 5 (1747) và GPT-5.6 Sol (1736). AA-Briefcase mô phỏng dự án dài nhiều tuần với hàng nghìn file: Opus 5 đạt Elo 1720 so với Fable 5 1574.
Multimodal khi có công cụ. Chartography (đọc biểu đồ chuyên môn) nhảy từ 29,6% khi không tool lên 83,0% khi có tool. Bài học rút ra rất thực tế: cho model quyền crop ảnh, chạy code và tự kiểm tra hiệu quả hơn nhiều so với việc chỉ bảo nó "suy nghĩ kỹ hơn".
Claude Opus 5 thua ở đâu?
Opus 5 không dẫn đầu ở DeepSWE, SWE-bench Pro, FrontierCode, HLE không tool, ARC-AGI-2, HealthBench Pro và một số bài pháp lý, tài liệu chuyên sâu.
| Vùng |
Model dẫn đầu |
Điểm Opus 5 |
| DeepSWE v1.1 |
GPT-5.6 Sol 72,7% |
68,8% |
| SWE-bench Pro |
Fable 5 80,0% |
79,2% |
| FrontierCode Main |
Fable 5 53,5% |
53,4% |
| HLE không tool |
Fable 5 56,5% |
56,3% |
| ARC-AGI-2 |
GPT-5.6 Sol 92,5 |
90,4 |
| HealthBench Pro |
Fable/Mythos ~66,0 |
59,8 |
| GDP.pdf có tool |
Mythos 5 87,3 |
85,5 |
Có một chi tiết quan trọng mà ít bài Việt nhắc tới: effort cao nhất không phải lúc nào cũng tốt nhất. Trên FrontierCode, ở mức effort cao Opus 5 có xu hướng refactor vượt phạm vi, "cải thiện" cả codebase thay vì chỉ xử lý issue, rồi bị bộ chấm trừ điểm vì diff không gọn. System Card cho biết chỉ cần thêm một chỉ dẫn kiểu "chỉ thay đổi trong phạm vi task" là phần lớn trường hợp hồi phục hiệu năng.
Chênh 0,1 điểm giữa Opus 5 và Fable 5 trên FrontierCode cũng không đủ để quyết định thay model trong hệ thống production. Cái bạn cần là A/B test trên workload thật của mình.
Giá API Claude Opus 5 là bao nhiêu?
Giá chuẩn của Claude Opus 5 là 5 USD cho 1 triệu token đầu vào và 25 USD cho 1 triệu token đầu ra, giữ nguyên như Opus 4.8.
Công thức tính đơn giản:
Chi phí = (input_tokens / 1.000.000 × 5 USD)
+ (output_tokens / 1.000.000 × 25 USD)
Ví dụ một lượt dùng 200.000 token input và 50.000 token output: 1,00 USD + 1,25 USD = 2,25 USD.
Fast mode dùng đúng model Opus 5 đầy đủ, chạy nhanh hơn khoảng 2,5 lần với giá khoảng gấp đôi mức chuẩn. Nó hợp lý cho phiên tương tác trực tiếp và coding realtime, kém kinh tế cho batch job chạy đêm.
Chi phí thực tế thường cao hơn con số lý thuyết vì còn có prompt cache, tool call, web search, code execution, retry, context compaction, subagent và fallback. Khi lập ngân sách, hãy đo chi phí mỗi task hoàn thành thay vì chi phí mỗi 1.000 token. Một model rẻ nhưng phải chạy lại ba lần thì không rẻ.
Cấu hình Claude Opus 5 thế nào cho hiệu quả?
Medium effort là điểm khởi đầu hợp lý cho hầu hết tác vụ; chỉ nâng lên high, xhigh hoặc max khi benchmark nội bộ chứng minh mức đó đáng tiền.
Bằng chứng từ System Card: AutomationBench ở medium đạt 24% với chi phí khoảng 0,89 USD mỗi task, gần bằng max (26%). GDPval-AA ở xhigh vẫn đứng đầu bảng dù dùng ít hơn khoảng 25% output token so với max.
| Tác vụ |
Effort khởi đầu |
| Chat thông thường |
low/medium |
| Viết, chỉnh sửa, tóm tắt |
medium |
| Coding issue rõ phạm vi |
medium |
| Debug phức tạp |
high |
| Research nhiều nguồn |
high/xhigh |
| Toán, chứng minh khó |
xhigh/max |
| Agent production lặp lại |
medium, rồi tối ưu dần |
Chuyển model rất nhẹ nhàng về mặt kỹ thuật:
Claude Code: /model claude-opus-5
API: model = "claude-opus-5"
Anthropic cũng công bố hai tính năng beta cùng đợt. Mid-conversation tool changes cho phép đổi tập công cụ giữa hội thoại mà không làm mất hiệu lực prompt cache, rất hợp với quy trình plan → execute → review. Automatic fallbacks cho phép request bị classifier đánh dấu tự chuyển sang model khác; trong Claude.ai, Claude Code và Claude Cowork, mặc định fallback là Opus 4.8.
Ai nên dùng Claude Opus 5?
Opus 5 phù hợp nhất với đội cần hoàn thành chuỗi công việc phức tạp: agent nội bộ, back-office automation, repository lớn, research nhiều nguồn và tài liệu chuyên nghiệp.
Nếu bạn đang dùng Opus 4.8, việc thử nâng cấp có chi phí chuyển đổi thấp vì giá API không đổi. Nếu bạn đang dùng Fable 5, Mythos 5 hoặc GPT-5.6 Sol, quyết định nên dựa trên benchmark nội bộ theo đúng workload chứ không dựa vào một bảng xếp hạng chung.
Checklist nhanh trước khi chọn Opus 5:
- Task có nhiều bước và cần tool hoặc GUI?
- Cần đọc nhiều file, nhiều nguồn?
- Có checker khách quan để xác minh kết quả?
- Đã đặt quyền tối thiểu và approval cho thao tác không đảo ngược?
- Đã so medium với high/max trên tập task thật?
Nếu câu trả lời phần lớn là "chưa", vấn đề của bạn có thể không nằm ở model mà nằm ở cách thiết kế quy trình. Đây cũng là lỗi phổ biến nhất chúng tôi gặp khi tư vấn cho các đội mới triển khai AI: đổi model liên tục trong khi prompt, tool và tiêu chí nghiệm thu vẫn để trống.
Với công việc marketing và vận hành hằng ngày, cách khai thác Opus 5 hiệu quả nhất không phải là hỏi nó nhiều hơn, mà là đưa nó vào một quy trình có Project, có brand voice, có dữ liệu và có bước kiểm chứng cuối. Đó cũng là khung mà khóa Claude AI Mastery của Vinalink Academy hướng dẫn: cá nhân hóa Claude bằng Project và Skill, xây trợ lý cho Content/Marketing/Sales, dùng Claude Cowork cho quy trình văn phòng và tự tạo landing page bằng Vibe Coding. Học viên thực hành trực tiếp trên công việc thật của mình, không phải bài tập mẫu.
Câu hỏi thường gặp về Claude Opus 5
Claude Opus 5 ra mắt ngày nào?
Claude Opus 5 được Anthropic phát hành ngày 24/07/2026, với model ID là claude-opus-5 và knowledge cutoff tháng 05/2026.
Giá API Claude Opus 5 là bao nhiêu?
Giá chuẩn là 5 USD cho 1 triệu token đầu vào và 25 USD cho 1 triệu token đầu ra, bằng mức giá của Opus 4.8. Fast mode có giá khoảng gấp đôi.
Claude Opus 5 có tốt hơn Opus 4.8 không?
Có, rõ nhất ở agentic coding, computer use, automation, multimodal và công việc tri thức dài hơi. Tuy nhiên cần kiểm thử regression về độ dài phản hồi, hallucination và phạm vi chỉnh sửa.
Claude Opus 5 có tốt hơn Fable 5 không?
Không phải mọi mặt. Opus 5 thắng ở nhiều bài agent, automation, computer use và professional work. Fable 5 vẫn nhỉnh hơn ở SWE-bench Pro, FrontierCode, HLE không tool và một số bài pháp lý, y tế.
Fast mode có dùng model nhỏ hơn không?
Không. Theo bài giới thiệu của Anthropic, Fast mode vẫn là Opus 5 đầy đủ, chỉ là tier tốc độ cao hơn với giá khoảng gấp đôi mức chuẩn.
Claude Opus 5 có bịa thông tin không?
Có thể. System Card cho biết model chính xác hơn tổng thể nhưng ảo giác dữ kiện hơi nhiều hơn Opus 4.8 và đôi khi thể hiện quá tự tin, nên vẫn cần yêu cầu trích dẫn và kiểm tra nguồn.
Nên dùng mức effort nào cho Claude Opus 5?
Medium là điểm bắt đầu hợp lý. Chỉ tăng lên high, xhigh hoặc max khi benchmark nội bộ chứng minh giá trị, vì với coding, effort quá cao có thể gây sửa vượt phạm vi.
Claude Opus 5 không phải model tốt nhất cho mọi bài toán, và Anthropic cũng không tuyên bố như vậy. Giá trị của nó nằm ở khả năng duy trì mục tiêu qua chuỗi công việc dài, phối hợp công cụ, tự kiểm chứng và tạo ra sản phẩm hoàn chỉnh với mức giá không đổi so với thế hệ trước.
Việc cần làm ngay hôm nay khá đơn giản: chọn 10 task thật trong công việc của bạn, chạy song song Opus 5 ở medium và high, rồi đo tỷ lệ hoàn thành cùng thời gian bạn phải sửa lại. Con số đó nói nhiều hơn mọi bảng benchmark.
Nếu bạn muốn đi từ "biết Opus 5 là gì" đến "dùng Claude làm được việc trong công việc thật", khóa Claude AI Mastery tại Vinalink Academy là điểm khởi đầu phù hợp: 6 buổi online, thực hành trực tiếp trên công việc của chính bạn.