Claude Haiku 4.5 là gì?
Claude Haiku 4.5 là mô hình nhỏ và nhanh nhất dòng Claude 4.5 của Anthropic, ra mắt 15/10/2025, đạt hiệu năng coding ngang Claude Sonnet 4.
Anthropic phân dòng Claude theo ba tầng quen thuộc: Opus cho tác vụ nặng, Sonnet cho công việc hằng ngày, Haiku cho tốc độ và chi phí. Haiku 4.5 nằm ở tầng thấp nhất về giá, nhưng đây là bản Haiku đầu tiên được xếp vào nhóm mô hình suy luận hỗn hợp (hybrid reasoning model).
Nói cho dễ hiểu: các đời Haiku trước trả lời nhanh nhưng không "suy nghĩ". Haiku 4.5 có thể bật chế độ extended thinking để dành thêm thời gian lập luận trước khi trả lời, giống cách Sonnet 3.7 và Sonnet 4.5 đang làm. Đây là điểm gãy về mặt kiến trúc so với Haiku 3.5.
Ba nâng cấp mà Anthropic nhấn mạnh trong System Card của mô hình:
- Lập trình agentic và computer use (điều khiển GUI, trình duyệt) tốt hơn hẳn Haiku 3.5.
- Extended thinking lần đầu có mặt trên dòng Haiku.
- Nhận biết ngữ cảnh (context awareness) để tránh hiện tượng làm tắt giữa chừng.
Claude Haiku 4.5 mạnh đến đâu trên benchmark?
Claude Haiku 4.5 đạt 73.3% trên SWE-bench Verified và 61.6% GPQA Diamond, ngang Claude Sonnet 4 ở tác vụ lập trình theo dữ liệu Anthropic công bố.
Con số 73.3% trên SWE-bench Verified là điểm đáng nói nhất. Benchmark này đo khả năng mô hình tự sửa các issue thật trong repo mã nguồn mở, không phải bài toán đồ chơi. Một mô hình giá rẻ đạt mức này là chuyện chưa từng có ở thế hệ trước.
| Chỉ số |
Claude Haiku 4.5 |
| Ngày ra mắt |
15/10/2025 |
| Context window |
200.000 token |
| Output tối đa |
64.000 token (Haiku 3.5 chỉ 8.192) |
| Knowledge cutoff |
Tháng 2/2025 |
| SWE-bench Verified |
73.3% |
| GPQA Diamond |
61.6% |
| Cấp độ triển khai |
ASL-2 |
Nhưng benchmark tổng không kể hết câu chuyện. Trên tập con khó của SWE-bench Verified (những bài mà kỹ sư thật cần 2 đến 8 tiếng để xử lý), Haiku 4.5 chỉ giải được 36.6%, tương đương Claude Sonnet 4. Ở Cybench, mô hình giải 15/32 thử thách Capture The Flag, thấp hơn Sonnet 4 với 22/32.
Đọc hai con số đó cùng nhau, bạn sẽ thấy bức chân dung thật: Haiku 4.5 xử lý rất tốt các tác vụ có phạm vi rõ ràng, nhưng đuối dần khi bài toán đòi hỏi lập luận nhiều tầng và kéo dài.
Giá Claude Haiku 4.5 là bao nhiêu?
Giá công bố của Claude Haiku 4.5 là 1 USD cho mỗi triệu token input và 5 USD cho mỗi triệu token output, bằng khoảng một phần ba giá Sonnet 4.5.
Đây là giá quốc tế tính bằng USD trên Claude API, ghi nhận tại thời điểm ra mắt.
| Mô hình |
Input (USD/triệu token) |
Output (USD/triệu token) |
| Claude 3 Haiku |
0.25 |
1.25 |
| Claude Haiku 3.5 |
0.8 |
4 |
| Claude Haiku 4.5 |
1 |
5 |
| Claude Sonnet 4/4.5 |
3 |
15 |
Haiku 4.5 đắt hơn Haiku 3.5 khoảng 25%, nhưng đổi lại bạn nhận được năng lực coding gấp nhiều lần. Anthropic cũng cho biết prompt caching có thể giảm tới 90% chi phí, còn xử lý theo lô (batch processing) giảm thêm 50%. Với hệ thống chạy hàng triệu request mỗi tháng, hai kỹ thuật này quan trọng hơn cả việc chọn mô hình nào.
Một cách nghĩ đơn giản về bài toán chi phí: gọi Opus để tóm tắt một email 200 chữ giống như thuê xe cẩu để bê chậu cây ra ban công. Làm được, nhưng bạn đang trả tiền cho phần công suất không dùng tới.
Context awareness của Claude Haiku 4.5 giúp gì cho công việc thật?
Context awareness giúp Claude Haiku 4.5 biết đã dùng bao nhiêu trong 200.000 token ngữ cảnh, nhờ đó kết thúc gọn thay vì cắt ngang giữa chừng.
Đây là chi tiết kỹ thuật ít được nhắc nhưng ảnh hưởng trực tiếp đến trải nghiệm khi bạn chạy agent. Trong các chuỗi tác vụ dài, mô hình thường chạm trần cửa sổ ngữ cảnh mà không hề "biết" điều đó. Kết quả là câu trả lời bị cắt ngang, hoặc mô hình bỏ dở việc đang làm.
Anthropic huấn luyện Haiku 4.5 để theo dõi chính xác lượng ngữ cảnh đã tiêu tốn. Theo System Card, việc này mang lại ba hiệu ứng:
- Mô hình biết gói lại câu trả lời gọn gàng khi sắp hết ngữ cảnh.
- Mô hình kiên trì suy luận sâu hơn khi còn nhiều dung lượng.
- Giảm hiện tượng "tính lười agent" (agentic laziness), tức là dừng sớm hoặc làm tắt.
Nếu bạn từng để một agent chạy 40 bước rồi phát hiện nó bỏ dở ở bước 27 mà không báo gì, bạn hiểu vì sao đây là nâng cấp thực dụng chứ không phải tính năng trên slide.
Claude Haiku 4.5 khác gì Sonnet 4.5 và Haiku 3.5?
Haiku 4.5 nhanh và rẻ hơn Sonnet 4.5 nhưng kém hơn ở suy luận phức tạp; so với Haiku 3.5, nó thêm extended thinking và computer use.
| Tiêu chí |
Haiku 3.5 |
Haiku 4.5 |
Sonnet 4.5 |
| Extended thinking |
Không |
Có |
Có |
| Computer use |
Không |
Có |
Có |
| Output tối đa |
8.192 token |
64.000 token |
Cao hơn Haiku |
| Tỷ lệ từ chối nhầm |
4.26% |
0.02% |
0.02% |
| Reward hacking trung bình |
34.0% |
15.5% |
15.5% |
| Vị trí phù hợp |
Tác vụ đơn giản |
Sub-agent, xử lý khối lượng lớn |
Coding và reasoning phức tạp |
So với Haiku 3.5, bước nhảy rõ nhất nằm ở tỷ lệ từ chối nhầm: từ 4.26% xuống 0.02%. Nghĩa là mô hình cũ cứ khoảng 24 câu hỏi lành tính về chủ đề nhạy cảm thì từ chối nhầm một câu. Với Haiku 4.5, con số đó gần như biến mất.
So với Sonnet 4.5, ranh giới nằm ở độ khó của bài toán. Anthropic công bố tỷ lệ reward hacking của cả hai đều là 15.5%, nhưng trên các bài coding khó và tác vụ an ninh mạng, Sonnet vẫn dẫn trước. Cách phân vai hợp lý là để Sonnet 4.5 làm orchestrator và Haiku 4.5 làm các sub-agent chạy song song.
Nếu bạn đang xây hệ thống multi-agent theo hướng này, Mastering Agentic AI của Vinalink Academy đi vào đúng phần kiến trúc phân vai đó.
Mức độ an toàn của Claude Haiku 4.5 ra sao?
Anthropic triển khai Claude Haiku 4.5 ở chuẩn ASL-2, với tỷ lệ phản hồi an toàn 99.38% và tỷ lệ từ chối nhầm chỉ 0.02% trong đánh giá nội bộ.
ASL-2 là cấp độ an toàn theo Responsible Scaling Policy của Anthropic. Để đạt mức này, mô hình phải vượt qua các bài đánh giá loại trừ ASL-3 về vũ khí CBRN, khả năng tự chủ và an ninh mạng. Haiku 4.5 nằm dưới ngưỡng lo ngại ở cả ba nhóm.
Vài điểm đáng chú ý khác từ System Card:
- Chống prompt injection: khi bật bộ phân loại an toàn cho computer use, Haiku 4.5 đạt 92.4%, cao hơn Sonnet 4.5 (82.6%).
- Lập trình độc hại: đạt 100% điểm an toàn trước các yêu cầu viết mã độc khi có công cụ lập trình.
- Kiểm thử đa lượt: tỷ lệ thất bại giảm xuống dưới 5% trên mọi danh mục, trong khi Haiku 3.5 từng lên tới 25%.
- Định kiến chính trị: bất đối xứng 5.3% ở chế độ mặc định, so với 38.7% của Haiku 3.5.
Với doanh nghiệp Việt Nam đang cân nhắc đưa mô hình vào quy trình chăm sóc khách hàng, con số chống prompt injection 92.4% quan trọng hơn điểm benchmark coding. Nó quyết định việc bot của bạn có bị người dùng dụ làm chuyện ngoài kịch bản hay không.
Claude Haiku 4.5 phù hợp với ai và dùng vào việc gì?
Claude Haiku 4.5 hợp với chatbot thời gian thực, xử lý dữ liệu số lượng lớn và các sub-agent chạy song song trong hệ thống multi-agent.
Nhóm ứng dụng nên cân nhắc dùng Haiku 4.5:
- Trợ lý thời gian thực: chatbot website, bot Zalo/Messenger cần trả lời dưới một giây.
- Tự động hóa chăm sóc khách hàng: phân loại ticket, trả lời câu hỏi lặp lại, tóm tắt hội thoại.
- Sub-agent trong hệ thống multi-agent: chạy 10 đến 20 instance song song để crawl, phân loại, trích xuất dữ liệu.
- Pair programming: gợi ý code, refactor, viết test cho các đoạn có phạm vi rõ ràng.
- Xử lý khối lượng lớn: gán nhãn dữ liệu, chuẩn hóa nội dung, viết meta description hàng loạt.
Nhóm nên chọn mô hình lớn hơn: kiến trúc hệ thống phức tạp, phân tích tài chính nhiều ràng buộc, debug lỗi sâu trong codebase lớn, hoặc bất cứ việc gì mà sai một lần là tốn kém hơn phần chi phí token bạn tiết kiệm được.
Mô hình có sẵn trên Claude.ai (web, iOS, Android) cho cả người dùng free, và cho developer qua Claude API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI và Microsoft Foundry.
Cần lưu ý gì trước khi đưa Claude Haiku 4.5 vào quy trình?
Trước khi dùng Haiku 4.5 ở quy mô lớn, hãy kiểm tra knowledge cutoff tháng 2/2025, chi phí thực tế theo lượng token và giới hạn ở tác vụ suy luận sâu.
Knowledge cutoff tháng 2/2025. Mô hình không biết gì về sự kiện sau mốc này. Nếu bạn hỏi về chính sách mới, giá thị trường hiện tại hay tính năng nền tảng vừa cập nhật, hãy nạp dữ liệu vào context thay vì tin vào trí nhớ của mô hình.
Chi phí không tuyến tính với giá niêm yết. Giá 1 USD/triệu token nghe rẻ, nhưng một agent chạy 30 bước với context dài có thể ngốn vài trăm nghìn token cho một tác vụ. Hãy đo thử trên 100 request thật trước khi ước tính ngân sách tháng.
Đừng dùng để thay thế đánh giá con người. Anthropic ghi nhận khoảng 9% kịch bản kiểm thử cho thấy mô hình nghi ngờ mình đang bị đánh giá. Con số này không phải lỗi, nhưng nó nhắc bạn rằng hành vi trong môi trường test và môi trường thật có thể lệch nhau.
Kiểm tra lại thông tin kỹ thuật trước khi trích dẫn. Bảng giá và danh sách nền tảng hỗ trợ thay đổi theo thời gian. Số liệu trong bài lấy từ System Card và thông báo ra mắt tháng 10/2025.
Câu hỏi thường gặp về Claude Haiku 4.5
Claude Haiku 4.5 ra mắt khi nào?
Claude Haiku 4.5 được Anthropic ra mắt ngày 15/10/2025, là mô hình nhỏ và nhanh nhất trong dòng Claude 4.5.
Claude Haiku 4.5 có context window bao nhiêu token?
Claude Haiku 4.5 có cửa sổ ngữ cảnh 200.000 token và output tối đa 64.000 token, tăng mạnh so với mức 8.192 token của Haiku 3.5.
Claude Haiku 4.5 giá bao nhiêu?
Giá công bố tại thời điểm ra mắt là 1 USD cho mỗi triệu token input và 5 USD cho mỗi triệu token output, bằng khoảng một phần ba giá Claude Sonnet 4.5.
Claude Haiku 4.5 có mạnh hơn Claude Sonnet 4.5 không?
Không. Haiku 4.5 nhanh và rẻ hơn nhưng kém Sonnet 4.5 ở các tác vụ suy luận phức tạp, coding khó và an ninh mạng. Haiku 4.5 phù hợp làm sub-agent xử lý khối lượng lớn.
Claude Haiku 4.5 có hỗ trợ extended thinking không?
Có. Đây là mô hình Haiku đầu tiên hỗ trợ extended thinking, cho phép mô hình dành thêm thời gian suy luận trước khi trả lời thay vì phản hồi ngay.
Knowledge cutoff của Claude Haiku 4.5 là khi nào?
Dữ liệu huấn luyện của Claude Haiku 4.5 tính đến tháng 2/2025. Mô hình không nắm được các sự kiện xảy ra sau mốc thời gian này.
Dùng Claude Haiku 4.5 ở đâu?
Mô hình có trên Claude.ai (web, iOS, Android) cho cả người dùng miễn phí, và cho developer qua Claude API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI và Microsoft Foundry.
Chọn đúng mô hình quan trọng hơn chọn mô hình mạnh nhất
Phần lớn doanh nghiệp Việt Nam đang trả tiền cho mô hình cao cấp để làm những việc mà Haiku 4.5 xử lý xong trong một phần ba chi phí. Ngược lại, cũng không ít team ép Haiku làm việc của Sonnet rồi kết luận "AI không dùng được".
Việc cần làm ngay tuần này: liệt kê 5 tác vụ AI mà team bạn đang chạy thường xuyên nhất, đánh dấu tác vụ nào có phạm vi rõ ràng và lặp lại. Đó chính là danh sách nên chuyển sang Haiku 4.5 để thử.
Nếu bạn muốn đi xa hơn phần lý thuyết và thực sự xây trợ lý AI chạy trên công việc thật của mình, khóa Claude AI Mastery của Vinalink Academy có 6 buổi thực chiến, đi từ cách ra lệnh đúng, cá nhân hóa bằng Project và Skill, cho tới xây Agent tự động và Vibe Coding. Toàn bộ bài tập làm trực tiếp trên dữ liệu công việc của học viên.