TÀI LIỆU  Thư viện kiến thức

Claude Haiku 5.5 là gì? Giá, benchmark và khi nào nên dùng

12:34 | 08/10/2026
Claude Haiku 5.5 là mô hình nhỏ, nhanh và rẻ nhất mà Anthropic vừa phát hành ngày 07/10/2026. Giá token giảm tới 90% so với Haiku 4.5, còn điểm benchmark lại tăng mạnh. Bài viết này giúp bạn hiểu Haiku 5.5 có gì mới, chi phí thực tế bao nhiêu, mạnh yếu ở đâu và khi nào nên dùng nó thay cho Sonnet hay Opus.

Claude Haiku 5.5 là gì?

Claude Haiku 5.5 là mô hình AI cỡ nhỏ của Anthropic, ra mắt ngày 07/10/2026, dành cho tác vụ khối lượng lớn, cần tốc độ và chi phí thấp.

Nếu coi gia đình Claude 5.5 là một đội làm việc, Opus 5.5 là người làm chiến lược, Sonnet 5.5 là trưởng nhóm triển khai, còn Haiku 5.5 là người xử lý khối việc lặp lại mỗi ngày. Opus 5.5 ra mắt ngày 22/09/2026, Sonnet 5.5 ra mắt ngày 28/09/2026. Haiku 5.5 là mảnh ghép cuối cùng của thế hệ này.

Anthropic định vị Haiku 5.5 cho các việc như tóm tắt, nén ngữ cảnh hội thoại, truy vấn cơ sở dữ liệu và phân loại yêu cầu. Mô hình này cũng được thiết kế để làm subagent (tác tử phụ) cho Opus 5.5 hoặc Sonnet 5.5 trong các quy trình lập trình. Vì là mô hình nhanh nhất của Anthropic ở tốc độ tiêu chuẩn, nó hợp với chăm sóc khách hàng trực tiếp và tự động thao tác trình duyệt.

Hạng mục Thông tin
Nhà phát triển Anthropic
Model ID trên API claude-haiku-5-5
Ngày phát hành 07/10/2026
Mốc dữ liệu huấn luyện Tháng 6/2026
Cửa sổ ngữ cảnh 1 triệu token
Đầu vào Văn bản, hình ảnh, ảnh chụp màn hình, tài liệu
Đầu ra Văn bản
Nơi sử dụng Claude.ai, Claude API, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Azure

Thông tin trong bảng được tổng hợp từ trang công bố chính thức của Anthropic và System Card của mô hình.

Claude Haiku 5.5 có gì mới so với Haiku 4.5?

So với Haiku 4.5, Claude Haiku 5.5 có thêm mức effort điều chỉnh được, ngữ cảnh 1 triệu token, tokenizer mới và tốc độ phản hồi nhanh hơn.

Haiku 4.5 ra mắt khoảng một năm trước. Giữa hai phiên bản không có Haiku 5, nên khoảng cách nâng cấp lần này khá lớn. Dưới đây là bốn thay đổi bạn nên biết trước khi chuyển sang dùng.

Lần đầu dòng Haiku có mức effort điều chỉnh được

Effort là "mức độ suy nghĩ" bạn cho phép mô hình bỏ ra trước khi trả lời. Haiku 5.5 có 5 mức: low, medium, high, xhigh và max. Trên API, mức mặc định là medium. Suy nghĩ nhiều thì trả lời tốt hơn, nhưng tốn thêm token output, tức là tốn tiền hơn.

Theo System Card, trên bài đo GDPval-AA, Haiku 5.5 đạt Elo 1620 ở mức max. Ở mức medium, điểm còn 1277 nhưng lượng token output chỉ bằng khoảng 1/10. Nghĩa là với việc đơn giản như phân loại email, bạn không cần bật max cho tốn tiền.

Cửa sổ ngữ cảnh 1 triệu token

Haiku 5.5 đọc được tối đa 1 triệu token trong một lần. Bạn có thể nạp bộ tài liệu sản phẩm, hợp đồng dài hoặc lịch sử hội thoại dài mà không phải cắt nhỏ. Có một lưu ý về chi phí: prompt vượt 100.000 token sẽ bị tính giá cao gấp 5 lần, phần bảng giá bên dưới có giải thích cụ thể.

Tokenizer mới giống Sonnet 5.5 và Opus 5.5

Tokenizer là bộ chia văn bản thành token để mô hình đọc và tính tiền. Haiku 5.5 dùng tokenizer thế hệ mới, đồng bộ với Sonnet 5.5 và Opus 5.5. Anthropic thừa nhận tokenizer này dùng nhiều token hơn một chút cho cùng một khối việc. Đây là lý do mức giảm giá thực tế thấp hơn mức giảm trên bảng giá.

Nhanh hơn và hỗ trợ điều khiển trình duyệt tốt hơn

Anthropic gọi Haiku 5.5 là mô hình nhanh nhất của họ ở tốc độ tiêu chuẩn (Opus ở chế độ Fast Mode vẫn nhanh hơn). Trong thử nghiệm của Asana, độ trễ hoàn thành tác vụ giảm hơn 30% và tốc độ suy luận mỗi lượt agent nhanh gấp 2,5 lần. SDK Python và TypeScript cũng được cập nhật để hỗ trợ Computer Use và Browser Use ở dạng beta.

Giá Claude Haiku 5.5 bao nhiêu và có rẻ thật không?

Với prompt dưới 100.000 token, Claude Haiku 5.5 có giá 0,10 USD input và 0,50 USD output mỗi triệu token, rẻ hơn Haiku 4.5 khoảng 75%.

Bảng giá dưới đây là giá niêm yết quốc tế, tính bằng USD cho mỗi 1 triệu token:

Loại token Haiku 5.5 (prompt ≤ 100.000 token) Haiku 5.5 (prompt > 100.000 token) Haiku 4.5 Sonnet 5.5
Input 0,10 USD 0,50 USD 1,00 USD 2,00 USD
Output 0,50 USD 2,50 USD 5,00 USD 10,00 USD
Cache write 0,125 USD 0,625 USD 1,25 USD 2,50 USD
Cache read 0,01 USD 0,05 USD 0,10 USD 0,10 USD

Vì sao giảm 90% trên bảng giá nhưng thực tế chỉ khoảng 75%?

Có hai lý do. Thứ nhất, giá chỉ giảm 90% với prompt dưới 100.000 token, còn prompt dài hơn chỉ giảm 50%. Theo Anthropic, khoảng 90% request trên Haiku 4.5 nằm ở nhóm dưới 100.000 token. Thứ hai, tokenizer mới tiêu tốn nhiều token hơn cho cùng một việc. Gộp hai yếu tố, Anthropic ước tính chi phí vận hành trung bình giảm khoảng 75%.

Ví dụ tính nhanh cho một chatbot chăm sóc khách hàng

Giả sử chatbot của bạn xử lý 10.000 lượt hỏi mỗi ngày, mỗi lượt khoảng 2.000 token input và 300 token output. Tính theo giá niêm yết, Haiku 5.5 tốn khoảng 2 USD cho input và 1,5 USD cho output, tổng 3,5 USD/ngày. Cùng khối lượng đó, Haiku 4.5 tốn khoảng 35 USD/ngày.

Đây là phép tính minh họa của chúng tôi dựa trên bảng giá, chưa tính phần token tăng thêm do tokenizer mới và chưa trừ phần tiết kiệm từ prompt caching. Hóa đơn thực tế của bạn sẽ khác, nhưng chênh lệch vẫn đủ lớn để nhiều tác vụ trước đây "đắt quá không dám tự động hóa" giờ trở nên khả thi.

Cùng ngày ra mắt, Anthropic giảm 50% giá cache read của Sonnet 5.5, từ 0,20 USD xuống 0,10 USD mỗi triệu token. Thuê bao Claude Max 5x được tặng 100 USD API credit mỗi tháng, Max 20x được 200 USD, gói Team được tối đa 500 USD dùng chung cho cả nhóm.

Claude Haiku 5.5 mạnh đến đâu qua các bài benchmark?

Claude Haiku 5.5 vượt Haiku 4.5 và GPT-6 Luna ở mọi bài đo được công bố chung, nhưng vẫn đứng sau Sonnet 5.5 trên tất cả các bài đo.

Bảng dưới đây lấy từ số liệu Anthropic công bố ngày 07/10/2026. GPT-6 Luna là mô hình nhỏ của OpenAI, đối thủ trực tiếp cùng phân khúc giá.

Benchmark Đo năng lực gì Haiku 5.5 Haiku 4.5 GPT-6 Luna Sonnet 5.5
GDPval-AA v2.1 (Elo) Công việc chuyên môn thực tế ở 44 nghề 1620 735 1437 1840
AA-Briefcase v1.1 (Elo) Dự án kéo dài qua nhiều phiên làm việc 1578 614 1336 1824
OSWorld 2.1 (offline) Tự thao tác máy tính qua nhiều bước 72,4% 15,7% 48,9% 83,9%
Humanity's Last Exam (không công cụ) Kiến thức học thuật cấp chuyên gia 45,9% 10,2% Không công bố 56,9%
Humanity's Last Exam (có công cụ) Kiến thức chuyên gia có tra cứu, chạy code 57,4% 18,7% Không công bố 64,5%
Terminal-Bench 4.0 Làm việc độc lập trên dòng lệnh 39,2% 0,0% 16,4% 70,6%
FrontierCode 1.1 (Main) Giải quyết pull request thực tế 46,4% Không công bố 42,4% 52,1% (xhigh)
Chartography (không công cụ) Đọc hiểu biểu đồ nghiệp vụ 46,4% 6,4% 29,1% 61,6%

Điểm mạnh nhất: điều khiển máy tính và việc văn phòng

Trên OSWorld 2.1, Haiku 5.5 tăng từ 15,7% lên 72,4%. Nói đơn giản, Haiku 4.5 gần như không dùng được để tự động thao tác máy tính, còn Haiku 5.5 đã dùng được. Trên GDPval-AA, điểm Elo tăng hơn gấp đôi và cao hơn GPT-6 Luna khoảng 180 điểm. Với các pipeline trích xuất số liệu từ báo cáo, mức tăng ở Chartography (6,4% lên 46,4%) là con số đáng chú ý.

Điểm cần tỉnh táo: lập trình phức tạp

Vâng, 39,2% trên Terminal-Bench 4.0 nghe không oai lắm. Nhưng Haiku 4.5 được đúng 0%, nên đây là bước nhảy thật. Dù vậy, Sonnet 5.5 đạt 70,6% trên cùng bài đo. Chính Anthropic khuyến nghị dùng Sonnet 5.5 hoặc Opus 5.5 cho lập trình agent phức tạp, còn Haiku 5.5 hợp với việc có phạm vi hẹp như tóm tắt, nén ngữ cảnh hay làm subagent.

Doanh nghiệp đang dùng Claude Haiku 5.5 vào việc gì?

Asana, HubSpot, AlphaSense, Box và Cognition đã thử Claude Haiku 5.5 cho agent nội bộ, kiểm toán CRM, hỏi đáp tài liệu và lập trình.

Các kết quả dưới đây là phản hồi thử nghiệm sớm mà Anthropic công bố cùng bài ra mắt. Đây là số liệu do đối tác tự đo trên hệ thống riêng của họ, không phải benchmark độc lập.

Doanh nghiệp Bài toán Kết quả công bố
Asana Agent AI Teammates: phân loại lỗi, thiết lập dự án Độ trễ giảm hơn 30%, suy luận mỗi lượt agent nhanh tới 2,5 lần
HubSpot Mô phỏng tác vụ CRM, kiểm toán bản ghi lỗi thời 92,8% (trung bình 3 lần chạy), tỷ lệ dương tính giả thấp nhất trong các mô hình nhỏ được thử
AlphaSense Tính năng hỏi đáp trong tài liệu, khoảng 8 triệu lượt gọi mỗi tuần Điểm chính xác tăng từ 0,76 lên 0,84 trên 400 truy vấn
Box Box AI phân tích tài liệu tài chính Cao hơn Haiku 4.5 11 điểm, độ trễ giảm khoảng một nửa
Cognition Haiku 5.5 làm trợ lý cho Devin Fusion Giữ FrontierCode 66,2, giảm chi phí và độ trễ

Nhìn kỹ bảng này, bạn sẽ thấy một điểm chung: không doanh nghiệp nào dùng Haiku 5.5 làm "bộ não chính". Họ giao cho nó những việc lặp lại với khối lượng lớn, hoặc đặt nó làm trợ lý cho một mô hình lớn hơn. Đó cũng là cách dùng chúng tôi khuyên bạn bắt đầu.

Khi nào nên dùng Claude Haiku 5.5 thay cho Sonnet hoặc Opus?

Hãy dùng Claude Haiku 5.5 cho việc lặp lại, cần nhanh và rẻ. Chọn Sonnet 5.5 hoặc Opus 5.5 cho lập trình phức tạp và tư duy chiến lược.

Dùng Opus để phân loại email cũng giống như thuê kiến trúc sư trưởng đi xếp ghế hội trường. Làm được, làm tốt, nhưng hóa đơn cuối tháng sẽ khiến bạn hối hận. Bảng dưới đây là cách chia việc chúng tôi thấy hợp lý cho phần lớn đội marketing và vận hành:

Loại việc Mô hình gợi ý Lý do
Phân loại ticket, bình luận, email Haiku 5.5 (low hoặc medium) Việc lặp lại, cần rẻ và nhanh
Tóm tắt tài liệu, nén lịch sử hội thoại Haiku 5.5 Đúng nhóm việc Anthropic thiết kế cho mô hình
Chatbot chăm sóc khách hàng trực tiếp Haiku 5.5 Độ trễ thấp, chi phí mỗi lượt rất nhỏ
Tự động thao tác trình duyệt Haiku 5.5, nâng lên Sonnet 5.5 nếu luồng dài và rủi ro cao OSWorld 72,4% đủ cho tác vụ rõ ràng, chưa bằng Sonnet
Lập trình nhiều file, refactor lớn Sonnet 5.5 hoặc Opus 5.5 Terminal-Bench: Sonnet 70,6% so với Haiku 39,2%
Lập chiến lược, phân tích nhiều tầng Opus 5.5 Cần suy luận sâu, sai một bước tốn kém

Mô hình "trưởng nhóm và trợ lý" trong hệ thống multi-agent

Cách khai thác Haiku 5.5 hiệu quả nhất là ghép nó với một mô hình lớn. Mô hình lớn lên kế hoạch và ra quyết định, Haiku 5.5 đi làm các việc nhỏ: đọc tài liệu, trích số liệu, chạy kiểm tra, tóm tắt kết quả. Ví dụ, Rogo dùng Haiku 5.5 để trích số liệu doanh thu theo mảng từ báo cáo thường niên 10-K, sau đó mô hình lớn dùng số liệu đó để dựng slide thuyết trình.

Nếu bạn làm marketing, có thể áp dụng tương tự: để Haiku 5.5 gom và phân loại bình luận fanpage, tóm tắt báo cáo quảng cáo hằng ngày, rồi giao phần đọc insight và đề xuất chiến lược cho Sonnet hoặc Opus.

Claude Haiku 5.5 có an toàn khi dùng cho agent không?

Claude Haiku 5.5 chống prompt injection tốt nhất dòng Haiku, nhưng tỷ lệ ảo giác vẫn tương đương Haiku 4.5 nên bạn cần kiểm chứng đầu ra.

Prompt injection là kiểu tấn công giấu lệnh độc hại trong trang web, email hoặc tài liệu để "dụ" agent làm việc ngoài ý muốn. Theo System Card, trong môi trường lập trình, tỷ lệ tấn công gián tiếp thành công lên Haiku 5.5 chỉ 0,08%, so với 58,40% của Haiku 4.5. Trong môi trường điều khiển máy tính, con số này là 0,07% so với 18,89%.

Với các yêu cầu đơn lẻ, mô hình cũng bớt "khó tính" hơn: tỷ lệ từ chối nhầm yêu cầu bình thường trên Claude.ai giảm từ 3,05% xuống 0,82%. Có điều, trong bài kiểm tra hành vi tự động của Anthropic, Haiku 5.5 lại từ chối thừa nhiều hơn mọi mô hình được thử, kể cả Haiku 4.5. Nếu bạn dựng agent chạy hội thoại dài, hãy test kỹ các tình huống bị từ chối nhầm trước khi đưa vào vận hành.

Điểm yếu cần biết: System Card ghi nhận tỷ lệ ảo giác dữ kiện của Haiku 5.5 vẫn tương đương Haiku 4.5 và cao hơn Sonnet, Opus. Nếu bạn dùng Haiku 5.5 để viết nội dung có số liệu, giá bán hay thông tin pháp lý, hãy luôn có một bước kiểm tra lại trước khi xuất bản.

Làm sao để bắt đầu dùng Claude Haiku 5.5?

Bạn có thể dùng Claude Haiku 5.5 trên Claude.ai hoặc gọi API với model ID claude-haiku-5-5 qua Claude Platform, Bedrock, Vertex AI và Azure.

  1. Dùng trực tiếp trên Claude.ai: chọn Haiku 5.5 trong danh sách mô hình. Cách này hợp để thử nhanh chất lượng trả lời trước khi tích hợp.
  2. Gọi qua Claude API: khai báo model là claude-haiku-5-5. Nếu bạn đang dùng Haiku 4.5, thường chỉ cần đổi model ID rồi chạy lại bộ test.
  3. Dùng qua nền tảng đám mây: Haiku 5.5 có sẵn trên Amazon Bedrock, Google Cloud Vertex AI và Microsoft Azure, tiện cho doanh nghiệp đã có hạ tầng ở đó.
  4. Chọn effort phù hợp: bắt đầu với medium, thử hạ xuống low cho việc phân loại và trích xuất, chỉ nâng lên high hoặc max khi cần suy luận nhiều bước.
  5. Kiểm soát độ dài prompt: cố giữ prompt dưới 100.000 token và bật prompt caching cho phần nội dung lặp lại để hưởng mức giá thấp nhất.

Một mẹo nhỏ từ kinh nghiệm triển khai AI: đừng đổi toàn bộ hệ thống sang mô hình mới trong một ngày. Hãy chạy song song Haiku 5.5 và mô hình cũ trên cùng một bộ dữ liệu mẫu, so sánh chất lượng và chi phí, rồi mới chuyển dần.

Câu hỏi thường gặp về Claude Haiku 5.5

Claude Haiku 5.5 ra mắt khi nào?

Claude Haiku 5.5 được Anthropic phát hành ngày 07/10/2026. Đây là mô hình cuối cùng trong gia đình Claude 5.5, sau Opus 5.5 và Sonnet 5.5.

Giá Claude Haiku 5.5 bao nhiêu?

Với prompt từ 100.000 token trở xuống, giá là 0,10 USD cho mỗi triệu token input và 0,50 USD cho mỗi triệu token output. Prompt dài hơn có giá 0,50 USD input và 2,50 USD output. Anthropic ước tính chi phí trung bình thấp hơn Haiku 4.5 khoảng 75%.

Claude Haiku 5.5 khác gì Claude Sonnet 5.5?

Haiku 5.5 rẻ hơn và nhanh hơn, hợp với việc lặp lại khối lượng lớn. Sonnet 5.5 mạnh hơn trên mọi benchmark Anthropic công bố, ví dụ Terminal-Bench 4.0 đạt 70,6% so với 39,2% của Haiku 5.5, nên phù hợp hơn cho lập trình và phân tích phức tạp.

Claude Haiku 5.5 có lập trình tốt không?

Haiku 5.5 lập trình tốt hơn hẳn Haiku 4.5 và đạt 46,4% trên FrontierCode 1.1. Tuy vậy, Anthropic khuyến nghị dùng nó làm subagent hỗ trợ Sonnet 5.5 hoặc Opus 5.5, thay vì giao toàn bộ dự án lập trình phức tạp.

Cửa sổ ngữ cảnh của Claude Haiku 5.5 là bao nhiêu?

Claude Haiku 5.5 có cửa sổ ngữ cảnh 1 triệu token. Lưu ý rằng prompt vượt 100.000 token sẽ bị tính theo bậc giá cao hơn gấp 5 lần.

Claude Haiku 5.5 có tốt hơn GPT-6 Luna không?

Theo bảng số liệu Anthropic công bố, Haiku 5.5 cao hơn GPT-6 Luna ở mọi benchmark mà cả hai cùng có mặt, như OSWorld 2.1 đạt 72,4% so với 48,9%. Đây là số liệu từ phía Anthropic, nên bạn vẫn nên tự thử trên dữ liệu thực tế của mình.

Bạn nên làm gì tiếp theo với Claude Haiku 5.5?

Hãy chọn một việc lặp lại trong tuần này, chạy thử trên Claude Haiku 5.5 ở mức medium và so sánh chi phí, chất lượng với cách cũ.

Claude Haiku 5.5 không thay được Sonnet hay Opus. Giá trị của nó nằm ở chỗ biến những việc trước đây "đắt quá không đáng tự động hóa" thành việc chạy được mỗi ngày với chi phí rất nhỏ. Ai biết chia việc đúng giữa ba mô hình sẽ tiết kiệm được nhiều nhất.

Nếu bạn muốn đi xa hơn việc thử từng mô hình, hãy tham khảo khóa học Claude AI Mastery của Vinalink Academy. Chương trình 6 buổi thực chiến hướng dẫn bạn cá nhân hóa Claude bằng Project và Skill, xây trợ lý cho Content, Marketing, Sales, dựng agent tự động và lập lộ trình AI 90 ngày cho doanh nghiệp. Vinalink Academy đã đào tạo hơn 15.000 học viên. Bài tập trong khóa đều làm trực tiếp trên công việc thật của bạn.

Call Zalo Messenger TikTok LinkedIn