Claude Haiku 5.5 là gì? Model AI rẻ hơn 75%, có effort level điều chỉnh
Claude Haiku 5.5 ra mắt 7/10/2026: model nhanh nhất của Anthropic, giá rẻ hơn tới 75% so với Haiku 4.5, có thêm effort level để chọn mức cân bằng chi phí/độ chính xác.
Ngày 7/10/2026, Anthropic ra mắt Claude Haiku 5.5 — model nhỏ, nhanh nhất trong dòng Claude 5.5, với mức giá rẻ hơn tới 75% so với Haiku 4.5. Đây cũng là model Haiku đầu tiên có tham số “effort level” để tự chọn đánh đổi giữa tốc độ/chi phí và độ thông minh. Vậy Claude Haiku 5.5 phù hợp dùng cho việc gì, giá cụ thể ra sao và có đáng chuyển sang dùng ngay? Bài này tổng hợp các thông tin đã được Anthropic và nhiều báo công nghệ xác nhận.
Claude Haiku 5.5 là gì?
Claude Haiku 5.5 là model nhỏ nhất và nhanh nhất trong thế hệ Claude 5.5 của Anthropic, ra mắt sau Claude Opus 5.5 và Claude Sonnet 5.5 khoảng hai tuần, hoàn tất bộ ba model 5.5 mà Anthropic đã úp mở từ trước. Model ID trên API là claude-haiku-5-5.
Anthropic định vị model này cho các tác vụ khối lượng lớn, cần xử lý nhanh và rẻ: tóm tắt văn bản, phân loại dữ liệu, trích xuất thông tin, hoặc làm “subagent” chạy nền cho các hệ thống AI agent phức tạp hơn — nơi một model nhỏ, rẻ được gọi lại nhiều lần thay vì dùng model lớn cho mọi việc.
Điểm mới: Effort level — tự chọn mức “cố gắng” của model
Khác với các bản Haiku trước, Claude Haiku 5.5 là model Haiku đầu tiên hỗ trợ tham số effort level, cho phép lập trình viên chủ động đánh đổi giữa chi phí và chất lượng câu trả lời. Có 4 mức: low, medium, high, max, trong đó medium là mặc định khi gọi qua API.
- Low: phản hồi nhanh, rẻ nhất, phù hợp tác vụ đơn giản (phân loại, gắn tag, lọc nội dung).
- Medium (mặc định): cân bằng giữa tốc độ và độ chính xác cho phần lớn tác vụ hàng ngày.
- High / Max: dùng khi cần model “cố gắng” nhiều hơn, chấp nhận trả thêm chi phí và thời gian để tăng độ chính xác — gần tiếp cận hiệu năng của model lớn hơn ở các việc khó.
Trên benchmark OSWorld 2.1 (đo khả năng điều khiển máy tính của AI, tập offline), Anthropic công bố model đạt 42,0% ở mức effort Low (chi phí khoảng 0,07 USD/lượt thử) và tăng lên 72,4% ở mức Max (khoảng 0,61 USD/lượt thử). Để so sánh, Haiku 4.5 chỉ đạt 15,7% trên cùng benchmark, còn Claude Sonnet 5.5 đạt 83,9%.
Giá Claude Haiku 5.5: rẻ hơn tới 75%
Đây là điểm đáng chú ý nhất của bản cập nhật này: Anthropic giảm giá mạnh so với Haiku 4.5, trung bình rẻ hơn khoảng 75% tùy theo độ dài prompt.
| Model | Input (dưới 100K token) | Output (dưới 100K token) |
|---|---|---|
| Claude Haiku 4.5 | 1 USD / triệu token | 5 USD / triệu token |
| Claude Haiku 5.5 | 0,10 USD / triệu token | 0,50 USD / triệu token |
Với prompt vượt 100.000 token, giá tăng lên 0,50 USD/triệu token input và 2,50 USD/triệu token output. Nếu dùng qua Batch API (xử lý theo lô, không cần phản hồi ngay), chi phí input và output được giảm thêm 50%. Bảng giá chi tiết và cách tính theo độ dài prompt được letsdatascience.com phân tích thêm ngay sau khi Anthropic công bố.
Claude Haiku 5.5 chạy ở đâu?
Model này có sẵn trên nền tảng Claude của Anthropic, và trên cả ba nền tảng cloud lớn: Amazon Bedrock (AWS), Google Cloud Vertex AI, và Microsoft Azure AI Foundry — giống cách Anthropic triển khai các bản Opus 5.5 và Sonnet 5.5 trước đó.
Khi nào nên dùng Claude Haiku 5.5 thay vì Sonnet hoặc Opus?
Không phải tác vụ nào cũng cần model AI mạnh nhất. Haiku 5.5 hợp lý khi:
- Xử lý số lượng request lớn (hàng chục nghìn lượt gọi API/ngày) mà chi phí model lớn sẽ quá tốn kém.
- Tác vụ không đòi hỏi lý luận phức tạp: phân loại email, tóm tắt ngắn, gắn nhãn dữ liệu, kiểm duyệt nội dung cơ bản.
- Làm subagent trong một hệ thống AI agent nhiều tầng, nơi model lớn chỉ xử lý phần việc khó, còn phần việc lặp lại giao cho Haiku để tiết kiệm chi phí.
Ngược lại, nếu công việc cần lý luận sâu, viết code phức tạp hoặc phân tích nhiều bước, Claude Sonnet 5.5 hoặc Opus 5.5 vẫn là lựa chọn phù hợp hơn — có thể tham khảo thêm về lộ trình đào tạo kỹ sư AI mà Anthropic đang đầu tư qua Claude Frontier Academy.
Câu hỏi thường gặp
Claude Haiku 5.5 có thay thế được Claude Sonnet 5 không?
Không hoàn toàn. Haiku 5.5 nhanh và rẻ hơn, nhưng về độ “thông minh” tổng thể vẫn thấp hơn dòng Sonnet. Nếu đang dùng Claude Sonnet 5 cho công việc cần lý luận phức tạp, nên giữ Sonnet cho phần việc chính và chỉ chuyển các tác vụ đơn giản, lặp lại sang Haiku 5.5 để tiết kiệm chi phí.
Effort level có ảnh hưởng đến tốc độ phản hồi không?
Có. Mức effort thấp (Low) cho phản hồi nhanh hơn và rẻ hơn, còn mức cao (High, Max) khiến model xử lý kỹ hơn nên mất nhiều thời gian và chi phí hơn, đổi lại độ chính xác cao hơn trên các tác vụ khó.
Giá mới áp dụng từ khi nào?
Mức giá mới áp dụng ngay từ ngày ra mắt 7/10/2026, trên tất cả các kênh: Claude API, Amazon Bedrock, Google Cloud Vertex AI và Microsoft Azure.
Kết luận
Haiku 5.5 không phải là model để “khoe” năng lực lý luận, mà là công cụ tối ưu chi phí cho các tác vụ AI quy mô lớn — đúng với vai trò truyền thống của dòng Haiku. Việc bổ sung effort level giúp lập trình viên linh hoạt hơn, còn mức giá giảm tới 75% khiến việc chạy hàng loạt request trở nên dễ chịu hơn nhiều so với trước. Nếu hệ thống của bạn đang tốn kém vì dùng model lớn cho cả những việc đơn giản, đây là lúc nên thử chuyển một phần sang Claude Haiku 5.5.