Claude Fable 5.1 là gì? Model AI mới của Anthropic, giảm 75% chi phí cache
Claude Fable 5.1 ra mắt 1/9/2026 với benchmark coding tăng vọt và giá cache read giảm 75%. Tổng hợp tính năng, giá cả và cách dùng thực tế.
Claude Fable 5.1 vừa được Anthropic ra mắt ngày 1/9/2026, và điểm đáng chú ý nhất không nằm ở điểm benchmark cao hơn — mà ở chỗ hãng cắt giá đọc cache tới 75%, khiến chi phí chạy các AI agent làm việc dài hơi (coding agent, trợ lý xử lý backlog) giảm mạnh mà không cần đổi cách dùng. Nếu bạn đang dùng Claude Code, Claude API hay Claude Cowork và tự hỏi bản nâng cấp này có đáng chuyển sang không, bài viết này tổng hợp tính năng, giá cả và cách dùng thực tế của Claude Fable 5.1.
Claude Fable 5.1 là gì?
Claude Fable 5.1 là model mới nhất trong dòng frontier của Anthropic, ra mắt cùng lúc với một phiên bản anh em tên Claude Mythos 5.1. Theo thông báo từ trang chính thức của Anthropic, hai model này dùng chung một nền tảng, chỉ khác nhau ở mức độ an toàn (safeguard) được áp dụng:
- Claude Fable 5.1: phát hành công khai (GA), dùng cho công việc thông thường — coding, viết nội dung, phân tích dữ liệu, chạy agent.
- Claude Mythos 5.1: chỉ cấp qua chương trình trusted-access, hướng tới các tác vụ nhạy cảm hơn như nghiên cứu an ninh mạng hoặc khoa học sự sống, nơi cần kiểm soát chặt hơn.
Với phần lớn người dùng — kể cả dev cá nhân lẫn agency đang triển khai AI agent — Claude Fable 5.1 mới là bản cần quan tâm. Nếu bạn đã quen với Claude Opus 5, có thể hiểu đơn giản: Opus 5 là model “dùng hàng ngày” chi phí thấp hơn, còn Fable 5.1 là bản frontier mạnh nhất, dành cho tác vụ đòi hỏi suy luận sâu và chạy agent xuyên nhiều bước.
Tính năng và benchmark đáng chú ý
So với Fable 5 (bản trước), Claude Fable 5.1 có một số thay đổi ảnh hưởng trực tiếp tới việc dùng model cho công việc lập trình và agent:
- Ngữ cảnh 1 triệu token, output tối đa 128.000 token — đủ nạp một codebase cỡ vừa hoặc xử lý output dài như báo cáo, tài liệu kỹ thuật mà không cần cắt nhỏ.
- Chế độ “High effort” mặc định trong Claude Code — tinh chỉnh để chạy tác vụ nhiều giờ, xuyên nhiều ứng dụng: xử lý backlog trong Claude Cowork, nhận việc qua Slack (Claude Tag, đang beta), điều khiển trình duyệt, hoặc chạy như managed agent không cần giám sát trực tiếp.
- Hệ thống safeguard mới giảm khoảng 60% cảnh báo sai so với bản trước, tức model ít bị chặn nhầm khi xử lý tác vụ hợp lệ nhưng nhìn giống rủi ro (chạy lệnh hệ thống, sửa file cấu hình).
Về điểm benchmark, mức tăng đáng chú ý nhất nằm ở các bài test liên quan trực tiếp tới coding agent:
| Benchmark | Claude Fable 5 | Claude Fable 5.1 |
|---|---|---|
| Terminal-Bench-Science 0.1 | 24,7% | 52,6% |
| Terminal-Bench 4.0 | 42,0% | 55,8% |
| SWE-bench Verified | — | 95,0% |
| SWE-bench Pro | — | 81,2% (dẫn đầu) |
Mức nhảy vọt ở Terminal-Bench-Science — bài test mô phỏng việc chạy lệnh terminal để giải quyết tác vụ khoa học/kỹ thuật nhiều bước — cho thấy Claude Fable 5.1 được tối ưu rõ ràng cho các coding agent tự chủ (autonomous agent) chứ không chỉ để trả lời chat. Đây cũng là lý do model này được đặt làm hiệu năng tham chiếu khi so với các đối thủ như Muse Code của Meta hay các coding agent khác trên thị trường.
Giá Claude Fable 5.1 bao nhiêu?
Giá đầu vào/đầu ra của Claude Fable 5.1 giữ nguyên như Fable 5: 10 USD/triệu token input, 50 USD/triệu token output. Thay đổi lớn nhất nằm ở giá cache — phần chi phí chiếm tỷ trọng cao nhất trong các pipeline agentic chạy lặp lại nhiều lần trên cùng một ngữ cảnh:
| Loại chi phí | Giá |
|---|---|
| Input (chưa cache) | 10 USD / triệu token |
| Output | 50 USD / triệu token |
| Cache read (mới) | 0,25 USD / triệu token (giảm 75%) |
| Cache write (5 phút) | 12,50 USD / triệu token |
| Cache write (1 giờ) | 20 USD / triệu token |
Với workload thông thường, mức giảm giá cache read này đủ hạ chi phí chung khoảng 25%. Với workload agentic nặng — kiểu Claude Code liên tục đọc lại cùng một đoạn codebase lớn qua nhiều bước — mức tiết kiệm có thể lên tới 45%, vì phần lớn token trong các lượt gọi lặp lại là cache read chứ không phải input mới.
Ví dụ thực tế: một agent sửa lỗi trong codebase 500.000 token, chạy 20 bước và mỗi bước đọc lại gần như toàn bộ context qua cache. Ở giá cache read thông thường trước đây (khoảng 1 USD/triệu token), riêng phần này cho 20 bước có thể tốn khoảng 10 USD; với giá mới 0,25 USD/triệu token, con số giảm còn khoảng 2,5 USD cho cùng khối lượng việc. Đây là lý do các agency chạy nhiều agent song song cảm nhận rõ nhất sự khác biệt trên hóa đơn cuối tháng.
Cách dùng Claude Fable 5.1
Claude Fable 5.1 đã có sẵn trên các kênh chính của Anthropic:
- Claude Code: chọn model Fable 5.1, mặc định chạy effort “High” — phù hợp tác vụ phức tạp, sửa lỗi nhiều file. Thao tác đơn giản (đổi tên biến, sửa lỗi nhỏ) nên hạ xuống effort “Medium” để tiết kiệm chi phí.
- Claude API: gọi qua model ID, tận dụng prompt caching để hưởng giá cache read mới — nhớ đặt phần context tĩnh (system prompt, tài liệu tham chiếu) ở đầu prompt để cache hoạt động hiệu quả.
- Claude Cowork và Claude Tag (Slack): dùng Fable 5.1 xử lý backlog hoặc nhận việc qua Slack ở chế độ beta, phù hợp nhóm muốn giao việc dài hơi cho AI agent thay vì giám sát từng bước.
Có nên nâng cấp lên Claude Fable 5.1 không?
Nếu bạn đang chạy Claude Code hoặc bất kỳ pipeline agentic nào dùng prompt caching thường xuyên, câu trả lời gần như chắc chắn là có — vì giá input/output không đổi trong khi cache read rẻ hơn hẳn, tức không có lý do gì để ở lại bản cũ. Với người dùng chỉ chat đơn giản, không tận dụng cache nhiều, mức tiết kiệm sẽ ít rõ rệt hơn nhưng vẫn hưởng lợi từ điểm benchmark coding cao hơn.
Một lưu ý nhỏ: nếu công việc của bạn liên quan tới nội dung cần độ an toàn cao hơn (ví dụ nghiên cứu bảo mật, phân tích lỗ hổng hệ thống), Claude Mythos 5.1 mới là lựa chọn phù hợp — nhưng model này chỉ cấp qua chương trình trusted-access, không phải ai cũng đăng ký được ngay.
Câu hỏi thường gặp
Khác biệt giữa Fable 5.1 và Mythos 5.1?
Cùng nền tảng model, khác mức safeguard: Fable 5.1 phát hành công khai, còn Mythos 5.1 chỉ cấp qua chương trình trusted-access cho tác vụ nhạy cảm như an ninh mạng, khoa học sự sống.
Giá có đắt hơn bản Fable 5 không?
Không. Input/output giữ nguyên (10 và 50 USD/triệu token). Thay đổi duy nhất là cache read giảm 75%, còn 0,25 USD/triệu token — workload dùng nhiều cache sẽ rẻ hơn trước.
Fable 5.1 có thay thế Claude Opus 5 không?
Không hẳn. Opus 5 vẫn là lựa chọn “dùng hàng ngày” chi phí thấp hơn, còn Fable 5.1 là model frontier mạnh nhất, phù hợp tác vụ agentic phức tạp, chạy dài hơi.
Kết luận
Claude Fable 5.1 không phải kiểu nâng cấp chỉ đổi số phiên bản — mức giảm 75% giá cache read là thay đổi có tác động tài chính thật, đặc biệt với ai đang chạy coding agent hoặc pipeline agentic dùng Claude Code, Claude API hàng ngày. Kết hợp với điểm benchmark coding tăng mạnh (SWE-bench Verified 95%, Terminal-Bench-Science hơn gấp đôi), đây là bản nâng cấp đáng chuyển sang ngay nếu bạn đã quen với hệ sinh thái Claude. Theo dõi thêm diễn biến giá và tính năng qua VentureBeat nếu bạn cần cập nhật liên tục về hệ sinh thái Claude.