Claude Fable 5.1 và Mythos 5.1: Mô hình frontier bạn có thể dùng — và mô hình bạn không thể
Anthropic phát hành Claude Fable 5.1 và Claude Mythos 5.1 vào ngày 1 tháng 9 năm 2026. Hai mô hình dùng cùng một mô hình nền, nhưng có safeguards khác nhau: Fable 5.1 được cung cấp rộng rãi, còn Mythos 5.1 chỉ dành cho các tổ chức đã được thẩm định thông qua chương trình trusted access của Anthropic.
Bản phát hành này đáng chú ý vì hai lý do. Thứ nhất, Anthropic tuyên bố Fable 5.1 tiến bộ đáng kể ở coding dài hạn, nghiên cứu, tài liệu, bảng tính, slide, vision và computer use. Thứ hai, công ty đang cố làm cho mô hình cấp Fable phù hợp hơn với production bằng cách giảm giá cache read, tinh chỉnh safety routing và giới thiệu kiến trúc giám sát doanh nghiệp do khách hàng kiểm soát.
Phản hồi ban đầu của cộng đồng rất hào hứng với công việc khó và nhiều phần, nhưng thận trọng hơn về tốc độ, usage limit, văn phong, safeguards, lưu trữ dữ liệu và việc giá theo đơn vị thấp hơn có thật sự làm hóa đơn giảm hay không. Cách đọc hợp lý nhất là: Fable 5.1 giống một động cơ làm việc chuyên biệt, không phải mô hình nên b ật mù quáng cho mọi prompt.
Anthropic thực sự đã phát hành gì
Phiên bản công khai là Claude Fable 5.1, với API model ID claude-fable-5-1. Claude Mythos 5.1 dùng cùng mô hình và thông số, nhưng chỉ được cung cấp thông qua chương trình trusted access cho một số tổ chức an ninh mạng và khoa học sự sống.
Các chi tiết vận hành quan trọng:
- Context window: 1M token.
- Max output: 128K token.
- Thinking: adaptive thinking luôn bật; dùng
effortđể điều khiển độ sâu. - Effort mặc định:
hightrong Claude Code vàmediumtrong Claude.ai và Claude Cowork. - Giá cơ bản: 10 USD mỗi triệu input token và 50 USD mỗi triệu output token.
- Cache read: 0,25 USD mỗi triệu token, bằng một phần tư giá của Fable 5.
- Giá batch: 5 USD mỗi triệu input token và 25 USD mỗi triệu output token.
- Nền tảng: Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud và Microsoft Foundry.
Anthropic ước tính Fable 5.1 rẻ hơn khoảng 25% ở workload tính phí theo token thông thường, và có thể rẻ hơn khoảng 45% ở công việc agentic cao. Đây là ước tính của công ty, không phải nghiên cứu chi phí độc lập. Cơ chế thì rõ ràng: giá input và output giữ nguyên như Fable 5, nhưng cache read giảm từ 1 USD xuống 0,25 USD cho mỗi triệu token. Agent chạy lâu và liên tục đọc lại cùng prompt hoặc tool context sẽ hưởng lợi nhiều nhất.
Fable 5.1 cũng mang statistical text watermark của Anthropic. Anthropic cho biết watermark không nhìn thấy đối với người đọc, không thêm token, không xác định người dùng hay tổ chức và gần như không ảnh hưởng đến tốc độ. Detection API hiện ở private preview cho các tổ chức đủ điều kiện.
Câu chuyện năng lực: tốt hơn ở công việc kéo dài
Benchmark do Anthropic công bố cho thấy cải thiện so với Fable 5 ở agentic coding, knowledge work, nghiên cứu khoa học, computer use và giải quyết vấn đề dài hạn. Một số số liệu trong bảng chính thức:
| Đánh giá | Fable 5.1 | Fable 5 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0, agentic coding | 55,8% | 42,0% | 52,3% |
| GDPval-AA v2, knowledge work | 1853 | 1723 | 1824 |
| OSWorld 2.0, strict | 41,7% | 36,1% | 39,6% |
| CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% |
Phải đọc các con số này cùng phần chú thích, không coi chúng là bảng xếp hạng chung. Anthropic nói Fable 5.1 được đánh giá với safeguards production bật sẵn. Khi safeguard can thiệp, một số task bị tính zero hoặc được hoàn thành bởi model fallback. Kết quả OSWorld dùng bộ task tháng 8 năm 2026 và không so sánh trực tiếp được với số liệu cũ. Với Terminal-Bench-Science 0.1, Anthropic báo cáo sai số chuẩn khoảng 3,5–4,5 điểm.
Mô tả định tính hữu ích hơn là: Fable 5.1 được thiết kế để giữ mạch lạc khi task mở rộng. Nó có thể lập bản đồ một codebase lớn, lần theo sự cố hiếm qua nhiều service, lập kế hoạch từ nhiều tài liệu, chạy thử nghiệm, sửa artifact và quay lại với bằng chứng thay vì chỉ đưa ra câu trả lời đầu tiên nghe có vẻ hợp lý.
Vì vậy, nó có thể quan trọng với đội Claude Code hơn người dùng chat thông thường. Lợi ích kỳ vọng không nhất thiết là trả lời tốt hơn một câu hỏi ngắn, mà là ít bị kẹt hơn, ít sửa hời hợt hơn, phân tích nguyên nhân gốc tốt hơn và hoàn thành nhiều việc hơn trong session kéo dài vài giờ.
Fable và Mythos: một mô hình, hai chính sách runtime
Khác biệt sản phẩm quan trọng nhất không nằm ở intelligence thuần túy, mà ở policy layer bao quanh mô hình.
Fable 5.1 là phiên bản dành cho sử dụng chung. Safeguards của nó chính xác hơn Fable 5:
- Có thể xác định lỗ hổng trong source code cho công việc phòng thủ, nhưng không tạo exploit, không làm penetration testing và không quét lỗ hổng dựa trên binary.
- Anthropic cho biết biology safeguards can thiệp ít hơn 85% đối với câu hỏi lành tính về biology cơ bản và y khoa so với safeguards khi Fable 5 ra mắt.
- Nghiên cứu biology và chemistry dual-use vẫn có thể bị route sang model Opus.
- Claude API có thể trả về
stop_reason: "refusal"vàstop_details.category. Ứng dụng phải coi đây là một kết quả runtime, không mặc định mọi HTTP 200 là câu trả lời đã hoàn tất.
Mythos 5.1 là phiên bản ít hạn chế hơn cho người tham gia được phê duyệt trong Cyber Verification và Life Sciences Verification. Quyền truy cập vẫn rất hạn chế; Anthropic hiện nói chỉ một số tổ chức tại Mỹ có thể dùng. Claude Security cũng chạy trên Mythos 5.1.
Điều này giải thích tại sao Fable 5.1 có thể thấp hơn Mythos 5.1 ở một số cyber evaluation dù cùng model: refusal hoặc fallback làm thay đổi kết quả đo. Nó cũng giải thích vì sao trải nghiệm thực tế có thể khác headline capability: model có thể làm được task, nhưng sản phẩm công khai không cho phép hoàn thành task đó.