Claude Fable 5.1: Giữ Nguyên Giá, Đọc Bộ Nhớ Đệm Rẻ Đi 4 Lần, Kèm Ba Thay Đổi Gây Vỡ Mã
Ngày 1/9/2026, Anthropic phát hành Claude Fable 5.1 với giá đầu vào và đầu ra y hệt Fable 5, nhưng giá đọc bộ nhớ đệm giảm còn 0,25 USD mỗi triệu token — bằng một phần tư mức cũ. Đổi lại là ba thay đổi phá vỡ mã đang chạy. Đáng chú ý hơn cả: Anthropic tự liệt kê bảy điểm mô hình mới làm kém đi so vớ
Anthropic vừa ra bản kế nhiệm của mô hình mạnh nhất trong dòng sản phẩm, giữ nguyên giá đầu vào và đầu ra, và cắt giá đọc bộ nhớ đệm xuống còn một phần tư. Nhưng phần đáng đọc nhất trong tài liệu phát hành không phải bảng điểm — mà là danh sách bảy điểm mô hình mới làm kém đi, do chính Anthropic viết ra.
Anthropic phát hành cái gì
Ngày 1/9/2026, Anthropic phát hành Claude Fable 5.1 và Claude Mythos 5.1. Bản Fable 5.1 mở cho mọi khách hàng trên Claude API với mã gọi claude-fable-5-1, đồng thời có trên Amazon Bedrock, Google Cloud và Microsoft Foundry. Bản Mythos 5.1 có năng lực y hệt nhưng chỉ dành cho thành viên chương trình Project Glasswing — những tổ chức đã qua thẩm định để làm việc trong lĩnh vực an ninh mạng và khoa học sự sống, nơi bộ lọc an toàn của bản phổ thông sẽ chặn.
| Thông số | Claude Fable 5.1 |
|---|---|
| Mã mô hình (Claude API) | claude-fable-5-1 |
| Cửa sổ ngữ cảnh | 1 triệu token, tính giá tiêu chuẩn trên toàn bộ cửa sổ |
| Đầu ra tối đa | 128 nghìn token |
| Cơ chế suy nghĩ | Thích ứng, luôn bật; điều chỉnh độ sâu bằng tham số effort, mặc định high |
| Mốc kiến thức đáng tin cậy | Tháng 6/2026 |
| Cam kết vòng đời | Không ngừng phục vụ sớm hơn 1/9/2027 |
Nguồn: tài liệu chính thức platform.claude.com, trang tổng quan Claude Fable 5.1, đọc ngày 2/9/2026.
Chỗ tiền thực sự thay đổi: giá đọc bộ nhớ đệm
Giá đầu vào và đầu ra không đổi so với Fable 5. Thay đổi duy nhất về giá nằm ở đọc bộ nhớ đệm: trên các mô hình Claude khác, một lượt đọc đệm tốn 10% giá đầu vào cơ bản; trên Fable 5.1 và Mythos 5.1, nó chỉ tốn 2,5%. Quy ra tiền là 0,25 USD mỗi triệu token, thay vì 1 USD.
| Hạng mục | Fable 5.1 / Mythos 5.1 | Ghi chú |
|---|---|---|
| Đầu vào | 10 USD / triệu token | Giữ nguyên |
| Đầu ra | 50 USD / triệu token | Giữ nguyên |
| Ghi đệm 5 phút | 12,50 USD / triệu token | Giữ nguyên |
| Ghi đệm 1 giờ | 20 USD / triệu token | Giữ nguyên |
| Đọc đệm | 0,25 USD / triệu token | Còn một phần tư mức cũ |
| Xử lý theo lô | 5 USD vào / 25 USD ra | Giảm 50% |
Nguồn: trang "What's new in Claude Fable 5.1" trên platform.claude.com, đọc ngày 2/9/2026.
Ai thực sự được lợi? Chỉ những khối lượng công việc đọc lại một đoạn mở đầu ổn định nhiều lần: tác tử chạy dài trên cùng một kho mã, trợ lý hỏi đáp trên cùng một bộ tài liệu, quy trình hàng loạt dùng chung một system prompt lớn.
Anthropic công bố mức tiết kiệm khoảng 25% cho khối lượng công việc thông thường và tối đa 45% cho tác vụ nặng tính tác tử. Đây là số của nhà sản xuất, chưa có tổ chức độc lập nào kiểm chứng. Hai điều kiện không đổi cần nhớ: độ dài tối thiểu để lưu đệm vẫn là 512 token, và giá ghi vào đệm không giảm. Nếu mỗi lượt gọi của bạn mang một ngữ cảnh khác nhau, khoản giảm giá này gần như không chạm tới bạn.
Ba thay đổi phá vỡ mã đang chạy
Anthropic gọi thẳng ba thay đổi này là breaking. Nếu bạn chỉ đổi tên mô hình rồi triển khai, đây là ba chỗ hỏng.
- Không còn ép gọi công cụ. Đặt tool_choice thành any hoặc tool sẽ trả lỗi 400. Lý do Anthropic đưa ra: suy nghĩ luôn bật, mà một lệnh ép gọi công cụ sẽ bỏ qua bước suy nghĩ, khiến mô hình viết phần lập luận vào chính tham số của công cụ và làm giảm chất lượng tham số. Cách thay thế là giữ auto rồi dùng strict tool use hoặc structured outputs, hoặc đơn giản là nói rõ trong prompt khi nào cần gọi công cụ.
- Khối suy nghĩ gắn chặt với mô hình sinh ra nó. Fable 5.1 đọc được khối suy nghĩ của các mô hình cũ, nhưng không mô hình cũ nào đọc được khối của Fable 5.1. Hệ quả thực tế: một hệ thống định tuyến hoặc dự phòng chuyển mô hình giữa chừng sẽ mất toàn bộ phần suy luận ở những lượt chạy trên mô hình cũ. Khối bị loại bỏ không bị tính vào input_tokens và không bị tính tiền, nhưng nếu không bật cờ beta thì việc loại bỏ diễn ra âm thầm.
- Sửa lượt cũ làm mất hiệu lực khối suy nghĩ. Sửa bất cứ thứ gì đứng trước một khối suy nghĩ — kể cả dựng lại system prompt hay mảng tools — sẽ khiến lượt gọi sau báo lỗi. Quy tắc này được cưỡng chế với tài khoản tạo từ 31/8/2026 trở đi; tài khoản cũ hơn thì API chỉ ghi nhận sai khác. Claude Code, claude.ai và Claude Agent SDK đã tự giữ đúng phần đầu hội thoại cho bạn — rủi ro nằm ở mã tự dựng mảng messages.
Đi kèm là năm bổ sung không phá vỡ gì: đổi mức nỗ lực giữa cuộc hội thoại mà không làm hỏng bộ đệm (beta), system message chỉ có hiệu lực trong một lượt (beta), cập nhật tiến độ đọc được giữa các lần gọi công cụ qua tuỳ chọn display dạng updates (beta), giá đọc đệm thấp hơn, và dấu vết nguồn gốc nội dung — văn bản do Fable 5.1 sinh ra mang thuỷ vân thống kê của Anthropic, còn ảnh và video lấy qua Files API mang thông tin xác thực C2PA.
Điểm số — toàn bộ do Anthropic tự công bố
Các con số dưới đây lấy từ trang thông báo của Anthropic. Tính đến ngày viết bài, chưa có tổ chức đo lường độc lập nào công bố kết quả cho Fable 5.1. Nên đọc chúng như tuyên bố của nhà sản xuất.
| Bài đo | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | 29,0% | 22,4% |
| GDPval-AA v2 (điểm số) | 1853 | 1723 | 1824 | 1711 |
| AutomationBench | 31,4% | 17,1% | 26,9% | 19,6% |
| CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% | 67,2% |
| Humanity's Last Exam (không công cụ) | 60,9% | 57,8% | 56,6% | chưa công bố |
| OSWorld 2.0 (chấm chặt) | 41,7% | 36,1% | 39,6% | chưa công bố |
| Terminal-Bench 4.0 | 55,8% | chưa công bố | 52,3% | 37,3% |
Nguồn: trang thông báo Claude Fable 5.1 và Mythos 5.1 của Anthropic, đọc ngày 2/9/2026. Ở Terminal-Bench 4.0, trang thông báo nêu Mythos 5.1 đạt 60,9% và Mythos 5 đạt 42,0%, nhưng không nêu số của Fable 5 — nên ô đó để trống thay vì suy đoán.
Bước nhảy lớn nhất nằm ở Terminal-Bench-Science: từ 24,7% lên 52,6%, tức hơn gấp đôi. Nhưng cần đọc kèm bối cảnh — đây là bài đo mới ở phiên bản 0.1, và một bài đo càng mới thì càng ít người ngoài kiểm chứng được. Trên các bài đo đã quen thuộc hơn như Humanity's Last Exam hay CursorBench, khoảng cách với Fable 5 và Opus 5 chỉ vào khoảng ba điểm phần trăm.
Phần hiếm thấy: hãng tự liệt kê chỗ mình làm kém đi
Trong tài liệu kỹ thuật, Anthropic dành hẳn một mục tên "Changed from Claude Fable 5" liệt kê bảy khác biệt hành vi xuất hiện mà không cần bạn đổi dòng mã nào — và phần lớn là bất lợi:
- Gọi công cụ song song thất thường hơn. Chỗ Fable 5 gộp nhiều lệnh vào một lượt thì Fable 5.1 có thể chỉ gọi một. Anthropic nói điều này không làm giảm chất lượng câu trả lời, nhưng "tốn thêm token, thêm lượt qua lại và thêm thời gian chờ".
- Ít cập nhật tiến độ hơn trong các lượt chạy công cụ dài, khiến giao diện của bạn trông như đang đứng im.
- Ở mức nỗ lực thấp, trả lời theo trí nhớ nhiều hơn — gọi công cụ tìm kiếm ít đi. Với bài toán cần thông tin mới, đây là rủi ro chính xác chứ không chỉ là tốc độ.
- Văn phong đặc hơn và ít định dạng hơn trong hội thoại — câu dài hơn, ít xuống dòng, ít in đậm và ít danh sách.
- Khi tóm tắt tài liệu, hay chép nguyên đoạn mà không đánh dấu là trích dẫn. Với đơn vị làm nội dung hay báo cáo, đây là điểm cần kiểm soát nghiêm túc.
- Khi sửa tệp, hay viết lại toàn bộ tệp thay vì sửa đúng chỗ — kết quả thường giống nhau nhưng tốn token đầu ra và thời gian.
Một nhà cung cấp tự đăng danh sách này ngay trong tài liệu phát hành là chuyện không phổ biến. Nó cũng hữu ích hơn bảng điểm: bảng điểm cho bạn biết mô hình giỏi đến đâu trong điều kiện lý tưởng, còn danh sách này cho bạn biết chỗ nào sẽ đau khi đưa vào chạy thật.
Đáng chú ý không kém: chính Anthropic khuyến nghị phần lớn khối lượng công việc nên bắt đầu từ Claude Opus 5, chứ không phải mô hình mới nhất. Opus 5 có giá 5 USD vào và 25 USD ra — bằng một nửa Fable 5.1 — và tài liệu ghi rõ chỉ nên chuyển lên Fable 5.1 khi cần suy luận nặng, tác vụ tác tử chạy dài, hoặc khi Opus 5 ở mức nỗ lực cao vẫn chưa đạt yêu cầu.
Bối cảnh: cuộc chạy đua hạ tầng phía sau
Bản phát hành đến ngay sau một loạt hợp đồng hạ tầng lớn. Theo Reuters, ngày 31/8/2026 Anthropic ký hợp đồng điện toán đám mây trị giá 35 tỷ USD trong sáu năm với Lambda — công ty được Nvidia hậu thuẫn — cho khoảng 350 megawatt công suất tại một trung tâm dữ liệu ở hạt Nueces, bang Texas do Hut 8 xây dựng. Trước đó trong cùng tháng, hãng đã cam kết 45 tỷ USD trong sáu năm với Nscale cho công suất tại West Virginia. Reuters ước tính riêng năm 2026 Anthropic đã ký các thoả thuận điện toán trị giá ít nhất 135 tỷ USD.
Những con số này giải thích vì sao giá đầu vào và đầu ra không giảm, mà chỉ có giá đọc bộ nhớ đệm giảm. Đọc đệm là phần rẻ nhất để phục vụ — dữ liệu đã nằm sẵn — nên đó cũng là phần dễ hạ giá nhất mà không đụng vào biên lợi nhuận của phần tính toán thật.
Ba việc doanh nghiệp Việt Nam nên làm
- Kiểm tra xem bạn có thực sự dùng bộ nhớ đệm không, trước khi mừng vì giảm giá. Mức giảm chỉ áp cho lượt đọc đệm. Hãy mở hoá đơn tháng gần nhất, tách riêng phần token đọc đệm và phần token đầu vào thường. Nếu tỷ lệ đọc đệm thấp, khoản giảm này gần như vô nghĩa với bạn, và bài toán đúng là thiết kế lại prompt để có một đoạn mở đầu ổn định dài hơn 512 token.
- Nếu mã tự dựng mảng messages, rà ba thay đổi gây vỡ mã trước khi đổi tên mô hình. Cụ thể: bỏ mọi tool_choice dạng any hoặc tool; ngừng chèn rồi xoá văn bản nhắc việc vào các lượt cũ; ngừng dựng lại system prompt giữa chừng. Ba lỗi này không xuất hiện lúc chạy thử ngắn — chúng xuất hiện ở phiên dài, đúng lúc bạn đã lên môi trường thật.
- Đừng mặc định chọn mô hình đắt nhất. Chính nhà sản xuất khuyến nghị bắt đầu từ Opus 5 với giá bằng một nửa. Cách làm đúng là dựng một bộ thử vài trăm mẫu trên đúng dữ liệu của bạn, chạy cả hai mô hình, rồi so cả chất lượng lẫn chi phí mỗi tác vụ — thay vì so bảng điểm của bài đo mà bạn không dùng bao giờ.
Nguồn:
- Anthropic — Claude Fable 5.1 overview — nguồn cho mã mô hình, cửa sổ ngữ cảnh, giới hạn đầu ra, giá, mốc kiến thức, cam kết vòng đời và bảng so sánh với Opus 5, Sonnet 5, Haiku 4.5, đọc 2/9/2026
- Anthropic — What's new in Claude Fable 5.1 — nguồn cho ba thay đổi gây vỡ mã, năm tính năng bổ sung, bảng giá chi tiết, và toàn bộ mục "Changed from Claude Fable 5" liệt kê bảy khác biệt hành vi, đọc 2/9/2026
- Anthropic — Claude Fable 5.1 and Claude Mythos 5.1 — nguồn cho toàn bộ điểm benchmark và mức tiết kiệm chi phí 25% đến 45%, đọc 2/9/2026
- SiliconANGLE — Anthropic launches Claude Fable 5.1 after inking $35B cloud deal with Lambda — nguồn cho bối cảnh thương vụ Lambda và Nscale, đọc 2/9/2026
- Reuters (qua bản đăng lại của các đài liên kết) — Anthropic signs $35 billion cloud deal with Nvidia-backed Lambda — nguồn cho thời hạn sáu năm, công suất khoảng 350 megawatt, hạt Nueces, Hut 8, và con số ít nhất 135 tỷ USD thoả thuận điện toán trong năm 2026, đọc 2/9/2026
Toàn bộ điểm benchmark trong bài là số do Anthropic tự công bố. Tính đến 2/9/2026, Locaith không tìm thấy kết quả đo độc lập nào cho Claude Fable 5.1, và chúng tôi chưa tự chạy thử mô hình này. Các mức tiết kiệm 25% và 45% cũng là con số của nhà sản xuất, phụ thuộc hoàn toàn vào tỷ lệ đọc bộ nhớ đệm trong khối lượng công việc cụ thể. Thương vụ Lambda được Reuters dẫn nguồn giấu tên và chưa có thông cáo chính thức từ Anthropic xác nhận giá trị hợp đồng. Ba khuyến nghị ở cuối bài là quan điểm riêng của Locaith, không có trong tài liệu của Anthropic. Ảnh bìa là ảnh công bố chính thức của Anthropic cho bản 5.1, tải từ trang thông báo anthropic.com/claude-fable-and-mythos-5-1. Ảnh: Anthropic. Biên soạn và phân tích bởi Ban Biên Tập Locaith, 2/9/2026.