Claude Fable 5.1: Giữ Nguyên Giá, Đọc Bộ Nhớ Đệm Rẻ Đi 4 Lần, Kèm Ba Thay Đổi Gây Vỡ Mã

Ngày 1/9/2026, Anthropic phát hành Claude Fable 5.1 với giá đầu vào và đầu ra y hệt Fable 5, nhưng giá đọc bộ nhớ đệm giảm còn 0,25 USD mỗi triệu token — bằng một phần tư mức cũ. Đổi lại là ba thay đổi phá vỡ mã đang chạy. Đáng chú ý hơn cả: Anthropic tự liệt kê bảy điểm mô hình mới làm kém đi so vớ

Anthropic vừa ra bản kế nhiệm của mô hình mạnh nhất trong dòng sản phẩm, giữ nguyên giá đầu vào và đầu ra, và cắt giá đọc bộ nhớ đệm xuống còn một phần tư. Nhưng phần đáng đọc nhất trong tài liệu phát hành không phải bảng điểm — mà là danh sách bảy điểm mô hình mới làm kém đi, do chính Anthropic viết ra.

Anthropic phát hành cái gì

Ngày 1/9/2026, Anthropic phát hành Claude Fable 5.1Claude Mythos 5.1. Bản Fable 5.1 mở cho mọi khách hàng trên Claude API với mã gọi claude-fable-5-1, đồng thời có trên Amazon Bedrock, Google Cloud và Microsoft Foundry. Bản Mythos 5.1 có năng lực y hệt nhưng chỉ dành cho thành viên chương trình Project Glasswing — những tổ chức đã qua thẩm định để làm việc trong lĩnh vực an ninh mạng và khoa học sự sống, nơi bộ lọc an toàn của bản phổ thông sẽ chặn.

Thông số Claude Fable 5.1
Mã mô hình (Claude API)claude-fable-5-1
Cửa sổ ngữ cảnh1 triệu token, tính giá tiêu chuẩn trên toàn bộ cửa sổ
Đầu ra tối đa128 nghìn token
Cơ chế suy nghĩThích ứng, luôn bật; điều chỉnh độ sâu bằng tham số effort, mặc định high
Mốc kiến thức đáng tin cậyTháng 6/2026
Cam kết vòng đờiKhông ngừng phục vụ sớm hơn 1/9/2027

Nguồn: tài liệu chính thức platform.claude.com, trang tổng quan Claude Fable 5.1, đọc ngày 2/9/2026.

Chỗ tiền thực sự thay đổi: giá đọc bộ nhớ đệm

Giá đầu vào và đầu ra không đổi so với Fable 5. Thay đổi duy nhất về giá nằm ở đọc bộ nhớ đệm: trên các mô hình Claude khác, một lượt đọc đệm tốn 10% giá đầu vào cơ bản; trên Fable 5.1 và Mythos 5.1, nó chỉ tốn 2,5%. Quy ra tiền là 0,25 USD mỗi triệu token, thay vì 1 USD.

Hạng mục Fable 5.1 / Mythos 5.1 Ghi chú
Đầu vào10 USD / triệu tokenGiữ nguyên
Đầu ra50 USD / triệu tokenGiữ nguyên
Ghi đệm 5 phút12,50 USD / triệu tokenGiữ nguyên
Ghi đệm 1 giờ20 USD / triệu tokenGiữ nguyên
Đọc đệm0,25 USD / triệu tokenCòn một phần tư mức cũ
Xử lý theo lô5 USD vào / 25 USD raGiảm 50%

Nguồn: trang "What's new in Claude Fable 5.1" trên platform.claude.com, đọc ngày 2/9/2026.

Ai thực sự được lợi? Chỉ những khối lượng công việc đọc lại một đoạn mở đầu ổn định nhiều lần: tác tử chạy dài trên cùng một kho mã, trợ lý hỏi đáp trên cùng một bộ tài liệu, quy trình hàng loạt dùng chung một system prompt lớn.

Anthropic công bố mức tiết kiệm khoảng 25% cho khối lượng công việc thông thường và tối đa 45% cho tác vụ nặng tính tác tử. Đây là số của nhà sản xuất, chưa có tổ chức độc lập nào kiểm chứng. Hai điều kiện không đổi cần nhớ: độ dài tối thiểu để lưu đệm vẫn là 512 token, và giá ghi vào đệm không giảm. Nếu mỗi lượt gọi của bạn mang một ngữ cảnh khác nhau, khoản giảm giá này gần như không chạm tới bạn.

Ba thay đổi phá vỡ mã đang chạy

Anthropic gọi thẳng ba thay đổi này là breaking. Nếu bạn chỉ đổi tên mô hình rồi triển khai, đây là ba chỗ hỏng.

Đi kèm là năm bổ sung không phá vỡ gì: đổi mức nỗ lực giữa cuộc hội thoại mà không làm hỏng bộ đệm (beta), system message chỉ có hiệu lực trong một lượt (beta), cập nhật tiến độ đọc được giữa các lần gọi công cụ qua tuỳ chọn display dạng updates (beta), giá đọc đệm thấp hơn, và dấu vết nguồn gốc nội dung — văn bản do Fable 5.1 sinh ra mang thuỷ vân thống kê của Anthropic, còn ảnh và video lấy qua Files API mang thông tin xác thực C2PA.

Điểm số — toàn bộ do Anthropic tự công bố

Các con số dưới đây lấy từ trang thông báo của Anthropic. Tính đến ngày viết bài, chưa có tổ chức đo lường độc lập nào công bố kết quả cho Fable 5.1. Nên đọc chúng như tuyên bố của nhà sản xuất.

Bài đo Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
Terminal-Bench-Science 0.152,6%24,7%29,0%22,4%
GDPval-AA v2 (điểm số)1853172318241711
AutomationBench31,4%17,1%26,9%19,6%
CursorBench 3.2.073,4%70,5%70,0%67,2%
Humanity's Last Exam (không công cụ)60,9%57,8%56,6%chưa công bố
OSWorld 2.0 (chấm chặt)41,7%36,1%39,6%chưa công bố
Terminal-Bench 4.055,8%chưa công bố52,3%37,3%

Nguồn: trang thông báo Claude Fable 5.1 và Mythos 5.1 của Anthropic, đọc ngày 2/9/2026. Ở Terminal-Bench 4.0, trang thông báo nêu Mythos 5.1 đạt 60,9% và Mythos 5 đạt 42,0%, nhưng không nêu số của Fable 5 — nên ô đó để trống thay vì suy đoán.

Bước nhảy lớn nhất nằm ở Terminal-Bench-Science: từ 24,7% lên 52,6%, tức hơn gấp đôi. Nhưng cần đọc kèm bối cảnh — đây là bài đo mới ở phiên bản 0.1, và một bài đo càng mới thì càng ít người ngoài kiểm chứng được. Trên các bài đo đã quen thuộc hơn như Humanity's Last Exam hay CursorBench, khoảng cách với Fable 5 và Opus 5 chỉ vào khoảng ba điểm phần trăm.

Phần hiếm thấy: hãng tự liệt kê chỗ mình làm kém đi

Trong tài liệu kỹ thuật, Anthropic dành hẳn một mục tên "Changed from Claude Fable 5" liệt kê bảy khác biệt hành vi xuất hiện mà không cần bạn đổi dòng mã nào — và phần lớn là bất lợi:

Một nhà cung cấp tự đăng danh sách này ngay trong tài liệu phát hành là chuyện không phổ biến. Nó cũng hữu ích hơn bảng điểm: bảng điểm cho bạn biết mô hình giỏi đến đâu trong điều kiện lý tưởng, còn danh sách này cho bạn biết chỗ nào sẽ đau khi đưa vào chạy thật.

Đáng chú ý không kém: chính Anthropic khuyến nghị phần lớn khối lượng công việc nên bắt đầu từ Claude Opus 5, chứ không phải mô hình mới nhất. Opus 5 có giá 5 USD vào và 25 USD ra — bằng một nửa Fable 5.1 — và tài liệu ghi rõ chỉ nên chuyển lên Fable 5.1 khi cần suy luận nặng, tác vụ tác tử chạy dài, hoặc khi Opus 5 ở mức nỗ lực cao vẫn chưa đạt yêu cầu.

Bối cảnh: cuộc chạy đua hạ tầng phía sau

Bản phát hành đến ngay sau một loạt hợp đồng hạ tầng lớn. Theo Reuters, ngày 31/8/2026 Anthropic ký hợp đồng điện toán đám mây trị giá 35 tỷ USD trong sáu năm với Lambda — công ty được Nvidia hậu thuẫn — cho khoảng 350 megawatt công suất tại một trung tâm dữ liệu ở hạt Nueces, bang Texas do Hut 8 xây dựng. Trước đó trong cùng tháng, hãng đã cam kết 45 tỷ USD trong sáu năm với Nscale cho công suất tại West Virginia. Reuters ước tính riêng năm 2026 Anthropic đã ký các thoả thuận điện toán trị giá ít nhất 135 tỷ USD.

Những con số này giải thích vì sao giá đầu vào và đầu ra không giảm, mà chỉ có giá đọc bộ nhớ đệm giảm. Đọc đệm là phần rẻ nhất để phục vụ — dữ liệu đã nằm sẵn — nên đó cũng là phần dễ hạ giá nhất mà không đụng vào biên lợi nhuận của phần tính toán thật.

Ba việc doanh nghiệp Việt Nam nên làm

Nguồn:

Toàn bộ điểm benchmark trong bài là số do Anthropic tự công bố. Tính đến 2/9/2026, Locaith không tìm thấy kết quả đo độc lập nào cho Claude Fable 5.1, và chúng tôi chưa tự chạy thử mô hình này. Các mức tiết kiệm 25% và 45% cũng là con số của nhà sản xuất, phụ thuộc hoàn toàn vào tỷ lệ đọc bộ nhớ đệm trong khối lượng công việc cụ thể. Thương vụ Lambda được Reuters dẫn nguồn giấu tên và chưa có thông cáo chính thức từ Anthropic xác nhận giá trị hợp đồng. Ba khuyến nghị ở cuối bài là quan điểm riêng của Locaith, không có trong tài liệu của Anthropic. Ảnh bìa là ảnh công bố chính thức của Anthropic cho bản 5.1, tải từ trang thông báo anthropic.com/claude-fable-and-mythos-5-1. Ảnh: Anthropic. Biên soạn và phân tích bởi Ban Biên Tập Locaith, 2/9/2026.

Messenger