Claude API Tính Phí Trở Lại Yêu Cầu Bị Từ Chối Ở Ba Nhóm, Kể Cả Khi Bộ Lọc Chặn Nhầm
Từ 24/9/2026, Anthropic tính tiền lại những yêu cầu bị bộ phân loại an toàn của Claude chặn trước khi có đầu ra, nếu thuộc nhóm sinh học (bio), hỗ trợ phát triển mô hình AI cạnh tranh (frontier_llm) hoặc đòi mô hình chép lại suy luận nội bộ (reasoning_extraction). Anthropic nói đây là các nhóm có ít
Từ đầu tháng 6/2026, mỗi lần bộ lọc an toàn của Claude chặn một yêu cầu ngay từ đầu, trước khi mô hình kịp viết chữ nào, lập trình viên không mất tiền. Từ ngày 24/9/2026, điều đó chỉ còn đúng một phần. Anthropic tính phí trở lại những lượt từ chối như vậy nếu chúng thuộc ba nhóm: sinh học, hỗ trợ phát triển mô hình AI cạnh tranh, và trích xuất suy luận. Lý do hãng đưa ra là để phá các nỗ lực lách biện pháp bảo vệ ở quy mô lớn. Cái giá là người dùng hợp lệ bị chặn nhầm trong ba nhóm này cũng phải trả tiền, và Anthropic không công bố tỷ lệ chặn nhầm là bao nhiêu.
Điều gì thay đổi ngày 24/9
Ghi chú phát hành của Claude Platform ngày 24/9/2026 viết: "Chúng tôi tính phí trở lại các lượt từ chối đến trước bất kỳ đầu ra nào khi stop_details.category là 'bio', 'frontier_llm' hoặc 'reasoning_extraction', những nhóm mà chúng tôi đo được lượng chặn nhầm thấp." Các lượt này bị tính "như mọi yêu cầu khác, theo giá của mô hình đã chạy nó". Từ chối trước đầu ra ở các nhóm khác vẫn miễn phí. Từ chối giữa chừng, tức sau khi mô hình đã stream một phần câu trả lời, thì trước nay vẫn bị tính.
Trang tài liệu "Refusals and fallback" nói rõ hơn về mục đích: việc tính phí nhằm "phá các nỗ lực lách biện pháp bảo vệ của Anthropic ở quy mô lớn". Quy định áp dụng trên mọi nền tảng bán Claude: Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud và Microsoft Foundry. Lượt bị từ chối, dù có bị tính tiền hay không, vẫn bị trừ vào giới hạn tốc độ (rate limit).
Chỉ bốn mô hình có bộ phân loại này: Claude Fable 5.1, Claude Fable 5, Claude Opus 5.5 và Claude Opus 5. Người dùng Sonnet 5 hay Haiku 4.5 không bị ảnh hưởng.
Năm nhóm từ chối, ba nhóm bị tính tiền
| Nhóm | Ý nghĩa, theo Anthropic | Bị chặn trước đầu ra có tính tiền? |
|---|---|---|
cyber | Có thể giúp gây hại trên mạng, như viết mã độc hay khai thác lỗ hổng. Công việc an ninh mạng hợp lệ cũng có thể bị chặn. | Không |
bio | Có thể giúp gây hại sinh học, như phương pháp phòng thí nghiệm nguy hiểm. Công việc khoa học sự sống có ích cũng có thể bị chặn. | Có |
frontier_llm | Có thể giúp phát triển mô hình AI cạnh tranh, điều bị hạn chế trong điều khoản thương mại của Anthropic. Công việc học máy hợp lệ cũng có thể bị chặn. | Có |
reasoning_extraction | Yêu cầu mô hình chép lại suy luận nội bộ vào phần trả lời. | Có |
general_harms | Lĩnh vực khác trong chính sách sử dụng. Công việc hợp lệ cũng có thể bị chặn. | Không |
null | Lượt từ chối không gắn với nhóm nào. | Không |
Nguồn: tài liệu Refusals and fallback của Anthropic, Locaith đọc ngày 26/9/2026 và dịch. Anthropic ghi danh sách nhóm bị tính tiền "có thể thay đổi" khi hãng tiếp tục đo tỷ lệ chặn nhầm.
Bốn trong năm dòng mô tả tự ghi rằng công việc hợp lệ cũng có thể kích hoạt bộ lọc, trong đó có hai nhóm nay bị tính tiền: bio và frontier_llm. Anthropic nói đây là những nhóm hãng "đo được lượng chặn nhầm thấp, tính tới tháng 9/2026", nhưng không công bố con số hay cách đo. Người dùng không có cách nào tự kiểm tra "thấp" nghĩa là một phần nghìn hay một phần trăm.
Với frontier_llm, ranh giới giữa "giúp phát triển mô hình AI cạnh tranh" và "công việc học máy thông thường" do bộ phân loại của Anthropic vạch. Một nhóm sinh dữ liệu để tinh chỉnh mô hình nhỏ cho nội bộ doanh nghiệp, hay một nhóm nghiên cứu đánh giá mô hình mã nguồn mở, là những trường hợp Locaith cho rằng có thể rơi vào vùng xám. Đây là suy đoán của Locaith; Anthropic không nêu ví dụ về chặn nhầm. Chính trang giới thiệu Opus 5.5 cho thấy nhóm này có tồn tại thực tế trong đánh giá: khi bộ lọc can thiệp trong các bài đo của Anthropic, việc về sinh học và phát triển LLM tiên phong được Claude Opus 5 làm thay.
reasoning_extraction có nguồn gốc khác. Nhóm này xuất hiện cùng Claude Fable 5 ngày 9/6/2026, gắn với điều khoản dịch vụ cấm "đảo ngược kỹ thuật hoặc sao chép đầu ra của mô hình". Trên các mô hình này, suy luận thô không bao giờ được trả về; lập trình viên chỉ nhận bản tóm tắt nếu đặt thinking.display là "summarized". Yêu cầu Claude chép lại toàn bộ quá trình suy nghĩ vào câu trả lời, một cách có thể dùng để lấy dữ liệu huấn luyện cho mô hình khác, giờ vừa bị chặn vừa bị tính tiền. Tài liệu khuyên dùng adaptive thinking nếu cần suy luận ở dạng có cấu trúc.
Bốn tháng, ba lần đổi
Locaith dựng lại mốc thời gian từ nguồn cấp RSS của ghi chú phát hành Claude Platform:
- 28/5/2026: trường
stop_detailstrên phản hồi từ chối được công bố chính thức, với các nhómcyber,biohoặcnull. - 2/6/2026: "Bạn không còn bị tính phí" cho yêu cầu trả về
stop_reason: "refusal"khi Claude chưa tạo đầu ra nào. Chữ "không còn" cho thấy trước đó các lượt này có bị tính. - 9/6/2026: Claude Fable 5 ra mắt cùng nhóm
reasoning_extraction; ghi chú nhắc lại lượt bị chặn trước đầu ra không bị tính phí. - 24/7/2026: tham số
fallbackscó chế độ"default"(beta), tự chạy lại yêu cầu bị từ chối trên mô hình Anthropic khuyến nghị cho từng nhóm. - 24/9/2026: tính phí trở lại cho
bio,frontier_llmvàreasoning_extraction.
Locaith không tìm thấy ghi chú phát hành nào nêu ngày nhóm frontier_llm và general_harms được thêm vào; hai nhóm này chỉ xuất hiện trong tài liệu hiện hành.
Một lượt bị chặn tốn bao nhiêu
Lượt bị chặn trước đầu ra không có token đầu ra, nên chi phí chủ yếu là token đầu vào. Với giá niêm yết trên trang giá của Anthropic ngày 26/9/2026, Locaith tính:
| Mô hình | Giá đầu vào | Yêu cầu 50.000 token bị chặn | Yêu cầu 200.000 token bị chặn |
|---|---|---|---|
| Claude Fable 5.1 | 10 USD / triệu token | 0,50 USD | 2,00 USD |
| Claude Opus 5 | 5 USD / triệu token | 0,25 USD | 1,00 USD |
| Claude Opus 5.5 | 4 USD / triệu token | 0,20 USD | 0,80 USD |
Locaith tính theo giá đầu vào cơ bản, chưa tính giảm giá bộ nhớ đệm. Cỡ yêu cầu 50.000 và 200.000 token là ví dụ của Locaith; Fable 5 cùng giá với Fable 5.1.
Nếu dùng fallback, chi phí cộng dồn. Theo tài liệu, lượt bị từ chối ở nhóm tính tiền vẫn bị tính, cộng thêm lượt chạy lại trên mô hình dự phòng theo giá của mô hình đó. "Fallback credit" chỉ bù phần tiền ghi bộ nhớ đệm lần hai cho lượt chạy lại, không hoàn tiền lượt bị chặn. Anthropic không công bố chế độ "default" chọn mô hình nào cho từng nhóm. Nhưng nếu nó giống cách hãng chạy bài đo cho Opus 5.5, nơi việc sinh học và phát triển LLM được Opus 5 làm thay, thì lượt dự phòng còn đắt hơn: Opus 5 có giá 5 USD và 25 USD mỗi triệu token, cao hơn mức 4 USD và 20 USD của Opus 5.5. Đây là suy luận của Locaith từ hai tài liệu, chưa được Anthropic xác nhận.
Cổng bán lại API đã thu tiền từ trước
Thay đổi này còn chạm tới một tầng nhiều doanh nghiệp không nhìn thấy: các cổng trung chuyển bán lại API. Ngày 24/9, cùng ngày Anthropic đổi chính sách, một người dùng mở issue #7551 trên new-api, dự án mã nguồn mở để tự dựng cổng AI với 48,9 nghìn sao trên GitHub (Locaith xem ngày 26/9/2026). Issue báo rằng new-api vẫn trừ tiền người dùng cuối theo số token đầu vào khi Claude từ chối trước đầu ra, trong khi Anthropic không tính phí, và dẫn đúng câu trong tài liệu cũ của Anthropic rằng lượt từ chối trước đầu ra không bị tính. Tới 26/9, issue vẫn mở.
Nghĩa là từ 2/6, người mua Claude qua các cổng dựng trên phiên bản new-api có lỗi này có thể đã trả tiền cho những lượt mà nhà cung cấp gốc không thu. Giờ quy tắc đúng phức tạp hơn: miễn phí với cyber, general_harms và null, tính phí với ba nhóm còn lại. Locaith không có số liệu về việc bao nhiêu cổng bán lại đang chạy new-api hay đã sửa lỗi.
Lập trình viên nên làm gì
Các gợi ý dưới đây là quan điểm của Locaith:
- Ghi lại
stop_details.categorycho mọi phản hồi từ chối. Đó là cách duy nhất biết mình đang trả tiền cho bao nhiêu lượt bị chặn và ở nhóm nào. Trường này có sẵn, không cần header beta. - Đừng yêu cầu Claude chép lại suy luận vào câu trả lời. Nếu cần xem mô hình nghĩ gì, đặt
thinking.displaylà"summarized"và đọc khối thinking. - Tổ chức làm sinh học hợp pháp nên đăng ký xác minh. Anthropic nói các tổ chức đã được thẩm định có thể nộp đơn vào Life Sciences Verification Program để dùng Opus 5.5 cho nghiên cứu sinh học.
- Cân nhắc Sonnet 5 cho việc không cần mô hình mạnh nhất. Sonnet 5 không nằm trong danh sách có bộ phân loại này, và giá đầu vào 2 USD mỗi triệu token.
- Nếu mua qua bên trung gian, hỏi họ tính tiền lượt bị từ chối theo quy tắc nào, và đối chiếu với nhật ký của chính bạn.
Nguồn:
- Anthropic — Claude Platform release notes — nguồn cho mục ngày 24/9/2026; các mục 28/5, 2/6, 9/6 và 24/7/2026 Locaith đọc qua nguồn cấp RSS ngày 26/9/2026
- Anthropic — Refusals and fallback — nguồn cho danh sách mô hình có bộ phân loại, năm nhóm từ chối, quy tắc tính phí, mục đích tính phí, rate limit và fallback credit; Locaith đọc 26/9/2026
- Anthropic — Pricing — giá đầu vào của Fable 5.1, Opus 5.5, Opus 5 và Sonnet 5; Locaith đọc 26/9/2026
- Anthropic — Claude Opus 5.5 — nguồn cho Life Sciences Verification Program và việc Opus 5 làm thay khi bộ lọc can thiệp trong bài đo
- Anthropic — What's new in Claude Opus 5.5 — nguồn cho bộ phân loại sinh học và nhóm reasoning_extraction trên Opus 5.5
- Anthropic — claude-cookbooks PR #890, gộp ngày 24/9/2026 — sửa hướng dẫn tính phí từ "không tính" sang "tính ở một số nhóm", dùng để đối chiếu
- QuantumNous — new-api issue #7551, mở ngày 24/9/2026 — nguồn cho lỗi tính phí lượt từ chối ở cổng trung chuyển
Quy tắc tính phí và mô tả các nhóm từ chối lấy từ tài liệu của Anthropic, Locaith đọc và dịch ngày 26/9/2026; Anthropic ghi rằng danh sách nhóm bị tính phí có thể thay đổi. Anthropic không công bố tỷ lệ chặn nhầm. Bảng chi phí do Locaith tính theo giá niêm yết, với cỡ yêu cầu là ví dụ. Nhận định về vùng xám của nhóm frontier_llm, suy luận về chi phí của chế độ fallback mặc định và các gợi ý cuối bài là quan điểm của Locaith. Các câu trích được Locaith dịch từ tiếng Anh. Ảnh bìa và ảnh trong bài: chụp màn hình tài liệu Claude Platform của Anthropic, Locaith chụp ngày 26/9/2026. Biên soạn và phân tích bởi Ban Biên Tập Locaith, 26/9/2026.