Claude Opus 5.5: Ngang Fable 5.1, Rẻ Hơn Opus 5 Tới 40%, Nhưng Việc An Ninh Mạng Bị Đẩy Về Opus 4.8

Ngày 22/9/2026, Anthropic phát hành Claude Opus 5.5 với giá API 4 và 20 USD mỗi triệu token, thấp hơn Opus 5 20%, đọc bộ nhớ đệm rẻ hơn 60%, và theo hãng là rẻ hơn 40% trên khối lượng việc điển hình vì tốn ít token hơn. Trên bốn bộ đo tác tử mã do Anthropic công bố, Opus 5.5 vượt Fable 5.1 nhưng thu

Ba tuần sau Fable 5.1, Anthropic đưa ra một mô hình mà hãng nói làm được phần lớn việc của Fable 5.1 với giá bằng 40% và tốn ít token hơn. Bảng giá và bảng điểm đều do Anthropic công bố ngày 22/9/2026. Điều đáng đọc kỹ hơn cả hai bảng đó là dòng nhỏ về an ninh mạng: phần lớn tác vụ loại này không chạy trên Opus 5.5, mà bị chuyển về Opus 4.8, và cách chuyển chưa được mô tả đủ để người viết tác tử biết chuyện đó có xảy ra với mình hay không.

Giá: ba con số, ba nghĩa khác nhau

Anthropic niêm yết Opus 5.5 ở 4 USD mỗi triệu token đầu vào và 20 USD mỗi triệu token đầu ra, so với 5 và 25 USD của Opus 5, tức giảm 20%. Đọc bộ nhớ đệm giảm từ 0,50 xuống 0,20 USD, tức 60%. Ghi bộ nhớ đệm giảm từ 6,25 xuống 5 USD. Chế độ nhanh có giá riêng, 8 và 40 USD. Con số 40% trong tiêu đề của hãng là một ước tính khác: "Ở thiết lập mặc định, nó sẽ tốn ít hơn Opus 5 40% trên khối lượng việc điển hình", vì theo Anthropic mô hình mới dùng ít token và ít bước hơn để xong việc, và sinh đầu ra nhanh hơn Opus 5 hơn 30%.

USD / triệu token Opus 5.5 Opus 5 Fable 5.1 GPT-6 Sol (cùng ngày)
Đầu vào45102
Đầu ra20255010
Đọc bộ nhớ đệm0,200,50chưa đối chiếu0,20
Chế độ nhanh (vào / ra)8 / 40không cókhông cókhông có

Nguồn: bảng giá trong bài đăng Claude Opus 5.5 của Anthropic (22/9/2026), giá Fable 5.1 theo bài Locaith ngày 2/9/2026, giá GPT-6 Sol theo tài liệu API của OpenAI. Chưa gồm phụ phí ngữ cảnh dài. Toàn bộ là giá niêm yết của hãng.

Bảng điểm: vượt Fable 5.1, không vượt Astra ở mọi chỗ

Anthropic công bố kết quả trên chín bộ đo, chạy ở chế độ suy nghĩ thích ứng với nỗ lực tối đa. Trên bốn bộ đo tác tử mã trong đồ hoạ dưới, Opus 5.5 cao hơn Fable 5.1 từ 4 tới 11 điểm, nhưng thấp hơn GPT-6 Astra ở AutomationBench (40,0 so với 41,4) và Terminal-Bench-Science (58,7 so với 64,6). Sai số chuẩn Anthropic ghi cho Terminal-Bench 4.0 là ±2,6 điểm với Opus 5.5, nên vài khoảng cách trong bảng nằm trong vùng nhiễu. Chính Anthropic viết: "Ở các mức năng lực này, chúng tôi thấy khoảng cách trên bộ đo đã trở thành chỉ dấu kém tin cậy hơn về khác biệt ngoài đời."

Biểu đồ cột so sánh Claude Opus 5.5, Fable 5.1, Opus 5 và GPT-6 Astra trên Terminal-Bench 4.0, FrontierCode v1.1, AutomationBench và Terminal-Bench-Science 0.1
Opus 5.5 dẫn ở hai bộ đo mã, GPT-6 Astra dẫn ở hai bộ còn lại. Số của Astra là số Anthropic trích từ công bố của OpenAI, không phải Anthropic tự chạy. Đồ hoạ: Locaith, dựng theo anthropic.com/claude-opus-5-5.

Các bộ đo còn lại theo Anthropic: CursorBench 4.0 đạt 57,8% (Fable 5.1: 51,8%); GDPval-AA v2.1 đạt 1846 Elo (Fable 5.1: 1735; GPT-6 Astra: 1542); Humanity's Last Exam có công cụ đạt 67,7% (Fable 5.1: 65,6%); OSWorld 2.0 đạt 81,8% (Fable 5.1: 80,7%). Có một ghi chú nhỏ nhưng quan trọng trong phần chú thích bảng của hãng: vì rào chắn an toàn can thiệp, các tác vụ an ninh mạng trong bảng do Opus 4.8 làm, các tác vụ sinh học và phát triển mô hình do Opus 5 làm. Tức là điểm ở hai lĩnh vực đó không phải điểm của Opus 5.5.

Nguồn ngoài hãng duy nhất tới lúc này là Artificial Analysis, theo tường thuật của The Decoder: Opus 5.5 đạt 58 điểm trên Chỉ số Trí tuệ của tổ chức này ở nỗ lực tối đa, cao nhất từ trước tới nay, dẫn đầu 6 trên 10 bài đo, gồm Humanity's Last Exam 61,4% (Fable 5.1: 59,1%) và SciCode 66,9% (63,1%). Cùng nguồn nêu cái giá của nỗ lực tối đa: khoảng 119.000 token đầu ra mỗi tác vụ, so với khoảng 27.000 của GPT-6 Astra. Locaith chưa đọc trực tiếp trang Artificial Analysis; các số này là số đo bên thứ ba, đọc qua tường thuật.

An ninh mạng: chuyển về Opus 4.8, và một lỗi mở từ 12/9

Anthropic viết rằng vì Opus 5.5 có năng lực an ninh mạng mạnh, hãng áp dụng rào chắn tương tự Fable 5.1: "Phần lớn tác vụ an ninh mạng sẽ được chuyển hướng sang Opus 4.8." Việc phát triển phần mềm thông thường, gồm tìm và sửa lỗi, vẫn chạy trên Opus 5.5. Người làm bảo mật có thể xin vào Chương trình Xác minh An ninh mạng, và Anthropic nói sẽ mở rộng chương trình này cho Opus 5.5 "sớm". Trang hỗ trợ của chương trình, khi Locaith đọc ngày 23/9, vẫn ghi Opus 5.5 là mô hình sắp được thêm.

Lỗi #93821 trên kho anthropics/claude-code, mở ngày 12/9/2026, vẫn chưa có phản hồi từ nhân viên Anthropic khi Locaith đọc.

Người báo lỗi dùng Fable 5.1 để đóng gói một engine WebAssembly của chính họ. Khi mô hình đọc tài liệu nội bộ của dự án có các từ "obfuscate", "strip symbols", "leak", "protect", "no readable strings", bộ phân loại an ninh mạng gắn cờ, và phiên bị chuyển sang Opus 4.8. Kích hoạt đến từ đầu ra của công cụ đọc tệp, không phải từ câu lệnh của người dùng. Sau đó, chọn lại mô hình bằng /model fable không đưa Fable 5.1 trở lại; mọi lượt tiếp theo vẫn chạy trên Opus 4.8. Người báo lỗi liên kết tới một lỗi tương tự, #63751, mở từ 29/5/2026.

Anthropic chưa công bố ngưỡng phân loại, tỷ lệ chuyển nhầm, hay cách API báo cho người gọi biết yêu cầu đã bị chuyển. Với một tác tử chạy hàng chục lượt gọi liên tiếp, một lượt bị chuyển sang mô hình khác mà không có tín hiệu là một lỗi khó chẩn đoán.

Những gì đổi với người tích hợp API

Điều đáng rút ra cho doanh nghiệp Việt Nam

Nguồn:

Mọi điểm số, giá và tỷ lệ trong bài, trừ đoạn về Artificial Analysis, là do Anthropic công bố; số của GPT-6 Astra trong đồ hoạ là số Anthropic trích từ OpenAI, không phải Anthropic tự chạy. Các số của Artificial Analysis được đọc qua tường thuật của The Decoder, Locaith chưa truy cập trực tiếp. Mô tả về việc chuyển mô hình âm thầm lấy từ một báo cáo lỗi của người dùng trên GitHub, chưa được Anthropic xác nhận hay bác bỏ. Câu trích của Anthropic được Locaith dịch từ tiếng Anh. Phần nhận định cuối bài là quan điểm riêng của Locaith. Ảnh bìa: ảnh minh hoạ chính thức của bài đăng Anthropic. Đồ hoạ trong bài do Locaith dựng từ số liệu Anthropic công bố. Biên soạn và phân tích bởi Ban Biên Tập Locaith, 23/9/2026.

Messenger