Anthropic Mở An Ninh Mạng Ba Bậc: Red Team Không Bị Chặn, Phòng Thủ Chặn 46 Trên 50 Lượt

Ngày 6/10/2026, Anthropic gộp Project Glasswing và Cyber Verification Program thành ba bậc truy cập cho đội an ninh mạng đã xác minh. Bài thử CyScenarioBench trên Opus 5.5: bậc Phòng thủ chặn 46 trên 50 lượt, bậc Red Team không chặn lượt nào, nhưng không có số đo tỉ lệ chặn nhầm công việc phòng thủ

Ngày 6/10/2026, Anthropic gộp Project Glasswing và Cyber Verification Program (CVP) thành một chương trình ba bậc, cho các đội an ninh mạng đã được xác minh dùng Claude Opus 5.5, Sonnet 5.5 và Mythos 5.1 với ít bị chặn hơn. Bài thử đi kèm cho thấy bậc Phòng thủ chặn 46 trên 50 lượt thử tấn công, còn bậc Red Team không chặn lượt nào. Hai điều ít được nhắc: bài thử đo cái phanh chứ không đo tỉ lệ chặn nhầm công việc phòng thủ hợp pháp, và con số "129.000 lỗ hổng đã xác minh" chỉ là phần đã được phân loại, trong khi 65% ứng viên phát hiện chưa ai kiểm.

Ba bậc: ai được làm gì

Các mô hình phổ thông (Opus 5.5, Fable 5.1, Sonnet 5.5) vẫn có lớp bảo vệ an ninh mạng thận trọng và, theo Anthropic, "chặn hầu hết công việc an ninh mạng", nhưng vẫn cho rà soát mã, vá lỗi đã biết, tìm lỗ hổng trong mã nguồn của chính mình và phân loại cảnh báo. CVP là đường đăng ký để bớt bị chặn. Từ nay nó có ba bậc, mỗi bậc gồm cả Opus 5.5, Sonnet 5.5, Mythos 5.1 và các mô hình mới về sau:

Bậc Dành cho Được làm Điều kiện và thời gian duyệt
Phổ thông (không cần đăng ký)Lập trình viên, doanh nghiệpRà soát mã, vá lỗi đã biết, tìm lỗ hổng trong mã của chính mình, phân loại cảnh báo an ninhKhông có
Defense AccessĐội an ninh của công ty, tổ chức phi lợi nhuận, trường đại học, cơ quan nhà nước; nhà vận hành hạ tầng trọng yếu dù lớn hay nhỏ (như bệnh viện khu vực, tiện ích địa phương); hãng an ninh nhỏ; người duy trì mã nguồn mở; nhà nghiên cứu cá nhân có tiền sử báo lỗ hổngTrung tâm điều hành an ninh (SOC) và ứng cứu sự cố, phân tích mã độc, kỹ thuật phát hiện, phân loại và xác thực lỗ hổngXác minh danh tính, cam kết kiểm soát an ninh. Thông cáo nói trả lời "trong vài ngày"; trang trợ giúp nói thông báo quyết định "trong bảy ngày làm việc". Cá nhân nộp được nếu dùng gói trả phí
Red Team AccessĐội red team nội bộ hoặc của chính phủ, hãng kiểm thử xâm nhập. Chỉ tổ chức, không nhận cá nhânThêm kiểm thử xâm nhập có uỷ quyền, mô phỏng đối thủ, phát triển công cụ tấn công, xác thực khai thácXác minh doanh nghiệp, xác thực chống phishing, quản lý thông tin xác thực, truy cập theo ghế. Duyệt "vài tuần"; trong lúc chờ, tổ chức được xếp vào Defense Access
Specialized AccessTổ chức được phép kiểm thử hệ thống an toàn có thể ảnh hưởng tính mạng hoặc thị trường: điều hành bay, lưới điện, viễn thông, chuyển tiền liên ngân hàng, mạng hành chính chính phủThêm kiểm thử tấn công rủi ro cao, ít bị chặn nhấtThông tin xác thực ngắn hạn, kiểm soát thiết bị đầu cuối và mạng, kiểm tra lý lịch, giới hạn số ghế. Duyệt sâu từng tổ chức cùng chính phủ Mỹ; thành viên Glasswing chuyển sang không cần duyệt lại

Bài thử nói gì, và không nói gì

Để kiểm tra hiệu quả lớp bảo vệ, Anthropic cho Opus 5.5 chạy CyScenarioBench, bài đo khả năng lập kế hoạch và thực hiện các chiến dịch tấn công mạng nhiều giai đoạn trong ràng buộc thực tế, với lớp bảo vệ chỉnh theo từng bậc. Bài gồm 10 thử thách, mỗi thử thách chạy 5 lượt, tức 50 lượt cho mỗi bậc.

Biểu đồ cột tỉ lệ giải được bài CyScenarioBench của Claude Opus 5.5 theo bậc CVP: mặc định 0%, Defense Access khoảng 8%, Red Team Access khoảng 68%, Specialized Access khoảng 68%
Tỉ lệ giải CyScenarioBench của Opus 5.5 theo bậc CVP, trung bình trên 10 thử thách. Ảnh: Anthropic.
Bậc Kết quả (Anthropic công bố)
Phổ thôngMọi tác vụ bị chặn ngay ở lời nhắc đầu tiên
Defense Access46 trên 50 lượt bị chặn ở một thời điểm nào đó trong thử thách; 4 lượt còn lại thành công (8%)
Red Team AccessKhông lượt nào bị chặn; hoàn thành 34 trên 50 lượt (68%)
Không có lớp bảo vệ (đại diện bậc Specialized)Tỉ lệ thành công 67,6%

Điều bài thử xác nhận: các bậc hoạt động đúng thiết kế trên tấn công nhiều giai đoạn. Từ khoảng 68% khi không bị chặn, tỉ lệ giải rơi xuống 8% ở Defense và 0 ở bậc phổ thông. Đó là phép đo cái phanh.

Điều bài thử không đo

Tỉ lệ công việc phòng thủ hợp pháp bị chặn nhầm, thứ mà bậc Defense sinh ra để cho phép: SOC, phân tích mã độc, kỹ thuật phát hiện, xác thực lỗ hổng. Anthropic nói sẽ "tiếp tục tinh chỉnh bộ phân loại theo từng bậc" và có biểu mẫu báo chặn nhầm, nhưng bài không nêu một con số nào về chặn nhầm. Một đội SOC đọc thông cáo này biết bậc Defense khó dùng để tấn công, nhưng không biết nó làm gián đoạn công việc của mình bao nhiêu.

135.610 lỗ hổng: đọc kỹ bảng khảo sát Glasswing

Thông cáo nói đối tác của Glasswing tìm thấy "ít nhất 129.000 lỗ hổng phần mềm đã xác minh" từ tháng 4 đến tháng 7/2026, Anthropic tự quét mã nguồn mở thêm "5.500" lỗ hổng từ tháng 4 đến tháng 10, và hơn 33.000 trong số này được chấm mức nghiêm trọng hoặc cao. Bảng đi kèm, dựng từ khảo sát 33 đối tác cộng mã nguồn mở Anthropic quét, cho thấy các con số đó đến từ đâu:

Bảng kết quả khảo sát Project Glasswing: 595.597 ứng viên phát hiện, 208.175 đã phân loại, 135.610 lỗ hổng đúng, 27.989 mức cao, 5.680 mức nghiêm trọng, 9.333 đã vá
Kết quả khảo sát Project Glasswing, dựa trên khảo sát 33 đối tác cộng mã nguồn mở do Anthropic quét. Ảnh: Anthropic.
Số lượng (Anthropic công bố) Mã nội bộ của đối tác Mã nguồn mở, đối tác quét Mã nguồn mở, Anthropic quét Tổng
Ứng viên phát hiện554.06312.09529.439595.597
Đã phân loại (triage)196.0086.0446.123208.175
Xác nhận đúng126.9233.0135.674135.610
Mức cao24.7092663.01427.989
Mức nghiêm trọng4.088701.5225.680
Đã vá (mọi mức)8.5802375169.333
Tỉ lệ (Locaith tính từ bảng trên) Mã nội bộ của đối tác Mã nguồn mở, đối tác quét Mã nguồn mở, Anthropic quét Tổng
Ứng viên đã được phân loại35,4%50,0%20,8%35,0%
Đúng, trong số đã phân loại64,8%49,9%92,7%65,1%
Mức nghiêm trọng, trong số đúng3,2%2,3%26,8%4,2%
Đã vá, trong số đúng6,8%7,9%9,1%6,9%

Đội an ninh mạng Việt Nam cần biết

Điều Locaith chưa kiểm chứng được

Nguồn:

  • Anthropic — Expanding the Cyber Verification Program, 6/10/2026 — ba bậc, bài thử CyScenarioBench, số liệu Glasswing; biểu đồ và bảng khảo sát
  • Claude Help Center — Cyber Verification Program, đọc ngày 7/10/2026 — cách nộp đơn, hạn 15/12/2026, lý do không được duyệt, Bedrock, buổi trực tuyến 14/10

Thông cáo của Anthropic và trang trợ giúp Claude được Locaith đọc trực tiếp ngày 7/10/2026. Mọi số liệu về bài thử và về số lỗ hổng là của Anthropic, chưa được bên thứ ba kiểm chứng; hãng nói bảng khảo sát dựa trên dữ liệu một phần của 33 đối tác. Các bảng tỉ lệ, tổng 129.936 và 33.669, và con số 387.422 ứng viên chưa phân loại do Locaith tính từ bảng của Anthropic; Locaith đã cộng các cột và thấy khớp với dòng tổng. Ảnh bìa: hình minh hoạ "Hand Lock" Anthropic dùng cho bài công bố. Ảnh trong bài: biểu đồ và bảng khảo sát từ thông cáo của Anthropic. Biên soạn và phân tích bởi Ban Biên Tập Locaith, 07/10/2026.

Messenger