Claude Opus 4.6: Tập trung chất lượng viết và hỗ trợ coding

Claude Opus 4.6 phù hợp cho tác vụ cần văn phong ổn định, viết dài mạch lạc và hỗ trợ kỹ thuật.

Claude Opus 4.6 là lựa chọn đáng cân nhắc cho nhóm cần viết dài, biên tập nội dung có cấu trúc và hỗ trợ đọc hiểu tài liệu kỹ thuật.

Ứng dụng gợi ý

Bảng benchmark chính thức của Anthropic so sánh Claude Opus 4.6 với Opus 4.5, Sonnet 4.5, Gemini 3 Pro và GPT-5.2 trên 14 bài đo. Opus 4.6 dẫn đầu ở Terminal-Bench 2.0 (65,4%), OSWorld (72,7%), τ2-bench Retail (91,9%), BrowseComp (84,0%), Humanity’s Last Exam có công cụ (53,0%), Finance Agent (60,7%), GDPVal-AA Elo (1606) và ARC-AGI-2 (68,8%); Opus 4.5 vẫn nhỉnh hơn ở SWE-bench Verified (80,9% so với 80,8%) và MCP Atlas (62,3% so với 59,5%), còn GPT-5.2 dẫn ở GPQA Diamond (93,2%) và MMMU Pro, Gemini 3 Pro dẫn ở MMMLU (91,8%).
Số liệu do chính Anthropic công bố khi ra mắt Opus 4.6: mức tăng rõ nhất nằm ở nhóm tác vụ nhiều bước — dùng máy tính, tìm kiếm, phân tích tài chính và tác vụ văn phòng (GDPVal-AA Elo 1606 so với 1416 của Opus 4.5), đúng nhóm công việc biên tập – tổng hợp – hỗ trợ kỹ thuật nêu ở trên. Ngược lại, khoảng cách ở SWE-bench Verified gần như không đáng kể, nên hãy tự đo trên dữ liệu của mình trước khi đổi mô hình. Ảnh: Anthropic.

Link truy cập

Tài liệu Claude API: docs.anthropic.com/en/docs/about-claude/models

Messenger