Gemini 3.1 Pro: Nền tảng mạnh cho ứng dụng agent và xử lý đa phương thức

Gemini 3.1 Pro hướng đến các bài toán reasoning, coding và agentic workflow, phù hợp cho sản phẩm cần long-context và tool-use.

Gemini 3.1 Pro được nhiều đội sản phẩm lựa chọn khi cần cân bằng chất lượng, tốc độ và khả năng mở rộng cho tác vụ đa phương thức (text / image / audio / video).

Khi nào nên dùng?

Bảng so sánh benchmark chính thức của Google: Gemini 3.1 Pro đối chiếu với Gemini 3 Pro, Claude Sonnet 4.6, Claude Opus 4.6, GPT-5.2 và GPT-5.3-Codex trên 16 phép đo. Gemini 3.1 Pro đạt ARC-AGI-2 77,1% (so với 31,1% của Gemini 3 Pro), GPQA Diamond 94,3%, Humanity’s Last Exam 44,4% (không dùng công cụ), Terminal-Bench 2.0 68,5%, LiveCodeBench Pro Elo 2887, MCP Atlas 69,2%, BrowseComp 85,9%, MMMLU 92,6%; hai cột GPT-5.3-Codex và Opus 4.6 dẫn trước ở SWE-Bench Verified (80,8%), SWE-Bench Pro (56,8%), Terminal-Bench 2.0 (77,3%) và GDPval-AA Elo (1633 của Sonnet 4.6).
Bảng benchmark Google công bố cùng Gemini 3.1 Pro cho thấy vì sao mô hình này hợp với agent workflow và tác vụ đa phương thức: điểm agentic (MCP Atlas 69,2%, BrowseComp 85,9%, τ2-bench Telecom 99,3%) và long-context (MRCR v2 84,9%) đều dẫn đầu, trong khi SWE-Bench Verified và GDPval-AA vẫn thuộc về Opus 4.6 và Sonnet 4.6 — tức lựa chọn mô hình vẫn phải bám theo loại tác vụ. Ảnh: Google.

Link truy cập

Tài liệu Gemini API: ai.google.dev/gemini-api/docs/models/gemini

Messenger