Gemini 3.8 Flash: Giá 0,75 USD Chỉ Đến Hết Năm, Rồi Gấp Đôi — Và Bản Cyber Không Bán Cho Bạn

Ngày 2/9/2026, Google phát hành Gemini 3.8 Flash với giá 0,75 USD mỗi triệu token đầu vào — nhưng đây là giá khuyến mãi hết hiệu lực ngày 31/12/2026, sau đó tăng gấp đôi. Cùng lúc, hãng ra bản 3.8 Flash Cyber dùng chung mô hình lõi, chỉ khác ở mức nới an toàn, và khoá sau một chương trình xét duyệt.

Google vừa ra mô hình Flash thứ ba trong sáu tuần. Con số được đưa lên tiêu đề là 0,75 USD mỗi triệu token — rẻ đến mức khó tin so với năng lực. Phần không lên tiêu đề: mức giá đó hết hạn sau bốn tháng, và bản mạnh nhất trong đợt phát hành này thì bạn không mua được.

Google phát hành gì

Ngày 2/9/2026, Google phát hành hai mô hình: Gemini 3.8 Flash mở rộng rãi, và Gemini 3.8 Flash Cyber chuyên cho an ninh mạng, khoá sau xét duyệt. Đây là bản Flash thứ ba trong khoảng sáu tuần, ra sau bản 3.7 Flash đúng ba tuần.

Thông số Gemini 3.8 Flash
Cửa sổ ngữ cảnh1.048.576 token
Đầu ra tối đa65.536 token
Đầu vào nhận đượcVăn bản, ảnh, âm thanh, video
Đầu raChỉ văn bản
Mức suy nghĩLOW, MEDIUM (mặc định), HIGH — mức MINIMAL đã bị bỏ
Nơi dùng đượcGemini API, Google AI Studio, Antigravity, Android Studio, Gemini Enterprise; gói AI Pro và Ultra

Nguồn: thông báo trên blog.google và bản phân tích của MarkTechPost, đọc 3/9/2026.

Giá thật và giá quảng cáo

Đây là phần cần đọc kỹ nhất. Mức giá được đưa lên mọi tiêu đề là giá giới thiệu có thời hạn:

Hạng mục Đến 31/12/2026 Từ 1/1/2027
Đầu vào (mỗi triệu token)0,75 USD1,50 USD
Đầu ra (mỗi triệu token)3,75 USD7,50 USD

Nguồn: thông báo chính thức của Google, đọc 3/9/2026.

Nếu bạn đang lập dự toán cho năm 2027, hãy dùng con số 1,50 và 7,50 USD. Bốn tháng khuyến mãi là quãng đủ dài để một đội kỹ thuật xây xong hệ thống quanh mức giá thấp, và đủ ngắn để hoá đơn tháng 1/2027 gây bất ngờ. Đây là lần thứ hai trong vòng chưa đầy một tháng Locaith phải nhắc lại lưu ý này về một mô hình lớn — trước đó là đợt hạ giá có thời hạn của GPT-5.6 Sol. Giá khuyến mãi đang trở thành cách mặc định để các hãng giành thị phần, và người mua cần đọc ngày hết hạn trước khi đọc con số.

Một thay đổi gây vỡ mã, nằm ngoài tiêu đề

Mức suy nghĩ MINIMAL không còn được hỗ trợ. Chỉ còn LOW, MEDIUM (mặc định) và HIGH. Đây là chi tiết dễ bỏ sót nhất trong cả đợt phát hành, vì nó không xuất hiện ở bất kỳ tiêu đề nào — nhưng nếu mã của bạn đang đặt MINIMAL trên 3.7 Flash để ép chi phí xuống rồi chỉ đổi tên mô hình, đó chính là chỗ sẽ hỏng. Và vì MINIMAL vốn được dùng để tiết kiệm, việc buộc phải chuyển lên LOW cũng có nghĩa là chi phí thực tế của bạn tăng thêm một lần nữa, ngoài phần tăng giá theo lịch.

Điểm số — và chỗ số liệu không nghiêng về một phía

Phép đo Kết quả Ghi chú
HLE-Verified (suy luận nhiều bước)54,9%Số của Google
CWE-Bench, vá lỗi (bản Cyber)47,2% pass@1Thấp hơn mức 47,8% của mô hình dẫn đầu
Vá lỗi Chrome (đội Chrome Security đo)2,6 lầnNhiều bản vá đúng hơn so với mô hình thương mại tốt nhất, dù các mô hình đó lớn hơn nhiều
Kiểm thử xâm nhập (Wiz đo)Cao hơn 7,5–9,7 điểm phần trăm về độ bao phủVới chi phí thấp hơn 2,3 đến 5,2 lần
DeepSWE v1.1 (kỹ thuật phần mềm)Không công bố con số rõ ràngGoogle chỉ mô tả là vượt phần lớn mô hình biên giới lớn hơn

Nguồn: thông báo của Google và bản phân tích của MarkTechPost, đọc 3/9/2026. Các nguồn thứ cấp trình bày điểm DeepSWE v1.1 không thống nhất với điểm HLE-Verified, nên Locaith chỉ ghi con số 54,9% cho HLE-Verified và để trống DeepSWE thay vì gán nhầm.

Dòng đáng chú ý nhất là CWE-Bench: bản Cyber thua mô hình dẫn đầu 0,6 điểm phần trăm. Việc con số này vẫn nằm trong tài liệu, thay vì bị lược đi, làm cho các con số còn lại đáng tin hơn. Nó cũng cho thấy tại sao không nên đọc riêng một phép đo: cùng một mô hình có thể đứng sau trên bài thi chuẩn hoá và vượt lên rõ rệt trên công việc thật, như kết quả 2,6 lần của đội Chrome Security.

Bản Cyber: cùng một mô hình, hai lớp khoá

Chi tiết quan trọng nhất về Gemini 3.8 Flash Cyber không phải năng lực, mà là cấu trúc: theo phân tích kỹ thuật, hai bản dùng chung một mô hình lõi. Khác biệt nằm ở mức nới các lớp chặn an toàn, không nằm ở kiến trúc. Nói cách khác, Google không huấn luyện một mô hình tấn công riêng — hãng chỉ quyết định ai được phép tắt bớt phanh.

Đường vào là chương trình Fairwind, xét duyệt từng trường hợp, ban đầu chỉ mở cho cơ quan chính phủ đã thẩm định, đơn vị vận hành hạ tầng trọng yếu quốc gia, và người bảo trì phần mềm. Google cũng nêu rõ mô hình có các lớp bảo vệ chống lạm dụng trong lĩnh vực hoá học, sinh học, phóng xạ, hạt nhân và tấn công mạng.

Đặt cạnh việc OpenAI công bố Astra chạm ngưỡng "Critical" cùng ngày 2/9/2026 và khoá năng lực mạng sau chương trình Daybreak Blue, bức tranh khá rõ: hai hãng lớn nhất đã độc lập đi tới cùng một mô hình vận hành — bán mô hình phổ thông cho tất cả, và phát năng lực tấn công mạng theo danh sách. Locaith phân tích kỹ hơn ý nghĩa của điểm trùng hợp này trong bài cùng ngày về Astra.

Điều hiếm gặp: nhà sản xuất khuyên đừng nâng cấp

Trong hướng dẫn dành cho lập trình viên, Google nói thẳng rằng mới hơn không phải lúc nào cũng tốt hơn, và khuyến nghị giữ lại 3.7 Flash khi hiệu quả điện toán là ràng buộc quyết định. Với một hãng vừa phát hành ba mô hình trong sáu tuần, đây là câu đáng ghi nhận — và cũng là câu hữu ích nhất cho người mua trong toàn bộ tài liệu.

Ba việc doanh nghiệp Việt Nam nên làm

Nguồn:

Toàn bộ điểm số trong bài là số do Google công bố, kể cả các kết quả được gán cho đội Chrome Security và cho Wiz — Locaith không đọc được báo cáo gốc của hai bên này, mà chỉ thấy chúng được dẫn lại trong tài liệu của Google. Tính đến 3/9/2026 chúng tôi không tìm thấy đo lường độc lập nào cho Gemini 3.8 Flash, và chưa tự chạy thử mô hình. Các nguồn thứ cấp trình bày điểm DeepSWE v1.1 không thống nhất — một nguồn gộp nhầm nó với điểm HLE-Verified — nên chúng tôi để trống ô đó thay vì ghi một con số có thể sai. Mức giá sau ngày 1/1/2027 là mức Google công bố trước, có thể thay đổi. Ba khuyến nghị ở cuối bài là quan điểm riêng của Locaith. Ảnh bìa do Locaith tự dựng từ số liệu trong bài. Biên soạn và phân tích bởi Ban Biên Tập Locaith, 3/9/2026.

Messenger