Gemini 3.8 Flash: Giá 0,75 USD Chỉ Đến Hết Năm, Rồi Gấp Đôi — Và Bản Cyber Không Bán Cho Bạn
Ngày 2/9/2026, Google phát hành Gemini 3.8 Flash với giá 0,75 USD mỗi triệu token đầu vào — nhưng đây là giá khuyến mãi hết hiệu lực ngày 31/12/2026, sau đó tăng gấp đôi. Cùng lúc, hãng ra bản 3.8 Flash Cyber dùng chung mô hình lõi, chỉ khác ở mức nới an toàn, và khoá sau một chương trình xét duyệt.
Google vừa ra mô hình Flash thứ ba trong sáu tuần. Con số được đưa lên tiêu đề là 0,75 USD mỗi triệu token — rẻ đến mức khó tin so với năng lực. Phần không lên tiêu đề: mức giá đó hết hạn sau bốn tháng, và bản mạnh nhất trong đợt phát hành này thì bạn không mua được.
Google phát hành gì
Ngày 2/9/2026, Google phát hành hai mô hình: Gemini 3.8 Flash mở rộng rãi, và Gemini 3.8 Flash Cyber chuyên cho an ninh mạng, khoá sau xét duyệt. Đây là bản Flash thứ ba trong khoảng sáu tuần, ra sau bản 3.7 Flash đúng ba tuần.
| Thông số | Gemini 3.8 Flash |
|---|---|
| Cửa sổ ngữ cảnh | 1.048.576 token |
| Đầu ra tối đa | 65.536 token |
| Đầu vào nhận được | Văn bản, ảnh, âm thanh, video |
| Đầu ra | Chỉ văn bản |
| Mức suy nghĩ | LOW, MEDIUM (mặc định), HIGH — mức MINIMAL đã bị bỏ |
| Nơi dùng được | Gemini API, Google AI Studio, Antigravity, Android Studio, Gemini Enterprise; gói AI Pro và Ultra |
Nguồn: thông báo trên blog.google và bản phân tích của MarkTechPost, đọc 3/9/2026.
Giá thật và giá quảng cáo
Đây là phần cần đọc kỹ nhất. Mức giá được đưa lên mọi tiêu đề là giá giới thiệu có thời hạn:
| Hạng mục | Đến 31/12/2026 | Từ 1/1/2027 |
|---|---|---|
| Đầu vào (mỗi triệu token) | 0,75 USD | 1,50 USD |
| Đầu ra (mỗi triệu token) | 3,75 USD | 7,50 USD |
Nguồn: thông báo chính thức của Google, đọc 3/9/2026.
Nếu bạn đang lập dự toán cho năm 2027, hãy dùng con số 1,50 và 7,50 USD. Bốn tháng khuyến mãi là quãng đủ dài để một đội kỹ thuật xây xong hệ thống quanh mức giá thấp, và đủ ngắn để hoá đơn tháng 1/2027 gây bất ngờ. Đây là lần thứ hai trong vòng chưa đầy một tháng Locaith phải nhắc lại lưu ý này về một mô hình lớn — trước đó là đợt hạ giá có thời hạn của GPT-5.6 Sol. Giá khuyến mãi đang trở thành cách mặc định để các hãng giành thị phần, và người mua cần đọc ngày hết hạn trước khi đọc con số.
Một thay đổi gây vỡ mã, nằm ngoài tiêu đề
Mức suy nghĩ MINIMAL không còn được hỗ trợ. Chỉ còn LOW, MEDIUM (mặc định) và HIGH. Đây là chi tiết dễ bỏ sót nhất trong cả đợt phát hành, vì nó không xuất hiện ở bất kỳ tiêu đề nào — nhưng nếu mã của bạn đang đặt MINIMAL trên 3.7 Flash để ép chi phí xuống rồi chỉ đổi tên mô hình, đó chính là chỗ sẽ hỏng. Và vì MINIMAL vốn được dùng để tiết kiệm, việc buộc phải chuyển lên LOW cũng có nghĩa là chi phí thực tế của bạn tăng thêm một lần nữa, ngoài phần tăng giá theo lịch.
Điểm số — và chỗ số liệu không nghiêng về một phía
| Phép đo | Kết quả | Ghi chú |
|---|---|---|
| HLE-Verified (suy luận nhiều bước) | 54,9% | Số của Google |
| CWE-Bench, vá lỗi (bản Cyber) | 47,2% pass@1 | Thấp hơn mức 47,8% của mô hình dẫn đầu |
| Vá lỗi Chrome (đội Chrome Security đo) | 2,6 lần | Nhiều bản vá đúng hơn so với mô hình thương mại tốt nhất, dù các mô hình đó lớn hơn nhiều |
| Kiểm thử xâm nhập (Wiz đo) | Cao hơn 7,5–9,7 điểm phần trăm về độ bao phủ | Với chi phí thấp hơn 2,3 đến 5,2 lần |
| DeepSWE v1.1 (kỹ thuật phần mềm) | Không công bố con số rõ ràng | Google chỉ mô tả là vượt phần lớn mô hình biên giới lớn hơn |
Nguồn: thông báo của Google và bản phân tích của MarkTechPost, đọc 3/9/2026. Các nguồn thứ cấp trình bày điểm DeepSWE v1.1 không thống nhất với điểm HLE-Verified, nên Locaith chỉ ghi con số 54,9% cho HLE-Verified và để trống DeepSWE thay vì gán nhầm.
Dòng đáng chú ý nhất là CWE-Bench: bản Cyber thua mô hình dẫn đầu 0,6 điểm phần trăm. Việc con số này vẫn nằm trong tài liệu, thay vì bị lược đi, làm cho các con số còn lại đáng tin hơn. Nó cũng cho thấy tại sao không nên đọc riêng một phép đo: cùng một mô hình có thể đứng sau trên bài thi chuẩn hoá và vượt lên rõ rệt trên công việc thật, như kết quả 2,6 lần của đội Chrome Security.
Bản Cyber: cùng một mô hình, hai lớp khoá
Chi tiết quan trọng nhất về Gemini 3.8 Flash Cyber không phải năng lực, mà là cấu trúc: theo phân tích kỹ thuật, hai bản dùng chung một mô hình lõi. Khác biệt nằm ở mức nới các lớp chặn an toàn, không nằm ở kiến trúc. Nói cách khác, Google không huấn luyện một mô hình tấn công riêng — hãng chỉ quyết định ai được phép tắt bớt phanh.
Đường vào là chương trình Fairwind, xét duyệt từng trường hợp, ban đầu chỉ mở cho cơ quan chính phủ đã thẩm định, đơn vị vận hành hạ tầng trọng yếu quốc gia, và người bảo trì phần mềm. Google cũng nêu rõ mô hình có các lớp bảo vệ chống lạm dụng trong lĩnh vực hoá học, sinh học, phóng xạ, hạt nhân và tấn công mạng.
Đặt cạnh việc OpenAI công bố Astra chạm ngưỡng "Critical" cùng ngày 2/9/2026 và khoá năng lực mạng sau chương trình Daybreak Blue, bức tranh khá rõ: hai hãng lớn nhất đã độc lập đi tới cùng một mô hình vận hành — bán mô hình phổ thông cho tất cả, và phát năng lực tấn công mạng theo danh sách. Locaith phân tích kỹ hơn ý nghĩa của điểm trùng hợp này trong bài cùng ngày về Astra.
Điều hiếm gặp: nhà sản xuất khuyên đừng nâng cấp
Trong hướng dẫn dành cho lập trình viên, Google nói thẳng rằng mới hơn không phải lúc nào cũng tốt hơn, và khuyến nghị giữ lại 3.7 Flash khi hiệu quả điện toán là ràng buộc quyết định. Với một hãng vừa phát hành ba mô hình trong sáu tuần, đây là câu đáng ghi nhận — và cũng là câu hữu ích nhất cho người mua trong toàn bộ tài liệu.
Ba việc doanh nghiệp Việt Nam nên làm
- Lập dự toán theo giá sau 1/1/2027, không theo giá đang hiển thị. Hãy lấy lượng token tháng gần nhất, nhân với 1,50 và 7,50 USD, và xem con số đó có còn nằm trong ngân sách không. Nếu dự án chỉ khả thi ở mức giá khuyến mãi, thì nó chưa khả thi — nó chỉ đang được trợ giá bốn tháng.
- Tìm chuỗi MINIMAL trong mã trước khi đổi tên mô hình. Đây là một lần tìm kiếm trong kho mã, mất vài phút, và nó chặn đúng lỗi duy nhất chắc chắn xảy ra khi nâng cấp. Đồng thời tính lại chi phí, vì chuyển từ MINIMAL lên LOW làm tăng số token suy nghĩ.
- Đừng dựa vào bảng điểm để chọn giữa 3.7 và 3.8 Flash. Chính Google nói có trường hợp nên ở lại bản cũ. Cách quyết định đúng là dựng một bộ thử vài trăm mẫu trên đúng dữ liệu của bạn, chạy cả hai, rồi so chất lượng và chi phí mỗi tác vụ — nhất là khi hai mô hình chỉ cách nhau ba tuần và bản mới đắt gấp đôi kể từ đầu năm sau.
Nguồn:
- Google — Introducing Gemini 3.8 Flash and 3.8 Flash Cyber — nguồn cho ngày phát hành, giá giới thiệu và giá sau 1/1/2027, điểm HLE-Verified 54,9%, điểm CWE-Bench 47,2% pass@1, con số 2,6 lần của đội Chrome Security, điều kiện tham gia Fairwind và các lớp bảo vệ CBRN, đọc 3/9/2026
- MarkTechPost — Google DeepMind Releases Gemini 3.8 Flash and Gemini 3.8 Flash Cyber: One Core Model, Two Access Envelopes — nguồn cho cửa sổ ngữ cảnh 1.048.576 token, đầu ra 65.536 token, việc bỏ mức MINIMAL, mức 47,8% của mô hình dẫn đầu trên CWE-Bench, kết quả đo của Wiz, xác nhận hai bản dùng chung mô hình lõi, và khuyến nghị giữ lại 3.7 Flash, đọc 3/9/2026
- Thurrott — Google Releases Gemini 3.8 Flash and Cyber Variant — nguồn đối chiếu cho kênh phân phối và phạm vi mở của chương trình Fairwind, đọc 3/9/2026
Toàn bộ điểm số trong bài là số do Google công bố, kể cả các kết quả được gán cho đội Chrome Security và cho Wiz — Locaith không đọc được báo cáo gốc của hai bên này, mà chỉ thấy chúng được dẫn lại trong tài liệu của Google. Tính đến 3/9/2026 chúng tôi không tìm thấy đo lường độc lập nào cho Gemini 3.8 Flash, và chưa tự chạy thử mô hình. Các nguồn thứ cấp trình bày điểm DeepSWE v1.1 không thống nhất — một nguồn gộp nhầm nó với điểm HLE-Verified — nên chúng tôi để trống ô đó thay vì ghi một con số có thể sai. Mức giá sau ngày 1/1/2027 là mức Google công bố trước, có thể thay đổi. Ba khuyến nghị ở cuối bài là quan điểm riêng của Locaith. Ảnh bìa do Locaith tự dựng từ số liệu trong bài. Biên soạn và phân tích bởi Ban Biên Tập Locaith, 3/9/2026.