OpenAI DevDay: GPT-6.1 Sol Giữ Giá, Tác Tử Dots Tới Việt Nam, Gói Pro 200 Bị Cắt Hạn Mức
Tại DevDay ngày 29/9/2026, OpenAI ra GPT-6.1 Sol với giá API giữ nguyên 2 và 10 USD mỗi triệu token như GPT-6 Sol, chỉ phần đọc bộ nhớ đệm rẻ đi một nửa. Hãng mở dots, tác tử chạy GPT-6 Astra trên máy tính đám mây riêng, cho người dùng Pro ở mọi thị trường trừ Khu vực Kinh tế châu Âu, Thuỵ Sĩ và Anh
Tại DevDay 2026 ở San Francisco ngày 29/9, OpenAI công bố hơn 20 sản phẩm và tính năng trước khoảng 2.500 người tham dự, theo CNBC. Bài này chọn bốn thay đổi chạm trực tiếp tới doanh nghiệp và lập trình viên Việt Nam: mô hình GPT-6.1 Sol, tác tử dots, việc sắp xếp lại gói Pro, và mức tốc độ Ultrafast. Ở cả bốn, điều OpenAI đặt lên đầu bài công bố và điều nằm trong bảng giá hay trang trợ giúp không hoàn toàn giống nhau.
GPT-6.1 Sol: giá không đổi, chỉ đọc bộ nhớ đệm rẻ đi
GPT-6.1 Sol ra đúng một tuần sau GPT-6 Sol (22/9/2026). OpenAI giới thiệu nó bằng câu "trí tuệ gần bằng Astra với một phần năm giá". Tỷ lệ một phần năm là đúng, nhưng không mới: 2 USD đầu vào và 10 USD đầu ra mỗi triệu token chính là giá của GPT-6 Sol, còn GPT-6 Astra vẫn ở 10 và 50 USD. Thứ thay đổi trên bảng giá là đọc bộ nhớ đệm (cached input), từ 0,20 xuống 0,10 USD mỗi triệu token.
| Mô hình | Đầu vào | Đọc bộ nhớ đệm | Ghi bộ nhớ đệm | Đầu ra |
|---|---|---|---|---|
| GPT-6 Astra | 10 | 1,00 | 12,50 | 50 |
| GPT-6.1 Sol | 2 | 0,10 | 2,50 | 10 |
| GPT-6 Luna | 0,10 | 0,01 | 0,125 | 0,50 |
| Claude Fable 5.1 | 10 | 0,25 | 12,50 | 50 |
| Claude Opus 5.5 | 4 | 0,20 | 5 | 20 |
| Claude Sonnet 5.5 | 2 | 0,20 | 2,50 | 10 |
USD mỗi triệu token. Nguồn: trang giá API của OpenAI và trang giá Claude Platform, đọc ngày 30/9/2026. Giá OpenAI là mức ngữ cảnh ngắn; prompt dài hơn 272.000 token đầu vào bị tính gấp đôi giá đầu vào và bộ nhớ đệm, gấp 1,5 lần giá đầu ra cho cả request. Ghi bộ nhớ đệm của Claude là loại lưu 5 phút.
Đặt cạnh Claude, hai cặp giá trùng khít: GPT-6.1 Sol và Claude Sonnet 5.5 cùng 2 và 10 USD, GPT-6 Astra và Claude Fable 5.1 cùng 10 và 50 USD. Khác biệt đáng kể nằm ở bộ nhớ đệm: 0,10 USD của GPT-6.1 Sol bằng nửa mức 0,20 USD của Sonnet 5.5. Với các hệ thống gửi đi gửi lại cùng một khối ngữ cảnh lớn, như trợ lý tra cứu tài liệu nội bộ hay tác tử chạy nhiều bước, phần này có thể chiếm phần lớn hoá đơn.
Trên API, mô hình có tên gpt-6.1-sol, ngữ cảnh 1.050.000 token, đầu ra tối đa 128.000 token, mốc kiến thức 30/4/2026. Trong ChatGPT, nó có ở chế độ ChatGPT Work và trong Codex cho các gói Plus, Pro, Business, Enterprise và Edu, nhưng theo bài công bố thì "chưa có trong Chat", tức chế độ trò chuyện thường. Bản Ultrafast của GPT-6.1 Sol sẽ ra "trong vài ngày tới", chưa có giá.
Bảng điểm so với Opus 5.5, không so với Sonnet 5.5 cùng giá
Mọi con số dưới đây do OpenAI công bố. Hãng ghi chú rằng điểm của mô hình đối thủ được "lấy từ các báo cáo công khai", tức không chạy lại trên cùng hệ thống đo của OpenAI.
- DeepSWE v1.1 (việc kỹ thuật phần mềm dài hơi trong mã thật): bằng GPT-6 Astra với khoảng một phần năm chi phí, hơn điểm tốt nhất của GPT-6 Sol 6,4 điểm phần trăm.
- GDP.pdf (trả lời câu hỏi nghiệp vụ từ PDF phức tạp có bảng, biểu đồ, chữ nhỏ): cao hơn Opus 5.5 "có fallback" với chưa tới nửa chi phí mỗi việc ở mọi mức suy luận được thử.
- AutomationBench 1.0.6 (quy trình nghiệp vụ nhiều bước với 47 công cụ): hơn Opus 5.5 2,2 điểm phần trăm ở mức suy luận trung bình với khoảng một phần ba chi phí, hơn GPT-6 Sol 4,8 điểm.
- OSWorld 2.0 (điều khiển máy tính, tập ngoại tuyến): hơn GPT-6 Sol 7 điểm phần trăm ở mức suy luận cao nhất, kém Astra 2,1 điểm với khoảng một phần bảy chi phí.
- Terminal-Bench Science 0.1 (phân tích dữ liệu, mô phỏng, chứng minh định lý): hơn gấp đôi điểm GPT-6 Sol. Chi phí trung bình 5,47 USD mỗi việc, so với 23,21 USD của Opus 5.5 và 23,80 USD của Astra. Astra vẫn dẫn với 68,1%.
- Độ chính xác thông tin: ở mức suy luận thấp, tỷ lệ câu trả lời có ít nhất một lỗi sai sự thật giảm từ 11,4% xuống 7,7%, đo trên các hội thoại ChatGPT mà người dùng từng báo lỗi, tức cố ý chọn câu khó.
Hai điều bảng điểm không nói. Thứ nhất, đối thủ được chọn để so là Opus 5.5, giá 4 và 20 USD, gấp đôi GPT-6.1 Sol, và Fable 5.1. Claude Sonnet 5.5, mô hình có đúng cùng mức giá 2 và 10 USD, ra ngày 28/9, trước DevDay một ngày, nên không có trong các biểu đồ. Chiều ngược lại cũng vậy: bài công bố Sonnet 5.5 của Anthropic so với GPT-6 Sol chứ không phải GPT-6.1 Sol. Mỗi bên đang so với bản cũ của bên kia, và hiện chưa có phép đo nào đặt hai mô hình cùng giá lên cùng một thước.
Thứ hai, chính OpenAI ghi hai chú thích làm phép so khó đọc hơn: điểm Opus 5.5 trên GDP.pdf là điểm "có fallback", và trên AutomationBench, chi phí của Fable 5.1 bị tính thấp hơn thực tế vì bỏ qua fallback, thứ xảy ra ở khoảng 40% số việc. Bài công bố không giải thích fallback ở đây cụ thể là gì. Với một phép so chi phí, việc một phần mười hay bốn phần mười số việc phải chạy lại theo đường khác là khác biệt lớn, nên con số "một phần ba chi phí" nên được đọc cùng chú thích đó.
Về an toàn, OpenAI công bố một phép thử: khi công cụ tìm kiếm bị hỏng, mô hình có nói cho người dùng biết hay tự đoán. GPT-6.1 Sol không báo ở 2,1% trường hợp, so với 4,9% của GPT-6 Sol, 1,5% của Astra và 28,7% của GPT-6 Luna, trên tập việc được chọn để gây lỗi. Chi tiết nằm trong phụ lục system card của GPT-6.1 Sol.
Dots: tác tử chạy Astra, và Việt Nam nằm trong vùng được mở
Dots là sản phẩm chính của DevDay. Mỗi dot là một tác tử luôn chạy, dùng GPT-6 Astra, có máy tính đám mây và trình duyệt riêng, kết nối được với hơn 4.000 ứng dụng qua hệ plugin, và theo OpenAI thì học dần từ phản hồi. Người dùng nhắn hoặc gọi cho dot trong ChatGPT trên web, điện thoại, máy tính, hoặc qua Slack và Microsoft Teams. Dot có thể tự nhận việc và báo lại kết quả cần duyệt, kể cả khi người dùng không hỏi.
Bài công bố chỉ viết "ở các thị trường đủ điều kiện". Trang trợ giúp "Getting started with your dot" nói rõ hơn: dots mở cho người dùng Pro ở mọi thị trường trừ Khu vực Kinh tế châu Âu, Thuỵ Sĩ và Anh; người dùng Business Premium ở mọi khu vực ChatGPT hỗ trợ; Enterprise, Edu và Healthcare có bản beta nhưng tắt mặc định cho tới khi quản trị viên bật. Việt Nam không nằm trong danh sách loại trừ, nên thuê bao Pro ở Việt Nam thuộc diện được mở. Việc triển khai diễn ra dần và "có thể mất vài ngày". Locaith chưa kiểm tra bằng tài khoản thật.
Về tiền: dot đầu tiên nằm trong gói Pro hoặc Business Premium, không tính thêm. Trong tháng đầu, việc dùng dots không bị trừ vào hạn mức của gói; sau đó, theo trang trợ giúp, "chúng tôi sẽ chia sẻ điều khoản sử dụng cho từng gói". Nghĩa là từ khoảng cuối tháng 10, chưa ai biết một dot chạy liên tục sẽ tốn bao nhiêu hạn mức. OpenAI cũng nói sau này người dùng sẽ mua thêm dot, hoặc trả thêm để dot chạy nhanh hơn hay làm được nhiều việc hơn mỗi tháng.
Những điều khoản nên đọc trước khi nối dot vào công cụ công ty
Trang trợ giúp có vài chi tiết mà bài công bố không đặt lên trước:
- Dot tự đọc dữ liệu khi không được hỏi. OpenAI gọi đây là "nghiên cứu chủ động" (proactive research): khi bạn không làm việc với nó, dot rà các ứng dụng đã kết nối bằng công cụ chỉ đọc và "tạo ký ức từ đó". Công cụ chỉ đọc nên nó không gửi tin hay sửa nội dung trong lúc này, nhưng nó vẫn đọc.
- Ngắt kết nối không xoá những gì dot đã biết. Theo trang trợ giúp, ngắt một ứng dụng "không xoá thông tin dot đã lấy được từ ứng dụng đó". Muốn xoá, phải xoá cả dot bằng lệnh Reset, mất luôn hội thoại, ký ức và lịch việc.
- Dữ liệu huấn luyện tuỳ theo loại gói. OpenAI không dùng nội dung từ không gian làm việc Business, Enterprise, Edu để huấn luyện theo mặc định. Với gói cá nhân như Pro, người dùng tự chỉnh việc hội thoại và công việc của dot có được dùng để cải thiện mô hình hay không. OpenAI nói không huấn luyện trực tiếp trên phần nghiên cứu chủ động và ghi chú riêng của dot.
- Quy tắc duyệt có bốn mức. Với từng loại hành động, người dùng chọn: tự làm không cần hỏi, làm nếu đã được yêu cầu trong prompt, hỏi trước khi làm, hoặc trả lại cho người dùng. Hành động có thể ảnh hưởng tài khoản hay chia sẻ thông tin đi qua bước kiểm tra tự động (auto-review); việc như đổi mật khẩu luôn do người dùng tự làm. Dot dùng mật khẩu đã lưu để đăng nhập mà mô hình không nhìn thấy mật khẩu.
- Máy tính của bạn tách riêng, trừ khi bạn nối vào. Quyền truy cập máy tính cá nhân tắt mặc định. Khi bật, dot đọc được tệp và làm việc trên máy đó từ mọi kênh nhắn tin.
Với doanh nghiệp Việt Nam, điểm cần chú ý là khoảng cách giữa gói cá nhân và gói doanh nghiệp. Một nhân viên tự mua Pro rồi nối dot vào hộp thư hay Slack của công ty sẽ đưa dữ liệu công ty vào một tác tử chạy theo điều khoản của gói cá nhân, đọc liên tục và ghi nhớ, mà việc ngắt kết nối không xoá được phần đã ghi nhớ.
Gói Pro: thêm Pro 500, Pro 200 bị giảm hạn mức mà không nêu con số
ChatGPT Pro giờ có ba mức: Pro 100 (100 USD mỗi tháng), Pro 200 (200 USD) và Pro 500 (500 USD). Pro 500 có hạn mức gấp 25 lần gói Plus và là gói Pro duy nhất có Ultrafast; mua thêm credit trên Pro 100 hay Pro 200 không mở được Ultrafast.
Thay đổi ít được nhắc hơn nằm ở Pro 200. Theo trang trợ giúp cập nhật ngày 29/9, người đăng ký mới nhận "hạn mức thấp hơn trước đây", với lý do "để phản ánh các mô hình ngày càng hiệu quả của chúng tôi"; giá vẫn 200 USD. Thuê bao đang hoạt động tại thời điểm chốt, hoặc trong bảy ngày trước đó, được giữ hạn mức cũ đến 29/10/2026, rồi chuyển xuống mức thấp hơn. Trang trợ giúp không nói hạn mức mới là bao nhiêu, và chỉ người bị ảnh hưởng mới nhận email. Đầu tháng 9, chuyên mục này đã ghi nhận một thay đổi cùng kiểu ở Google: hạn mức Gemini Notebook bỏ con số 50 lượt đếm được để thay bằng mức không công bố.
Giám đốc tài chính Sarah Friar giải thích hướng đi này với CNBC: "Khi chúng tôi ra gói 200 USD, người ta nghĩ chúng tôi mất trí", và giờ người dùng "đang chuyển dần sang trả theo mức tiêu dùng", tức mua thêm credit ngoài phí thuê bao.
Ultrafast: nhanh tới sáu lần, giá đúng sáu lần
Ultrafast là mức tốc độ mới, cao hơn chế độ Fast (tên mới của Priority processing từ 30/7/2026). OpenAI nói nó sinh token nhanh "tới 8 lần" trong Codex, khoảng 300 token mỗi giây, và "tới 6 lần" trên API. Trên bảng giá API, GPT-6 Astra ở mức Ultrafast có giá 60 USD đầu vào và 300 USD đầu ra mỗi triệu token, đúng gấp sáu lần mức thường 10 và 50 USD; chế độ Fast là 20 và 100 USD, gấp đôi. Tốc độ là con số "tới", giá thì cố định: nếu một request chỉ nhanh gấp ba, bạn vẫn trả gấp sáu. Trong ChatGPT, Ultrafast chỉ có trên Pro 500 và Enterprise; bản Ultrafast của GPT-6.1 Sol chưa có giá.
Các công bố khác đáng chú ý
- OpenAI Private Intelligence: chế độ không lưu dữ liệu (Zero Data Retention) kèm kiểm tra an toàn tự động mà nhân viên OpenAI không xem được nội dung; bản xem trước Private Inference dùng điện toán bảo mật (confidential computing) ra "mùa thu này".
- Agents API có điều khiển máy tính, và Bedrock Managed Agents làm cùng Amazon để chạy tác tử OpenAI hoàn toàn trong AWS.
- Codex: chạy trên đám mây từ mọi thiết bị, CLI điều khiển bằng giọng nói, soát mã trong ứng dụng máy tính, và Codex Security Cloud quét cả kho GitHub theo lịch.
- Plugin extensions cho phép nhà phát triển dựng bảng điều khiển, trình soạn thảo ngay trong ChatGPT; plugin hỗ trợ đặc tả MCP Events đang được đề xuất để tự chạy khi có sự kiện ở ứng dụng khác.
- ChatGPT Space, Pages, slide cộng tác cho nhóm làm việc cùng nhau và cùng dot.
- Sign in with ChatGPT: dùng hạn mức gói ChatGPT ở 16 công cụ đối tác như Devin, Notion, Vercel. OpenAI Marketplace: khách hàng doanh nghiệp dùng một phần cam kết chi tiêu với OpenAI để mua phần mềm của 32 đối tác như Figma, Salesforce, Harvey, CrowdStrike.
Bối cảnh: một ngày sau khi huỷ GPT-6.1 Astra
DevDay diễn ra một ngày sau khi OpenAI thông báo huỷ kế hoạch ra GPT-6.1 Astra vì mô hình không đạt chuẩn an toàn của hãng, như chuyên mục này viết ngày 29/9. Friar nói với CNBC: "Khi phải ghìm tốc độ ở tuyến đầu, chúng tôi sẽ làm, và đó là điều chúng tôi đang cho thấy lúc này." Về kinh doanh, bà xác nhận doanh thu quý 3 tăng 70% so với quý trước và mảng doanh nghiệp tăng gấp đôi kể từ tháng 7. CNBC dẫn một nguồn giấu tên nói OpenAI đang bàn sơ bộ một vòng gọi vốn khoảng 30 tỷ USD, chưa có bản điều khoản; công ty đã huy động 122 tỷ USD ở mức định giá 852 tỷ USD hồi tháng 3 và nộp hồ sơ IPO bảo mật hồi tháng 6. Sam Altman nói ông "không có mốc thời gian cụ thể nào" cho việc niêm yết. OpenAI nói ChatGPT có 1,2 tỷ người dùng mỗi tuần.
Cần biết về nguồn tin:
- Mọi điểm benchmark và con số chi phí mỗi việc do OpenAI công bố; điểm của Claude được OpenAI lấy từ báo cáo công khai, không chạy lại trên cùng hệ thống. Chưa có đo lường độc lập nào về GPT-6.1 Sol tại thời điểm Locaith viết bài.
- Việc Việt Nam thuộc diện được mở dots là suy ra từ danh sách loại trừ trong trang trợ giúp của OpenAI; Locaith chưa thử tạo dot bằng tài khoản thật.
- Số liệu doanh thu và vòng gọi vốn là lời lãnh đạo OpenAI và nguồn giấu tên nói với CNBC, không phải báo cáo tài chính công bố.
Doanh nghiệp và đội kỹ thuật Việt Nam nên làm gì
Các nhận định dưới đây là quan điểm của Locaith:
- So GPT-6.1 Sol với Sonnet 5.5 trên dữ liệu của mình. Hai mô hình cùng giá, ra cách nhau một ngày, và không bên nào công bố phép so trực tiếp. Chạy cùng một bộ việc thật, đo cả điểm lẫn tổng token, vì giá mỗi token bằng nhau không có nghĩa chi phí mỗi việc bằng nhau.
- Tính lại hoá đơn theo tỷ lệ bộ nhớ đệm. Nếu phần lớn đầu vào của bạn là ngữ cảnh lặp lại, mức 0,10 USD là khác biệt thật. Nếu prompt thường dài hơn 272.000 token, nhớ rằng cả request bị tính giá ngữ cảnh dài.
- Đặt quy định trước khi nhân viên nối dot vào công cụ công ty. Quyết định ai được nối hộp thư, Slack, Drive của công ty vào tác tử chạy trên gói cá nhân. Nếu cần dots cho công việc, cân nhắc gói Business Premium, nơi dữ liệu không dùng để huấn luyện theo mặc định.
- Thuê bao Pro 200 nên ghi mốc 29/10/2026. Sau mốc đó hạn mức sẽ giảm mà chưa có con số; theo dõi mức dùng thực tế trong phần cài đặt để quyết định có nên chuyển sang Pro 100 hay không.
- Chỉ dùng Ultrafast khi độ trễ thật sự đáng giá gấp sáu. Với việc chạy nền hay xử lý theo lô, Batch và Flex rẻ hơn một nửa so với mức thường.
Nguồn:
- OpenAI — DevDay 2026 Recap, 29/9/2026 — danh sách công bố, phạm vi từng tính năng, Pro 500, Ultrafast, 1,2 tỷ người dùng mỗi tuần
- OpenAI — Introducing GPT-6.1 Sol, 29/9/2026 — bảng điểm, chi phí mỗi việc, chú thích về fallback, phép thử công cụ tìm kiếm hỏng, giá và nơi có mô hình
- OpenAI — Introducing dots, 29/9/2026 — cách dots hoạt động, cơ chế duyệt, chính sách huấn luyện, giá dot đầu tiên, ảnh bìa và ảnh trong bài
- OpenAI Help Center — Getting started with your dot — thị trường được mở, tháng đầu không trừ hạn mức, nghiên cứu chủ động, ngắt kết nối và Reset, quy tắc bốn mức; đọc 30/9/2026
- OpenAI Help Center — About ChatGPT Pro tiers — ba mức Pro, thay đổi hạn mức Pro 200, mốc 29/10/2026, Ultrafast chỉ trên Pro 500; đọc 30/9/2026
- OpenAI API Docs — Pricing và GPT-6.1 Sol — giá Standard, Fast, Ultrafast, ngưỡng 272.000 token, ngữ cảnh, mốc kiến thức; đọc 30/9/2026
- Claude Platform Docs — Pricing — giá Claude Fable 5.1, Opus 5.5, Sonnet 5.5; đọc 30/9/2026
- CNBC — OpenAI DevDay 2026: Live updates and announcements, 29/9/2026 — số người tham dự, lời Sarah Friar và Sam Altman, vòng gọi vốn đang bàn
- Locaith — bài ngày 29/9/2026 về GPT-6 Astra và việc huỷ GPT-6.1 Astra; bài ngày 29/9/2026 về Claude Sonnet 5.5; bài ngày 23/9/2026 về GPT-6 Sol và Luna; bài ngày 4/9/2026 về hạn mức Gemini Notebook
Điểm benchmark, chi phí mỗi việc và tốc độ là số do OpenAI công bố, chưa được kiểm chứng độc lập. Locaith không tự chạy thử GPT-6.1 Sol hay dots. Các câu trích được Locaith dịch từ tiếng Anh. Ảnh bìa: OpenAI, cắt từ ảnh giới thiệu dots, Locaith bỏ dòng chữ "dots" phía trên. Ảnh trong bài: OpenAI. Biên soạn và phân tích bởi Ban Biên Tập Locaith, 30/9/2026.