Google vừa ra Gemini 3.6 Flash, nhưng chưa phải bản Pro mới
Ngày 21/7/2026, Google công bố cùng lúc ba model: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber. Đây là đợt cập nhật đáng chú ý nhất của dòng Gemini kể từ đầu năm nay, nhưng cần nói thẳng ngay từ đầu để khỏi hiểu lầm: đây không phải Gemini 3.5 Pro, bản flagship mà Google từng nhắc tới hồi tháng 6. Gemini 3.5 Pro vẫn đang test nội bộ cùng một số đối tác chọn lọc, sau khi Google tự đánh giá bản dựng thử chưa đạt kỳ vọng ở khả năng code và suy luận nhiều bước. Gemini 4 thì mới bắt đầu vòng tiền huấn luyện mà Google gọi là tham vọng nhất từ trước tới giờ, còn lâu mới tới ngày ra mắt.
Nói dễ hiểu hơn, 3.6 Flash thuộc dòng workhorse, tức nhóm model tầm trung, chạy nhanh, giá rẻ, phục vụ khối lượng công việc lớn hằng ngày, chứ không phải bản đọ sức mạnh tuyệt đối với GPT hay Claude. Nếu bạn đang chờ một Gemini vượt trội hẳn để giải quyết bài toán code phức tạp hay suy luận dài hơi, bản này chưa phải câu trả lời. Mình viết bài này để tách bạch rõ hai chuyện đó, vì tuần vừa rồi không ít khách hỏi shop kiểu Gemini mới ra có phải bản xịn nhất chưa, và câu trả lời ngắn gọn là chưa.

Gemini 3.6 Flash là gì, ba bản mới khác nhau ra sao
Gemini 3.6 Flash là bản kế nhiệm Gemini 3.5 Flash, giữ vai trò workhorse mặc định của cả dòng Gemini. Model này có mặt ở Google AI Studio, Gemini API, app Gemini, Android Studio, Antigravity và Vertex AI/Gemini Enterprise. Giá API giữ nguyên phần input ở 1,50 USD/1 triệu token, còn output giảm từ 9 USD xuống 7,50 USD/1 triệu token. Mốc kiến thức của model cũng được cập nhật tới tháng 3/2026.
Đi cùng đợt này là hai bản khác, mỗi bản nhắm một nhu cầu riêng:
- Gemini 3.5 Flash-Lite: bản rẻ và nhanh nhất, tốc độ 350 token output mỗi giây, giá 0,30 USD/1 triệu input và 2,50 USD/1 triệu output. Phù hợp việc cần chạy khối lượng lớn như tìm kiếm dạng agent hay xử lý tài liệu hàng loạt, nơi tốc độ và chi phí quan trọng hơn độ sâu suy luận.
- Gemini 3.5 Flash Cyber: bản chuyên bảo mật, tích hợp với agent CodeMender để tìm, xác minh và vá lỗ hổng phần mềm. Model này chỉ mở qua một chương trình pilot giới hạn, dành cho chính phủ và đối tác được chọn, người dùng thường như mình với bạn không có cách nào truy cập trực tiếp, nên bài này chỉ nhắc qua cho đủ thông tin chứ không đi sâu.
Tóm lại phần liên quan tới đa số người dùng cá nhân và doanh nghiệp nhỏ ở Việt Nam vẫn là Gemini 3.6 Flash, vì đây là bản chạy trong app Gemini và các gói AI Pro/Ultra mà mình đang bán.
Điểm mạnh mới: code, đa phương thức và giảm 17% số token
Điểm được Google nhấn mạnh nhiều nhất ở 3.6 Flash là hiệu quả token. Theo công bố của Google, model này giảm khoảng 17% số token output cần thiết so với bản 3.5 Flash cũ để hoàn thành cùng một việc. Hiểu đơn giản, model tốn ít bước suy nghĩ và ít lần gọi công cụ hơn cho cùng một tác vụ nhiều bước, nên phản hồi nhanh hơn và rẻ hơn ở quy mô lớn, đây là thứ các đội dùng Gemini chạy agent hay pipeline tự động sẽ cảm nhận rõ nhất, hơn là người dùng phổ thông gõ vài câu hỏi hằng ngày.
Khả năng code cũng được cải thiện đáng kể so với bản tiền nhiệm, thể hiện qua các benchmark ở phần dưới. Ngoài ra Google cũng nói tới cải thiện ở khả năng điều khiển máy tính tự động, tức để model tự thao tác trên giao diện web hay ứng dụng thay người dùng, một hướng agentic mà cả Google, OpenAI lẫn xAI đều đang đẩy mạnh song song. Với người dùng phổ thông, phần dễ nhận ra nhất trong đợt cập nhật này thường là tốc độ phản hồi ở các tác vụ nhiều bước, kiểu vừa tra cứu vừa tổng hợp vừa viết lại, hơn là một cú nhảy vọt rõ rệt ở chất lượng câu trả lời cho một câu hỏi đơn lẻ.
Benchmark chính thức Google công bố
Theo đúng số liệu Google công bố trong bài Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber, so với Gemini 3.5 Flash cũ:
| Benchmark | Gemini 3.5 Flash (cũ) | Gemini 3.6 Flash (mới) |
|---|---|---|
| DeepSWE (đo bởi Datacurve) | 37% | 49% |
| MLE Bench | 49,7% | 63,9% |
| OSWorld-Verified (điều khiển máy tính tự động) | 78,4% | 83,0% |
| GDPval-AA v2 (việc tri thức) | 1349 điểm | 1421 điểm |
Mức tăng ở DeepSWE và MLE Bench là rõ nhất, cho thấy 3.6 Flash code tốt hơn khá nhiều so với bản cũ trong cùng phân khúc giá. Còn Gemini 3.5 Flash-Lite, phiên bản rẻ nhất, cũng có bước tiến so với 3.1 Flash-Lite: Terminal-Bench 2.1 tăng từ 31% lên 54%, SWE-Bench Pro từ 49,6% lên 54,2%, OSWorld-Verified từ 65,1% lên 74,0%. Những con số này đều là Google tự đo và tự công bố, nên đọc như một tín hiệu tiến bộ nội bộ dòng sản phẩm, không phải kết quả kiểm chứng độc lập bên thứ ba.

So với GPT-5.6 và Grok 4.5, Gemini 3.6 Flash đứng ở đâu
Đây là phần dễ viết sai nhất nên mình nói rõ luôn: không có benchmark đối đầu trực tiếp, cùng ngày, do cả hai hãng tự công bố giữa Gemini 3.6 Flash với GPT-5.6 hay Grok 4.5. Mọi so sánh xuyên hãng ở thời điểm này đều dựa trên benchmark riêng lẻ từng bên tự đo, nên chỉ mang tính tham khảo tương đối.
Điều cần tránh nhất là gán nhầm sức mạnh của Gemini 3.5 Pro, bản flagship còn chưa ra mắt rộng rãi, cho Gemini 3.6 Flash, bản workhorse tầm trung vừa ra. Thế mạnh truyền thống mà cả dòng Gemini vẫn được ghi nhận, đặc biệt ở các bản Pro, là phân tích đa phương tiện, đọc hiểu video, xử lý tài liệu nhiều hình ảnh và context window thường lên tới 1 triệu token. Đây là điểm mạnh chung của dòng Gemini, còn để nói cụ thể 3.6 Flash đạt đúng mức đó ở benchmark riêng thì Google chưa công bố số cho hạng mục này.
Vị trí thực tế của 3.6 Flash gần với việc cạnh tranh giá và hiệu năng cùng các model workhorse hạng trung khác, như các bản Terra hay Luna trong GPT-5.6, hơn là đối đầu trực diện với bản flagship của đối thủ. Nếu bạn muốn nhìn toàn cảnh Gemini so với các trợ lý khác ở mức phổ thông, có thể xem thêm bài so sánh Grok và Gemini hoặc bài so Gemini 3.5 Flash với ChatGPT và Claude mình từng viết trước đó, nhiều nhận định về thế mạnh đa phương tiện vẫn còn giá trị tham khảo.
Người Việt đang dùng Gemini thì cần biết gì
Tin vui là bạn không cần trả thêm tiền để chạm được Gemini 3.6 Flash. Model này chạy sẵn trong app Gemini bản miễn phí, chỉ là hạn mức sử dụng mỗi ngày sẽ thấp hơn so với tài khoản trả phí. Việc dồn dập ra model mới mỗi vài tháng của Google đôi khi khiến người dùng phổ thông rối, không rõ bản mình đang gõ chat có phải bản mới nhất hay không, nên nếu bạn thấy app Gemini tự nhiên trả lời nhanh và mượt hơn vài tuần gần đây, khả năng cao bạn đã được chuyển sang 3.6 Flash rồi mà không cần làm gì.
Câu hỏi thực tế hơn là khi nào nên cân nhắc lên gói trả phí. Nếu công việc của bạn chỉ dừng ở hỏi đáp, viết lách, tóm tắt tài liệu ở mức vừa phải, bản miễn phí với 3.6 Flash bên trong vẫn đủ dùng thoải mái. Còn nếu bạn cần dùng nhiều lần trong ngày, cần các công cụ đi kèm như Deep Research để nghiên cứu sâu, NotebookLM để tổng hợp tài liệu, Veo để tạo video, hoặc cần thêm dung lượng Google Drive, đó là lúc gói trả phí bắt đầu đáng tiền. Mình có viết riêng một bài so Gemini là gì, khác ChatGPT và Claude ra sao và một bài so Gemini Advanced với ChatGPT Plus, nếu bạn đang phân vân giữa các hệ sinh thái thì đọc thêm hai bài đó sẽ rõ hơn góc nhìn tổng thể, ngoài phạm vi bài này.
Một điều nữa mình hay nhắc khách khi tư vấn: đừng đợi Google công bố phiên bản mới rồi mới quyết định nâng cấp. Dòng Gemini cập nhật khá dồn dập trong năm nay, gần như cứ vài tháng lại có một bản mới, nên nếu cứ chờ bản mới nhất mới dùng thì gần như không bao giờ tới lượt. Quyết định nên dựa trên nhu cầu thực tế của bạn tại thời điểm hiện tại, còn model chạy bên dưới sẽ tự được Google cập nhật dần theo thời gian mà bạn không cần làm gì thêm.
Gói nào ở Việt Nam để có hạn mức cao hơn
Cần nói rõ một điểm hay bị hiểu sai: gói Google AI Pro không phải vé vào cửa để dùng Gemini 3.6 Flash, vì bản miễn phí đã có sẵn model này. Gói trả phí mang lại hạn mức sử dụng cao hơn nhiều lần mỗi ngày, cộng thêm quyền truy cập các công cụ khác trong hệ sinh thái Google như Deep Research, NotebookLM, Veo và dung lượng Drive lớn hơn.
Ở BestApp, Google AI Pro (Gemini) qua nâng cấp chính chủ hiện có ba lựa chọn thời hạn: 99.000đ cho 1 tháng, 250.000đ cho 6 tháng, và 400.000đ cho trọn năm. Với nhu cầu dùng thử hoặc dùng ngắn hạn, gói tháng đủ linh hoạt, còn nếu xác định gắn bó lâu dài thì gói năm tính ra rẻ hơn hẳn theo tháng.
Với nhu cầu nặng hơn nữa, kiểu chạy khối lượng công việc lớn hoặc cần hạn mức gần như không giới hạn, Google còn có gói Google AI Ultra riêng, với hai mức X5 khoảng 400.000đ/tháng và X20 khoảng 650.000đ/tháng. Đây là sản phẩm khác, dành cho nhóm nhỏ người dùng thật sự cần tới mức đó, phần lớn người dùng cá nhân hay công việc văn phòng thông thường chưa cần tới.

Có nên lên Google AI Pro để tận dụng Gemini mới chưa
Câu trả lời phụ thuộc vào việc bạn có đang chạm trần hạn mức miễn phí hay không. Nếu bạn thấy Gemini bản free thường xuyên báo hết lượt dùng trong ngày, hoặc bạn cần các công cụ đi kèm như Deep Research, NotebookLM, Veo mà bản free không có, lên AI Pro lúc này hợp lý, vì bạn được cả hạn mức cao hơn lẫn Gemini 3.6 Flash mới đang chạy bên trong.
Ngược lại, nếu nhu cầu của bạn vẫn gói gọn trong vài lần hỏi đáp mỗi ngày và bản free đã đủ, việc Google vừa ra model mới không tự nhiên biến bản miễn phí thành thiếu hụt. 3.6 Flash là bản nâng cấp workhorse, không phải cú nhảy vọt buộc ai cũng phải đổi gói ngay.




