Hôm nay, Google đã phát hành ba phiên bản Gemini với cùng một mục tiêu cơ bản là làm được nhiều việc hơn với ít token hơn.
- 3.6 Flash
- 3.5 Flash-Lite
- 3.5 Flash Cyber.
3.6 Flash là bản nâng cấp đa năng. Flash-Lite đánh đổi chất lượng lấy tốc độ và giá cả. Cyber là một công cụ bảo mật chuyên dụng mà hầu hết người dùng sẽ không được tiếp cận.
Bài viết dưới đây sẽ nêu rõ mỗi phiên bản thực sự làm được gì, hiệu năng ra sao và Gemini 3.5 Pro nằm ở đâu trong tổng thể.
Lựa chọn giữa các phiên bản Gemini mới
Mỗi phiên bản nằm ở một vị trí khác nhau trên bảng xếp hạng chi phí-khả năng. Nếu bạn lựa chọn dựa trên kết quả benchmark, hãy bỏ qua phần này; các kết quả benchmark nằm ở phía dưới.
Gemini 3.6 Flash là gì?
Gemini 3.6 Flash là phiên bản trọng tâm của bản phát hành này. Đây là phiên bản mà Google muốn bạn mặc định sử dụng cho việc lập trình, công việc trí tuệ và bất kỳ công việc đa phương thức nào.
Theo Artificial Analysis Index, Flash 3.6 giảm mức sử dụng token đầu ra xuống 17% so với Flash 3.5, và Google báo cáo mức giảm lên tới 65% trong các đánh giá riêng lẻ như DeepSWE. Một phần là do mô hình thông minh hơn, đưa ra ít thông tin hơn. Phần còn lại đến từ việc đưa ra kết luận với ít bước suy luận và gọi công cụ hơn, đây là một loại lợi ích khác và khó làm giả hơn.
Flash 3.6 nhận đầu vào là văn bản, hình ảnh, video, âm thanh và PDF, chạy cửa sổ ngữ cảnh 1 triệu token với giới hạn đầu ra 64k. Việc Computer use hiện đã được tích hợp vào cả API Gemini và Gemini Enterprise, cùng với việc gọi hàm, đầu ra có cấu trúc và tìm kiếm như một công cụ. (Mặc dù điều này có thể không còn độc đáo đối với Flash 3.6 nữa; hầu hết các phòng thí nghiệm tiên phong hiện nay đều cung cấp một số phiên bản Computer use).

Gemini 3.5 Flash-Lite là gì?
3.5 Flash-Lite không cố gắng trở thành mô hình thông minh nhất trong dòng sản phẩm. Nó là mô hình nhanh nhất, với 350 token đầu ra mỗi giây, và rẻ nhất, với giá 0,30 USD cho mỗi triệu token đầu vào và 2,50 USD cho mỗi triệu token đầu ra.
Nếu khối lượng công việc của bạn lớn và nhạy cảm với độ trễ — ví dụ như tìm kiếm agentic, xử lý tài liệu hàng loạt, bất cứ thứ gì chạy hàng nghìn lần mỗi ngày — thì khoảng cách chất lượng mà các mô hình khác mang lại có lẽ không đáng với chi phí để thu hẹp nó. Vì vậy, đó là điều mà Flash-Lite đang đặt cược.
Các nhà phát triển có thể điều chỉnh mức độ tư duy lên hoặc xuống tùy theo công việc: Tối thiểu hoặc thấp để thực thi nhanh, rẻ và khối lượng lớn, hoặc cao hơn cho công việc subagent nhiều bước thực sự cần suy luận.
Gemini 3.5 Flash Cyber là gì?
Cuối cùng, chúng ta có Cyber, một phiên bản mà hầu hết người đọc bài này sẽ không bao giờ có cơ hội sử dụng. Đó là phiên bản Flash 3.5 được tinh chỉnh đặc biệt để tìm và vá các lỗ hổng bảo mật, được triển khai bên trong hệ thống CodeMender của Google, nơi một số agent mô hình Cyber hoạt động cùng nhau và trả về một báo cáo tổng hợp.
Google cho biết nó có khả năng cạnh tranh với các mô hình quy mô tiên tiến trên CyberGym, một tiêu chuẩn an ninh mạng được sử dụng rộng rãi, mặc dù dung lượng nhỏ hơn — điều này, nếu được chứng minh là đúng, có thể là câu chuyện hiệu quả thú vị hơn trong toàn bộ bản phát hành này.
Quyền truy cập bị giới hạn cho các chính phủ và đối tác đáng tin cậy thông qua chương trình thí điểm của CodeMender. Không có giá bán công khai, không có ngày phát hành chính thức.
Benchmark Gemini 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber
Dưới đây là tóm tắt kết quả benchmark. Bài viết cũng đã bao gồm thông tin về giá cả, đây là một phần quan trọng khi lựa chọn.
| Benchmark | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro | GPT-5.6 Luna | Grok 4.5 | Claude Sonnet 5 |
|---|---|---|---|---|---|---|
| Input price ($/1M) | $1.50 | $1.50 | $2.00 | $1.00 | $2.00 | $3.00 |
| Output price ($/1M) | $7.50 | $9.00 | $12.00 | $6.00 | $6.00 | $15.00 |
| SWE-Bench Pro | 58.7% | 55.1% | 54.2% | 62.7% | 64.7% | 63.2% |
| DeepSWE v1.1 | 49% | 37% | 12% | 67% | 54% | 54% |
| Terminal-Bench 2.1 | 78.0% | 76.2% | 73.8% | 84.7% | 83.3% | 80.4% |
| MLE-Bench | 63.9% | 49.7% | 42.6% | 47.6% | 43.2% | 66.9% |
| OSWorld-Verified | 83.0% | 78.4% | 76.2% | 72.6% | — | 81.2% |
| GDPVal-AA v2 (Elo) | 1421 | 1349 | 965 | 1584 | 1535 | 1607 |
| CharXiv Reasoning (không có công cụ) | 85.2% | 84.2% | 83.3% | 82.7% | 81.6% | 77.0% |
| GDM-MRCR v2, 128k | 91.8% | 77.3% | 84.9% | 74.8% | 81.4% | 71.6% |
So với các đối thủ cạnh tranh bên ngoài, kết quả khá sít sao. GPT-5.6 Luna và Grok 4.5 dẫn đầu trong các bài kiểm tra đòi hỏi nhiều khả năng lập trình — SWE-Bench Pro, DeepSWE — và đó là một khoảng cách thực sự nếu khối lượng công việc của bạn thực sự nặng về lập trình chứ không phải chỉ liên quan đến lập trình.
Claude Sonnet 5 dẫn đầu trong các bài kiểm tra về kiến thức chuyên môn và MLE-Bench.
Điểm mạnh thực sự của 3.6 Flash nằm ở khả năng truy xuất thông tin ngữ cảnh dài và suy luận dựa trên biểu đồ, với khoảng cách đủ lớn để không có sự cạnh tranh nào đáng kể, và nó có giá thấp hơn mọi mô hình khác trong danh sách đó ngoại trừ GPT-5.6 Luna và Grok 4.5.
Ngày phát hành, tính khả dụng và giá cả
3.6 Flash và 3.5 Flash-Lite hiện đã có sẵn — trên Gemini API, Google AI Studio, Android Studio, và riêng đối với 3.6 Flash, cả Google Antigravity nữa. Khách hàng doanh nghiệp có cả hai phiên bản thông qua Gemini Enterprise Agent Platform, với 3.6 Flash cũng có trong ứng dụng Gemini Enterprise. Về phía người dùng cuối, cả hai đều có trong ứng dụng Gemini, và Flash-Lite đang bắt đầu xuất hiện trong AI Mode của Google Search.
Giá cả như sau:
- 3.6 Flash: 1,50 USD/1 triệu token đầu vào, 7,50 USD/1 triệu token đầu ra
- 3.5 Flash-Lite: 0,30 USD/1 triệu token đầu vào, 2,50 USD/1 triệu token đầu ra
- 3.5 Flash Cyber: Chưa công bố giá — chỉ giới hạn trong chương trình thí điểm CodeMender
Kết luận
Không có mô hình nào trong ba mô hình này cố gắng đứng đầu mọi bảng xếp hạng, và đó có lẽ là quyết định đúng đắn. Flash 3.6 thua kém GPT-5.6 Luna và Grok 4.5 về benchmark lập trình, và thua Claude Sonnet 5 về công việc tri thức, đổi lại là sự nhảy vọt về hiệu quả so với phiên bản tiền nhiệm và dẫn đầu rõ ràng về truy xuất ngữ cảnh dài.
Flash-Lite 3.5 thậm chí không cố gắng cạnh tranh về chất lượng. Nó đặt cược rằng đối với phần lớn khối lượng công việc agentic, chất lượng sau một điểm nhất định sẽ không còn quan trọng bằng tốc độ và chi phí. Điều đó có lẽ đúng. Đó cũng là kiểu đặt cược trông có vẻ đúng đắn cho đến khi một agent đưa ra quyết định sai mà một mô hình thông minh hơn sẽ không mắc phải.
Cyber không nằm trong bất kỳ bảng xếp hạng nào. Nó là một công cụ chuyên dụng được xây dựng cho một công việc duy nhất, chỉ dành cho những người mà Google tin tưởng sử dụng một cách có trách nhiệm — điều này nói lên mức độ nghiêm túc mà Google đang xem xét rủi ro phát hiện lỗ hổng bảo mật cũng như bất kỳ điều gì về khía cạnh an toàn.
Nhìn chung, điều này giống như việc Google tinh chỉnh toàn bộ tầng Flash cho các tác vụ xử lý dữ liệu quy mô lớn hơn là ba lần ra mắt riêng biệt, trong khi vẫn giữ lại các phiên bản đầy tham vọng hơn — 3.5 Pro, Gemini 4 — để sử dụng khi chúng sẵn sàng.
Hướng dẫn AI
Học IT
Hàm Excel