Tìm hiểu về Gemini 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber: Những mô hình mới của Google

Hôm nay, Google đã phát hành ba phiên bản Gemini với cùng một mục tiêu cơ bản là làm được nhiều việc hơn với ít token hơn.

  • 3.6 Flash
  • 3.5 Flash-Lite
  • 3.5 Flash Cyber.

3.6 Flash là bản nâng cấp đa năng. Flash-Lite đánh đổi chất lượng lấy tốc độ và giá cả. Cyber ​​là một công cụ bảo mật chuyên dụng mà hầu hết người dùng sẽ không được tiếp cận.

Bài viết dưới đây sẽ nêu rõ mỗi phiên bản thực sự làm được gì, hiệu năng ra sao và Gemini 3.5 Pro nằm ở đâu trong tổng thể.

Lựa chọn giữa các phiên bản Gemini mới

Mỗi phiên bản nằm ở một vị trí khác nhau trên bảng xếp hạng chi phí-khả năng. Nếu bạn lựa chọn dựa trên kết quả benchmark, hãy bỏ qua phần này; các kết quả benchmark nằm ở phía dưới.

Gemini 3.6 Flash là gì?

Gemini 3.6 Flash là phiên bản trọng tâm của bản phát hành này. Đây là phiên bản mà Google muốn bạn mặc định sử dụng cho việc lập trình, công việc trí tuệ và bất kỳ công việc đa phương thức nào.

Theo Artificial Analysis Index, Flash 3.6 giảm mức sử dụng token đầu ra xuống 17% so với Flash 3.5, và Google báo cáo mức giảm lên tới 65% trong các đánh giá riêng lẻ như DeepSWE. Một phần là do mô hình thông minh hơn, đưa ra ít thông tin hơn. Phần còn lại đến từ việc đưa ra kết luận với ít bước suy luận và gọi công cụ hơn, đây là một loại lợi ích khác và khó làm giả hơn.

Flash 3.6 nhận đầu vào là văn bản, hình ảnh, video, âm thanh và PDF, chạy cửa sổ ngữ cảnh 1 triệu token với giới hạn đầu ra 64k. Việc Computer use hiện đã được tích hợp vào cả API Gemini và Gemini Enterprise, cùng với việc gọi hàm, đầu ra có cấu trúc và tìm kiếm như một công cụ. (Mặc dù điều này có thể không còn độc đáo đối với Flash 3.6 nữa; hầu hết các phòng thí nghiệm tiên phong hiện nay đều cung cấp một số phiên bản Computer use).

Gemini 3.5 Flash-Lite là gì?

3.5 Flash-Lite không cố gắng trở thành mô hình thông minh nhất trong dòng sản phẩm. Nó là mô hình nhanh nhất, với 350 token đầu ra mỗi giây, và rẻ nhất, với giá 0,30 USD cho mỗi triệu token đầu vào và 2,50 USD cho mỗi triệu token đầu ra.

Nếu khối lượng công việc của bạn lớn và nhạy cảm với độ trễ — ví dụ như tìm kiếm agentic, xử lý tài liệu hàng loạt, bất cứ thứ gì chạy hàng nghìn lần mỗi ngày — thì khoảng cách chất lượng mà các mô hình khác mang lại có lẽ không đáng với chi phí để thu hẹp nó. Vì vậy, đó là điều mà Flash-Lite đang đặt cược.

Các nhà phát triển có thể điều chỉnh mức độ tư duy lên hoặc xuống tùy theo công việc: Tối thiểu hoặc thấp để thực thi nhanh, rẻ và khối lượng lớn, hoặc cao hơn cho công việc subagent nhiều bước thực sự cần suy luận.

Gemini 3.5 Flash Cyber ​​là gì?

Cuối cùng, chúng ta có Cyber, một phiên bản mà hầu hết người đọc bài này sẽ không bao giờ có cơ hội sử dụng. Đó là phiên bản Flash 3.5 được tinh chỉnh đặc biệt để tìm và vá các lỗ hổng bảo mật, được triển khai bên trong hệ thống CodeMender của Google, nơi một số agent mô hình Cyber ​​hoạt động cùng nhau và trả về một báo cáo tổng hợp.

Google cho biết nó có khả năng cạnh tranh với các mô hình quy mô tiên tiến trên CyberGym, một tiêu chuẩn an ninh mạng được sử dụng rộng rãi, mặc dù dung lượng nhỏ hơn — điều này, nếu được chứng minh là đúng, có thể là câu chuyện hiệu quả thú vị hơn trong toàn bộ bản phát hành này.

Quyền truy cập bị giới hạn cho các chính phủ và đối tác đáng tin cậy thông qua chương trình thí điểm của CodeMender. Không có giá bán công khai, không có ngày phát hành chính thức.

Benchmark Gemini 3.6 Flash, 3.5 Flash-Lite và 3.5 Flash Cyber

Dưới đây là tóm tắt kết quả benchmark. Bài viết cũng đã bao gồm thông tin về giá cả, đây là một phần quan trọng khi lựa chọn.

Benchmark Gemini 3.6 Flash Gemini 3.5 Flash Gemini 3.1 Pro GPT-5.6 Luna Grok 4.5 Claude Sonnet 5
Input price ($/1M) $1.50 $1.50 $2.00 $1.00 $2.00 $3.00
Output price ($/1M) $7.50 $9.00 $12.00 $6.00 $6.00 $15.00
SWE-Bench Pro 58.7% 55.1% 54.2% 62.7% 64.7% 63.2%
DeepSWE v1.1 49% 37% 12% 67% 54% 54%
Terminal-Bench 2.1 78.0% 76.2% 73.8% 84.7% 83.3% 80.4%
MLE-Bench 63.9% 49.7% 42.6% 47.6% 43.2% 66.9%
OSWorld-Verified 83.0% 78.4% 76.2% 72.6% 81.2%
GDPVal-AA v2 (Elo) 1421 1349 965 1584 1535 1607
CharXiv Reasoning (không có công cụ) 85.2% 84.2% 83.3% 82.7% 81.6% 77.0%
GDM-MRCR v2, 128k 91.8% 77.3% 84.9% 74.8% 81.4% 71.6%

So với các đối thủ cạnh tranh bên ngoài, kết quả khá sít sao. GPT-5.6 Luna và Grok 4.5 dẫn đầu trong các bài kiểm tra đòi hỏi nhiều khả năng lập trình — SWE-Bench Pro, DeepSWE — và đó là một khoảng cách thực sự nếu khối lượng công việc của bạn thực sự nặng về lập trình chứ không phải chỉ liên quan đến lập trình.

Claude Sonnet 5 dẫn đầu trong các bài kiểm tra về kiến ​​thức chuyên môn và MLE-Bench.

Điểm mạnh thực sự của 3.6 Flash nằm ở khả năng truy xuất thông tin ngữ cảnh dài và suy luận dựa trên biểu đồ, với khoảng cách đủ lớn để không có sự cạnh tranh nào đáng kể, và nó có giá thấp hơn mọi mô hình khác trong danh sách đó ngoại trừ GPT-5.6 Luna và Grok 4.5.

Ngày phát hành, tính khả dụng và giá cả

3.6 Flash và 3.5 Flash-Lite hiện đã có sẵn — trên Gemini API, Google AI Studio, Android Studio, và riêng đối với 3.6 Flash, cả Google Antigravity nữa. Khách hàng doanh nghiệp có cả hai phiên bản thông qua Gemini Enterprise Agent Platform, với 3.6 Flash cũng có trong ứng dụng Gemini Enterprise. Về phía người dùng cuối, cả hai đều có trong ứng dụng Gemini, và Flash-Lite đang bắt đầu xuất hiện trong AI Mode của Google Search.

Giá cả như sau:

  • 3.6 Flash: 1,50 USD/1 triệu token đầu vào, 7,50 USD/1 triệu token đầu ra
  • 3.5 Flash-Lite: 0,30 USD/1 triệu token đầu vào, 2,50 USD/1 triệu token đầu ra
  • 3.5 Flash Cyber: Chưa công bố giá — chỉ giới hạn trong chương trình thí điểm CodeMender

Kết luận

Không có mô hình nào trong ba mô hình này cố gắng đứng đầu mọi bảng xếp hạng, và đó có lẽ là quyết định đúng đắn. Flash 3.6 thua kém GPT-5.6 Luna và Grok 4.5 về benchmark lập trình, và thua Claude Sonnet 5 về công việc tri thức, đổi lại là sự nhảy vọt về hiệu quả so với phiên bản tiền nhiệm và dẫn đầu rõ ràng về truy xuất ngữ cảnh dài.

Flash-Lite 3.5 thậm chí không cố gắng cạnh tranh về chất lượng. Nó đặt cược rằng đối với phần lớn khối lượng công việc agentic, chất lượng sau một điểm nhất định sẽ không còn quan trọng bằng tốc độ và chi phí. Điều đó có lẽ đúng. Đó cũng là kiểu đặt cược trông có vẻ đúng đắn cho đến khi một agent đưa ra quyết định sai mà một mô hình thông minh hơn sẽ không mắc phải.

Cyber ​​không nằm trong bất kỳ bảng xếp hạng nào. Nó là một công cụ chuyên dụng được xây dựng cho một công việc duy nhất, chỉ dành cho những người mà Google tin tưởng sử dụng một cách có trách nhiệm — điều này nói lên mức độ nghiêm túc mà Google đang xem xét rủi ro phát hiện lỗ hổng bảo mật cũng như bất kỳ điều gì về khía cạnh an toàn.

Nhìn chung, điều này giống như việc Google tinh chỉnh toàn bộ tầng Flash cho các tác vụ xử lý dữ liệu quy mô lớn hơn là ba lần ra mắt riêng biệt, trong khi vẫn giữ lại các phiên bản đầy tham vọng hơn — 3.5 Pro, Gemini 4 — để sử dụng khi chúng sẵn sàng.

Thứ Tư, 22/07/2026 09:54
51 👨
Xác thực tài khoản!

Theo Nghị định 147/2024/ND-CP, bạn cần xác thực tài khoản trước khi sử dụng tính năng này. Chúng tôi sẽ gửi mã xác thực qua SMS hoặc Zalo tới số điện thoại mà bạn nhập dưới đây:

Số điện thoại chưa đúng định dạng!
Số điện thoại này đã được xác thực!
Bạn có thể dùng Sđt này đăng nhập tại đây!
Lỗi gửi SMS, liên hệ Admin
0 Bình luận
Sắp xếp theo
❖ AI cho người mới