
Gemini 3.6 Flash Family
Gemini 3.6 Flash Family là dòng Flash hiệu quả về token, độ trễ thấp của Google để mở rộng quy mô tác nhân AI sản xuất – nổi bật với 3.6 Flash cho công việc chất lượng cao hơn với ít token hơn, 3.5 Flash-Lite cho các tác vụ thông lượng cao cực nhanh và 3.5 Flash Cyber được kiểm soát để phát hiện và vá lỗ hổng thông qua CodeMender.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/?ref=producthunt&utm_source=aipure

Thông tin Sản phẩm
Đã cập nhật:Jul 23, 2026
Xu hướng Lưu lượng Truy cập Hàng tháng của Gemini 3.6 Flash Family
Gemini 3.6 Flash Family đã nhận được 8.5m lượt truy cập trong tháng trước, thể hiện mức Suy giảm Nhẹ -12.1%. Dựa trên phân tích của chúng tôi, xu hướng này phù hợp với động lực thị trường điển hình trong lĩnh vực công cụ AI.
Xem lịch sử lưu lượng truy cậpGemini 3.6 Flash Family là gì
Gemini 3.6 Flash Family là một bộ các mô hình Gemini “Flash” được Google giới thiệu để giúp các nhà phát triển và doanh nghiệp vận hành các tác nhân AI hiệu quả hơn trong sản xuất – ưu tiên độ trễ thấp hơn, độ tin cậy cao hơn và chi phí trên mỗi tác vụ tốt hơn thay vì tối đa hóa kích thước mô hình thô. Được công bố vào ngày 21 tháng 7 năm 2026, gia đình này bao gồm Gemini 3.6 Flash (công cụ đa năng cho công việc mã hóa, kiến thức và các tác vụ đa phương thức), Gemini 3.5 Flash-Lite (mô hình lớp 3.5 nhanh nhất, hiệu quả nhất về chi phí cho khối lượng công việc lớn) và Gemini 3.5 Flash Cyber (một biến thể chuyên biệt về an ninh mạng chỉ có sẵn thông qua chương trình thí điểm CodeMender có giới hạn quyền truy cập dành cho chính phủ và các đối tác đáng tin cậy). Các mô hình này được định vị để hỗ trợ các quy trình làm việc tác nhân có thể mở rộng trên các công cụ dành cho nhà phát triển và các bề mặt doanh nghiệp, với 3.6 Flash và 3.5 Flash-Lite có sẵn thông qua API Gemini (Google AI Studio và Android Studio) và tích hợp sản phẩm rộng hơn.
Các Tính năng Chính của Gemini 3.6 Flash Family
Dòng sản phẩm Gemini 3.6 Flash Family là dòng Flash tập trung vào hiệu quả của Google để xây dựng và vận hành các tác nhân AI sản xuất ở quy mô lớn, bao gồm Gemini 3.6 Flash (mô hình chủ lực), Gemini 3.5 Flash-Lite (tùy chọn nhanh nhất và tiết kiệm chi phí nhất trong phân khúc 3.5), và Gemini 3.5 Flash Cyber (một biến thể tập trung vào an ninh mạng được triển khai trong CodeMender). Trên toàn bộ dòng sản phẩm, trọng tâm là độ trễ thấp hơn, thông lượng cao hơn, hiệu quả token được cải thiện và thực thi tác nhân đáng tin cậy (bao gồm công cụ sử dụng máy tính tích hợp thông qua Gemini API/Enterprise). Gemini 3.6 Flash đặc biệt cải thiện hiệu suất mã hóa, công việc tri thức và đa phương thức trong khi sử dụng ít token đầu ra hơn và chi phí mỗi token đầu ra thấp hơn 3.5 Flash, đồng thời đi kèm với các biện pháp bảo vệ an toàn Frontier Safety nâng cao chống lại việc lạm dụng CBRN và tấn công mạng. Flash-Lite nhắm đến các khối lượng công việc lớn, nhạy cảm với độ trễ với các cấp độ tư duy có thể cấu hình và hiệu suất giá thành mạnh mẽ. Flash Cyber bị hạn chế truy cập có chủ đích do rủi ro sử dụng kép và được cung cấp thông qua chương trình thử nghiệm CodeMender truy cập hạn chế cho các chính phủ và đối tác đáng tin cậy.
Hiệu suất "chủ lực" hiệu quả token (3.6 Flash): Mang lại khả năng mã hóa, công việc tri thức và đa phương thức tốt hơn trong khi giảm mức sử dụng token đầu ra (được báo cáo ít hơn 17% token đầu ra so với 3.5 Flash trên Artificial Analysis Index, và lên đến 65% ít hơn trong một số điểm chuẩn như DeepSWE), giúp giảm chi phí tác nhân cho mỗi tác vụ.
Giá thấp hơn cho các khối lượng công việc tác nhân quy mô lớn (3.6 Flash): Có giá 1,50 đô la cho mỗi 1 triệu token đầu vào và 7,50 đô la cho mỗi 1 triệu token đầu ra (chi phí đầu ra thấp hơn 3.5 Flash), nhằm mục đích làm cho các quy trình làm việc tác nhân nhiều bước hiệu quả hơn về chi phí trong sản xuất.
Tùy chọn mô hình thông lượng cao, độ trễ thấp (3.5 Flash-Lite): Được thiết kế cho các tác vụ nhạy cảm với độ trễ và khối lượng lớn (ví dụ: tìm kiếm tác nhân, xử lý tài liệu), với thông lượng được báo cáo khoảng 350 token đầu ra/giây và giá cả cạnh tranh (0,30 đô la cho mỗi 1 triệu token đầu vào, 2,50 đô la cho mỗi 1 triệu token đầu ra).
Các cấp độ tư duy có thể cấu hình để kiểm soát chi phí/chất lượng (3.5 Flash-Lite): Hỗ trợ các cấp độ tư duy có thể điều chỉnh để các nhà phát triển có thể chọn tư duy tối thiểu/thấp cho các tác vụ khối lượng lớn nhanh, rẻ hoặc tư duy cao hơn cho các khối lượng công việc tác nhân phụ nhiều bước.
Công cụ sử dụng máy tính tích hợp cho các tác nhân (3.6 Flash & 3.5 Flash-Lite): Sử dụng máy tính có sẵn dưới dạng công cụ phía máy khách tích hợp thông qua Gemini API và Gemini Enterprise, cải thiện việc thực thi tác vụ trong thế giới thực trong các quy trình làm việc tác nhân (ví dụ: các cải tiến được xác minh bởi OSWorld được báo cáo cho 3.6 Flash).
Chuyên gia an ninh mạng được triển khai thông qua CodeMender (3.5 Flash Cyber): Một mô hình tập trung vào an ninh mạng dựa trên 3.5 Flash được tinh chỉnh để tìm, xác thực và vá các lỗ hổng một cách hiệu quả; được điều phối dưới dạng nhiều tác nhân bên trong CodeMender để tạo ra các báo cáo bảo mật tổng hợp và hiệu suất điểm chuẩn CyberGym cạnh tranh, nhưng bị hạn chế trong chương trình thử nghiệm truy cập hạn chế (chính phủ và đối tác đáng tin cậy) do lo ngại về việc sử dụng kép.
Các Trường hợp Sử dụng của Gemini 3.6 Flash Family
Các tác nhân kỹ thuật phần mềm (mã hóa, gỡ lỗi, tái cấu trúc): Sử dụng 3.6 Flash làm công cụ mã hóa sản xuất để tạo các bản vá với ít chỉnh sửa không mong muốn và ít vòng lặp thực thi hơn, hỗ trợ đánh giá mã tự động, tạo thử nghiệm và các tác vụ kỹ thuật nhiều bước.
Công việc tri thức doanh nghiệp và phân tích đa phương thức: Áp dụng 3.6 Flash để phân tích tài liệu, biểu đồ/sơ đồ và soạn thảo báo cáo—hữu ích cho các nhóm pháp lý, tài chính, tư vấn và vận hành xử lý các đầu vào hỗn hợp văn bản và hình ảnh.
Các quy trình xử lý tài liệu khối lượng lớn: Sử dụng 3.5 Flash-Lite để trích xuất, phân loại, tóm tắt và định tuyến nhanh chóng trên các tập dữ liệu lớn (ví dụ: yêu cầu bồi thường, hóa đơn, hợp đồng, phiếu hỗ trợ) nơi thông lượng và độ trễ chiếm ưu thế.
Tự động hóa tìm kiếm tác nhân và hỗ trợ khách hàng: Triển khai 3.5 Flash-Lite để tìm kiếm tác nhân độ trễ thấp trên các cơ sở kiến thức nội bộ và soạn thảo phản hồi nhanh chóng, với các cấp độ tư duy có thể cấu hình để cân bằng tốc độ so với chiều sâu lý luận.
Tự động hóa sử dụng máy tính cho các quy trình làm việc lặp lại: Sử dụng các khả năng sử dụng máy tính tích hợp (thông qua Gemini API/Enterprise) để điều khiển các tác vụ dựa trên giao diện người dùng như điền biểu mẫu, nhập dữ liệu đa hệ thống và các quy trình vận hành từng bước.
Phát hiện và khắc phục lỗ hổng ở quy mô lớn (bị hạn chế): Trong CodeMender, 3.5 Flash Cyber có thể giúp các nhóm bảo mật xác định và vá các lỗ hổng mã một cách hiệu quả, tạo ra các báo cáo tổng hợp từ nhiều tác nhân chuyên biệt; dành cho các nhà bảo vệ đã được kiểm duyệt do rủi ro lạm dụng.
Ưu điểm
Hiệu quả mạnh mẽ và cấu hình chi phí cho các tác nhân sản xuất (ít token hơn, độ trễ thấp hơn, chi phí mỗi tác vụ thấp hơn).
Cải thiện hiệu suất mã hóa, công việc tri thức và đa phương thức trong 3.6 Flash so với 3.5 Flash (theo các điểm chuẩn được trích dẫn).
Flash-Lite cung cấp thông lượng rất cao và chi phí thấp cho các khối lượng công việc lớn với chiều sâu lý luận có thể cấu hình.
Các biện pháp bảo vệ an toàn Frontier Safety nâng cao trong 3.6 Flash nhắm mục tiêu lạm dụng CBRN và tấn công mạng, với mục đích giảm các từ chối không cần thiết.
Nhược điểm
Gemini 3.5 Flash Cyber không có sẵn rộng rãi; quyền truy cập bị giới hạn cho các chính phủ và đối tác đáng tin cậy thông qua chương trình thử nghiệm CodeMender do rủi ro sử dụng kép.
Dòng sản phẩm ưu tiên hiệu quả và khả năng mở rộng tác nhân hơn là định vị là khả năng hàng đầu tuyệt đối (3.5 Pro vẫn đang chờ phát hành rộng rãi hơn).
Các tính năng sử dụng máy tính của tác nhân có thể yêu cầu tích hợp và quản trị cẩn thận (công cụ/điều phối, kiểm tra độ tin cậy) để đảm bảo an toàn sản xuất.
Cách Sử dụng Gemini 3.6 Flash Family
1) Chọn mô hình phù hợp trong gia đình Gemini 3.6 Flash: Chọn dựa trên khối lượng công việc: (a) gemini-3.6-flash cho một công cụ đa năng (mã hóa, công việc kiến thức, đa phương thức, quy trình làm việc tác nhân) với hiệu quả token được cải thiện; (b) gemini-3.5-flash-lite cho các tác vụ thông lượng cao nhanh nhất/chi phí thấp nhất (tìm kiếm tác nhân, xử lý tài liệu, trích xuất, định tuyến, phân loại) và các cấp độ tư duy có thể cấu hình. Lưu ý: Gemini 3.5 Flash Cyber bị hạn chế (chính phủ/đối tác đáng tin cậy thông qua chương trình thí điểm CodeMender) và không có sẵn rộng rãi.
2) Quyết định nơi bạn sẽ sử dụng nó (ứng dụng tiêu dùng so với API nhà phát triển so với doanh nghiệp): Các tùy chọn truy cập từ các nguồn: (a) ứng dụng Gemini cho mọi người (3.6 Flash và 3.5 Flash-Lite được triển khai ở đó; Flash-Lite cũng được triển khai trong Google Search); (b) API Gemini thông qua Google AI Studio và Android Studio cho nhà phát triển; (c) Nền tảng tác nhân doanh nghiệp Gemini cho doanh nghiệp (3.6 Flash cũng có trong ứng dụng Gemini Enterprise).
3) Sử dụng nó trong Google AI Studio (cách nhanh nhất để thử các mô hình): Mở Google AI Studio và bắt đầu một cuộc trò chuyện/lời nhắc mới bằng cách sử dụng mô hình mục tiêu. Đối với 3.6 Flash, bạn có thể sử dụng mục nhập AI Studio nhắm mục tiêu gemini-3.6-flash. Đối với Flash-Lite, chọn gemini-3.5-flash-lite. Chạy một vài lời nhắc đại diện (ví dụ: tái cấu trúc mã, hỏi đáp tài liệu, suy luận biểu đồ/sơ đồ) và so sánh độ trễ và độ dài đầu ra – 3.6 Flash được thiết kế để sử dụng ít token đầu ra hơn 3.5 Flash.
4) Gọi các mô hình từ API Gemini (cách sử dụng kiểu sản xuất): Trong các yêu cầu API Gemini của bạn, đặt ID mô hình thành một trong các chuỗi GA mới: gemini-3.6-flash hoặc gemini-3.5-flash-lite. Đây là các định danh di chuyển đột phá được nêu bật trong các nguồn. Sau đó, gửi lời nhắc/tin nhắn của bạn như bình thường thông qua đường dẫn tài liệu 'mô hình mới nhất' của API Gemini.
5) Điều chỉnh chi phí/độ trễ với các cấp độ tư duy (đặc biệt đối với 3.5 Flash-Lite): Đối với việc trích xuất, định tuyến hoặc phân loại khối lượng lớn, hãy giữ thinking_level ở mức "minimal" (mặc định) để tối đa hóa thông lượng và giảm thiểu chi phí/độ trễ. Đối với các tác nhân phụ tự động với các lệnh gọi công cụ, thực thi mã hoặc suy luận nhiều bước, hãy nâng thinking_level lên "medium" hoặc "high" để giảm việc chấm dứt công cụ sớm và cải thiện độ tin cậy nhiều bước.
6) Sử dụng công cụ sử dụng máy tính tích hợp cho quy trình làm việc tác nhân (nếu được hỗ trợ): Gemini 3.6 Flash và 3.5 Flash-Lite bao gồm việc sử dụng máy tính như một công cụ tích hợp (theo các nguồn). Khi xây dựng các tác nhân cần điều hướng giao diện người dùng hoặc thực hiện các tác vụ nhiều bước, hãy bật và dựa vào khả năng sử dụng máy tính tích hợp thông qua API Gemini / các bề mặt Gemini Enterprise hỗ trợ nó.
7) Xây dựng và kiểm tra quy trình làm việc tác nhân với tư duy ưu tiên hiệu quả: Thiết kế các vòng lặp tác nhân của bạn để tận dụng việc giảm mức sử dụng token đầu ra của 3.6 Flash và ít bước suy luận/lệnh gọi công cụ hơn. Xác nhận rằng quy trình làm việc của bạn đạt được cùng một kết quả tác vụ với ít lần lặp hơn (ví dụ: ít vòng lặp gọi công cụ hơn trong các tác vụ nhiều bước). Đối với Flash-Lite, ưu tiên các giai đoạn thông lượng cao (tìm kiếm, phân loại, trích xuất) và chỉ dành các cấp độ tư duy cao hơn cho các bước thực sự cần chúng.
8) Tích hợp trong Android Studio cho quy trình làm việc của nhà phát triển: Nếu bạn xây dựng ứng dụng Android hoặc công cụ dành cho nhà phát triển, hãy truy cập các mô hình thông qua Android Studio (như được liệt kê trong các nguồn). Chọn gemini-3.6-flash hoặc gemini-3.5-flash-lite cho các tác vụ như tạo mã, tái cấu trúc và hỗ trợ gỡ lỗi, sau đó lặp lại các lời nhắc và cài đặt (bao gồm cả cấp độ tư duy) để phù hợp với mục tiêu độ trễ và chất lượng của bạn.
9) Triển khai trong Nền tảng tác nhân doanh nghiệp Gemini (triển khai doanh nghiệp): Đối với việc triển khai tác nhân doanh nghiệp, hãy sử dụng Nền tảng tác nhân doanh nghiệp Gemini để chạy 3.6 Flash và 3.5 Flash-Lite trong các quy trình làm việc tác nhân sản xuất. Nếu bạn cũng sử dụng ứng dụng Gemini Enterprise, hãy lưu ý rằng 3.6 Flash có sẵn ở đó theo các nguồn.
10) Hiểu giá cả và lập kế hoạch sử dụng phù hợp: Từ các nguồn: Gemini 3.6 Flash có giá 1,50 đô la cho mỗi 1 triệu token đầu vào và 7,50 đô la cho mỗi 1 triệu token đầu ra; Gemini 3.5 Flash-Lite có giá 0,30 đô la cho mỗi 1 triệu token đầu vào và 2,50 đô la cho mỗi 1 triệu token đầu ra. Sử dụng Flash-Lite cho các tác vụ khối lượng lớn/thông lượng cao và 3.6 Flash cho công việc phức tạp hơn, nơi chất lượng và hiệu suất đa phương thức/tác nhân quan trọng.
11) Áp dụng danh sách kiểm tra di chuyển được khuyến nghị khi chuyển từ các mô hình Flash cũ hơn: Cập nhật chuỗi mô hình của bạn thành các ID mới (gemini-3.6-flash, gemini-3.5-flash-lite). Xóa các tham số không dùng nữa và xác thực hành vi gọi hàm theo yêu cầu của các thay đổi API áp dụng bắt đầu với các mô hình này và tất cả các bản phát hành Gemini trong tương lai (theo các nguồn).
12) Biết những gì bạn không thể truy cập (và các lựa chọn thay thế): Gemini 3.5 Flash Cyber bị hạn chế có chủ ý do lo ngại về mục đích sử dụng kép và sẽ chỉ có sẵn cho các chính phủ và đối tác đáng tin cậy thông qua CodeMender trong một chương trình thí điểm có giới hạn quyền truy cập. Nếu bạn cần các quy trình làm việc tập trung vào bảo mật mà không có quyền truy cập đó, hãy sử dụng 3.6 Flash cho các tác vụ xem xét và khắc phục mã chung, đồng thời triển khai các biện pháp bảo vệ và quy trình xem xét của riêng bạn.
Câu hỏi Thường gặp về Gemini 3.6 Flash Family
Google đã giới thiệu ba mô hình liên quan vào ngày 21 tháng 7 năm 2026: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber (mô hình Cyber chỉ được cung cấp trong CodeMender).
Bài viết phổ biến

Atoms: Nền tảng AI đa tác nhân biến ý tưởng thành sản phẩm sẵn sàng ra mắt
May 22, 2026

Nano Banana SBTI: Nó là gì, Cách thức hoạt động và Cách sử dụng nó vào năm 2026
Apr 15, 2026

Đánh giá Atoms — Trình tạo sản phẩm AI định nghĩa lại việc tạo nội dung số vào năm 2026
Apr 10, 2026

Kilo Claw: Cách Triển Khai và Sử Dụng AI Agent "Làm-Thay-Bạn" Thực Sự (Cập Nhật 2026)
Apr 3, 2026
Phân tích Trang web Gemini 3.6 Flash Family
Lưu lượng truy cập & Xếp hạng của Gemini 3.6 Flash Family
8.5M
Lượt truy cập hàng tháng
#8357
Xếp hạng Toàn cầu
#353
Xếp hạng Danh mục
Xu hướng Lưu lượng truy cập: Nov 2024-Jun 2025
Thông tin chi tiết về Người dùng Gemini 3.6 Flash Family
00:00:53
Thời lượng Truy cập Trung bình
1.93
Số trang mỗi lần Truy cập
55.03%
Tỷ lệ Thoát của Người dùng
Khu vực Hàng đầu của Gemini 3.6 Flash Family
US: 26.94%
IN: 8.76%
GB: 5.14%
JP: 4.24%
DE: 3.01%
Others: 51.91%







