
Gemini 3.6 Flash Family
Gemini 3.6 Flash Family adalah jajaran Flash Google yang efisien token dan latensi rendah untuk menskalakan agen AI produksi—menampilkan 3.6 Flash untuk pekerjaan berkualitas lebih tinggi dengan lebih sedikit token, 3.5 Flash-Lite untuk tugas throughput tinggi ultra-cepat, dan 3.5 Flash Cyber yang dibatasi untuk deteksi dan penambalan kerentanan melalui CodeMender.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/?ref=producthunt&utm_source=aipure

Informasi Produk
Diperbarui:Jul 23, 2026
Tren Traffic Bulanan Gemini 3.6 Flash Family
Gemini 3.6 Flash Family menerima 8.5m kunjungan bulan lalu, menunjukkan Penurunan Sedikit sebesar -12.1%. Berdasarkan analisis kami, tren ini sejalan dengan dinamika pasar yang umum di sektor alat AI.
Lihat riwayat trafficApa itu Gemini 3.6 Flash Family
Gemini 3.6 Flash Family adalah serangkaian model Gemini “Flash” yang diperkenalkan oleh Google untuk membantu pengembang dan perusahaan menjalankan agen AI secara lebih efisien dalam produksi—memprioritaskan latensi yang lebih rendah, keandalan yang lebih tinggi, dan biaya per tugas yang lebih baik daripada memaksimalkan ukuran model mentah. Diumumkan pada 21 Juli 2026, keluarga ini mencakup Gemini 3.6 Flash (model serbaguna untuk pengkodean, pekerjaan pengetahuan, dan tugas multimodal), Gemini 3.5 Flash-Lite (model kelas 3.5 tercepat dan paling hemat biaya untuk beban kerja bervolume tinggi), dan Gemini 3.5 Flash Cyber (varian khusus keamanan siber yang hanya tersedia melalui pilot CodeMender akses terbatas untuk pemerintah dan mitra tepercaya). Model-model ini diposisikan untuk mendukung alur kerja agen yang skalabel di seluruh alat pengembang dan permukaan perusahaan, dengan 3.6 Flash dan 3.5 Flash-Lite tersedia melalui Gemini API (Google AI Studio dan Android Studio) dan integrasi produk yang lebih luas.
Fitur Utama Gemini 3.6 Flash Family
Gemini 3.6 Flash Family adalah lini Flash Google yang berfokus pada efisiensi untuk membangun dan menjalankan agen AI produksi dalam skala besar, terdiri dari Gemini 3.6 Flash (model pekerja keras), Gemini 3.5 Flash-Lite (opsi kelas 3.5 tercepat dan paling hemat biaya), dan Gemini 3.5 Flash Cyber (varian yang berfokus pada siber yang digunakan dalam CodeMender). Di seluruh keluarga, penekanannya adalah pada latensi yang lebih rendah, throughput yang lebih tinggi, efisiensi token yang lebih baik, dan eksekusi agen yang andal (termasuk alat penggunaan komputer bawaan melalui Gemini API/Enterprise). Gemini 3.6 Flash secara khusus meningkatkan kinerja pengkodean, pekerjaan pengetahuan, dan multimodal sambil menggunakan lebih sedikit token output dan biaya yang lebih rendah per token output daripada 3.5 Flash, dan dilengkapi dengan perlindungan Frontier Safety yang ditingkatkan untuk penyalahgunaan CBRN dan serangan siber. Flash-Lite menargetkan beban kerja bervolume tinggi, sensitif latensi dengan tingkat pemikiran yang dapat dikonfigurasi dan kinerja harga yang kuat. Flash Cyber sengaja dibatasi aksesnya karena risiko penggunaan ganda dan ditawarkan melalui pilot CodeMender akses terbatas untuk pemerintah dan mitra tepercaya.
Kinerja 'pekerja keras' yang efisien token (3.6 Flash): Memberikan kemampuan pengkodean, pekerjaan pengetahuan, dan multimodal yang lebih baik sambil mengurangi penggunaan token output (dilaporkan 17% lebih sedikit token output daripada 3.5 Flash pada Artificial Analysis Index, dan hingga 65% lebih sedikit dalam beberapa benchmark seperti DeepSWE), membantu menurunkan biaya agen per tugas.
Harga lebih rendah untuk beban kerja agen berskala (3.6 Flash): Dihargai $1,50 per 1 juta token input dan $7,50 per 1 juta token output (biaya output lebih rendah dari 3.5 Flash), bertujuan untuk membuat alur kerja agen multi-langkah lebih hemat biaya dalam produksi.
Opsi model throughput tinggi, latensi rendah (3.5 Flash-Lite): Dirancang untuk tugas-tugas sensitif latensi dan bervolume tinggi (misalnya, pencarian agen, pemrosesan dokumen), dengan throughput yang dilaporkan ~350 token output/detik dan harga agresif ($0,30 per 1 juta token input, $2,50 per 1 juta token output).
Tingkat pemikiran yang dapat dikonfigurasi untuk kontrol biaya/kualitas (3.5 Flash-Lite): Mendukung tingkat pemikiran yang dapat disesuaikan sehingga pengembang dapat memilih pemikiran minimal/rendah untuk tugas bervolume tinggi yang cepat dan murah atau pemikiran yang lebih tinggi untuk beban kerja sub-agen multi-langkah.
Alat penggunaan komputer bawaan untuk agen (3.6 Flash & 3.5 Flash-Lite): Penggunaan komputer tersedia sebagai alat sisi klien bawaan melalui Gemini API dan Gemini Enterprise, meningkatkan eksekusi tugas dunia nyata dalam alur kerja agen (misalnya, peningkatan OSWorld-Verified yang dilaporkan untuk 3.6 Flash).
Spesialis keamanan siber yang digunakan melalui CodeMender (3.5 Flash Cyber): Model berbasis 3.5 Flash yang berfokus pada siber yang disetel dengan baik untuk menemukan, memvalidasi, dan menambal kerentanan secara efisien; diatur sebagai beberapa agen di dalam CodeMender untuk menghasilkan laporan keamanan konsolidasi dan kinerja benchmark CyberGym yang kompetitif, tetapi dibatasi untuk pilot akses terbatas (pemerintah dan mitra tepercaya) karena masalah penggunaan ganda.
Kasus Penggunaan Gemini 3.6 Flash Family
Agen rekayasa perangkat lunak (pengkodean, debugging, refactoring): Gunakan 3.6 Flash sebagai pekerja keras pengkodean produksi untuk menghasilkan patch dengan lebih sedikit editan yang tidak diinginkan dan lebih sedikit loop eksekusi, mendukung tinjauan kode otomatis, pembuatan pengujian, dan tugas rekayasa multi-langkah.
Pekerjaan pengetahuan perusahaan dan analisis multimodal: Terapkan 3.6 Flash untuk mengurai dokumen, menganalisis bagan/diagram, dan menyusun laporan—berguna untuk tim hukum, keuangan, konsultasi, dan operasi yang menangani input campuran teks dan visual.
Pipeline pemrosesan dokumen bervolume tinggi: Gunakan 3.5 Flash-Lite untuk ekstraksi, klasifikasi, ringkasan, dan perutean cepat di seluruh korpora besar (misalnya, klaim, faktur, kontrak, tiket dukungan) di mana throughput dan latensi mendominasi.
Pencarian agen dan otomatisasi dukungan pelanggan: Terapkan 3.5 Flash-Lite untuk pencarian agen latensi rendah di atas basis pengetahuan internal dan penyusunan respons cepat, dengan tingkat pemikiran yang dapat dikonfigurasi untuk menyeimbangkan kecepatan vs. kedalaman penalaran.
Otomatisasi penggunaan komputer untuk alur kerja berulang: Gunakan kemampuan penggunaan komputer bawaan (melalui Gemini API/Enterprise) untuk mendorong tugas berbasis UI seperti pengisian formulir, entri data lintas sistem, dan prosedur operasional langkah demi langkah.
Deteksi dan remediasi kerentanan dalam skala besar (terbatas): Dalam CodeMender, 3.5 Flash Cyber dapat membantu tim keamanan mengidentifikasi dan menambal kerentanan kode secara efisien, menghasilkan laporan konsolidasi dari beberapa agen khusus; ditujukan untuk pembela yang telah diverifikasi karena risiko penyalahgunaan.
Kelebihan
Profil efisiensi dan biaya yang kuat untuk agen produksi (lebih sedikit token, latensi lebih rendah, biaya per tugas lebih rendah).
Peningkatan pengkodean, pekerjaan pengetahuan, dan kinerja multimodal di 3.6 Flash dibandingkan 3.5 Flash (berdasarkan peningkatan benchmark yang disebutkan).
Flash-Lite menawarkan throughput yang sangat tinggi dan biaya rendah untuk beban kerja bervolume tinggi dengan kedalaman penalaran yang dapat dikonfigurasi.
Peningkatan perlindungan Frontier Safety di 3.6 Flash yang menargetkan penyalahgunaan CBRN dan serangan siber, dengan tujuan untuk mengurangi penolakan yang tidak perlu.
Kekurangan
Gemini 3.5 Flash Cyber tidak tersedia secara umum; akses terbatas untuk pemerintah dan mitra tepercaya melalui pilot CodeMender karena risiko penggunaan ganda.
Keluarga ini memprioritaskan efisiensi dan penskalaan agen daripada memposisikan sebagai kemampuan unggulan teratas (3.5 Pro masih menunggu rilis yang lebih luas).
Fitur penggunaan komputer agen mungkin memerlukan integrasi dan tata kelola yang cermat (perkakas/orkestrasi, pemeriksaan keandalan) agar aman dalam produksi.
Cara Menggunakan Gemini 3.6 Flash Family
1) Pilih model yang tepat dalam keluarga Gemini 3.6 Flash: Pilih berdasarkan beban kerja: (a) gemini-3.6-flash untuk model serbaguna (pengkodean, pekerjaan pengetahuan, multimodal, alur kerja agen) dengan efisiensi token yang ditingkatkan; (b) gemini-3.5-flash-lite untuk tugas throughput tinggi tercepat/termurah (pencarian agen, pemrosesan dokumen, ekstraksi, perutean, klasifikasi) dan tingkat pemikiran yang dapat dikonfigurasi. Catatan: Gemini 3.5 Flash Cyber dibatasi (pemerintah/mitra tepercaya melalui pilot CodeMender) dan tidak tersedia secara umum.
2) Putuskan di mana Anda akan menggunakannya (aplikasi konsumen vs API pengembang vs perusahaan): Opsi akses dari sumber: (a) Aplikasi Gemini untuk semua orang (3.6 Flash dan 3.5 Flash-Lite diluncurkan di sana; Flash-Lite juga diluncurkan di Google Search); (b) Gemini API melalui Google AI Studio dan Android Studio untuk pengembang; (c) Gemini Enterprise Agent Platform untuk perusahaan (3.6 Flash juga di aplikasi Gemini Enterprise).
3) Gunakan di Google AI Studio (cara tercepat untuk mencoba model): Buka Google AI Studio dan mulai obrolan/prompt baru menggunakan model target. Untuk 3.6 Flash, Anda dapat menggunakan entri AI Studio yang menargetkan gemini-3.6-flash. Untuk Flash-Lite, pilih gemini-3.5-flash-lite. Jalankan beberapa prompt representatif (misalnya, refaktor kode, Q&A dokumen, penalaran bagan/diagram) dan bandingkan latensi dan panjang keluaran—3.6 Flash dirancang untuk menggunakan lebih sedikit token keluaran daripada 3.5 Flash.
4) Panggil model dari Gemini API (penggunaan gaya produksi): Dalam permintaan Gemini API Anda, atur ID model ke salah satu string GA baru: gemini-3.6-flash atau gemini-3.5-flash-lite. Ini adalah pengidentifikasi migrasi yang menonjolkan perubahan yang disorot dalam sumber. Kemudian kirim prompt/pesan Anda seperti biasa melalui jalur dokumentasi 'model terbaru' Gemini API.
5) Sesuaikan biaya/latensi dengan tingkat pemikiran (terutama untuk 3.5 Flash-Lite): Untuk ekstraksi, perutean, atau klasifikasi bervolume tinggi, pertahankan thinking_level pada "minimal" (default) untuk memaksimalkan throughput dan meminimalkan biaya/latensi. Untuk subagen otonom dengan panggilan alat, eksekusi kode, atau penalaran multi-langkah, naikkan thinking_level ke "medium" atau "high" untuk mengurangi penghentian alat prematur dan meningkatkan keandalan multi-langkah.
6) Gunakan alat bantu penggunaan komputer bawaan untuk alur kerja agen (jika didukung): Gemini 3.6 Flash dan 3.5 Flash-Lite menyertakan penggunaan komputer sebagai alat bawaan (sesuai sumber). Saat membangun agen yang perlu menavigasi UI atau menjalankan tugas multi-langkah, aktifkan dan andalkan kemampuan penggunaan komputer bawaan melalui Gemini API / permukaan Gemini Enterprise yang mendukungnya.
7) Bangun dan uji alur kerja agen dengan pola pikir yang mengutamakan efisiensi: Rancang loop agen Anda untuk memanfaatkan penggunaan token keluaran 3.6 Flash yang lebih sedikit dan langkah penalaran/panggilan alat yang lebih sedikit. Validasi bahwa alur kerja Anda mencapai hasil tugas yang sama dengan iterasi yang lebih sedikit (misalnya, loop panggilan alat yang lebih sedikit dalam tugas multi-langkah). Untuk Flash-Lite, prioritaskan tahapan yang membutuhkan throughput tinggi (pencarian, penyaringan, ekstraksi) dan cadangkan tingkat pemikiran yang lebih tinggi hanya untuk langkah-langkah yang benar-benar membutuhkannya.
8) Integrasikan di Android Studio untuk alur kerja pengembang: Jika Anda membangun aplikasi Android atau alat pengembang, akses model melalui Android Studio (seperti yang tercantum dalam sumber). Pilih gemini-3.6-flash atau gemini-3.5-flash-lite untuk tugas-tugas seperti pembuatan kode, refactoring, dan bantuan debugging, lalu ulangi prompt dan pengaturan (termasuk tingkat pemikiran) agar sesuai dengan target latensi dan kualitas Anda.
9) Terapkan di Gemini Enterprise Agent Platform (peluncuran perusahaan): Untuk penerapan agen perusahaan, gunakan Gemini Enterprise Agent Platform untuk menjalankan 3.6 Flash dan 3.5 Flash-Lite dalam alur kerja agen produksi. Jika Anda juga menggunakan aplikasi Gemini Enterprise, perhatikan bahwa 3.6 Flash tersedia di sana sesuai sumber.
10) Pahami harga dan rencanakan penggunaan sesuai kebutuhan: Dari sumber: Gemini 3.6 Flash dihargai $1,50 per 1 juta token masukan dan $7,50 per 1 juta token keluaran; Gemini 3.5 Flash-Lite dihargai $0,30 per 1 juta token masukan dan $2,50 per 1 juta token keluaran. Gunakan Flash-Lite untuk tugas massal/throughput dan 3.6 Flash untuk pekerjaan kompleksitas yang lebih tinggi di mana kualitas dan kinerja multimodal/agen penting.
11) Terapkan daftar periksa migrasi yang direkomendasikan saat beralih dari model Flash yang lebih lama: Perbarui string model Anda ke ID baru (gemini-3.6-flash, gemini-3.5-flash-lite). Hapus parameter yang tidak digunakan lagi dan validasi perilaku panggilan fungsi sesuai persyaratan perubahan API yang berlaku mulai dari model ini dan semua rilis Gemini mendatang (sesuai sumber).
12) Ketahui apa yang tidak dapat Anda akses (dan alternatifnya): Gemini 3.5 Flash Cyber sengaja dibatasi karena masalah penggunaan ganda dan hanya akan tersedia untuk pemerintah dan mitra tepercaya melalui CodeMender dalam pilot akses terbatas. Jika Anda memerlukan alur kerja yang berfokus pada keamanan tanpa akses tersebut, gunakan 3.6 Flash untuk tinjauan kode umum dan tugas remediasi, serta terapkan batasan dan proses tinjauan Anda sendiri.
FAQ Gemini 3.6 Flash Family
Google memperkenalkan tiga model terkait pada 21 Juli 2026: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, dan Gemini 3.5 Flash Cyber (model Cyber hanya tersedia di CodeMender).
Artikel Populer

Atoms: Platform AI Multi-Agen yang Mengubah Ide menjadi Produk Siap Diluncurkan
May 22, 2026

Nano Banana SBTI: Apa Itu, Bagaimana Cara Kerjanya, dan Cara Menggunakannya di Tahun 2026
Apr 15, 2026

Ulasan Atoms — Pembuat Produk AI yang Mendefinisikan Ulang Kreasi Digital di Tahun 2026
Apr 10, 2026

Kilo Claw: Cara Menerapkan dan Menggunakan Agen AI "Lakukan-Untuk-Anda" Sejati (Pembaruan 2026)
Apr 3, 2026
Analitik Situs Web Gemini 3.6 Flash Family
Lalu Lintas & Peringkat Gemini 3.6 Flash Family
8.5M
Kunjungan Bulanan
#8357
Peringkat Global
#353
Peringkat Kategori
Tren Lalu Lintas: Nov 2024-Jun 2025
Wawasan Pengguna Gemini 3.6 Flash Family
00:00:53
Rata-rata Durasi Kunjungan
1.93
Halaman Per Kunjungan
55.03%
Tingkat Pentalan Pengguna
Wilayah Teratas Gemini 3.6 Flash Family
US: 26.94%
IN: 8.76%
GB: 5.14%
JP: 4.24%
DE: 3.01%
Others: 51.91%







