Gemini 3.6 Flash Family

Gemini 3.6 Flash Family

Gemini 3.6 Flash 제품군은 Google의 토큰 효율적이고 낮은 지연 시간의 Flash 라인업으로, 프로덕션 AI 에이전트 확장을 위한 것입니다. 더 적은 토큰으로 더 높은 품질의 작업을 위한 3.6 Flash, 초고속 고처리량 작업을 위한 3.5 Flash-Lite, CodeMender를 통한 취약점 감지 및 패치를 위한 게이트형 3.5 Flash Cyber를 특징으로 합니다.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/?ref=producthunt&utm_source=aipure
Gemini 3.6 Flash Family

제품 정보

업데이트됨:Jul 23, 2026

Gemini 3.6 Flash Family 월간 트래픽 동향

Gemini 3.6 Flash Family은(는) 지난달 8.5m회 방문을 기록했으며, 이는 -12.1%의 약간의 감소을(를) 보여줍니다. 저희 분석에 따르면 이러한 추세는 AI 도구 분야의 일반적인 시장 동향과 일치합니다.
과거 트래픽 보기

Gemini 3.6 Flash Family이란?

Gemini 3.6 Flash 제품군은 Google이 개발자와 기업이 프로덕션 환경에서 AI 에이전트를 보다 효율적으로 실행할 수 있도록 도입한 Gemini "Flash" 모델 세트입니다. 이 모델은 원시 모델 크기를 최대화하기보다는 낮은 지연 시간, 높은 신뢰성, 더 나은 작업당 비용을 우선시합니다. 2026년 7월 21일에 발표된 이 제품군에는 Gemini 3.6 Flash(코딩, 지식 작업 및 멀티모달 작업을 위한 범용 주력 모델), Gemini 3.5 Flash-Lite(대용량 워크로드에 가장 빠르고 비용 효율적인 3.5급 모델), Gemini 3.5 Flash Cyber(정부 및 신뢰할 수 있는 파트너를 위한 제한된 액세스 CodeMender 파일럿을 통해서만 제공되는 사이버 보안 전문 변형)가 포함됩니다. 이 모델들은 개발자 도구 및 엔터프라이즈 표면 전반에 걸쳐 확장 가능한 에이전트 워크플로우를 지원하도록 포지셔닝되었으며, 3.6 Flash 및 3.5 Flash-Lite는 Gemini API(Google AI Studio 및 Android Studio) 및 더 광범위한 제품 통합을 통해 사용할 수 있습니다.

Gemini 3.6 Flash Family의 주요 기능

Gemini 3.6 Flash 제품군은 Gemini 3.6 Flash(핵심 모델), Gemini 3.5 Flash-Lite(가장 빠르고 비용 효율적인 3.5급 옵션), Gemini 3.5 Flash Cyber(CodeMender 내에 배포된 사이버 중심 변형)로 구성되어 프로덕션 AI 에이전트를 대규모로 구축하고 실행하기 위한 Google의 효율성 중심 Flash 라인업입니다. 이 제품군 전체에서 낮은 지연 시간, 높은 처리량, 향상된 토큰 효율성, 안정적인 에이전트 실행(Gemini API/Enterprise를 통한 내장 컴퓨터 사용 도구 포함)에 중점을 둡니다. Gemini 3.6 Flash는 특히 코딩, 지식 작업 및 멀티모달 성능을 향상시키면서 3.5 Flash보다 적은 출력 토큰을 사용하고 출력 토큰당 비용이 적게 들며, CBRN 및 사이버 공격 오용에 대한 향상된 Frontier Safety 보호 기능을 제공합니다. Flash-Lite는 구성 가능한 사고 수준과 강력한 가격 대비 성능으로 대용량, 지연 시간에 민감한 워크로드를 목표로 합니다. Flash Cyber는 이중 사용 위험으로 인해 의도적으로 액세스가 제한되며 정부 및 신뢰할 수 있는 파트너를 위한 제한된 액세스 CodeMender 파일럿을 통해 제공됩니다.
토큰 효율적인 "핵심" 성능 (3.6 Flash): 더 나은 코딩, 지식 작업 및 멀티모달 기능을 제공하면서 출력 토큰 사용량을 줄여(Artificial Analysis Index에서 3.5 Flash보다 17% 적은 출력 토큰 보고, DeepSWE와 같은 일부 벤치마크에서는 최대 65% 감소) 작업당 에이전트 비용을 낮추는 데 도움을 줍니다.
확장된 에이전트 워크로드에 대한 낮은 가격 (3.6 Flash): 100만 입력 토큰당 1.50달러, 100만 출력 토큰당 7.50달러(3.5 Flash보다 낮은 출력 비용)로 책정되어 프로덕션에서 다단계 에이전트 워크플로우의 비용 효율성을 높이는 것을 목표로 합니다.
고처리량, 저지연 모델 옵션 (3.5 Flash-Lite): 지연 시간에 민감하고 대용량 작업(예: 에이전트 검색, 문서 처리)을 위해 설계되었으며, 약 350 출력 토큰/초의 처리량과 공격적인 가격($0.30/100만 입력 토큰, $2.50/100만 출력 토큰)을 보고합니다.
비용/품질 관리를 위한 구성 가능한 사고 수준 (3.5 Flash-Lite): 조정 가능한 사고 수준을 지원하여 개발자가 빠르고 저렴한 대용량 작업을 위해 최소/낮은 사고를 선택하거나 다단계 하위 에이전트 워크로드를 위해 더 높은 사고를 선택할 수 있습니다.
에이전트를 위한 내장 컴퓨터 사용 도구 (3.6 Flash & 3.5 Flash-Lite): 컴퓨터 사용은 Gemini API 및 Gemini Enterprise를 통해 내장 클라이언트 측 도구로 제공되어 에이전트 워크플로우에서 실제 작업 실행을 개선합니다(예: 3.6 Flash에 대해 보고된 OSWorld-Verified 개선 사항).
CodeMender를 통해 배포된 사이버 보안 전문가 (3.5 Flash Cyber): 3.5 Flash 기반의 사이버 중심 모델로, 취약점을 효율적으로 찾고, 검증하고, 패치하도록 미세 조정되었습니다. CodeMender 내에서 여러 에이전트로 오케스트레이션되어 통합 보안 보고서와 경쟁력 있는 CyberGym 벤치마크 성능을 생성하지만, 이중 사용 문제로 인해 제한된 액세스 파일럿(정부 및 신뢰할 수 있는 파트너)으로 제한됩니다.

Gemini 3.6 Flash Family의 사용 사례

소프트웨어 엔지니어링 에이전트(코딩, 디버깅, 리팩토링): 3.6 Flash를 프로덕션 코딩 작업용으로 사용하여 원치 않는 편집 및 실행 루프를 줄여 패치를 생성하고, 자동화된 코드 검토, 테스트 생성 및 다단계 엔지니어링 작업을 지원합니다.
엔터프라이즈 지식 작업 및 멀티모달 분석: 3.6 Flash를 사용하여 문서를 구문 분석하고, 차트/다이어그램을 분석하고, 보고서를 작성합니다. 이는 혼합 텍스트 및 시각적 입력을 처리하는 법률, 금융, 컨설팅 및 운영 팀에 유용합니다.
대용량 문서 처리 파이프라인: 처리량과 지연 시간이 중요한 대규모 코퍼스(예: 청구서, 송장, 계약서, 지원 티켓)에서 빠른 추출, 분류, 요약 및 라우팅을 위해 3.5 Flash-Lite를 사용합니다.
에이전트 검색 및 고객 지원 자동화: 내부 지식 기반을 통한 저지연 에이전트 검색 및 빠른 응답 초안 작성을 위해 3.5 Flash-Lite를 배포하고, 속도와 추론 깊이의 균형을 맞추기 위해 구성 가능한 사고 수준을 제공합니다.
반복적인 워크플로우를 위한 컴퓨터 사용 자동화: 내장된 컴퓨터 사용 기능(Gemini API/Enterprise를 통해)을 사용하여 양식 작성, 시스템 간 데이터 입력 및 단계별 운영 절차와 같은 UI 기반 작업을 수행합니다.
대규모 취약점 탐지 및 수정(제한됨): CodeMender 내에서 3.5 Flash Cyber는 보안 팀이 코드 취약점을 효율적으로 식별하고 패치하는 데 도움을 주며, 여러 전문 에이전트로부터 통합 보고서를 생성합니다. 오용 위험으로 인해 검증된 방어자에게만 제공됩니다.

장점

프로덕션 에이전트를 위한 강력한 효율성 및 비용 프로필(적은 토큰, 낮은 지연 시간, 낮은 작업당 비용).
3.6 Flash에서 3.5 Flash보다 향상된 코딩, 지식 작업 및 멀티모달 성능(인용된 벤치마크 이득 기준).
Flash-Lite는 구성 가능한 추론 깊이로 대용량 워크로드에 대해 매우 높은 처리량과 낮은 비용을 제공합니다.
CBRN 및 사이버 공격 오용을 목표로 하는 3.6 Flash의 향상된 Frontier Safety 보호 기능으로 불필요한 거부를 줄이는 것을 목표로 합니다.

단점

Gemini 3.5 Flash Cyber는 일반적으로 사용할 수 없습니다. 이중 사용 위험으로 인해 CodeMender 파일럿을 통해 정부 및 신뢰할 수 있는 파트너에게만 액세스가 제한됩니다.
이 제품군은 절대적인 최고급 플래그십 기능(3.5 Pro는 아직 광범위한 출시 대기 중)으로 포지셔닝하기보다는 효율성과 에이전트 확장에 우선순위를 둡니다.
에이전트 컴퓨터 사용 기능은 프로덕션 안전을 위해 신중한 통합 및 거버넌스(도구/오케스트레이션, 안정성 검사)가 필요할 수 있습니다.

Gemini 3.6 Flash Family 사용 방법

1) Gemini 3.6 Flash 제품군에서 적합한 모델 선택: 워크로드에 따라 선택: (a) 향상된 토큰 효율성을 갖춘 범용 주력 모델(코딩, 지식 작업, 멀티모달, 에이전트 워크플로우)을 위한 gemini-3.6-flash; (b) 가장 빠르고 저렴한 고처리량 작업(에이전트 검색, 문서 처리, 추출, 라우팅, 분류) 및 구성 가능한 사고 수준을 위한 gemini-3.5-flash-lite. 참고: Gemini 3.5 Flash Cyber는 제한적이며(CodeMender 파일럿을 통한 정부/신뢰할 수 있는 파트너) 일반적으로 사용할 수 없습니다.
2) 어디에서 사용할지 결정 (소비자 앱 vs 개발자 API vs 엔터프라이즈): 다음 소스에서 액세스 옵션: (a) 모든 사용자를 위한 Gemini 앱 (3.6 Flash 및 3.5 Flash-Lite가 출시될 예정이며, Flash-Lite는 Google 검색에서도 출시될 예정); (b) 개발자를 위한 Google AI Studio 및 Android Studio를 통한 Gemini API; (c) 기업을 위한 Gemini Enterprise Agent Platform (3.6 Flash는 Gemini Enterprise 앱에서도 사용 가능).
3) Google AI Studio에서 사용 (모델을 가장 빠르게 시도하는 방법): Google AI Studio를 열고 대상 모델을 사용하여 새 채팅/프롬프트를 시작합니다. 3.6 Flash의 경우 gemini-3.6-flash를 대상으로 하는 AI Studio 항목을 사용할 수 있습니다. Flash-Lite의 경우 gemini-3.5-flash-lite를 선택합니다. 몇 가지 대표적인 프롬프트(예: 코드 리팩토링, 문서 Q&A, 차트/다이어그램 추론)를 실행하고 지연 시간과 출력 길이를 비교합니다. 3.6 Flash는 3.5 Flash보다 적은 출력 토큰을 사용하도록 설계되었습니다.
4) Gemini API에서 모델 호출 (프로덕션 스타일 사용): Gemini API 요청에서 모델 ID를 새로운 GA 문자열인 gemini-3.6-flash 또는 gemini-3.5-flash-lite 중 하나로 설정합니다. 이는 소스에서 강조된 주요 마이그레이션 식별자입니다. 그런 다음 Gemini API '최신 모델' 문서 경로를 통해 평소와 같이 프롬프트/메시지를 보냅니다.
5) 사고 수준으로 비용/지연 시간 조정 (특히 3.5 Flash-Lite의 경우): 대용량 추출, 라우팅 또는 분류의 경우 처리량을 최대화하고 비용/지연 시간을 최소화하려면 thinking_level을 "minimal"(기본값)로 유지합니다. 도구 호출, 코드 실행 또는 다단계 추론이 포함된 자율 서브 에이전트의 경우 조기 도구 종료를 줄이고 다단계 신뢰성을 개선하기 위해 thinking_level을 "medium" 또는 "high"로 높입니다.
6) 에이전트 워크플로우를 위한 내장 컴퓨터 사용 도구 활용 (지원되는 경우): Gemini 3.6 Flash 및 3.5 Flash-Lite에는 내장 도구로 컴퓨터 사용 기능이 포함되어 있습니다(소스에 따름). UI를 탐색하거나 다단계 작업을 실행해야 하는 에이전트를 구축할 때, 이를 지원하는 Gemini API / Gemini Enterprise 표면을 통해 내장 컴퓨터 사용 기능을 활성화하고 활용합니다.
7) 효율성 우선 사고방식으로 에이전트 워크플로우 구축 및 테스트: 3.6 Flash의 감소된 출력 토큰 사용량과 적은 추론 단계/도구 호출을 활용하도록 에이전트 루프를 설계합니다. 더 적은 반복(예: 다단계 작업에서 더 적은 도구 호출 루프)으로 워크플로우가 동일한 작업 결과를 달성하는지 확인합니다. Flash-Lite의 경우 처리량이 많은 단계(검색, 분류, 추출)를 우선시하고, 더 높은 사고 수준은 실제로 필요한 단계에만 예약합니다.
8) 개발자 워크플로우를 위해 Android Studio에 통합: Android 앱 또는 개발자 도구를 구축하는 경우 Android Studio를 통해 모델에 액세스합니다(소스에 나열된 대로). 코드 생성, 리팩토링 및 디버깅 지원과 같은 작업을 위해 gemini-3.6-flash 또는 gemini-3.5-flash-lite를 선택한 다음, 지연 시간 및 품질 목표에 맞게 프롬프트 및 설정(사고 수준 포함)을 반복합니다.
9) Gemini Enterprise Agent Platform에 배포 (엔터프라이즈 출시): 엔터프라이즈 에이전트 배포의 경우 Gemini Enterprise Agent Platform을 사용하여 프로덕션 에이전트 워크플로우에서 3.6 Flash 및 3.5 Flash-Lite를 실행합니다. Gemini Enterprise 앱도 사용하는 경우, 소스에 따라 3.6 Flash가 해당 앱에서 사용 가능합니다.
10) 가격 이해 및 그에 따른 사용 계획: 소스에 따르면: Gemini 3.6 Flash는 1M 입력 토큰당 $1.50, 1M 출력 토큰당 $7.50입니다. Gemini 3.5 Flash-Lite는 1M 입력 토큰당 $0.30, 1M 출력 토큰당 $2.50입니다. 대량/처리량 작업에는 Flash-Lite를 사용하고, 품질 및 멀티모달/에이전트 성능이 중요한 더 복잡한 작업에는 3.6 Flash를 사용합니다.
11) 이전 Flash 모델에서 전환할 때 권장 마이그레이션 체크리스트 적용: 모델 문자열을 새 ID(gemini-3.6-flash, gemini-3.5-flash-lite)로 업데이트합니다. 이 모델과 향후 모든 Gemini 릴리스에 적용되는 API 변경 사항에 따라 더 이상 사용되지 않는 매개변수를 제거하고 함수 호출 동작을 확인합니다(소스에 따름).
12) 액세스할 수 없는 것 (및 대안) 파악: Gemini 3.5 Flash Cyber는 이중 용도 문제로 인해 의도적으로 제한되며, 제한된 액세스 파일럿을 통해 CodeMender를 통해 정부 및 신뢰할 수 있는 파트너에게만 제공됩니다. 해당 액세스 없이 보안 중심 워크플로우가 필요한 경우, 일반적인 코드 검토 및 수정 작업에 3.6 Flash를 사용하고 자체적인 안전 장치 및 검토 프로세스를 구현합니다.

Gemini 3.6 Flash Family 자주 묻는 질문

Google은 2026년 7월 21일에 Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, Gemini 3.5 Flash Cyber (Cyber 모델은 CodeMender 내에서만 제공됨)의 세 가지 관련 모델을 발표했습니다.

Gemini 3.6 Flash Family 웹사이트 분석

Gemini 3.6 Flash Family 트래픽 및 순위
8.5M
월간 방문자 수
#8357
전 세계 순위
#353
카테고리 순위
트래픽 트렌드: Nov 2024-Jun 2025
Gemini 3.6 Flash Family 사용자 인사이트
00:00:53
평균 방문 시간
1.93
방문당 페이지 수
55.03%
사용자 이탈률
Gemini 3.6 Flash Family의 상위 지역
  1. US: 26.94%

  2. IN: 8.76%

  3. GB: 5.14%

  4. JP: 4.24%

  5. DE: 3.01%

  6. Others: 51.91%

Gemini 3.6 Flash Family와(과) 유사한 최신 AI 도구

Gait
Gait
Gait는 AI 지원 코드 생성을 버전 관리와 통합하여 팀이 AI 생성 코드 맥락을 효율적으로 추적, 이해 및 공유할 수 있도록 하는 협업 도구입니다.
invoices.dev
invoices.dev
invoices.dev는 개발자의 Git 커밋에서 직접 청구서를 생성하는 자동화된 청구 플랫폼으로, GitHub, Slack, Linear 및 Google 서비스와의 통합 기능을 제공합니다.
EasyRFP
EasyRFP
EasyRFP는 RFP(제안 요청) 응답을 간소화하고 딥 러닝 기술을 통해 실시간 현장 표현형을 가능하게 하는 AI 기반 엣지 컴퓨팅 툴킷입니다.
Cart.ai
Cart.ai
Cart.ai는 코딩, 고객 관계 관리, 비디오 편집, 전자상거래 설정 및 맞춤형 AI 개발을 포함한 종합적인 비즈니스 자동화 솔루션을 제공하는 AI 기반 서비스 플랫폼으로, 24/7 지원을 제공합니다.