Gemini 3.6 Flash, 3.5 Flash-Lite, 및 3.5 Flash Cyber 소개
요약
Google이 개발자 및 고객의 요구에 맞춰 Gemini 모델 시리즈를 업데이트했습니다. 3.6 Flash는 코딩과 지식 작업 성능을 높이고 토큰 효율성을 개선했으며, 3.5 Flash-Lite와 전문화된 사이버 보안 모델인 3.5 Flash Cyber도 공개되었습니다. 또한 차세대 모델인 Gemini 4 개발에도 박차를 가하고 있습니다.
핵심 포인트
- Gemini 3.6 Flash는 코딩 및 지식 작업 성능을 개선했습니다.
- 출력 토큰 사용량이 17% 감소하여 비용 효율성이 높아졌습니다.
- 3.5 Flash-Lite는 빠르고 비용 효율적인 에이전트 워크플로우에 적합합니다.
- 전문 사이버 보안 애플리케이션을 위한 3.5 Flash Cyber 모델이 추가되었습니다.
Gemini 3.6 Flash, 3.5 Flash-Lite, 및 3.5 Flash Cyber 소개

프로덕션 AI 에이전트를 구축하는 개발자와 고객들은 더 높은 토큰 효율성, 낮은 지연 시간(latency), 그리고 더욱 신뢰할 수 있는 성능을 필요로 합니다. 당사의 Flash 모델 시리즈는 에이전트 워크플로우를 확장할 수 있도록 효율성과 품질의 최적점을 충족하도록 설계되었습니다. Gemini 3.5 Flash를 기반으로, 새로운 Gemini 모델들을 소개합니다:
3.6 Flash: 더 나은 코딩, 지식 작업(knowledge work), 그리고 멀티모달 성능을 제공하는 당사의 주력 모델입니다. Artificial Analysis Index에 따르면, 이 모델은 3.5 Flash 대비 출력 토큰 사용량을 17% 줄이며, Datacurve의 DeepSWE와 같은 일부 벤치마크에서는 최대 65%까지 감소시키고, 이는 모두 더 낮은 출력 토큰당 비용으로 이루어집니다.3.5 Flash-Lite: 가장 빠르고 비용 효율적인 3.5 클래스 모델로, Artificial Analysis Index에 따르면 초당 350개의 출력 토큰을 제공하며, 에이전트 워크플로우에서 이전 Flash-Lite 세대보다도 크게 뛰어난 성능을 보여줍니다.3.5 Flash Cyber in CodeMender: 성공적인 사이버 보안 애플리케이션은 모델을 에이전트 인프라와 신중하게 오케스트레이션(orchestration)하는 것을 필요로 합니다. 당사는 새롭고 매우 효율적이며 전문화된 사이버 중심 모델과 우리의 CodeMender 코드 보안 에이전트를 결합하여, 최첨단에서 경쟁력 있는 성능을 제공합니다.
오늘 발표된 내용 외에도, Gemini 3.5 Pro는 현재 파트너들과 테스트 중이며 준비되는 대로 광범위하게 사용할 수 있도록 할 계획입니다. 병행하여, 당사 팀은 이미 차세대 모델 구축에 집중하고 있습니다. 우리는 Gemini 4를 위해 역대 가장 야심찬 사전 학습(pre-training)을 시작했으며, 이 진전에 매우 기대가 됩니다.
3.6 Flash: 3.5 Flash보다 더 효율적이고 더 나은 품질
3.6 Flash: 3.5 Flash보다 더 효율적이고 더 나은 품질
Gemini 3.6 Flash는 3.5 Flash에서 얻은 개발자 및 고객 피드백을 바탕으로 구축되었습니다. 3.6 Flash는 코딩 및 지식 작업 분야에서 한 단계 높은 성능을 제공할 뿐만 아니라, 토큰 효율성을 의미 있게 개선했습니다. 예를 들어, Artificial Analysis Index를 보면 3.6 Flash가 3.5 Flash보다 출력 토큰 사용량이 17% 적은 것을 확인할 수 있습니다. 또한 다단계 워크플로우(multi-step workflows)를 완료하는 데 필요한 추론 단계와 도구 호출 횟수도 더 적습니다.
이러한 향상된 효율성은 3.5 Flash보다 낮은 가격과 결합되었습니다. 입력 토큰당 $1.50, 출력 토큰당 $7.50의 비용으로 3.6 Flash는 에이전트(agentic task)당 전체 비용을 절감하여, 에이전트를 구축하고 실행하는 데 더 경제적입니다.
OSWorld 검증 작업(API)에서 3.6 Flash가 3.5 Flash보다 더 나은 토큰 효율성과 낮은 장황함을 보여줍니다.
효율성이 높아졌음에도 불구하고, 3.6 Flash는 다양한 사용 사례 전반에 걸쳐 3.5 Flash 대비 성능 향상을 보입니다:
- DeepSWE에서는 (49% 대 37%) 더 적은 원치 않는 코드 수정과 감소된 실행 루프를 통해 더 높은 정밀도를 제공하며, MLE Bench에서는 (63.9% 대 49.7%)에서 상당한 개선을 보여줍니다.
- OSWorld-Verified에서는 (83.0% 대 78.4%)처럼 컴퓨터 사용 능력이 향상되었습니다. 컴퓨터 사용 기능은 이제 Gemini API 및 Gemini Enterprise를 통해 내장된 클라이언트 측 도구입니다.
- GDPval-AA v2 (1421 대 1349)와 같은 벤치마크에서 볼 수 있듯이, 지식 작업(knowledge work)에서도 3.6 Flash가 3.5 Flash보다 뛰어난 성능을 보입니다. Hebbia 및 Harvey 같은 고객들은 문서 파싱, 차트 및 데이터 분석, 보고서 초안 작성과 같은 멀티모달 작업(multimodal tasks)에서 특히 높은 능력을 발견했습니다.
3.6 Flash는 AIS에서 관리형 에이전트(Managed Agents)를 사용하여 3.5 Flash (AIS)보다 더 효율적이고 정확하게 금융 데이터 및 녹취록을 파싱하고 분석하는 데 도움을 줄 수 있습니다.
3.6 Flash는 AGY에서 다중 에이전트 오케스트레이션(multi-agent orchestration)을 사용하여 3.5 Flash (AGY)보다 낮은 지연 시간과 더 높은 품질로 코드 마이그레이션을 수행합니다.
3.6 Flash는 canvas(Gemini App)를 사용하여 3D 워크플로우를 위한 사진 질감 추출기 개발에 도움을 줍니다.
3.6 Flash는 AGY와 tldraw 오프라인 에디터를 사용하여 강력한 시각적 이해 능력(AGY)을 바탕으로 인터랙티브 테마 스튜디오를 구축합니다.


고객들은 3.6 Flash가 복잡한 워크플로우 및 지식 기반 작업 전반에 걸쳐 토큰 효율성, 정확도, 속도를 균형 있게 맞추면서 비용과 품질 모두에서 진전을 이루었다고 보고합니다:




안전성을 고려하여 구축됨 (Built with safety)
3.6 Flash는 화학(Chemical), 생물학(Biological), 방사능(Radiological), 핵(Nuclear) (CBRN) 및 사이버 공격 오용 영역에서 향상된 Frontier Safety 보호 장치를 적용하여 출시됩니다. 이러한 보호 장치는 모델이 탈옥(jailbreaks)에 훨씬 더 강하게 저항하도록 만듭니다. 동시에, 이 모델은 유익한 사용 사례에 대한 거부(refusals)를 최소화하도록 훈련되었습니다.
더 자세한 정보는 3.6 Flash 모델 카드에서 확인하십시오.
3.5 Flash-Lite: 에이전트 워크플로우 확장을 위해 구축됨 (Built to scale agentic workflows)
Flash 외에도, 저희는 저지연(low-latency) 작업과 에이전트 검색 및 문서 처리와 같이 높은 처리량(high throughput)이 개발자 워크플로우에 중요한 작업을 위해 설계된 Gemini 3.5 Flash-Lite도 출시합니다.
3.5 Flash-Lite는 3.5 시리즈 중 가장 빠른 모델입니다. Artificial Analysis가 측정한 바에 따르면, 초당 350개의 출력 토큰으로 작동합니다. 입력 토큰 1백만 개당 $0.3, 출력 토큰 1백만 개당 $2.5의 가격 책정으로, 3.1 Flash-Lite보다 훨씬 더 나은 품질을 제공하는 3.5 Flash-Lite는 높은 처리량의 프로덕션 트래픽을 실행하는 개발자와 고객에게 강력한 가격 대비 성능 비율을 제공합니다.
3.5 Flash-Lite는 3.5 Flash보다 낮은 지연 시간으로 고용량 작업을 수행합니다.
3.5 Flash-Lite는 에이전트 시스템의 효율적인 확장을 가능하게 합니다. 사고 수준(thinking levels) 전반에 걸쳐, 이 모델은 3.1 Flash-Lite를 크게 능가합니다. 개발자는 워크로드에 따라 모델을 구성하여 최소 및 낮은 사고 수준으로 고용량 작업에 대한 저지연, 저비용 실행을 우선시하거나, 더 높은 사고 수준을 활용하여 다단계 서브 에이전트(multi-step subagent) 워크로드를 처리하도록 할 수 있습니다. 또한 이 모델은 이제 컴퓨터 사용 기능을 내장 도구로 갖추어 모든 영역에서 이러한 에이전트 작업을 안정적으로 지원합니다.
Terminal-Bench 2.1에서 코딩 및 에이전트 작업 측면에서 큰 향상을 보였으며 (31% 대비 54%), GDM-MRCR v2에서는 긴 컨텍스트 처리 능력에서 향상되었고 (60.1% 대비 72.2%), GDPval-AA v2에서는 실제 세계 작업 실행 능력이 크게 개선되었습니다 (642 대비 1140).

실제로 많은 에이전트 및 코딩 평가에서 3.5 Flash-Lite는 SWE-Bench Pro (49.6% 대비 54.2%)와 OSWorld-Verified (65.1% 대비 74.0%)를 포함하여 3 Flash보다 더 나은 성능을 보여, 2.5 및 3 Flash 기반 워크로드 모두에서 더 빠르고 유능한 옵션이 됩니다.

3.5 Flash-Lite는 방대한 이커머스 데이터셋에서 제품 특징을 추출하고 이를 합성합니다.
마스터 에이전트인 3.6 Flash와 함께 작동하며, 3.5 Flash-Lite는 즉시 탐색할 수 있는 25가지의 고유한 웹 디자인 콘셉트를 생성합니다.
3.5 Flash-Lite는 멀티모달 이해력을 활용하여 영수증 번역 및 요약 작업을 확장할 수 있습니다.
3.5 Flash-Lite는 여러 옵션을 즉시 생성하고 반복하며 게임을 만듭니다.
3.5 Flash-Lite의 초기 고객들은 에이전트 워크플로우 및 데이터 처리 작업을 확장하는 데 있어 속도, 지능, 비용 효율성의 독특한 조합을 강조합니다:



모델에 대한 더 자세한 정보는 3.5 Flash-Lite 모델 카드를 참조하십시오.
CodeMender에서의 3.5 Flash Cyber: 취약점 찾기 및 효율적으로 수정하기
AI 모델은 현재 시스템이 패치할 수 있는 속도보다 빠르게 보안 취약점을 찾는 능력을 갖추게 되었습니다. 이러한 증가하는 위협에 대처하려면 매우 유능하고 효율적인 소프트웨어 보안 접근 방식이 필요합니다.
Flash의 성능과 효율성은 규모에 맞춰 코드 보안 문제를 탐지, 검증 및 패치하기 위한 이상적인 기반을 제공합니다. Gemini 3.5 Flash Cyber는 3.5 Flash를 기반으로 구축되었으며, 대형 모델보다 낮은 토큰당 비용으로 사이버 보안 취약점을 찾고 수정하도록 미세 조정되었습니다.
CodeMender는 여러 3.5 Flash Cyber 에이전트가 협력하여 단일 통합 보고서를 생성하는 시스템으로, 3.5 Flash Cyber는 인기 있는 벤치마크인 CyberGym에서 경쟁력 있는 최고 수준의 성능을 보여줍니다.

이 기술의 이중 용도(dual-use) 특성을 고려하여, 저희는 3.5 Flash Cyber 배포에 의도적인 접근 방식을 취했습니다. 이 모델은 제한적 액세스 파일럿 프로그램의 일환으로 곧 CodeMender를 통해 정부 및 신뢰할 수 있는 파트너에게만 독점적으로 제공될 예정입니다. 이를 통해 최전선의 방어자들이 광범위한 오용을 완화하는 동시에, 중요한 취약점을 발견하고 수정하여 악용되기 전에 대비할 수 있도록 앞서 나갈 수 있게 됩니다.
3.6 Flash 및 3.5 Flash-Lite: 오늘 시작하세요
3.6 Flash와 3.5 Flash-Lite는 오늘부터 사용할 수 있습니다:
- Gemini API를 사용하는 개발자들은 Google AI Studio 및 Android Studio에서 이용할 수 있습니다. 3.6 Flash는 Google Antigravity에서도 사용 가능합니다. 개발자 가이드(Developer Guide)로 시작하세요.
- 기업 고객들은 Gemini Enterprise Agent Platform에서 이용할 수 있습니다. 3.6 Flash는 Gemini Enterprise 앱에서도 사용할 수 있습니다.
- 모든 사용자들은 Gemini 앱을 통해 이용할 수 있습니다. 3.5 Flash-Lite는 Google Search에도 순차적으로 출시될 예정입니다.
3.6 Flash와 3.5 Flash-Lite를 사용하여 구축을 시작하면서, 향후 Gemini 모델 개선에 대한 여러분의 피드백을 환영하며 곧 3.5 Pro를 출시할 것을 기대합니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Google DeepMind의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기