Gemini 3.8 Flash 및 3.8 Flash Cyber 공개
요약
Google이 최고의 추론 및 코딩 모델인 Gemini 3.8을 출시하며, 특히 소프트웨어 엔지니어링과 에이전트 작업에 최적화된 'Gemini 3.8 Flash'와 사이버 보안 특화 모델 'Gemini 3.8 Flash Cyber'를 공개했습니다. 이 모델들은 이전 버전 대비 상당한 성능 향상을 보여주며, 낮은 비용으로 높은 지능을 제공하는 것이 특징입니다.
핵심 포인트
- Gemini 3.8은 추론 및 코딩 능력이 강화된 최신 모델이다.
- Gemini 3.8 Flash는 자율 에이전트 작업과 소프트웨어 엔지니어링에 강점을 보인다.
- Gemini 3.8 Flash Cyber는 취약점 탐지 및 자동 패치 분야의 전문 보안 모델이다.
- DeepSWE v1.1 등 여러 벤치마크에서 최첨단 성능을 입증했다.
Gemini 3.8 Flash 및 3.8 Flash Cyber 소개

3주 전 3.7 Flash의 모멘텀을 이어받아, 단 6주 만에 세 번째 Flash 버전을 출시하며, 오늘 저희는 최고의 추론(reasoning) 및 코딩 모델인 Gemini 3.8을 소개합니다. 이 모델은 3.7과 동일한 속도와 낮은 비용으로 제공됩니다. Gemini 3.8은 두 가지 변형을 도입합니다:
Gemini 3.8 Flash: 소프트웨어 엔지니어링, 에이전트 작업(agentic tasks), 그리고 전문 영역의 중요하고 다단계적인 추론에서 3.7 Flash 대비 상당한 개선 사항을 제공하는 가장 지능적인 워크호스 모델입니다. 이 모델은 3.7 Flash와 동일한 도입 가격인 입력 토큰 백만 개당 $0.75, 출력 토큰 백만 개당 $3.75로 이용 가능합니다.Gemini 3.8 Flash Cyber: 취약점 탐지 및 자동 패치 분야에서 최첨단 수준의 성능을 갖춘 가장 강력한 사이버 보안 모델이며, 새로운 Fairwind Program을 통해 신뢰할 수 있는 방어자들에게 제공됩니다.
오늘 공개된 두 버전 모두 서로 다른 배포 환경에 맞춰져 있지만, 동일한 기반 지능(foundational intelligence)으로 구동되며, 근본적인 모델을 재귀적으로 평가하고 개선하도록 설계된 장기 실행 에이전트 루프를 통해 더욱 가속화됩니다. 이 공유 핵심에서의 상당한 코딩 및 추론 향상은 사이버 보안이라는 매우 까다로운 도메인에서 수행된 엄격한 훈련을 포함하여 여러 혁신에 의해 주도되었습니다.
Gemini 3.8 Flash: 장기 지평(long-horizon) 코딩 및 자율 에이전트용으로 구축
Gemini 3.8 Flash는 3.7 Flash 대비 상당한 성능 향상을 제공하며, 종종 더 높은 비용의 최첨단 모델에 근접하는 성능을 보여줍니다.

**DeepSWE v1.1 (장기 지평 소프트웨어 엔지니어링)**에서 3.8 Flash는 복잡한 엔지니어링 문제를 처음부터 끝까지 자율적으로 해결하는 데 있어 대부분의 대형 최첨단 모델을 능가하며, 비용은 그 일부에 불과합니다.

또한, 3.8 Flash는 전문 지식 영역 전반에 걸쳐 중요한 기업 자율성에 필요한 신뢰성을 보여줍니다**.** 고급 분석 및 보고가 요구되는 정량적 및 전문 분야에서, 3.8 Flash는 Vals Finance Agent V2와 Harvey's Legal Agent Benchmark 같은 벤치마크에서 3.7 Flash 및 다른 최첨단 모델보다 뛰어난 성능을 보입니다. 3.8 Flash는 또한 HLE-Verified에서 54.9%를 달성하여 STEM, 인문학, 전문 분야 전반에 걸친 다단계 추론 처리 능력을 입증했습니다.



이러한 성능 향상은 핵심 설계 선택에서 비롯됩니다. 즉, 3.8 Flash가 더 열심히 작동한다는 것입니다. 복잡한 작업에 대해, 이 모델은 더 큰 성실성을 보여주며 — 추가적인 추론 단계를 실행하고 도구를 반복적으로 호출합니다. 때로는 성능을 극대화하기 위해 토큰을 더 많이 사용할 수 있으며, 특히 높은 노력 수준에서 그렇습니다.
컴퓨팅 효율성이 주요 제약 사항인 애플리케이션의 경우, 개발자는 토큰 오버헤드를 최소화하기 위해 낮은 노력 수준을 활용하거나, 효율성 우선 워크로드에 대해 여전히 완벽하게 지원되는 Gemini 3.7 Flash에 의존할 수 있습니다.
Gemini 3.8 Flash는 Google Antigravity에서 루핑(looping) 지침을 사용한 간단한 프롬프트로 이 게임을 만들었습니다. 이 게임은 퍼즐, 환경 스토리텔링, 그리고 Nano Banana로 생성된 질감을 사용하여 마법사가 성을 탐험하는 몰입형 3D 레벨을 만듭니다.
Gemini 3.8 Flash는 Google Antigravity에서 단일 프롬프트만으로 위치, 길 안내, 스트리트 뷰가 완벽하게 구현된 Google Maps의 DOS 버전을 구축했습니다.
U.S. Geological Survey의 실제 데이터를 사용하여 Gemini 3.8 Flash로 Google Antigravity에 구축한 유명 지리적 장소의 지형도에서 실시간 단면, 2D 투영, 과학적 설명을 탐색해 보세요.
하드웨어 해부학 (Hardware Anatomy)은 Gemini 3.8 Flash를 사용하여 Google AI Studio에서 구축된 인터랙티브 3D 시각화 도구로, 하드웨어 장치의 물리적 비율을 갖춘 분해(teardown) 과정을 사실적인 Three.js 렌더링으로 생성합니다. 이 도구는 기기를 자동으로 여러 레이어로 분해하여 '분해 슬라이더(deconstruction slider)'를 통해 폭발시키고 검사할 수 있게 합니다.
Gemini 3.8 Flash Cyber: 전문가 수준의 사이버 성능
Gemini 3.8 Flash Cyber는 Fairwind Program을 통해 신뢰받는 방어자 그룹에게 제공되며, 빠른 반복(quick iteration)을 가능하게 하는 Flash 속도와 비용으로 오늘날 복잡한 사이버 보안 환경에서 결정적인 우위를 제공합니다.
자율 취약점 발견 (Autonomous vulnerability discovery)
취약점을 찾는 표준 산업 벤치마크인 CyberGym에서, Gemini 3.8 Flash Cyber는 자율 취약점 발견 분야에서 최첨단 수준의 성능을 보여줍니다. 이는 3.5 Flash Cyber뿐만 아니라 훨씬 더 큰 규모의 최첨단 모델(frontier models)보다도 뛰어납니다.

CyberGym처럼 C/C++ 코드베이스에 국한되지 않은 실제 방어 요구 사항을 더 잘 포착하기 위해, 우리는 또한 Gemini 3.8 Flash Cyber를 광범위한 내부 벤치마크와 비교 평가했습니다. 이 벤치마크에서는 모델이 20개 프로그래밍 언어에 걸쳐 복잡한 코드베이스 전반의 다양한 취약점을 발견해야 합니다. 여기서 이 모델은 이전 모델들보다 인상적인 도약을 보여주며 70%가 넘는 성공률을 달성합니다.

자동 패치 (Automated patching)
Gemini 3.8 Flash Cyber를 통해 우리는 방어자들에게 공격자보다 우위를 점하게 해주는 전문가 수준의 역량을 갖추는 데 중점을 두었습니다. 이것이 바로 우리가 처음부터 취약점 수정(vulnerability fixing)에 투자하고, 익스플로잇(exploitation)과 같은 공격적 기능보다 우선순위를 높인 이유입니다.
Collinear가 운영하는 CWE-Bench는 패치 역량에 대한 까다로운 외부 벤치마크입니다. 이 벤치마크에서 Gemini 3.8 Flash Cyber는 파레토 프론티어(Pareto frontier) 상에 위치합니다. 선도적인 최첨단 모델이 47.8%인 것에 비해, pass@1 값은 47.2%로 약간 낮지만 훨씬 낮은 비용으로 제공됩니다.

실제 영향: Google 코드 보호
실제 영향: Google 코드 보호
저희는 이미 Google 전반에 걸쳐 코드를 보호하기 위해 Gemini 3.8 Flash Cyber를 사용하고 있습니다. 예를 들면:
- Chrome 보안팀은 3.8 Flash Cyber가 훨씬 크지만 최고의 상용 모델들보다 높은 취약점 패치를 2.6배 더 많이 생성하는 것을 발견했습니다.
- Wiz는 Gemini 3.8 Flash Cyber가 다른 선도적인 최첨단 모델(frontier models) 대비 2.3
5.2배 낮은 비용으로 자체 침투 테스트 벤치마크에서 +7.59.7% 더 높은 재현율(recall)을 달성하는 것을 발견했습니다. - Google 클라우드 취약점 연구팀은 3.8 Flash Cyber 모델을 활용하여 2시간도 안 되는 시간에 중요한 기반 취약점을 찾아냈는데, 이 취약점의 연구 및 발견에는 보통 몇 달이 걸립니다.
저희 Fairwind Program 파트너들이 말하는 것




안전을 염두에 두고 구축됨
3.8 Flash는 저희의 Frontier Safety Framework에 따라 화학(Chemical), 생물학적(Biological), 방사능(Radiological), 핵(Nuclear) (CBRN) 및 사이버 공격 영역에서의 오용 방지 장치를 갖추고 있으며, 동시에 유익한 사용 사례를 가능하게 합니다. 3.8 Flash Cyber는 사이버 보안을 위한 보다 허용적인 완화 조치 세트를 갖추고 있어, 더 포괄적인 사이버 역량이 필요한 신뢰할 수 있는 방어자에게만 제공됩니다.
Gemini 3.8 모델은 또한 Gray Swan이 측정한 프롬프트 주입(prompt injection) 견고성에서 상당한 도약을 이루었으며, Gemini 모델 사용자를 프롬프트 주입 관련 악의적인 공격으로부터 보호합니다.

Gemini 3.8 Flash 및 Cyber: 오늘 시작하기
AI 자동 생성 콘텐츠
본 콘텐츠는 Google DeepMind의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기