Google, Gemini 3.6 Flash, Flash-Lite 및 Gemini Robotics 2로 확장
요약
Google이 Gemini 3.6 Flash, 3.5 Flash-Lite 및 Gemini Robotics 2를 발표하며 모델 라인업을 확장했습니다. 3.6 Flash는 코딩과 멀티모달 작업에 최적화된 범용 모델이며, Flash-Lite는 높은 처리량이 필요한 워크플로를 위해 설계되었습니다.
핵심 포인트
- Gemini 3.6 Flash는 3.5 Flash 대비 출력 토큰을 약 17% 절감하여 효율성 개선
- Gemini 3.5 Flash-Lite는 초당 350개 토큰을 생성하는 고속/저비용 모델
- Gemini Robotics 2를 통해 소프트웨어 에이전트를 물리적 로보틱스 영역으로 확장
- 3.6 Flash의 가격은 입력 100만 토큰당 $1.50, 출력 100만 토큰당 $7.50
Google은 두 가지 측면에서 Gemini를 동시에 확장하고 있습니다. 소프트웨어 및 기업 워크플로우를 위한 더 빠르고 저렴한 모델, 그리고 체화된(embodied) 교차 로봇 제어를 위해 설계된 새로운 로보틱스 제품군입니다. 이번 출시에는 Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, Gemini 3.5 Flash Cyber, 그리고 관련 체화된 추론(embodied-reasoning) 및 온디바이스(on-device) 변형 모델이 포함된 Gemini Robotics 2가 포함됩니다.
가장 명확하고 즉각적인 기업용 소식은 에이전트적 작업(agentic work)을 위한 모델 선택 폭이 넓어졌다는 점입니다. 공식 Gemini Flash 발표에서 Google은 3.6 Flash를 코딩, 지식 작업 및 멀티모달(multimodal) 작업을 위한 범용 워크호스(workhorse)로 포지셔닝하는 한편, 3.5 Flash-Lite는 응답 속도와 비용 효율성이 결정적인 워크로드(workload)를 겨냥하고 있습니다. 로보틱스 업데이트는 이러한 광범위한 추진력을 소프트웨어 에이전트를 넘어 물리적 환경에서 추론하고 행동해야 하는 시스템으로 확장합니다.
에이전트적 워크로드를 위한 더 넓은 Gemini 스택
Gemini 3.6 Flash는 Google의 개발자, 기업 및 소비자 채널을 통해 일반적으로 사용할 수 있습니다. Google은 이 모델이 코딩, 지식 작업 및 멀티모달 작업에서 3.5 Flash보다 개선되었으며, 3.5 Flash보다 출력 토큰(output tokens)을 약 17% 적게 생성한다고 밝혔습니다. 이러한 토큰 효율성 주장은 다단계 에이전트 워크플로우에서 출력 토큰이 지연 시간(latency)과 추론 비용(inference spending) 모두의 중요한 부분이기 때문에 중요합니다.
Google은 Gemini 3.6 Flash의 가격을 입력 토큰 100만 개당 $1.50, 출력 토큰 100만 개당 $7.50로 책정했습니다. 회사는 이 모델이 작업당 더 낮은 비용을 제공한다고 설명하는데, 이 지표는 토큰 가격뿐만 아니라 작업을 완료하는 데 필요한 토큰 수에도 달려 있습니다. 제공된 출시 정보에는 3.5 Flash-Lite의 가격이 명시되어 있지 않으므로, 3.6 Flash의 가격을 통해 추론해서는 안 됩니다.
Gemini 3.5 Flash-Lite는 다른 역할을 수행합니다. Google은 이를 가장 빠르고 비용 효율적인 하위 제품군(subfamily)이라고 부르며, 명시된 출력 속도는 **초당 350개 출력 토큰 (350 output tokens per second)**입니다. 이는 조직이 3.6 Flash의 광범위한 범용적(workhorse) 포지셔닝보다 빠른 모델 응답과 높은 요청 볼륨을 더 중요하게 여길 수 있는 고처리량 에이전트 워크플로 (high-throughput agentic workflows)를 위해 의도되었습니다.
| 출시 모델 | 주요 포지셔닝 | 가용성 또는 액세스 | 확인된 세부 사항 |
|---|---|---|---|
| Gemini 3.6 Flash | 코딩, 지식 작업 및 멀티모달 (multimodal) 작업을 위한 범용 모델 (Workhorse) | Gemini API, Google AI Studio, Android Studio, Antigravity, Gemini Enterprise 및 Gemini 앱 전반에 걸쳐 일반 가용 (General availability) | 입력 토큰 100만 개당 $1.50; 출력 토큰 100만 개당 $7.50 |
| ... |
가용성의 분리는 매우 중요합니다. 3.6 Flash와 3.5 Flash-Lite는 Gemini 앱, Gemini Enterprise 앱, Gemini Enterprise 에이전트 플랫폼, Google AI Studio, Gemini API 및 Google Antigravity를 포함한 Gemini 생태계 전반에서 폭넓게 사용할 수 있습니다. 반면, 3.5 Flash Cyber는 정부 및 신뢰할 수 있는 파트너를 위한 제한된 파일럿 프로그램을 통해 처리되고 있습니다. 또한 Google은 Gemini 3.5 Pro가 광범위하게 사용 가능한 상태로 제시하기보다는 파트너들과 함께 테스트 중이라고 밝혔습니다.
기술 팀의 경우, 실질적인 결정은 단일한 "최고" 모델을 선택하는 문제라기보다 워크플로의 경제성 및 리스크 프로필 (risk profile)에 모델을 맞추는 것에 가깝습니다:
- Gemini 3.6 Flash는 코딩, 추론 중심의 지식 작업 및 멀티모달 (multimodal) 입력을 결합하는 작업에 대한 일반적인 옵션입니다.
- Gemini 3.5 Flash-Lite는 고속, 대량의 에이전트 운영을 목표로 합니다.
- Gemini 3.5 Flash Cyber는 취약점 발견 및 해결 (vulnerability discovery and remediation)의 높은 리스크 특성을 반영하여, 액세스가 제한된 특화된 기능입니다.
이러한 옵션들을 평가하는 기업들은 Scalevise와 협력하여 AI 아키텍처, 워크플로우 자동화 (workflow automation), 그리고 모델 선택을 실제 운영 요구 사항과 연결하는 통합 계획을 수립할 수 있습니다.
Gemini Robotics 2, Gemini를 Embodied AI로 확장
Google DeepMind의 로보틱스 출시는 단순히 또 다른 텍스트나 코드 모델이 아닙니다. Gemini Robotics 2는 Gemini Robotics ER 2 및 Gemini Robotics On-Device 2를 포함하는 Embodied AI (체화된 인공지능) 제품군의 일부입니다. Google은 이 제품군이 휴머노이드 및 기타 로봇을 위한 전신 지능 (whole-body intelligence)과 교차 체화 제어 (cross-embodiment control)를 가능하게 한다고 설명합니다.
이러한 프레임워크는 기존의 엔터프라이즈 AI와는 다른 배포 과제를 시사합니다. 소프트웨어 에이전트는 API와 도구를 통해 작동할 수 있는 반면, 로봇은 인지 (perception), 추론 (reasoning), 움직임 (movement), 그리고 물리적 신체의 제약 사항을 연결해야 합니다. 교차 체화 제어 (Cross-embodiment control)는 시스템을 단일 기계 설계로 제한하는 대신, 하나 이상의 로봇 폼 팩터 (form factor)에 걸쳐 지능을 적용하는 것을 목표로 한다는 점에서 특히 중요합니다.
로보틱스 서비스는 현재 활성화되어 있으며, 데모를 보여주는 전용 DeepMind 페이지와 조기 액세스 대기 명단(early-access waitlist)이 마련되어 있습니다. 제공된 자료에는 Gemini Robotics 2, Gemini Robotics ER 2 또는 Gemini Robotics On-Device 2에 대한 광범위한 일반 사용 가능성(general availability)이나 상업적 가격 책정이 명시되어 있지 않습니다. 기업들에게 이번 업데이트는 물리적 AI (physical AI)에 대한 Google의 방향성을 보여주는 중요한 지표가 되지만, 로보틱스 기능이 일반 사용 가능한 Flash 출시 버전과 동일한 액세스 모델로 배포될 것이라고 가정할 수 있는 근거는 아직 아닙니다.
이러한 출시들은 Google이 더욱 세분화된 Gemini 포트폴리오를 구축하고 있음을 보여줍니다. Flash 모델은 속도, 토큰 사용량, 도구 지원 워크플로우 (tool-enabled workflows), 그리고 배포 범위와 관련된 일반적인 기업의 요구 사항을 해결합니다. 로보틱스 (robotics) 제품군은 더 장기적인 필요성, 즉 물리적 세계와 직접 상호작용하는 시스템에 멀티모달 추론 (multimodal reasoning)을 도입하는 문제를 다룹니다. 공통된 맥락은 소프트웨어 워크플로우에서 로봇에 이르기까지, 점점 더 다양해지는 형태의 에이전시 (agency) 전반에서 Gemini를 유용하게 만들려는 노력입니다.
자주 묻는 질문 (Frequently Asked Questions)
Gemini 3.6 Flash는 무엇인가요?
Gemini 3.6 Flash는 코딩, 지식 노동 (knowledge-work), 그리고 멀티모달 (multimodal) 작업을 위해 Google이 제공하는 범용 워크호스 (workhorse) 모델입니다. Google은 입력 토큰 100만 개당 $1.50, 출력 토큰 100만 개당 $7.50로 가격을 책정했습니다.
Gemini 3.5 Flash-Lite는 Gemini 3.6 Flash와 어떻게 다른가요?
Google은 3.5 Flash-Lite를 초당 최대 350개의 출력 토큰을 생성하며, 고속 에이전트 워크플로우 (agentic workflows)를 위한 가장 빠르고 비용 효율적인 하위 제품군으로 포지셔닝하고 있습니다. 반면 Gemini 3.6 Flash는 코딩, 지식 노동 및 멀티모달 작업을 위해 보다 폭넓게 포지셔닝되어 있습니다.
Gemini 3.6 Flash와 3.5 Flash-Lite는 어디에서 사용할 수 있나요?
Google은 Gemini App, Gemini Enterprise App, Gemini Enterprise Agent Platform, Google AI Studio, Gemini API, 그리고 Google Antigravity를 통해 일반 사용 가능 (general availability) 상태임을 명시하고 있습니다. 또한 Google은 3.5 Flash-Lite에 대한 Google Search 통합을 언급했습니다.
Gemini Robotics 2는 널리 사용할 수 있나요?
Gemini Robotics 2 제품군은 현재 운영 중이며 초기 액세스 대기 명단 (early-access waitlist)을 운영하고 있으나, 제공된 정보에는 광범위한 일반 사용 가능 여부나 상업적 가격 책정에 대한 확인 내용은 포함되어 있지 않습니다.
결론 (Conclusion)
Google의 Gemini 업데이트는 AI 워크로드 전반에 걸쳐 더 명확한 역할 분담을 만들어냅니다. Gemini 3.6 Flash와 3.5 Flash-Lite는 서로 다른 성능 우선순위를 가진 기업 및 개발자 워크플로를 위해 폭넓게 사용 가능한 옵션을 제공하며, Gemini Robotics 2는 프로그램을 체화된 지능 (Embodied Intelligence) 분야로 확장합니다. 단기적인 핵심 과제는 조직이 이렇게 확장되는 모델 범위를 어떻게 신뢰할 수 있고 적절하게 거버넌스가 이루어진 소프트웨어 및 로보틱스 배포로 전환하느냐 하는 것입니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기