
【2026년 8.1】Gemini 기능 개정 및 로드맵 통합 리포트
요약
Gemini 3.6 Flash 출시와 함께 구모델 지원 종료 및 모델 로드맵 업데이트를 다룹니다. Gemini 3.6 Flash는 효율성이 개선되었으며, API 파라미터 제어 방식이 프롬프트 기반으로 변화하는 등 중요한 기술적 전환을 포함합니다.
핵심 포인트
- Gemini 3.6 Flash 출시 및 3.5 Flash 모델 삭제 예정
- Gemini 3.6 Flash의 출력 토큰 소비량 17% 감소 및 성능 향상
- API 파라미터(temperature 등)가 내부 최적화로 인해 무시됨
- Gemini Spark 및 Daily Brief 등 개인 에이전트 기능 확장
- 로보틱스 및 임베딩 모델 등 구세대 모델의 순차적 종료
2026년 7월 하순 ~ 8월 상순의 Gemini 관련 주요 업데이트 및 릴리스 정보에 대한 해설입니다.
Gemini 3.6 Flash로의 완전 이행 및 최적화
2026년 7월 하순에 주력 경량 모델인 Gemini 3.6 Flash (및 3.5 Flash-Lite)가 정식 출시(GA)되었습니다. 이에 따라, 2026년 8월 4일을 기점으로 Enterprise 앱 등의 글로벌 리전에서 구모델인 「Gemini 3.5 Flash」가 삭제됩니다. 시스템이나 워크플로우에서 구모델을 지정하고 있는 경우에는 8월 상순까지 3.6 Flash로 전환해야 합니다. -
개발자용 모델 정리
API 및 개발 환경에서는 로보틱스 모델인 gemini-robotics-er-1.6-preview가 8월 31일에 제공 종료되며, 후속 모델 (gemini-robotics-er-2-preview)로의 인계가 권장되고 있습니다.
Google I/O 2026에서 발표된, 대화 형식으로 동영상을 생성하거나 부분 편집·리믹스를 수행할 수 있는 신모델 Gemini Omni와 관련하여, 일반 사용자 및 유료 플랜 대상 전개의 일환으로 2026년 8월 5일까지 동영상 10개 무료 생성 캠페인이 실시되고 있습니다.
- 캠페인 기간 종료 후에는 주로 「Google AI Plus / Pro / Ultra」 등의 유료 플랜 계약자용 기능으로서 제공됩니다.
Google I/O에서 예고되었던 개인용·기업용 기능의 롤아웃(Rollout)이 진행되고 있습니다.
**24시간형 개인 에이전트 「Gemini Spark」 및 「Daily Brief」**의 순차적 기능 추가 - Workspace 앱(Gmail, Docs, Keep 등)에서의 음성 대화 기능 확충 및 AI Studio · Antigravity 2.0을 통한 Managed Agents(AI 에이전트 구축 기능) 구현
Google DeepMind로부터 주력 모델군이 차세대 모델로 업데이트되었으며, API 및 엔터프라이즈 영역에서의 권장 모델이 순차적으로 교체되고 있습니다.
Gemini 3.6 Flash -
특징: 처리 효율의 추가 최적화가 이루어져, 기존 3.5 Flash에 비해 출력 토큰 소비량이 약 17% 감소했습니다. -
성능: DeepSWE(49%) 등의 벤치마크에서 점수가 크게 상승하였으며, 특히 코딩이나 복잡한 태스크 실행(Agentic Workflow)에서의 처리 능력이 향상되었습니다. -
가격 설정: 입력 $1.50 / 100만 토큰, 출력 $7.50 / 100만 토큰. -
Gemini 3.5 Flash-Lite -
특징: 최대 350토큰/초라는 매우 높은 응답 속도를 가진 최경량 모델. -
용도: 에이전트의 라우팅(Routing), 분류, 대량의 하위 태스크 처리에 최적화되어 있습니다.
신모델 도입에 따라 API 동작에 있어 운용상의 중요한 사양 변경이 실시되고 있습니다.
비권장(Deprecated) 대상: temperature, top_p, top_k -
변경점: API 호출 시 이러한 파라미터를 지정하더라도 에러를 일으키지 않고 내부적으로 무시(Silent Ignore)됩니다. -
배경: 결정론적(Deterministic)이며 태스크에 최적화된 처리(에이전트 동작의 안정화 및 비용 최적화)를 모델 내부에서 완결시키는 설계로 이행했기 때문입니다. 출력의 랜덤성을 기존의 파라미터 제어에 의존하던 코드는 프롬프트(Prompt)를 통한 지정으로 전환해야 합니다.
API 및 클라우드 서비스에서 제공되는 구세대 모델 및 프리뷰 버전 모델이 8월 중에 순차적으로 셧다운(Shutdown)됩니다.
| 대상 모델 / 엔드포인트 | 종료 예정일 | 권장되는 이행처 |
|---|---|---|
embedding-2-preview | 2026년 8월 10일 | gemini-embedding-2 |
Imagen 4 시리즈 (imagen-4.0-generate-001 등) | 2026년 8월 17일 | gemini-3.1-flash-image |
gemini-robotics-er-1.6-preview | 2026년 8월 31일 | gemini-robotics-er-2-preview |
모델 ID 재작성
애플리케이션이나 시스템에서 지정하고 있는 모델 엔드포인트(Model Endpoint)를 기존 모델에서 gemini-3.6-flash나 gemini-3.5-flash-lite로 전환합니다.
파라미터 처리 재검토
요청 파라미터(Request Parameter)에 포함된 temperature 등을 삭제하거나, 지정 전제의 로직(랜덤 제어 등)을 프롬프트 엔지니어링 (Prompt Engineering) 측에서 조정합니다.
이미지 생성·임베딩 모델의 이행 준비
8월 중순까지 셧다운(Shutdown)될 Imagen 4나 프리뷰 엔드포인트를 호출하고 있는 코드를 수정해 주시기 바랍니다.
Gemini Omni(제미나이 옴니)는 2026년 5월 Google I/O 2026에서 발표된 차세대 멀티모달 (Multimodal) 영상 생성·편집 모델입니다. 현재 실시되고 있는 캠페인의 상세 내용과 이 모델의 혁신적인 기능에 대해 해설합니다.
통상적으로는 유료 플랜 대상의 고급 기능이지만, 한정된 기간 동안 무료 사용자에게 개방되어 있습니다.
실시 기간: 2026년 7월 30일(목) ~ 2026년 8월 5일(수) 15시 59분까지 (일본 시간).
캠페인 내용: 무료 프레임 사용자라도 Gemini Omni를 이용하여 하루 최대 10개까지 영상 생성, 편집, 리믹스(Remix)를 무료로 가능.
이용 방법: Gemini 앱 내의 도구 메뉴에서 「영상 만들기 (Create video)」를 선택함으로써, 자연어 지시에 의한 영상 제작을 체험할 수 있습니다.
기존의 영상 생성 AI(Google의 Veo 등)가 주로 「제로에서부터 짧은 클립을 생성하는 것」에 특화되어 있었던 것에 반해, Gemini Omni는 「기존 영상을 이해하고, 대화 형식으로 직접 편집·재구축하는」 능력을 갖추고 있습니다.
대화 형식의 영상 편집과 리믹스
생성한 영상이나 입력한 기존 영상에 대해 「이 장면을 15초로 줄여줘」, 「배경을 해질녘으로 바꿔줘」, 「특정 오브젝트를 자연스럽게 삭제해줘」와 같은 자연어 지시를 내리는 것만으로, 모델이 문맥을 이해하여 영상을 재생성·편집합니다.
「세계 모델 (World Model)」에 의한 높은 일관성
모델 내부에 물리 세계의 인지(물체의 영속성, 공간의 깊이, 인물의 동일성 등)를 유지하고 있기 때문에, 컷 전환 시 인물의 얼굴이 바뀌거나 물체가 부자연스럽게 사라지는 등의 파탄을 방지합니다.
완전한 멀티모달 처리
텍스트, 이미지, 음성, 나아가 영상 그 자체를 입력으로 받아들입니다. 또한, 프롬프트 하나로 「영상」, 「네이티브 음성」, 「자막」을 동시에 출력할 수 있기 때문에, 후처리에서의 음성이나 자막 타이밍 맞추기가 불필요해집니다.
Google Flow 등의 에코시스템(Ecosystem)으로의 통합
영상 생성 모델인 「Veo」와 연계하여, Veo가 소재를 생성하고 Gemini Omni가 이를 편집·통합하는 등의 워크플로우(Workflow)가 구축되어 있으며, Google의 AI 영상 제작 도구인 「Google Flow」의 핵심으로서 기능하고 있습니다.
단일 채팅 응답을 넘어, 백그라운드에서 태스크(Task)를 자동 실행하는 에이전트(Agent) 기능이 전개되고 있습니다.
Gemini Spark (일본어 전개 개시)
Google AI Ultra 가입자를 대상으로 일본어 대응이 시작된, 24시간 운용형 퍼스널 AI 에이전트입니다.
앱을 넘나드는 멀티 스텝 실행: Gmail, Google 캘린더, 문서(Docs), 스프레드시트(Sheets), Google 포토 등에 더해, MCP(Model Context Protocol)나 외부 서비스(Canva, OpenTable 등)와 연계합니다.
클라우드 상에서의 백그라운드 처리: 실행 기반으로 「Google Antigravity」와 「Gemini 3.5」를 채택하고 있어, 사용자가 PC를 닫거나 스마트폰을 잠그더라도 클라우드 상에서 여러 단계의 태스크(예: 메일에서 정보 추출 → 문서 작성 → 관계자에게 전송 초안 작성)를 계속해서 실행합니다.
트리거 실행: 지정된 일시(「매주 월요일 아침」 등)나 특정 조건을 만족하는 메일을 수신한 타이밍에 자동으로 처리를 시작하게 하는 것이 가능합니다.
Gemini Daily Brief
Gmail이나 Google 캘린더에서 데이터를 자동으로 추출하여, 지정한 시간(아침·점심·저녁 등)에 그날의 일정, 회의 자료, 이동 시간, 우선순위가 높은 메일의 요약을 한 화면에 집약하여 자동으로 배포하는 기능입니다.
Workspace의 주요 애플리케이션에 대한 AI 기능의 통합과 실용성 강화가 이루어지고 있습니다.
Gmail / 문서 (Docs) / 프레젠테이션 (Slides) / 스프레드시트 (Sheets) -
Gmail: 문서 작성 지원 (Help me write) 기능에 새로운 교정 기능이 추가되어, 지시에 따른 맞춤형 편집이 가능해졌습니다. -
Google Slides: AI가 완전히 네이티브하며 재편집이 가능한 프레젠테이션을 직접 생성할 수 있게 되었습니다. -
Google Sheets: 수식 오류의 자동 트러블슈팅 (Troubleshooting) 기능과 다국어 값 입력 지원 및 테이블 생성 기능이 확장되었습니다. -
Google Vids (동영상 제작) -
Gemini Omni와의 통합을 통해 텍스트나 소재로부터의 비디오 클립 생성, 대화 형식의 비디오 편집이 지원됩니다.
AI 영상 내에 자신을 퍼스널 아바타 (Personal Avatar)로 등장시키는 기능도 구현되어 있습니다.
Google Classroom & Gemini Notebook -
교육용 기능으로서, Gemini Notebook을 활용한 클래스 노트북 (Class Notebook) 생성, 루브릭 (Rubric) 파일/이미지로부터의 평가 기준 변환, Google Classroom으로의 직접 공유 등이 지원 언어를 확대하며 전개되고 있습니다.
개발자용으로는, 자율형 AI 에이전트 (Autonomous AI Agent)를 인프라 구축 없이 즉시 실행할 수 있는 기반이 Gemini API 및 Google AI Studio에 도입되었습니다.
Managed Agents (Gemini API)
단 한 번의 API 호출 (client.interactions.create 등)로, Google이 관리하는 격리된 원격 Linux 샌드박스 (Sandbox) 환경 (컨테이너)을 즉시 프로비저닝 (Provisioning)할 수 있습니다. -
실행 환경: 샌드박스 내에서 Bash, Python, Node.js 등의 코드 실행, 파일 관리, 웹 검색을 자율적으로 수행하는 것이 가능합니다. -
Antigravity Agent 및 커스텀 정의 (AGENTS.md / SKILL.md) -
antigravity-preview 에이전트를 베이스로 사용할 수 있으며, 세션 (environment_id)을 유지함으로써 컨텍스트 (Context)나 생성된 파일을 보존한 채 멀티턴 (Multi-turn) 대화를 지속할 수 있습니다. -
에이전트의 역할이나 스킬 (Skill)은 코드 내에 오케스트레이션 (Orchestration)을 기술하는 대신, AGENTS.md나 .agents/skills/ (SKILL.md)와 같은 Markdown 파일로 기술 및 마운트하여 정의하고 관리할 수 있습니다. -
Vertex AI / 거버넌스 (Governance) 측면의 강화
엔터프라이즈 (Enterprise) 영역 (Vertex AI)에서는 입력 데이터, 프롬프트 (Prompt), 사고 과정이 모델 학습에 이용되지 않는 보안 경계 (VPC Service Controls 등) 및 데이터 레지던시 (Data Residency) 대응이 엄격해져 있으며, 사내 시스템이나 RAG (검색 증강 생성)에 안전하게 통합할 수 있도록 정비되어 있습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 Qiita AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기