구글, 나노 바나나 2.1 출시... 마스킹 및 피사체 일관성 개선
요약
구글이 AI 이미지 생성 및 편집 모델 'Nano Banana 2.1'을 발표하며 시각 디자인과 마스크 기반 편집, 주체 일관성 분야에서 큰 개선을 이루었습니다. 이 모델은 Gemini 앱, 구글 검색 등 주요 플랫폼에 순차 적용되며 개발자에게도 정식 개방되었습니다.
핵심 포인트
- 주체 일관성이 향상되어 여러 생성물에서도 외형이 유지됩니다.
- 개발자는 gemini-nano-banana-2.1 ID로 모델을 사용할 수 있습니다.
- 텍스트, 이미지, 오디오, 비디오 입력을 지원하며 4K 해상도 출력이 가능합니다.
- OpenAI와 Microsoft 등 경쟁사 제품과의 성능 비교가 이루어졌습니다.
AI 요약 뉴스 주요 내용
구글, AI 이미지 생성 및 편집 모델 'Nano Banana 2.1' 정식 발표
시각 디자인, 마스크 기반 이미지 편집, 주체 일관성 분야에서 주요 개선
Gemini, 검색 AI , 개발자 API 등 주요 플랫폼에 순차 적용
10월 7일 소식에 따르면, 구글(Google)은 오늘 자사의 AI 이미지 생성 및 편집 모델 업그레이드 버전인 Nano Banana 2.1을 정식 발표했습니다. 구글은 신형 Nano Banana 2.1이 전반적인 성능 향상을 이루었으며, 특히 시각 디자인, 마스크 기반 이미지 편집, 그리고 주체 일관성 측면에서의 발전이 눈에 띄게 두드러진다고 강조했습니다.
올해 초, 구글은 Gemini 3.1 Flash Image로도 불리는 Nano Banana 2를 선보인 바 있습니다. Nano Banana 2는 구글 Flash 시리즈 모델 특유의 빠른 속도를 유지하면서도 Nano Banana Pro급의 이미지 출력 품질을 구현했습니다. 또한, 구글은 기존 Pro 버전에만 제공되던 현실 세계 지식베이스, 텍스트 렌더링 효과 최적화, 캐릭터 및 사물 일관성 성능 향상 등 여러 주요 기능들을 더 낮은 라인업의 해당 모델에도 대거 이식했습니다.
IT홈이 포착한 바에 따르면, Nano Banana 2.1은 기존 역량을 바탕으로 주로 세 가지 핵심 방향에서 개선을 이루었습니다.
개선된 주체 일관성은 Gemini 사용자들에게 실용성이 매우 높으며, 여러 번에 걸친 생성 결과물 속에서도 동일한 인물이나 사물의 외형이 일관되게 유지되도록 도와줍니다. 구글 Nano Banana 2.1은 현재 Gemini 앱, 구글 검색 AI 모드, Google AI Studio, Google Flow, Stitch, 구글 광고 및 Gemini 기업용 플랫폼 등에 순차적으로 배포 및 적용되고 있습니다.
개발자들을 대상으로는 Nano Banana 2.1이 이미 정식 개방되었으며, 대응하는 모델 ID는 gemini-nano-banana-2.1입니다. 해당 모델은 텍스트, 이미지, 오디오, 비디오 입력을 지원하며, 동시에 1K, 2K, 4K 해상도의 이미지 출력이 가능합니다.
현재 OpenAI의 ChatGPT Images 2.5는 여전히 글로벌 시장을 선도하는 이미지 생성 및 편집 모델로 자리 잡고 있습니다. 사용자가 한 장의 이미지를 지속적으로 미세 조정할 때, 편집되지 않은 영역을 변형시키지 않고 반복적인 수정 과정에서 원본 화질이 저하되는 것을 방지하는 능력이 탁월합니다. OpenAI의 해당 제품 바로 뒤는 올해 8월에 출시된 마이크로소프트 AI(Microsoft AI)의 MAI-Image-2.6 모델이 추격하고 있습니다.
※ 퀘이사존 공식 기사가 아닌 해외 뉴스/기사를 번역한 것으로, 퀘이사존 견해와 주관은 포함되어 있지 않습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 퀘이사존 하드웨어 뉴스의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기