
SenseNova U1.5-Lite-Preview 오픈소스 공개: 이미지 생성 및 편집 능력 대폭 향상
요약
SenseNova가 이미지 이해, 생성, 편집 기능을 통합한 경량 멀티모달 모델 U1.5-Lite-Preview를 오픈소스로 공개했습니다. 8B 규모임에도 4K 고해상도 생성과 정교한 텍스트/레이아웃 편집 능력을 갖추어 상용 모델 수준의 성능을 보여줍니다.
핵심 포인트
- 8B 규모의 경량 모델로 이미지 생성 및 편집 성능 대폭 향상
- 네이티브 4K 이미지 생성 및 고해상도 디테일 유지 지원
- 중국어/영어 텍스트 생성 및 복잡한 레이아웃 구성 안정화
- 기존 폰트와 질감을 유지하며 특정 영역만 수정하는 편집 기능 강화
올해 4월, SenseNova U1이라는 네이티브 통합 멀티모달 모델 (Native Unified Multimodal Model)을 발표한 SenseNova는 이미지 이해, 추론, 생성 및 편집을 하나의 모델로 통합했습니다.
몇 달간의 반복적인 개선을 거쳐, 오늘 그 경량 업그레이드 버전인 U1.5-Lite-Preview가 정식으로 오픈소스 (Open Source)되었습니다. 이미지 생성 및 편집 능력이 대폭 향상되었습니다.
단 8B 규모임에도 불구하고, 여러 벤치마크 테스트 (Benchmark Test)에서 이미지 생성 및 편집 효과가 U1을 명확히 능가하며, 심지어 상용 폐쇄형 모델 (Closed-source Model)과 견줄 만한 수준을 보여주었습니다.
이번 업데이트를 통해 네이티브로 4K 이미지 생성을 지원하며, 초고해상도 프레임에서도 텍스트, 아이콘 등의 세부 사항을 확대했을 때 명확하게 확인할 수 있습니다.
중국어와 영어 텍스트 생성 및 복잡한 레이아웃 (Layout) 구성도 더욱 안정되어, 포스터, 잡지 내지, 인포그래픽 (Infographic) 등을 한 번에 완성할 수 있습니다.
- GitHub: https://t.co/9bdXaR8BNE
- Hugging Face: https://t.co/SalJbcxzwT
- ModelScope (魔搭社区): https://t.co/HkbVh8Zd8c
이 외에도 편집 능력이 매우 크게 향상되어, 단 한 번의 생성(抽卡)으로 결과가 만족스럽지 않을 때 발생하는 번거로움을 효과적으로 방지하며, 잘못된 부분을 즉시 수정할 수 있습니다.
이미지 내의 텍스트를 수정할 때 기존의 폰트와 질감을 유지하며, 편집 영역을 지정하기 위해 박스를 그릴 수 있고, 박스 외부의 콘텐츠에는 영향을 주지 않습니다.
한 번의 생성이 끝이 아니라, 결과물 위에서 문구를 반복 수정하고, 레이아웃을 조정하며, 요소를 보완하여 만족스러울 때까지 수정할 수 있습니다.
[IMG:https://pbs.twimg.com/media/HOyg-jEaoAAH34F.jpg]
[IMG:https://pbs.twimg.com/media/HOyg-i7bcAABBb5.jpg]
AI 자동 생성 콘텐츠
본 콘텐츠는 X @github_daily (자동 발견)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기