
SenseNova U1.5 Lite 프리뷰 출시
요약
SenseNova가 성능이 향상된 U1.5-Lite-Preview 모델을 공개했습니다. 4K 네이티브 생성, 개선된 텍스트 렌더링, 구조화된 긴 프롬프트 처리 능력을 갖추었으며 이미지 편집 워크플로우가 강화되었습니다.
핵심 포인트
- Qwen-Image-Bench 등 주요 벤치마크 점수 상승
- 4K 해상도에서 질감, 재질, 조명 디테일 개선
- 복잡한 레이아웃 내 중국어 및 영어 텍스트 렌더링 강화
- 다중 참조 합성 및 스타일 전이 등 새로운 편집 워크플로우 도입
- 긴 구조화된 프롬프트에 대한 안정적인 작동 지원
SenseNova가 U1.5-Lite-Preview 벤치마크를 공개했습니다: Qwen-Image-Bench 점수가 47.14에서 55.20으로 상승했습니다. ImgEdit-Bench는 3.90에서 4.37로, GEdit-Bench-en은 7.47에서 8.17로 상승했습니다. 주요 업데이트 사항은 다음과 같습니다: 더 나은 질감(texture), 재질(material), 조명(lighting) 디테일을 갖춘 4K 네이티브 생성. 포스터나 인포그래픽과 같이 밀도가 높은 레이아웃에 대해 개선된 중국어 및 영어 텍스트 렌더링(rendering). 계층적 제약 조건이 포함된 길고 구조화된 프롬프트가 안정적으로 작동합니다 (문서에 포함된 프롬프트 예시 중 하나는 타임라인, 색상 체계, 구도 규칙 및 금지 요소를 다루는 약 3,880자의 중국어입니다). 이미지 편집은 국소적(localized)으로 유지됩니다. 한 영역을 변경해도 이미지의 나머지 부분이 변하지 않습니다. 새로운 워크플로우: 다중 참조 합성(multi-reference composition), 스타일 전이(style transfer), 재생성(rerolling) 없는 연속적인 반복 편집. 여전히 프리뷰 품질 단계입니다. 짧은 프롬프트 이해도, 작은 글꼴 렌더링, 얼굴 디테일, 미적 일관성(aesthetic consistency)은 약점으로 인정되었습니다. 세상 지식(World knowledge)과 복잡한 장면에서의 편집 안정성 또한 개선이 필요합니다. GitHub: https://github.com/OpenSenseNova/SenseNova-U1 HF: https://huggingface.co/sensenova/SenseNova-U1.5-8B-MoT-Preview /u/SandyL925에 의해 제출됨 [link] [comments]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/LocalLLaMA의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기