Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
InvokeAI 6.13 버전이 커뮤니티 주도로 출시되었습니다. Anima 및 Qwen 모델 지원, API 모델 연동, 새로운 캔버스 도구 및 멀티 유저 모드 확장 등 강력한 이미지 생성 기능을 제공합니다.
Anima 모델을 활용하여 이미지를 편집하는 두 가지 기술적 방법론을 소개합니다. 인페인팅과 컨트롤넷을 활용한 포즈 변경 방식과 LoRA를 이용한 의상 및 표정 변경 방식의 장단점을 분석합니다.
저사양 VRAM GPU 환경에서 Microsoft Lens Turbo 모델을 테스트하기 위한 ComfyUI 워크플로우와 모델 정보를 공유합니다. 최신 성능을 위해 ComfyUI 업데이트가 권장됩니다.
Qwen, Flux, LTXV 등 다양한 AI 모델을 활용하여 5일 만에 2.5분 분량의 애니메이션 쇼를 제작한 파이프라인을 소개합니다. 기존 방식과 달리 기획 단계부터 AI를 전면 도입하여 스타일 일관성과 캐릭터 구현을 최적화했습니다.
LTX Director 커스텀 노드와 Transition LoRA를 결합하여 복잡한 장면 전환을 매끄럽게 구현하는 방법을 소개합니다. ComfyUI 환경에서 고품질의 영상 전환 효과를 만드는 워크플로우를 다룹니다.
Anima 모델을 위한 ComfyUI 커스텀 노드를 소개합니다. 기존 sd-forge-couple 방식보다 이미지 토큰 마스킹을 통해 더 정교한 경계를 제공하지만, 구도 불균형을 방지하기 위한 파라미터 조절이 필요합니다.
Meituan에서 출시한 LongCat-Video-Avatar 1.5는 오디오 기반 인간 비디오 생성을 위한 오픈 소스 프레임워크입니다. Whisper-Large 인코더와 DMD2 기반 증류 기술을 통해 자연스러운 입술 움직임과 빠른 추론 속도를 제공합니다.
ComfyUI-Angelo 노드가 Qwen Edit 모델 지원을 시작했습니다. Flux Klein과 함께 편집 모드에서 활용 가능하며, 스마트 인페인트 및 리파인 모드 등 사용자 요청 기능이 업데이트되었습니다.
Anima 스타일 및 캐릭터 탐색을 위한 ComfyUI 노드와 LoRA 익스플로러가 업데이트되었습니다. Civitai API를 통해 직접 다운로드가 가능하며, 실시간 프롬프트 제어 기능을 제공합니다.
NVIDIA의 Pixel Diffusion Decoder(PiD)를 사용하여 ZIT 및 Flux-1 모델의 이미지 생성 품질을 테스트한 결과입니다. 512px 생성물과 1024px 다운스케일링 이미지를 비교하여 PiD의 성능을 검증했습니다.
NVIDIA의 PiD(Pixel Diffusion Decoder) 방식을 지원하는 실험적인 ComfyUI 커스텀 노드를 소개합니다. 이 노드는 디코딩과 업스케일을 하나의 단계로 결합하여 고해상도 이미지를 생성하며, 다양한 백본 모델을 지원합니다.
Wan 2.2 I2V 비디오 모델을 활용하여 캐릭터의 일관성을 유지하면서 특정 포즈를 구현하는 새로운 워크플로우를 소개합니다. 80프레임의 비디오 시퀀스를 생성하여 첫 프레임의 캐릭터가 마지막 프레임의 포즈를 취하도록 유도하는 독창적인 프롬프팅 기법을 다룹니다.
WhatDreamsCost가 개발한 Director 노드는 타임라인 편집을 통해 비디오 생성 과정을 정밀하게 제어할 수 있는 새로운 워크플로우를 제공합니다. T2V, I2V 등 다양한 모드를 지원하며 향후 V2V 기능도 추가될 예정입니다.
Z-Image Turbo/Base 모델을 사용하여 사실적인 거울 셀카 이미지를 생성하기 위한 최적의 프롬프트 예시를 제공합니다. 피사체의 외양, 의상, 동작, 환경, 카메라 설정 및 조명 디테일을 포함한 구조화된 프롬프트 구성을 제안합니다.
ComfyUI-Flux2Klein-Enhancer의 최종 업데이트 버전이 공개되었습니다. 노드를 복잡하게 연결할 필요 없이 Multi ReferenceLatent와 Identity Feature Transfer Final 노드를 통해 다중 참조 이미지를 효율적으로 처리할 수 있습니다.
ComfyUI를 활용할 수 있는 48개의 다양한 프론트엔드 UI 목록을 소개합니다. 워크플로우 통합형부터 API 기반 UI, 개발자용 러너 서버 활용형까지 다양한 카테고리로 분류되어 있습니다.
Microsoft Lens 모델이 ComfyUI에 네이티브로 지원될 예정입니다. JSON 프롬프트 형식을 활용하여 정교한 이미지 생성이 가능하며, 다양한 해상도와 종횡비를 지원합니다.
Anima AI 모델의 캐릭터 및 아티스트 지식 범위를 확인하기 위해 49,000개의 샘플 이미지를 활용한 검색 엔진 Animadex를 구축했습니다. 사용자는 태그, 속성, 저작권별로 캐릭터를 검색하고 관련 LoRA 정보를 확인할 수 있습니다.
Untwisting RoPE 기술을 ComfyUI에 구현하여 별도의 학습 없이 스타일 전이가 가능하도록 지원합니다. 현재 Z-image Turbo 모델에 대한 구현이 완료되었으며, 향후 지원 모델 확장을 검토 중입니다.
Nvidia가 Wan 모델을 기반으로 한 AnyFlow를 출시했습니다. 이는 플로우 맵을 활용한 최초의 any-step 비디오 확산 프레임워크로, 사용자의 컴퓨팅 예산에 맞춰 타임스텝을 동적으로 조정할 수 있습니다.