Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Apple Silicon에서 LTX-Video 2.3 및 이미지 모델을 로컬로 실행할 수 있는 오픈 소스 AI 스위트 Phosphene 3.0을 공개합니다. MIT 라이선스로 제공되며, 구독료 없이 자신만의 캐릭터 LoRA를 학습시키고 비디오와 이미지를 생성할 수 있습니다.
ComfyUI-Angelo 노드에 SAM 3가 추가되어 텍스트 입력이나 드롭다운 선택만으로 편집 대상을 정밀하게 탐지할 수 있습니다. 사용자는 직접 그릴 필요 없이 원하는 객체를 클릭하여 간편하게 인페인팅 및 리파이닝 작업을 수행할 수 있습니다.
Flux 2 Klein 증류(distilled) 모델을 활용하여 고해상도 이미지를 빠르고 직관적으로 생성할 수 있는 워크플로우를 공유합니다. Sage Attention을 통한 속도 향상과 Civitai 연동 Lora Manager 기능을 포함하고 있습니다.
Adonis Flux 2 Klein 9B를 위한 새로운 Post 모델이 공개되었습니다. 이 모델은 업스케일 과정에서 발생하는 아티팩트를 제거하고 피부, 머리카락 등 세부 디테일을 정교하게 다듬어 더욱 자연스러운 고해상도 이미지를 생성합니다.
FLUX.2 klein Base 9B를 기반으로 VAE 없이 Oklab 색 공간에서 이미지를 생성하는 AsymFLUX.2 klein 모델과 ComfyUI 확장 프로그램이 출시되었습니다. 기본 어댑터와 안정성을 높인 SFT 변형 모델 등 세 가지 버전을 제공합니다.
ComfyUI 워크플로우를 시각적으로 정리할 수 있는 'DENO Visual Fold' 기능이 추가되었습니다. 이 기능은 노드 구조를 변경하지 않고 선택한 노드들을 컴팩트한 그룹으로 접어 복잡한 캔버스를 깔끔하게 관리할 수 있게 돕습니다.
Anima 모델에서 여러 아티스트 태그를 혼합할 때 발생하는 스타일 불일치와 불안정성을 해결하기 위한 구체적인 프롬프트 엔지니어링 기법을 다룹니다. @ 기호 사용, 가중치 조절, 시프트(shift) 값 조정, 공백 관리 등 일관된 스타일 유지를 위한 실전 팁을 제공합니다.
ComfyUI 사용자가 이미지 생성 후 특정 부분만을 수정하기 위해 외부 편집 도구를 사용해야 하는 번거로움을 해결하기 위해 개발한 통합 노드입니다. Angelo는 샘플러, 인페인터, 리파이너 기능을 하나로 통합하여 ComfyUI 내에서 매끄러운 편집 워크플로우를 제공합니다. 현재 Klein 9B 모델에 최적화된 스마트 모드를 지원하며, 다른 편집 모델로의 확장 가능성을 열어두고 있습니다.
Klein 9B Distilled 모델에 두 개의 서로 다른 LoRA를 결합하여 극도의 실사감을 구현하는 방법을 소개합니다. 'Smartphone Snapshot Photo Reality'와 피부 및 신체 표현에 특화된 LoRA를 함께 사용함으로써, 기존 모델보다 뛰어난 품질의 실사 이미지를 생성할 수 있습니다.
Stability AI가 음악 및 음향 효과(SFX) 생성을 위한 새로운 텍스트-오디오 모델 제품군인 Stable Audio 3를 출시했습니다. 이번 출시에는 Hugging Face를 통해 공개된 세 가지 오픈 웨이트 모델과 추론 및 LoRA 미세 조정을 위한 GitHub 저장소가 포함됩니다.
Spectral Progressive Diffusion(SPEED) 기술을 ComfyUI에서 사용할 수 있도록 구현한 커스텀 노드를 소개합니다. SPEED는 낮은 해상도에서 시작해 점진적으로 해상도를 높여 디노이징 초기 단계의 연산 낭비를 줄임으로써 이미지 생성 속도를 크게 향상시킵니다.
LTX2.3 모델의 일관성과 품질을 높이고 아티팩트를 줄이기 위한 RL LoRA가 공개되었습니다. 고품질 결과물을 얻기 위해 업스케일러 이후 두 번째 샘플러로 LTX Tiled Sampler를 사용하는 것이 권장됩니다.
ComfyUI 사용자를 위해 NVIDIA RTX 기술을 활용한 2단계(2-Pass) 업스케일링 노드를 개발했습니다. DeBlur와 High Bitrate/VSR을 결합하여 AI 비디오의 선명도를 극대화하며, 저사양 VRAM 환경에서도 작동할 수 있는 배치 이미지 워크플로우를 지원합니다.
Kijai가 비디오와 오디오의 완벽한 동기화를 지원하는 LTX2.3 OmniNFT RL-LoRA를 공개했습니다. 이 모델은 사실적인 립싱크와 동작에 맞춘 사운드를 생성하며, 기존 대비 동기화 오류를 52% 감소시킨 것이 특징입니다.
캐릭터 생성 워크플로우 v1.3 업데이트를 통해 Anima 모델이 포함되었으며, 캐릭터의 전신 생성을 지원합니다. 프레임 가장자리 여백 지정 기능과 'anima-lllite-inpainting-v2'를 활용한 타일 업스케일러 개선이 주요 변경 사항입니다.
LTX Director를 활용하여 단순한 이미지 흔들림을 넘어, 여러 장의 이미지를 키 포즈로 사용하는 연출된 로컬 I2V(Image-to-Video) 워크플로우를 소개합니다. 동일한 캐릭터의 다양한 각도 이미지를 타임라인에 배치함으로써 카메라 움직임, 포즈 변화, 오디오 싱크가 포함된 역동적인 비디오 생성이 가능합니다.
LumiPic은 단일 SDR 이미지를 부동 소수점 값을 가진 HDR EXR 파일로 변환해주는 LoRA 모델입니다. 이 기술을 통해 이미지의 노출 및 채색 후보정 시 훨씬 넓은 색상 범위를 활용할 수 있으며, ComfyUI 워크플로를 함께 제공합니다.
ComfyUI 환경에서 LTX 2.3 모델을 활용하여 고급 비디오를 제작할 수 있는 LTX Director 사용법에 대한 튜토리얼입니다. 노드 설정 방법부터 주요 기능의 실전 활용 예시까지 단계별 가이드를 제공합니다.
Anima Base 1.0, Flux.2 Klein 9b, Wan 2.2 모델을 결합하여 이미지 생성 및 편집을 수행하는 워크플로우를 소개합니다. 제공된 링크를 통해 실제 작업 결과물을 확인할 수 있습니다.
본 문서는 Flux Klein, Qwen, Wan 모델을 사용하여 이미지를 프롬프트하는 최적의 방법을 안내합니다. 이 모델들은 계층적 구조를 이해하도록 학습되었으므로, 프롬프트를 섹션별로 나누고 각 개념을 개별 줄에 작성하는 것이 효과적입니다. 이렇게 하면 복잡한 이미지 구성 요소(개념, 피사체, 의상, 포즈 등)를 체계적으로 정의하고, 생성된 이미지를 위한 프롬프트 수정 및 편집이 용이해집니다.