Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.

Ideogram 4의 안전 필터가 픽셀 분석보다 프롬프트 내 특정 트리거 단어에 민감하게 반응한다는 점을 분석합니다. 의류 명칭을 직접 언급하는 대신 상황과 페르소나를 묘사하여 필터를 우회하는 프롬프트 워크플로우를 제안합니다.

단일 프롬프트로 일관된 애니메이션 초안을 생성하는 로컬 실행 가능한 멀티샷 파이프라인을 소개합니다. LLM 에이전트와 ComfyUI를 결합하여 사용자가 대화형으로 샷을 추가하거나 수정할 수 있는 오픈 소스 워크플로우를 제공합니다.
baidu NAVA는 현재 ComfyUI에서 네이티브 지원되지 않지만, GitHub에 FP8 추론을 지원하는 래퍼를 출시했습니다. 이 래퍼에는 모노 및 멀티 채널 음성 제어 등 바로 사용할 수 있는 워크플로우 템플릿이 포함되어 있습니다.

본 글은 8GB VRAM 환경에서 Ideogram GGUF 모델을 ComfyUI에 사용할 수 있도록 패치한 방법을 안내합니다. 사용자는 기존의 nvfp4 모델 대신 커스텀된 GGUF 노드를 사용하여 안정적으로 Ideogram 이미지를 생성할 수 있습니다.

사용자가 이미지의 레이아웃에서 영감을 받아 프롬프트를 구성할 수 있도록, 모든 이미지를 Ideogram용 JSON 프롬프트로 자동 변환하는 도구를 개발했습니다. 이 최소한의 도구는 드래그 앤 드롭만으로 바운딩 박스(bbox) 영역과 Ideogram 전용 JSON 프롬프트를 감지해줍니다.
캐릭터 LoRA 학습 시 과적합을 방지하고 유사도를 높이기 위해 Depth Map과 Weight Noising 기술을 결합하는 새로운 방법론을 소개합니다. 가중치에 가우시안 섭동을 주입하여 모델이 데이터의 일관된 특징만을 학습하도록 유도합니다.
Anima 모델을 활용하여 이미지를 편집하는 두 가지 기술적 방법론을 소개합니다. 인페인팅과 컨트롤넷을 활용한 포즈 변경 방식과 LoRA를 이용한 의상 및 표정 변경 방식의 장단점을 분석합니다.
저사양 VRAM GPU 환경에서 Microsoft Lens Turbo 모델을 테스트하기 위한 ComfyUI 워크플로우와 모델 정보를 공유합니다. 최신 성능을 위해 ComfyUI 업데이트가 권장됩니다.
LTX Director 커스텀 노드와 Transition LoRA를 결합하여 복잡한 장면 전환을 매끄럽게 구현하는 방법을 소개합니다. ComfyUI 환경에서 고품질의 영상 전환 효과를 만드는 워크플로우를 다룹니다.
Anima 모델을 위한 ComfyUI 커스텀 노드를 소개합니다. 기존 sd-forge-couple 방식보다 이미지 토큰 마스킹을 통해 더 정교한 경계를 제공하지만, 구도 불균형을 방지하기 위한 파라미터 조절이 필요합니다.
ComfyUI-Angelo 노드가 Qwen Edit 모델 지원을 시작했습니다. Flux Klein과 함께 편집 모드에서 활용 가능하며, 스마트 인페인트 및 리파인 모드 등 사용자 요청 기능이 업데이트되었습니다.
Anima 스타일 및 캐릭터 탐색을 위한 ComfyUI 노드와 LoRA 익스플로러가 업데이트되었습니다. Civitai API를 통해 직접 다운로드가 가능하며, 실시간 프롬프트 제어 기능을 제공합니다.
NVIDIA의 PiD(Pixel Diffusion Decoder) 방식을 지원하는 실험적인 ComfyUI 커스텀 노드를 소개합니다. 이 노드는 디코딩과 업스케일을 하나의 단계로 결합하여 고해상도 이미지를 생성하며, 다양한 백본 모델을 지원합니다.
Z-Image Turbo/Base 모델을 사용하여 사실적인 거울 셀카 이미지를 생성하기 위한 최적의 프롬프트 예시를 제공합니다. 피사체의 외양, 의상, 동작, 환경, 카메라 설정 및 조명 디테일을 포함한 구조화된 프롬프트 구성을 제안합니다.
ComfyUI-Flux2Klein-Enhancer의 최종 업데이트 버전이 공개되었습니다. 노드를 복잡하게 연결할 필요 없이 Multi ReferenceLatent와 Identity Feature Transfer Final 노드를 통해 다중 참조 이미지를 효율적으로 처리할 수 있습니다.
Microsoft Lens 모델이 ComfyUI에 네이티브로 지원될 예정입니다. JSON 프롬프트 형식을 활용하여 정교한 이미지 생성이 가능하며, 다양한 해상도와 종횡비를 지원합니다.
Untwisting RoPE 기술을 ComfyUI에 구현하여 별도의 학습 없이 스타일 전이가 가능하도록 지원합니다. 현재 Z-image Turbo 모델에 대한 구현이 완료되었으며, 향후 지원 모델 확장을 검토 중입니다.
Apple Silicon에서 LTX-Video 2.3 및 이미지 모델을 로컬로 실행할 수 있는 오픈 소스 AI 스위트 Phosphene 3.0을 공개합니다. MIT 라이선스로 제공되며, 구독료 없이 자신만의 캐릭터 LoRA를 학습시키고 비디오와 이미지를 생성할 수 있습니다.
Anima 모델에서 여러 아티스트 태그를 혼합할 때 발생하는 스타일 불일치와 불안정성을 해결하기 위한 구체적인 프롬프트 엔지니어링 기법을 다룹니다. @ 기호 사용, 가중치 조절, 시프트(shift) 값 조정, 공백 관리 등 일관된 스타일 유지를 위한 실전 팁을 제공합니다.
Spectral Progressive Diffusion(SPEED) 기술을 ComfyUI에서 사용할 수 있도록 구현한 커스텀 노드를 소개합니다. SPEED는 낮은 해상도에서 시작해 점진적으로 해상도를 높여 디노이징 초기 단계의 연산 낭비를 줄임으로써 이미지 생성 속도를 크게 향상시킵니다.