Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.

YouTube가 플랫폼 내 AI 생성 콘텐츠를 식별하기 위한 새로운 내부 시스템을 도입합니다. 제작자가 AI 사용 사실을 밝히지 않더라도, 시스템이 실사 같은 AI 콘텐츠를 감지하면 자동으로 라벨을 부착할 예정입니다.

MOSS-Audio는 ASR, 화자 분리, 감정 인식 등 6가지 오디오 처리 능력을 단일 모델에 통합한 혁신적인 오픈 소스 모델입니다. 4B 및 8B 크기로 제공되며, 특히 타임스탬프 기반 ASR 성능은 Gemini 2.5 Pro를 압도하는 수준입니다.

OpenAI가 Codex를 위한 'Skills Catalog(기술 카탈로그)'를 공식 출시했습니다. 이 시스템을 통해 AI는 매번 별도의 설명 없이도 미리 정의된 작업을 단 한 번의 단계로 수행할 수 있습니다.

OpenAI가 Codex를 위한 'Skills Catalog(기술 카탈로그)'를 공식 출시했습니다. 이 시스템을 통해 AI는 사용자의 반복적인 설명 없이도 미리 정의된 작업을 단 한 번의 단계로 수행할 수 있습니다.

상용 소프트웨어 시장을 대체할 수 있는 강력한 기능을 가진 10가지 오픈 소스 GitHub 저장소를 소개합니다. 비디오 다운로드, 로컬 AI 실행, 이미지 생성, 자동화 등 다양한 분야에서 유료 서비스의 대안이 될 수 있는 도구들을 다룹니다.

AutoResearch AI 논문은 AI가 단순 보조를 넘어 연구 전체 워크플로에 참여하는 '워크플로 중심 AI'로의 전환을 다룹니다. 연구 과정의 전 단계에 참여하며 검증 가능하고 재현 가능한 폐쇄 루프(Closed-loop) 시스템 구축의 중요성을 강조합니다.

중국 개발자가 개발한 MoneyPrinterTurbo는 키워드 입력만으로 시나리오 작성부터 영상 편집까지 자동화하는 무료 오픈소스 도구입니다. Claude, GPT 등 다양한 LLM과 연동하여 숏폼 영상을 대량 제작할 수 있는 기능을 제공합니다.

독일 연구진이 생쥐의 뇌 조직을 -196°C에서 일주일간 냉동한 후 성공적으로 회복시키는 데 성공했습니다. 이 과정에서 뉴런의 전기 신호 전달과 시냅스 기억이 유지됨을 확인하여 신경 세포 저온 보존의 가능성을 입증했습니다.

GPT-SoVITS는 소량의 샘플만으로도 감정과 호흡까지 완벽하게 복제하는 오픈 소스 음성 클로닝 도구입니다. 제로샷 TTS 기능과 1분 미세 조정을 통해 CosyVoice를 능가하는 고품질 음성 합성을 제공합니다.

아이디어 입력만으로 이미지, 음성, 자막이 포함된 비디오를 자동 생성하는 오픈 소스 시스템을 소개합니다. DeepSeek 및 Moonshot을 활용한 시나리오 생성과 다양한 포맷 지원이 특징입니다.
Google AI Studio가 단일 프롬프트만으로 작동 가능한 네이티브 Android 애플리케이션을 생성하는 기능을 출시했습니다. AI가 Kotlin과 Jetpack Compose를 사용하여 앱을 코딩하고 기기에 직접 설치할 수 있어 모바일 개발 방식의 혁신을 예고합니다.
OpenAI가 보안 특화 플랫폼인 Daybreak를 공식 발표했습니다. Frontier AI 모델과 Codex를 결합하여 코드 작성 중 취약점을 탐지하고 보안 프로세스를 자동화하는 것을 목표로 합니다.

중국 개발자가 GitHub에서 13,000개 이상의 스타를 기록 중인 무료 영상 제작 도구 MoneyPrinterTurbo를 공개했습니다. 주제 입력만으로 시나리오 작성부터 영상 편집, 자막 및 음성 추가까지 자동화하여 숏폼 비디오를 생성합니다.
NVIDIA가 발표한 Lyra 2.0은 단일 정적 이미지로부터 탐험 가능한 3D 세계를 생성하는 기술입니다. 기존 AI 생성 비디오의 고질적 문제인 시간적 드리프팅(Temporal drifting)을 해결하여 견고한 3D 기하 구조를 유지합니다.

NVIDIA가 AI 에이전트의 성능을 극대화하기 위한 다양한 'Skills'를 공식 발표했습니다. 비디오 분석, 실시간 음성 생성, RAG 시스템 구축 및 모델 가속화 등 에이전트 개발에 필요한 핵심 기술들을 포함합니다.

Reddit 게시물을 활용하여 YouTube 쇼츠 영상을 자동으로 대량 생산하는 Python 기반의 오픈 소스 워크플로우를 소개합니다. 스크린샷 캡처, AI 내레이션, 배경 영상 합성 과정을 자동화하여 퀴즈 형태의 영상을 제작할 수 있습니다.

Gemini를 활용하여 사진이나 주소를 기반으로 개인화된 픽셀 아트 JRPG 세계를 생성하는 기술을 소개합니다. 지도 제작부터 동적인 NPC 행동 관리까지 AI가 게임 개발의 핵심 요소를 지원합니다.

Marshall Richards가 Termux를 통해 저가형 Android 스마트폰에서도 Antigravity CLI를 실행할 수 있는 설치 스크립트를 공개했습니다. 이를 통해 모바일 기기에서도 AI 에이전트를 관리할 수 있는 새로운 가능성이 열렸습니다.

dealignai가 Qwen3.6-27B 및 35B 모델의 MXFP4 및 MXFP8 버전을 Hugging Face에 공개했습니다. MTP(Multi-Token Prediction) 기술을 적용하여 모델 최적화를 달성했습니다.

Google DeepMind가 LLM 기반 에이전트와 Lean 형식 증명 시스템을 결합하여 9개의 미해결 Erdős 문제를 자율적으로 해결했습니다. 이 시스템은 수천 개의 접근 방식을 생성하고 검증하여 실제 연구 수준의 수학적 난제를 해결하는 데 성공했습니다.