Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Anthropic이 판단력과 정직성이 향상된 Claude Opus 4.8을 발표했습니다. 이 모델은 Claude Code에서 동적 워크플로와 수백 개의 병렬 서브 에이전트 실행 능력을 제공하며, Fast Mode를 통해 속도와 비용 효율성을 높였습니다.
NVIDIA가 최소한의 연산으로 고해상도 이미지와 비디오를 생성할 수 있는 오픈 소스 AI 모델인 SANA를 공개했습니다. 로컬 환경에서도 실행 가능한 가벼운 설계가 특징입니다.
Hao AI Lab이 LTX-2 모델 기반의 FastVideo Dreamverse를 오픈 소스로 공개했습니다. NVIDIA B200 GPU 한 장으로 1080p 30초 영상을 7초 만에 생성하는 실시간 비디오 생성 기술을 선보였습니다.

MOSS-Audio는 ASR, 화자 분리, 감정 인식 등 6가지 오디오 처리 능력을 단일 모델에 통합한 혁신적인 오픈 소스 모델입니다. 4B 및 8B 크기로 제공되며, 특히 타임스탬프 기반 ASR 성능은 Gemini 2.5 Pro를 압도하는 수준입니다.

AutoResearch AI 논문은 AI가 단순 보조를 넘어 연구 전체 워크플로에 참여하는 '워크플로 중심 AI'로의 전환을 다룹니다. 연구 과정의 전 단계에 참여하며 검증 가능하고 재현 가능한 폐쇄 루프(Closed-loop) 시스템 구축의 중요성을 강조합니다.

독일 연구진이 생쥐의 뇌 조직을 -196°C에서 일주일간 냉동한 후 성공적으로 회복시키는 데 성공했습니다. 이 과정에서 뉴런의 전기 신호 전달과 시냅스 기억이 유지됨을 확인하여 신경 세포 저온 보존의 가능성을 입증했습니다.

GPT-SoVITS는 소량의 샘플만으로도 감정과 호흡까지 완벽하게 복제하는 오픈 소스 음성 클로닝 도구입니다. 제로샷 TTS 기능과 1분 미세 조정을 통해 CosyVoice를 능가하는 고품질 음성 합성을 제공합니다.
NVIDIA가 발표한 Lyra 2.0은 단일 정적 이미지로부터 탐험 가능한 3D 세계를 생성하는 기술입니다. 기존 AI 생성 비디오의 고질적 문제인 시간적 드리프팅(Temporal drifting)을 해결하여 견고한 3D 기하 구조를 유지합니다.

dealignai가 Qwen3.6-27B 및 35B 모델의 MXFP4 및 MXFP8 버전을 Hugging Face에 공개했습니다. MTP(Multi-Token Prediction) 기술을 적용하여 모델 최적화를 달성했습니다.

Google DeepMind가 LLM 기반 에이전트와 Lean 형식 증명 시스템을 결합하여 9개의 미해결 Erdős 문제를 자율적으로 해결했습니다. 이 시스템은 수천 개의 접근 방식을 생성하고 검증하여 실제 연구 수준의 수학적 난제를 해결하는 데 성공했습니다.
dealignai가 Qwen3.6-27B 및 35B 모델을 MXFP4 및 MXFP8 형식으로 최적화하여 Hugging Face에 공개했습니다. MTP(Multi-Token Prediction) 기술을 적용하여 속도 향상과 효율적인 양자화를 구현했습니다.
AI2가 Hugging Face를 통해 양손 펙보드 조작 성능을 측정할 수 있는 새로운 벤치마크를 공개했습니다. LeRobot을 기반으로 제작되었으며, 다양한 카메라 각도와 14-DOF 암을 활용한 정밀한 조작 테스트를 지원합니다.
이번 주 Qwen3.7 시리즈(max, 27b, 35b), Minimax M3.0, Gemini 3.5 Pro/Flash, GPT-5.6, Sonnet-4.8, Kimi/GLM 등 다양한 최신 대규모 언어 모델(LLM)의 출시가 예정되어 있습니다.
과거 대규모 클러스터가 필요했던 이미지 생성 기술이 최적화 기술을 통해 16GB 노트북에서도 고해상도 구현이 가능해졌습니다. 선형 주의 메커니즘과 은닉 압축 기술을 활용하여 연산 효율을 극대화한 것이 특징입니다.
KISS 논문은 AI 에이전트가 실제 기후 과학 모델을 직접 실행할 수 있음을 입증했습니다. 이 에이전트들은 홍수 및 작물 부족 예측 모델을 활용하여 84%의 높은 성공률을 기록했습니다.
카라치의 한 개발자가 단 하나의 Jupyter notebook을 사용하여 GPT-4를 재현하는 데 성공했습니다. OpenAI가 막대한 비용을 들여 개발한 모델의 레시피를 GitHub에 무료로 공개하며 주목받고 있습니다.
LLM(Large Language Model)을 처음부터 직접 학습시킬 수 있는 방법을 안내하는 GitHub 저장소입니다. 초보자도 이해할 수 있도록 LLM 학습 과정을 단순화하여 설명합니다.
노트북 GPU 환경에서도 4K 고해상도 이미지를 생성할 수 있는 새로운 기술이 소개되었습니다. 이 기술은 기존 Flux 모델 대비 크기는 20배 작고 생성 속도는 100배 더 빠른 성능을 보여줍니다.
NVIDIA가 단일 이미지와 카메라 경로를 사용하여 1분 길이의 720p 고품질 비디오를 생성할 수 있는 새로운 모델 SANA를 발표했습니다. 이 모델은 RTX 5090과 같은 하드웨어에서 매우 빠른 속도로 작동하며, 매끄럽고 제어 가능한 비디오 생성을 지원합니다.
ByteDance가 30억 개의 활성 파라미터만을 사용하는 오픈 소스 모델인 Lance를 출시했습니다. 이 모델은 텍스트, 이미지, 비디오를 처리할 수 있을 뿐만 아니라 세 가지 모달리티를 동시에 생성할 수 있는 뛰어난 성능을 보여줍니다.