Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
대부분의 AI 월드 모델은 일관성 유지에 어려움을 겪으며, Robbyant의 LingBot-World-Infinity가 이를 개선한 사례를 제시합니다. 이 논문은 예측 오류 누적(autoregressive drift)을 줄이는 데 초점을 맞추었으며, 60분간의 스트레스 테스트에서도 품질 저하 없이 일관성을 유지했습니다.

LingBot-Vision은 마스크 경계 모델링과 자기 지도 ViT 백본을 활용하여 밀집 공간 인식을 수행하는 모델입니다. 이 모델은 깊이, 분할, 그리고 체화된 작업 등 다양한 분야에서 강력한 성능을 보여주었습니다.
claude-real-video는 Claude가 비디오를 실제로 '시청'할 수 있도록 하는 기능을 제공합니다. 이 기능은 장면 변화 감지를 이용한 프레임 추출, 중복 제거, 오디오 전사 등을 수행하며 로컬에서 실행 가능하고 MIT 라이선스를 따릅니다.
이 글은 역사학자 Eric H. Cline의 연구를 바탕으로 기원전 1177년 청동기 시대 붕괴의 원인과 과정을 분석합니다. 주요 논점은 단일 원인이 아닌 가뭄, 전쟁, 무역 차질 등이 복합적으로 작용한 '체제 붕괴'였다는 것입니다. 특히 장기간의 건조한 기후가 농업 생산에 큰 타격을 주었음을 강조하며, 고대 문명의 취약성을 설명합니다.
최근 오픈 웨이트 모델 시장이 급변하고 있으며, 2026년 4월 이후 네 개의 플래그십 모델이 연달아 출시되며 '최고의 오픈 웨이트 모델' 타이틀을 여러 번 바꿨습니다. DeepSeek V4 Pro, Kimi K2.6/K2.7, MiniMax M3 등 주요 모델들이 순차적으로 등장하며 각기 다른 강점(코딩, 컨텍스트 길이, 멀티모달리티)을 보여주고 있습니다.

Qwen3.6 35B-A3B 모델을 활용하여 단일 프롬프트로 계획 수립 및 구현 과정을 시도한 내용입니다. 특히, Q4_K_M (GPU)에서 Q8_0 (CPU)으로 양자화 방식을 변경하는 과정에서 성능 향상을 체감하며, 속도 저하를 감수할 만한 가치가 있음을 강조합니다.
OpenAI의 AGI 배포 최고책임자 Fidji Simo가 건강 문제로 인해 전일제 역할에서 물러나 파트타임 자문직으로 전환한다고 발표했습니다. 그는 자율신경계 장애인 POTS 진단을 받았으며, 현재는 회복에 집중할 계획입니다.

MiniCPM-V는 1.3B 파라미터 규모임에도 불구하고, Gemma4-E2B-it을 능가하는 성능과 Qwen3.5-0.8B보다 빠른 추론 속도를 보여주었습니다. 이는 내부 ViT(intra-ViT) 초기 압축 기술 덕분에 시각 인코딩 비용을 절반으로 줄였기 가능했습니다.
카메라 영상의 흐름으로부터 3D 공간을 재구성하는 AI 모델 'lingbot-map'이 GitHub에서 큰 주목을 받고 있습니다. 이 모델은 스트리밍 데이터 기반으로 3D 장면을 재구성하며, 긴 비디오에서도 오차(drift)를 줄이는 기능을 제공합니다. 또한, Claude Code와 연동하여 비디오 편집 작업을 지원하는 OSS도 개발되어 활용도가 높아지고 있습니다.

MANCE는 데이터 다양체(data manifold)에 제약을 가하여 모델 표현에서 특정 개념을 제거하는 최첨단 방법론입니다. 이 접근 방식은 정보 손실 없이 원하는 개념만 선택적으로 지우면서 다른 정보를 보존할 수 있게 합니다.
본 글은 AI Agent의 발전 방향으로 '가문 거버넌스 모델(FROST)'을 제시하며, 단순한 체인이나 팀 구성을 넘어선 자율적이고 계승 가능한 지식 구조를 제안합니다. 이는 AI 에이전트가 스스로 기억하고 다음 세대에 전달하는 방식으로 진화해야 함을 강조합니다.
최신 LLM들은 깊은 추론 능력과 암기력을 갖추었으나, 프롬프트의 안내나 인간의 개입 없이는 스스로 탐색 범위를 넓히지 못하는 경향을 보입니다. 따라서 모델이 최적의 결과를 내기 위해서는 '단계별 사고'와 같은 메타휴리스틱한 안내가 필수적이며, 이는 AI 에이전트 설계에 중요한 시사점을 제공합니다.
Microsoft가 AI 기반 에이전트형 시스템 MDASH를 도입하여 Windows 바이너리 취약점 발견 프로세스를 가속화했습니다. 이 시스템은 자율 스캔과 다중 AI 모델 검증을 통해 패치 주기를 압축시키고, 방어자와 공격자 양측 모두에게 영향을 미칠 것으로 분석됩니다.
Apple이 OpenAI를 상대로 전 직원 영업비밀 절도 혐의로 고소할 가능성이 제기되었습니다. 본문은 퇴사자가 Apple 기밀 정보를 취득하고 이를 새 회사에 활용하는 행위가 심각한 문제임을 지적하며, 특히 경업금지 조항보다 더 근본적인 윤리 및 법적 문제를 다루고 있습니다.

DataBricks의 분석에 따르면 pi-coding-agent가 기존 Codex 모델 대비 성능과 비용 면에서 우위를 보입니다. 또한, GLM 5.2 모델은 GPT 5.5 high 및 xhigh보다 높은 수준이며 Opus 4.8 high와 유사한 성능을 나타냈습니다.

UniClawBench는 능동적인 에이전트의 실세계 작업 수행 능력을 평가하는 역량 기반 벤치마크입니다. 이 벤치마크는 Skill Usage, Exploration, Long-Context Reasoning 등 5가지 핵심 기술 전반에 걸쳐 에이전트의 성능을 측정합니다.

본 논문은 후처리 소수 단계 자동회귀 비디오 생성기(Post-Training Few-Step Autoregressive Video Generators)를 위한 온정책 자체 증류 기법을 제안합니다. OPSD-V는 모델의 성능 향상을 위해 효율적인 학습 전략을 제시하며, 특히 비디오 생성 분야의 발전에 기여할 것으로 기대됩니다.

Grok 4.5 모델이 이제 무료 티어 사용자도 체험할 수 있도록 공개되었습니다. 모든 X 또는 Grok 계정에서 Grok Build를 통해 해당 기능을 사용해 볼 수 있습니다.

Open Knowledge Format (OKF)는 LLM-wiki 패턴을 휴대 가능하고 상호 운용 가능한 오픈 명세로 공식화한 것입니다. 이를 통해 지식 기반 콘텐츠를 표준화된 형식으로 관리할 수 있게 되어, 모델 학습 및 활용의 효율성을 높일 것으로 기대됩니다.
Grok 4.5가 Perplexity Computer 평가(evals)에서 모든 최첨단 모델 중 가장 높은 점수를 기록하며 뛰어난 성능을 입증했습니다. 이는 경쟁력 있는 비용으로 달성된 성과로 주목받고 있습니다.