Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.

LLM의 공간 인지 능력과 기억력을 측정하기 위해 미로 탈출을 활용한 새로운 벤치마크를 제안합니다. 모델이 도구 호출을 통해 열쇠를 찾고 문을 여는 과정을 통해 공간적 추론과 도구 활용 능력을 평가합니다.
FLUX 3의 공개 가중치 버전 출시 예고와 이에 대한 커뮤니티의 엇갈린 반응을 다룹니다. 멀티모달 기반의 세계 모델로서의 성능 기대감과 함께, 실제 공개 방식 및 데이터 학습의 한계에 대한 비판적 시각이 공존합니다.
FLUX 3와 mimic을 결합하여 비디오 생성 모델의 세계 표상 능력을 로봇 제어에 활용하는 차세대 비디오-액션 모델을 소개합니다. 동영상 생성 모델의 규모 확장이 로봇 훈련의 새로운 경로가 될 수 있음을 시사합니다.
Black Forest Labs가 이미지, 비디오, 오디오를 통합 학습한 멀티모달 모델 FLUX 3를 출시했습니다. 이 모델은 동기화된 오디오가 포함된 20초 비디오 생성이 가능하며, 물리적 행동을 예측하는 FLUX-mimic 기능을 통해 로보틱스 분야로 확장성을 보여줍니다.
최첨단 코딩 LLM들을 대상으로 복잡한 셀룰러 오토마타(Cellular Automata) 시뮬레이션 생성 능력을 평가한 벤치마크 결과입니다. GPT Sol 5.6이 물리 법칙과 복잡한 상호작용을 완벽히 구현하며 압도적인 점수로 승리했습니다.

이미지 생성 모델의 공간 인지 능력을 평가하기 위한 새로운 벤치마크를 소개합니다. 이 방식은 텍스트 대신 픽셀로 답변하게 하여 모델의 공간 이해도를 측정하며, GPT Image 2가 기존 모델보다 뛰어난 성능을 보임을 입증합니다.

Anthropic이 새로운 모델인 Claude Opus 5를 출시했습니다. 이 모델은 최고 지능을 지향하기보다 비용 효율성과 작업 완수 능력에 초점을 맞추어, 이전 모델 대비 다양한 산업 분야에서 성능 향상을 보였습니다.

Anthropic이 새로운 모델인 Claude Opus 5를 출시했습니다. 이 모델은 이전 모델 대비 비용 효율성을 극대화하면서도 코딩 및 지식 작업 벤치마크에서 SOTA 성능을 달성했습니다.
안전 필터에 과도하게 집중할 경우 모델이 유해하지는 않지만 사실과 다르거나 무관한 응답을 생성하는 '정중한 환각' 문제가 발생할 수 있습니다. 안전성과 응답의 유용성 사이의 균형을 맞추기 위한 총체적인 접근 방식이 필요합니다.
120B 규모의 새로운 모델인 Laguna S 2.1이 복잡한 메모리 제약 조건이 있는 알고리즘 문제를 해결하는 과정을 다룹니다. 긴 사고 과정(thinking tokens)을 통해 기존 Qwen 모델이 실패한 고난도 코딩 문제를 성공적으로 해결했음을 보여줍니다.
Moonshot AI가 2.8조 개의 파라미터를 가진 오픈 웨이트 모델인 Kimi K3를 출시했습니다. MXFP4 양자화 기술을 적용하여 효율성을 높였으며, 오픈 소스 AI 생태계의 경쟁 구도에 큰 변화를 예고하고 있습니다.

Anthropic의 Claude Opus 5 출시가 단순한 성능 향상을 넘어 업계의 패러다임을 바꾸고 있습니다. Opus 5는 압도적인 에이전트적 능력과 효율적인 가격 정책을 통해 범용 지능의 실질적인 상용화를 이끌 것으로 전망됩니다.

Wang Hong이 100년 동안 미해결 과제였던 3차원 Kakeya 추측 문제를 해결했습니다. 조화 해석학을 바탕으로 독창적인 입자 분석 모델을 창안하여 3차원 공간에서의 최소 부피가 무한히 작아질 수 없음을 증명했습니다.

Transformers 모델이 실제 환경에서 복잡한 멀티홉 추론(Multi-Hop Reasoning)을 수행할 수 있도록 돕는 데이터 구축 방법론을 다룹니다. 야생(In-the-wild) 환경의 데이터를 활용하여 모델의 추론 능력을 강화하는 방안을 제시합니다.
Anthropic의 Claude Opus 5 출시, Flux 3 X Mimic의 멀티모달 비디오-액션 모델 발표, 그리고 LangChain4j를 활용한 자가 구축 에이전트 기술을 다룹니다. 최신 LLM의 추론 능력 향상과 비디오 이해 기술의 진보를 핵심으로 합니다.


2026년 7월, Thinking Machines Lab의 Inkling과 Moonshot AI의 2.8조 파라미터급 Kimi K3가 연달아 공개되며 오픈 웨이트 모델의 급격한 성장을 보여줍니다. 오픈 웨이트 모델이 프론티어 모델과의 격차를 좁히며 실질적인 경쟁력을 갖추게 된 현황을 분석합니다.

Thinking Machines가 출시한 Inkling은 외부 인코더 없이 텍스트, 이미지, 오디오를 직접 처리하는 최초의 open-weight 멀티모달 모델입니다. 9750억 개의 파라미터를 보유하며, 오디오를 네이티브하게 이해하는 encoder-free early fusion 아키텍처를 채택했습니다.

MiniCPM4는 엔드 디바이스 환경에 최적화된 초효율적인 소형 언어 모델(SLM)입니다. 제한된 자원을 가진 기기에서도 높은 성능을 발휘하도록 설계되었습니다.
Anthropic의 Claude Opus 5 출시와 Meta의 Llama 4 공개, OpenAI의 ChatGPT Health 서비스 시작 등 주요 AI 모델 및 서비스 업데이트를 다룹니다. 모델의 성능 향상뿐만 아니라 비용 효율성, 라이선스 변화, 의료 분야 적용 및 법적 리스크 등 산업 전반의 변화를 요약합니다.
Moonshot AI가 2.8조 파라미터 규모의 Kimi K3 가중치를 2026년 7월 27일까지 공개하기로 했습니다. 또한 DeepSeek의 구형 API 폐지 소식과 V4 정식 버전 출시 현황을 정리했습니다.