Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.

Anthropic의 Claude Fable 5 서비스 재개 소식과 함께 Notion의 HTML 임베드 기능, xAI의 노코드 음성 에이전트 베타 출시 등 주요 AI 기술 업데이트를 다룹니다. 또한 NVIDIA의 오픈 웨이트 확산형 언어 모델 공개와 Cloudflare의 AI 크롤러 차단 방침 등 산업 전반의 움직임을 요약합니다.

Anthropic이 Opus를 상회하는 최상위 티어 모델인 Claude Fable 5를 공개했습니다. 이 모델은 높은 코딩 성능과 자율 에이전트 활용에 최적화되어 있으며, 사고(Thinking) 프로세스가 상시 활성화된 것이 특징입니다.
기존의 단기 코딩 벤치마크와 달리 장시간 수행되는 작업을 측정하는 SWE-Marathon 벤치마크를 소개합니다. 모델들이 짧은 작업에서는 높은 성능을 보이지만, 단계가 길어질수록 자기 검증 실패와 오류 누적으로 인해 성능 격차가 기하급수적으로 벌어짐을 분석합니다.
Ising 머신 기반의 열역학적 컴퓨팅 장치를 표준 역전파 방식으로 학습시켜 높은 이미지 인식 정확도를 달성한 연구 결과입니다. 열 잡음을 이용한 계산 방식이 에지 장치에서 저전력·저비용으로 작동할 수 있음을 수학적 모델로 증명했습니다.
Mixture of Experts(MoE) 모델의 핵심인 게이팅 네트워크의 역할과 라우팅 이슈를 다룹니다. 라우터의 잘못된 배정이 초래하는 성능 저하 문제를 설명하고, 이를 학습할 수 있는 인터랙티브 시뮬레이터를 소개합니다.
LLM의 정확도를 높이기 위해 흔히 사용되는 다수결 투표(Majority voting) 방식이 특정 추론 문제에서는 오히려 성능을 저하시킬 수 있음을 분석합니다. 다수결은 상관관계가 있는 오류를 수정하지 못하고 희귀한 정답을 오답으로 취급하는 한계가 있어, 검증(Verification) 방식이 더 효과적임을 제안합니다.
SciLens는 과학적 주장을 원자(Atoms) 단위로 분해하여 표와 그래프를 통해 검증하는 멀티모달 프레임워크입니다. SciClaimEval 벤치마크에서 79.2%의 macro-F1을 기록하며 과학적 주장 자동 검증 분야에서 우수한 성능을 입증했습니다.

NeoVerse는 야생의 단안 비디오를 활용하여 4D 월드 모델을 구축하는 연구를 다룹니다. 비디오 데이터를 통해 3차원 공간과 시간적 변화를 학습하는 새로운 접근 방식을 제시합니다.
양상 논리(Modal Logic)를 활용하여 신경망의 수치적 변환을 의미론적 구조 관점에서 해석하는 수학적 프레임워크를 제안합니다. 신경망이 층을 거치며 어떻게 의미론적 불변량을 보존하고 표현을 정교화하는지 탐구합니다.
범용 프론티어 AI 모델이 의료 전문 툴보다 우수하다는 논문의 방법론적 결함을 분석합니다. 채점자 간 낮은 일치도, 이해상충 의혹, 데이터 오염 및 통계적 오류 등 연구의 신뢰성을 저해하는 핵심 문제점들을 다룹니다.
Meta의 SAM 2는 이미지와 비디오 모두에서 프롬프트 기반 시각적 분할을 수행하는 파운데이션 모델입니다. 스트리밍 메모리를 갖춘 트랜스포머 아키텍처를 통해 실시간 비디오 처리가 가능하며, 대규모 SA-V 데이터셋을 통해 학습되었습니다.
Anthropic의 Claude Sonnet 5 출시와 관련하여 Opus 4.8 대비 비용 효율성을 수학적으로 분석합니다. Sonnet 5는 코딩 에이전트의 기본 모델로 적합하며, 도입 기간 동안 Opus 대비 60%의 비용 절감 효과를 제공합니다.
AI가 생성하는 수학적 증명과 논문의 속도가 급증하며 학계의 검증 시스템이 과부하되는 '증명 소화불량' 현상을 분석합니다. 타오쩌쉬안은 기존 학술 인프라를 개혁하여 AI와 인간의 연구 경로를 분리하는 계층적 인프라 구축의 필요성을 강조합니다.

TRELLIS 2를 활용하여 단일 이미지로부터 PBR 재질이 포함된 고품질 3D 메쉬를 생성하는 기술을 소개합니다. 이미지 한 장만으로 물리 기반 렌더링이 가능한 3D 모델을 구축할 수 있습니다.

MIT가 머신러닝 기초부터 심화 기술, 강화학습, 윤리까지 아우르는 고품질의 무료 AI 커리큘럼을 공개했습니다. 연구자들이 직접 집필한 12권의 핵심 도서를 통해 체계적인 학습이 가능합니다.

메타 퍼저 autofz의 제어 평면(control-plane) 프레임워크를 통해 LLM 에이전트 시스템의 오케스트레이션 문제를 고찰합니다. 불완전한 작업자들 사이에서 예산을 효율적으로 배분하고 최적의 작업을 선택하는 제어 평면의 중요성을 강조합니다.
ByteDance가 출시한 Seed Audio 1.0은 텍스트, 이미지, 오디오를 입력받아 대화, 배경음악, 효과음이 포함된 완전한 사운드 장면을 생성하는 차세대 멀티모달 AI 모델입니다. 단순 TTS를 넘어 감정 표현과 다중 캐릭터 대화까지 지원하여 오디오 제작의 패러다임을 바꿉니다.
LongCat-2.0은 1.6조 개의 파라미터를 보유한 대규모 MoE 언어 모델로, 100만 토큰의 롱 컨텍스트 처리에 최적화되어 있습니다. LongCat Sparse Attention 메커니즘을 통해 긴 문서 요약, 복잡한 에이전트 추론, 코드 생성 작업에서 강력한 성능을 발휘합니다.
HydraHead는 헤드 단위로 풀 어텐션과 선형 어텐션을 결합하여 Transformer의 연산량을 대폭 절감하는 연구입니다. 레이어 단위의 기존 하이브리드 방식과 달리, 헤드 수준의 선택적 병합을 통해 성능 저하를 최소화하면서도 효율성을 극대화했습니다.

구글이 유료 구독자 전용이었던 제미나이 개인화 이미지 생성을 미국 무료 사용자 전체에게 무료로 개방했습니다. 이 기능은 사용자의 지메일, 구글 포토 등 개인 데이터 접근 동의(opt-in)를 조건으로 하며, 이는 AI 경쟁에서 핵심 자산인 방대한 개인 데이터 확보 전략으로 해석됩니다.