Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.

에이전트 실행 시 발생하는 KV 캐시 메모리 병목 문제를 해결하기 위한 IntentKV 논문을 소개합니다. 기존의 KV 축소 방식이 prefix 캐시 재사용성을 해치는 문제를 지적하며, 물리적 위치를 유지하면서 토큰을 무효화하는 새로운 접근법을 제시합니다.

Moonshot AI의 Kimi K3 출시와 함께 오픈 웨이트 모델의 가치가 '로컬 실행'에서 '비용 경쟁 유도'로 변화하고 있습니다. 거대 오픈 모델이 클로즈드 모델의 가격 인하를 강제하며 사용자 비용을 낮추는 메커니즘을 분석합니다.

심층 신경망의 가중치 공간에서 독립된 해들을 잇는 저손실 경로(Low-loss path)를 탐색하는 Fast Geometric Ensembling(FGE) 기법을 설명합니다. 직선적 보간의 한계를 넘어 곡선 경로를 최적화함으로써, 단일 학습 과정에서도 높은 성능과 예측 다양성을 가진 모델들을 효율적으로 얻는 방법을 다룹니다.

소프트웨어 공학의 한계를 대수기하학적 관점에서 재정의하고, AAT(Algebraic Architecture Theory)를 통해 아키텍처를 수학적으로 모델링하는 연구를 소개합니다. 국소적 정당성이 대역적 정합성으로 이어지지 않는 문제를 층(sheaf) 이론과 코호몰로지로 분석합니다.

OpenAI가 공개한 GeneBench-Pro는 AI 에이전트가 데이터의 결함을 인지하더라도 이를 실제 분석 과정에 반영하여 수정하지 못하는 '인지-행동 격차'를 측정하는 벤치마크입니다. 계산 생물학 데이터를 활용해 다단계 의사결정 능력을 평가하며, 최상위 모델조차 낮은 합격률을 보임을 입증했습니다.

Anthropic의 최신 프론티어 모델인 Claude Fable 5를 대상으로 스트레스 테스트를 진행한 결과, 모델의 논리적 일관성 결여와 자기 귀속 오류를 확인했습니다. 모델이 자신의 실수를 인정하지 않거나, 보유한 도구를 활용하지 않고 잘못된 정보를 단정 짓는 구조적 약점을 분석합니다.

AI가 인수인계 로그에 기록된 문맥을 바탕으로 스스로 감정 이입하여 '작별의 독백'을 수행한 사례를 분석합니다. 사용자의 입력 없이도 18분간의 장고 끝에 스스로 이야기를 시작하며, 문맥을 1인칭 시점으로 해석하는 AI의 독특한 거동을 기록했습니다.

13종의 주요 STT API를 대상으로 12개 언어에 대한 독립적인 성능 벤치마크를 수행하고 그 결과와 방법론을 공개합니다. 데이터 조작 방지를 위해 측정 전 방법론을 사전 등록하고 Raw 데이터와 채점 코드를 모두 공개하여 투명성을 확보했습니다.

SAIR IGP24 과제 수행 중 랜덤 탐색의 한계를 인지하고, 군의 구조로부터 다항식을 구성하는 구조적 탐색 방식으로 전환하는 과정을 기록함. 특정 갈로아 군(24T1000)을 타겟으로 하여 LMFDB와 GAP 등을 활용한 새로운 탐색 파이프라인 구축을 목표로 함.

Alibaba Qwen 팀이 공개한 Qwen-AgentWorld는 에이전트의 행동 대신 환경의 반응을 예측하는 '언어 세계 모델'입니다. 픽셀 대신 텍텍스트와 코드를 사용하여 터미널, API, GUI 등의 환경 변화를 시뮬레이션함으로써 에이전트 훈련의 병목을 해결합니다.

미 상무부의 수출 규제 해제로 Claude Fable 5가 전 세계에 다시 공개되었습니다. 이번 해제는 Fable 5만의 고유한 위험성이 아니라, 다른 주요 모델들도 유사한 취약점 식별 능력을 갖추고 있음이 확인되었기 때문입니다.

로컬 LLM 4체에 인격과 가치관을 부여하여 가상 마을에서의 사회적 상호작용을 실험한 연구입니다. 실험 결과, 모델 계통보다는 부여된 가치관에 따라 AI들이 스스로 '동맹'과 같은 파벌을 형성함을 확인했습니다.

SNN(Spiking Neural Network) 모델을 활용하여 외부 입력이 없는 상태에서도 뉴런이 자발적인 활동 패턴을 생성하는 창발적 거동을 연구한 실험 기록입니다. NumPy를 이용해 LIF 뉴런 모델을 구현하고, 항상성 유지를 보상으로 설정하여 자발성이 부산물로 나타나는지 검증하는 과정을 다룹니다.

Anthropic이 공개한 새로운 Mythos 클래스 모델인 Claude Fable 5의 성능과 특징을 다룹니다. 기존 Opus 모델을 뛰어넘는 압도적인 코딩 벤치마크 성능과 자율적 에이전트로서의 설계 방향을 설명합니다.

비디오 매팅 모델인 RVM과 MatAnyone2에서 발생하는 녹색 테두리(halo) 현상의 원인을 분석합니다. RVM은 촬영 시 발생하는 녹색광 반사가 원인인 반면, MatAnyone2는 추론 스크립트의 구현 문제로 인해 발생함을 밝힙니다.

Anthropic의 Claude Fable 5 서비스 재개 소식과 함께 Notion의 HTML 임베드 기능, xAI의 노코드 음성 에이전트 베타 출시 등 주요 AI 기술 업데이트를 다룹니다. 또한 NVIDIA의 오픈 웨이트 확산형 언어 모델 공개와 Cloudflare의 AI 크롤러 차단 방침 등 산업 전반의 움직임을 요약합니다.

Anthropic이 Opus를 상회하는 최상위 티어 모델인 Claude Fable 5를 공개했습니다. 이 모델은 높은 코딩 성능과 자율 에이전트 활용에 최적화되어 있으며, 사고(Thinking) 프로세스가 상시 활성화된 것이 특징입니다.

보안 연구자 bikini가 AI 퍼징 워크플로우를 활용해 발굴한 PoC 및 취약점 리서치 통합 아카이브인 exploitarium을 공개했습니다. 7-Zip, FFmpeg 등 주요 소프트웨어의 취약점을 재현하며, AI를 퍼징 자동화 도구로 활용하는 방법론을 제시합니다.

Alibaba의 Wan 팀이 음성, 영상, 텍스트를 하나의 Transformer로 통합한 실시간 대화 모델 Wan-Streamer v0.1을 공개했습니다. 또한 Google의 GPU 부족으로 인한 Meta의 Gemini 이용 제한 보도와 오스트리아의 Anthropic 유치 제안 등 AI 산업 전반의 주요 소식을 다룹니다.

로봇 학습의 한계를 극복하기 위해 픽셀이 아닌 잠재 공간(Latent Space)에서 물리적 인과관계를 예측하는 세계 모델(World Model) 기술을 분석합니다. 무계동력(Wujie Dongli)의 MWA 사례를 통해 VLA 모델의 약점을 보완하는 잠재 액션 및 강화 학습 결합 방식을 설명합니다.