Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
심근 변형률 추정의 정확도를 높이기 위해 물리 기반 시뮬레이션과 반복적 정밀화 과정을 결합한 새로운 전략을 제안합니다. 실제 영상의 스펙클 탈상관 측도를 통합하여 사실적인 합성 시퀀스를 생성하며, 이를 통해 고성능의 오픈 소스 데이터셋을 구축했습니다.
GSM-Symbolic 벤치마크가 LLM의 추론 능력 부족을 주장한 결론에 대해 통계적 재평가를 수행합니다. GLMM 분석 결과, 성능 저하의 상당 부분이 큰 숫자 분포와 같은 데이터 편향에 기인하며, 모델별 실패 프로필이 상이함을 밝힙니다.
AI의 이분법적 도덕 판단 한계를 극복하기 위해 윤리적 다원주의를 확률적 분포로 모델링하는 프레임워크를 제안합니다. 규범 윤리 심플렉스를 도입하여 다양한 윤리 이론을 통합하고, 450개의 사례로 구성된 벤치마크를 통해 모델의 성능을 입증했습니다.
본 연구는 진화 알고리즘(EA) 분야에서 라마르크 및 볼드윈 진화의 성능을 다윈 진화와 비교 분석합니다. 실험 결과, 국소 탐색이 강화된 진화 방식이 딥러닝 베이스라인보다 우수한 성능을 보였으며, 이론적 분석을 통해 각 진화 유형의 실행 시간 상한과 하한을 증명했습니다.
본 연구는 다국어 환경에서 LLM-as-a-Judge의 신뢰성을 높이기 위한 전략을 탐구합니다. 영어, 스페인어, 바스크어를 대상으로 데이터 가용성에 따른 미세 조정 효과와 모델 크기 간의 트레이드오프를 체계적으로 분석했습니다.
본 연구는 사고 모델(thinking model)이 긴 컨텍스트를 자연스럽게 압축할 수 있다는 '압축으로서의 사고(TaC)' 패러다임을 제안합니다. 별도의 압축 모듈 없이 사고 흔적을 활용하며, 제약 조건이 추가된 TaC-C 모델은 기존 압축 방식보다 뛰어난 성능을 입증했습니다.
IPO 신고서의 복잡한 구조를 분석하기 위한 오픈 소스 프레임워크인 IPO-Toolkit과 대규모 멀티모달 데이터셋인 IPO-Dataset을 소개합니다. 10만 개 이상의 문서를 활용해 금융 문서 내 멀티모달 추론의 한계와 정렬 문제를 연구합니다.
LLM 검색 에이전트가 외부 검색보다 모델 내부 지식에 의존하는 '내재적 지식 의존성(IKD)' 문제를 분석합니다. 이를 평가하기 위해 최신 정보를 활용한 새로운 심층 검색 벤치마크인 LiveBrowseComp를 제안합니다.
모델 가중치를 수정하지 않고 LLM을 정렬하는 MARI 기법을 제안합니다. 에너지 보정 기반의 멀티 어댑터와 게이팅 모듈을 통해 샘플별로 최적화된 개입 방향과 강도를 결정하여 정렬 성능과 일반 능력을 동시에 향상시킵니다.
AlphaTransit는 MCTS와 신경망 정책-가치 네트워크를 결합하여 도시 규모의 대중교통 노선 설계를 최적화하는 프레임워크입니다. 지연된 피드백 문제를 해결하기 위해 시뮬레이터 롤아웃 없이도 의사결정 시점의 앞서보기를 제공하며, 벤치마크 테스트에서 기존 방식보다 높은 서비스율을 달성했습니다.
LLM 메모리 시스템의 오류 추적 및 원인 규명을 위한 새로운 프레임워크인 MemTrace를 제안합니다. 메모리 진화 그래프를 통해 정보 흐름을 추적하고, MemTraceBench를 통해 다양한 메모리 시스템의 실패 모드를 체계적으로 분석합니다.
소비자 수요를 반영하여 제품 이미지 생성 성능을 최적화하는 '유틸리티 인식 멀티모달 대조 학습' 프레임워크를 제안합니다. 기존 모델의 의미론적 정렬 한계를 넘어, 수요 중심의 시각적 단서를 학습함으로써 상업적 효과를 극대화합니다.
BIRDNet은 정형 데이터에서 불리언 함의 관계(BIRs)를 채굴하여 지식 그래프를 형성하고, 이를 계층형 신경망의 구조로 인코딩하는 뉴로심볼릭 모델입니다. 외부 규칙 없이 데이터로부터 직접 구조적 사전 지식을 학습하며, 높은 해석 가능성과 파라미터 효율성을 동시에 제공합니다.
베이지안 다목적 최적화를 위한 선호도 형상 기반 기대 개선(EHVI) 기준을 연구합니다. 하이퍼볼륨과 R2 지표의 기하학적 구조를 분석하여 정확한 계산, 파레토 호환성, 단조성을 보존하는 변환 방식을 제안합니다.
임상 텍스트 요약 시 LLM의 토큰 수준 불확실성을 정량화하는 Reverse Probing 프레임워크를 제안합니다. 모델의 내부 활성화를 탐사하여 기존 방식보다 낮은 비용으로 높은 정확도의 불확실성 신호를 추출합니다.
CORE는 성공과 실패한 추론 흔적을 비교하여 자연어 통찰을 생성하는 비매개변수적 학습 알고리즘입니다. 기존 방식보다 적은 샘플과 롤아웃으로도 효율적인 모델 자기 개선을 가능하게 하며, 해석 가능한 지식을 압축적으로 저장합니다.
코드 강화학습(RL)에서 외삽적 가중치 평균(EWA)을 통해 정확도와 효율성 사이의 파레토 프런티어를 확장하는 방법을 연구합니다. 중첩된 유닛 테스트 커버리지를 활용하여 훈련된 체크포인트 너머의 성능을 확보할 수 있음을 입증했습니다.
CubePart는 사용자가 정의한 부품 스키마에 따라 제어 가능한 3D 메쉬를 생성하는 새로운 프레임워크입니다. 전역 형상 합성 및 부품 수준 디코딩의 2단계 아키텍처를 통해 게임 엔진에서 즉시 사용 가능한 의미론적 부품 구조를 생성합니다.
SwarmHarness는 분산형 에이전트 네트워크를 통해 복잡한 작업을 효율적으로 분배하는 새로운 프레임워크를 제안합니다. 에이전트의 전문 기술을 기반으로 작업을 라우팅하며, 게임 이론적 인센티브 구조를 통해 시스템 전체의 목표를 달성합니다.
정적인 저장소 방식의 한계를 극복하기 위해 메모리를 이질적 그래프로 모델링한 FluxMem 프레임워크를 제안합니다. 초기 연결부터 피드백 기반 정제, 장기적 통합 과정을 통해 메모리 토폴로지를 동적으로 진화시킵니다. LoCoMo, Mind2Web 등 다양한 벤치마크에서 SOTA 성능을 기록하며 뛰어난 적응력을 입증했습니다.