Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
INSHAPE는 기존의 집단 수준(population-level) shapelet 방식이 가진 한계를 극복하기 위해 제안된 해석 가능한 시계열 분류(TSC) 프레임워크입니다. 각 시계열 인스턴스에 특화된 가변 길이의 패턴을 식별하고 패턴 간의 시간적 의존성을 모델링하여, 높은 예측 성능과 함께 국소적 및 전역적 해석 가능성을 동시에 제공합니다.
본 논문은 의료 및 금융과 같은 고위험 환경에서 불완전하거나 상충하는 정보에 대응하기 위해 3진 주장 검증(참/거짓/불확실)을 수행하는 신경 기호(neurosymbolic) 프레임워크인 ITA를 제안합니다. ITA는 형식적 논증 의미론을 활용하여 모델이 논증을 생성하고 점수를 매기도록 학습하며, 추론 시에는 사후 설명이 아닌 구조적으로 검증 가능한 논증을 바탕으로 최종 판결을 도출합니다. 실험 결과, ITA는 기존 논증 기반 모델보다 우수한 성능을 보였으며 비논증적 직접 예측 모델과 경쟁할 수 있는 수준의 성능과 함께 명시적인 검사 가능성을 제공합니다.
Speculative Decoding의 속도 향상을 위해 초안 트리의 연산 오버헤드와 수락률 사이의 트레이드오프를 해결하는 새로운 프레임워크인 Graft를 제안합니다. Graft는 가지치기(pruning)를 통해 확보된 연산 예산을 검색(retrieval)에 활용하여, 추가 학습 없이도 가지치기로 인한 손실을 보완하고 추론 속도를 극대화합니다. 실험 결과, 짧은 문맥에서는 최대 5.41배, 대규모 모델에서는 기존 방식 대비 최대 21.8%의 속도 향상을 달성했습니다.
본 논문은 기존 JEPA(Joint-Embedding Predictive Architecture)가 사용하는 등방성 가우시안 정규화가 구조화된 다운스트림 기하학을 반영하지 못하는 한계를 지적합니다. 이를 해결하기 위해 각 뷰를 위상 공간 상태로 인코딩하고 Hamiltonian leapfrog 맵을 통해 뷰 간 전이를 예측하는 HamJEPA를 제안합니다. 실험 결과, HamJEPA는 CIFAR-100 및 ImageNet-100 데이터셋에서 기존 SIGReg 대비 kNN 및 선형 프로브 성능을 크게 향상시켰습니다.
본 논문은 기존의 엄격한 이산 시간 장벽 인증서 조건을 완화하여, 임시적인 수치 증가를 허용하는 k-귀납적 신경 장벽 인증서(k-NBCs)를 제안합니다. 신경망을 활용해 미지의 비선형 시스템에 대한 확장성을 확보하면서도, 데이터 기반의 표현 학습과 CEGIS-SMT 프레임워크를 결합하여 시스템 동역학에 대한 사전 지식 없이도 안전성을 공식적으로 검증할 수 있는 방법을 제시합니다.
본 연구는 인공 시각 모델이 뇌의 반응을 예측할 때 단순한 예측 정확도를 넘어, 뇌의 어떤 반응 차원이 복구되는지를 분석하는 '타겟 공간 복구 프로파일(Target-Space Recovery Profiles)' 프레임워크를 제안합니다. fMRI 데이터를 활용해 재현 가능한 뇌 반응 차원을 식별하고, 모델이 이러한 차원을 얼마나 정확하게 재현하는지 정량화함으로써 모델-뇌 정렬을 더욱 정밀하게 진단합니다. 이를 통해 유사한 예측 정확도를 가진 모델이라도 실제 뇌의 반응 구조를 재현하는 방식은 다를 수 있음을 입증했습니다.
본 논문은 IMO 2009의 Grasshopper 문제를 Lean 4로 형식화하여 Aristotle API를 통한 AI 지원 정리 증명 과정을 분석한 사례 연구입니다. AI는 4개의 보조 보조정리를 검증하는 데 성공했으나, 전역적 조합론적 논리가 필요한 메인 정리는 해결하지 못한 채 'sorry' 상태로 남겨두었습니다. 이는 AI가 국소적 증명 탐색에는 강점이 있지만, 복잡한 전역적 장부 정리에는 한계가 있음을 보여줍니다.
Toto 2.0은 시계열 예측 분야에서 스케일링 법칙이 적용 가능함을 입증한 파운데이션 모델 제품군입니다. 4M에서 2.5B 파라미터 규모까지 확장 가능한 단일 학습 레시피를 통해 BOOM, GIFT-Eval, TIME 등 주요 벤치마크에서 SOTA 성능을 달성했습니다.
강화학습(RL)에서 루브릭 기반 보상을 사용할 때, 인간이 부여한 기준의 중요도와 학습에 유용한 신호가 일치하지 않는 문제를 해결하기 위한 POW3R 프레임워크를 제안합니다. POW3R은 정책의 현재 상태에 따라 기준별 보상 가중치를 동적으로 조정하여, 롤아웃을 효과적으로 구분할 수 있는 기준에 집중함으로써 학습 효율을 극대화합니다. 실험 결과, 기존 GRPO 방식보다 훨씬 적은 학습 단계만으로도 더 높은 평균 보상과 완결성을 달old했습니다.
방글라데시 Haor 습지의 돌발 홍수를 예측하기 위해 탈계절화된 머신러닝 앙상블 모델인 HaorFloodAlert를 개발했습니다. 이 시스템은 Sentinel-1 SAR 데이터를 활용하여 72시간 전 홍수 확률을 예측하며, 계절적 요인에 의한 정확도 왜곡을 방지하도록 설계되었습니다. 또한 3단계 경보 파이프라인과 쌀 피해 추정기를 포함하여 실질적인 농업 보호를 목표로 합니다.
본 논문은 EEG 신호를 미세한 시간 규모의 뇌 활동 패턴인 마이크로스테이트(microstates)로 변환하여 범용적인 표현을 학습하는 방법을 제안합니다. 연속적인 EEG 신호를 이산적인 마이크로스테이트 시퀀스로 클러스터링하여 토크나이저를 구축하며, 이는 수면 단계 분류 및 감정 인식 등 다양한 다운스트림 태스크에서 기존 방식보다 뛰어난 성능을 보입니다.
본 논문은 장기 전력망 계획 프로세스를 자동화하고 최적화하기 위해 Answer Set Programming(ASP)을 활용하는 새로운 접근 방식을 제안합니다. 기존 계획 언어로는 표현하기 까다로운 복잡한 위상적 및 조합론적 불변량을 ASP를 통해 간결하게 인코딩함으로써 전력망의 지속 가능성과 서비스 품질을 유지하는 방법을 다룹니다.
ARC-RL은 게임 ARC Raiders의 로봇 디자인에서 영감을 받은 네 가지 MuJoCo 기반 연속 제어 환경 세트를 소개합니다. 이 플레이그라운드는 다양한 형태의 다족 보행 로봇을 위해 통일된 관측 및 보상 함수 체계를 제공하며, 표준 온라인 알고리즘과 사전 데이터 증강 방법론의 성능을 비교 연구합니다.
지식 그래프(KG) 구축 시 데이터 소스와 온톨로지 간의 매핑 작업은 여전히 많은 수동 노력을 필요로 합니다. 본 논문은 LLM이 이질적인 데이터 소스로부터 지식 그래프를 구축할 때의 매핑 능력을 평가하기 위한 표준화된 벤치마크인 BLINKG를 제안합니다. 실험 결과, 최신 LLM들이 유망한 성능을 보였으나 복잡한 시나리오에서는 여전히 한계가 있음을 확인했습니다.
본 연구는 투표자 집단 내의 의견 불일치 구조를 분석하기 위해 새로운 계층화된 프레임워크를 제안합니다. 기존의 쌍체 비교 방식이 노이즈와 구조적 불일치를 구분하기 어렵다는 점을 지적하며, 다수결 행렬(plurality matrix)을 도입하여 의견 불일치 측정에 필요한 최소한의 정보 수준을 정의합니다.
CANINE은 시각 장애인이 로봇 안내견과 효과적으로 협응하여 내비게이션을 수행할 수 있도록 돕는 자동화된 코칭 시스템입니다. 지식 추적을 통해 학습자의 취약점을 파악하고, 파운데이션 모델을 활용해 맞춤형 구두 피드백을 제공함으로써 학습 효율과 내비게이션 성능을 크게 향상시킵니다.
LLM이 평가 문항 생성, 응답 시뮬레이션, 채점을 모두 수행할 때 발생하는 자기 참조적 문제를 해결하기 위한 새로운 타당도 기준인 '생성-평가 일치성(GEA)'을 제안합니다. 연구 결과, LLM은 구문론적 기술은 잘 복원하지만 설계 수준의 기술에서는 낮은 일치성을 보이며 저숙련도를 과대평가하는 경향이 있음이 밝혀졌습니다. 이를 개선하기 위해 기술별로 세분화된 루브릭 사용을 핵심 해결책으로 제시합니다.
EgoCoT-Bench는 MLLM의 1인칭 시점 비디오 이해 능력을 평가하기 위해 설계된 새로운 벤치마크입니다. 기존 벤치마크의 한계인 근거 기반 평가 부족을 해결하기 위해, 명시적인 단계별 근거(rationale)와 시공간적 증거를 포함한 검증 가능한 조작 중심 추론 데이터를 제공합니다. 실험 결과, 많은 모델이 정답은 맞히더라도 그 과정에 대한 근거 설명은 부정확하다는 점이 밝혀졌습니다.
CaptchaMind는 명시적 추론 프로세스 감독을 활용한 강화학습(RL) 기반의 CAPTCHA 해결 모델입니다. 연구진은 대규모 학습 데이터 부족 문제를 해결하기 위해 상세한 주석이 포함된 최초의 CAPTCHA 벤치마크인 CaptchaBench를 함께 제안했습니다. CaptchaMind는 기존 방식들이 어려워하던 미세한 시각적 추론 작업을 성공적으로 수행하며 높은 성공률을 기록했습니다.
TORQ는 MXFP4 형식을 활용한 LLM 활성화 양자화 시 발생하는 정확도 저하 문제를 해결하기 위한 훈련 불필요(PTQ) 프레임워크입니다. Schur-Horn 정리를 이용한 블록 간 직교 회전과 최대 엔트로피 가이드 기반의 블록 내 회전을 통해 활성화 분포의 불균형을 해소합니다. 실험 결과, Qwen3-32B 모델에서 기존 방식 대비 정확도를 대폭 향상시켜 4비트 양자화와 전체 정밀도 추론 사이의 격차를 크게 줄였습니다.