Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
코드 강화학습(RL)에서 외삽적 가중치 평균(EWA)을 통해 정확도와 효율성 사이의 파레토 프런티어를 확장하는 방법을 연구합니다. 중첩된 유닛 테스트 커버리지를 활용하여 훈련된 체크포인트 너머의 성능을 확보할 수 있음을 입증했습니다.
CubePart는 사용자가 정의한 부품 스키마에 따라 제어 가능한 3D 메쉬를 생성하는 새로운 프레임워크입니다. 전역 형상 합성 및 부품 수준 디코딩의 2단계 아키텍처를 통해 게임 엔진에서 즉시 사용 가능한 의미론적 부품 구조를 생성합니다.
SwarmHarness는 분산형 에이전트 네트워크를 통해 복잡한 작업을 효율적으로 분배하는 새로운 프레임워크를 제안합니다. 에이전트의 전문 기술을 기반으로 작업을 라우팅하며, 게임 이론적 인센티브 구조를 통해 시스템 전체의 목표를 달성합니다.
정적인 저장소 방식의 한계를 극복하기 위해 메모리를 이질적 그래프로 모델링한 FluxMem 프레임워크를 제안합니다. 초기 연결부터 피드백 기반 정제, 장기적 통합 과정을 통해 메모리 토폴로지를 동적으로 진화시킵니다. LoCoMo, Mind2Web 등 다양한 벤치마크에서 SOTA 성능을 기록하며 뛰어난 적응력을 입증했습니다.
자율 에이전트의 데이터 검색 시 의미론적 메타데이터의 효용성을 비교 연구했습니다. 실험 결과, schema.org를 활용한 의미론적 에이전트가 비정형 웹을 탐색하는 베이스라인 에이전트보다 데이터 정밀도와 실행 가능성 측면에서 압도적으로 높은 성능을 보였습니다.
LLM의 추론 능력을 향상시키기 위해 기술 뱅크를 활용하는 새로운 자기 증류(Self-Distillation) 기법인 SGSD를 제안합니다. 교사의 가설을 검증하고 불확실한 신호를 억제하는 게이트 목적 함수를 통해 수학적 추론 성능을 효과적으로 높였습니다.
소형 컴퓨터 사용 에이전트(CUA)의 도메인 특화 성능을 높이기 위한 새로운 프레임워크 LearnWeak를 소개합니다. 이 방식은 학생 모델의 약점을 식별하여 타겟팅된 데이터를 합성하고, 계획 및 실행 오류를 분리하여 학습하는 오류 인식 목적 함수를 사용합니다.
CaMBRAIN은 EEG 신호의 인과적 특성을 반영한 최초의 Mamba 기반 상태 공간 모델(SSM)입니다. 기존 어텐션 모델의 이차적 스케일링 문제를 해결하고, 다단계 자기지도 학습을 통해 실시간 연속 추론과 장기 문맥 유지를 가능하게 합니다.
본 연구는 Sim-to-real 간극을 극복하기 위해 물리 기반의 압력 중심(CoP) 촉각 표현을 제안합니다. 미분 가능한 역학 기반의 센서 보정 체계를 통해 고밀도 접촉 정보를 보존하며, 시각 정보가 없는 환경에서도 뛰어난 조작 성능을 입증했습니다.
OmniVerifier-M1은 멀티모달 모델의 신뢰성을 높이기 위해 기호적 검증 근거를 활용하는 메타 검증 연구입니다. 텍스트보다 뛰어난 기호적 출력을 활용하고 강화학습 목적 함수를 분리하여 정밀한 오류 위치 파악과 자기 수정이 가능한 시스템을 제안합니다.
인간의 능력을 초과하는 에이전트형 AI를 효과적으로 제어하기 위한 '보정된 집단 감독(CCO)' 방법론을 제안합니다. 공형 결정 이론을 활용해 통계적 보증을 제공하며, 감독자의 우려에 비례하여 페널티를 부여함으로써 안전성과 효용을 동시에 확보합니다.
광범위한 생물 의학 지식을 특정 데이터셋과 연결하기 위해 시나리오 기반 명제로 변환하는 SCENE 프레임워크를 제안합니다. 이층 구조의 멀티 에이전트 시스템을 통해 지식 탐색과 데이터 기반 증거 사이의 간극을 메우고 검증 가능한 가설을 생성합니다.
도메인 특화 학습 시 발생하는 일반 능력 저하 문제를 해결하기 위해 CaMOPD라는 새로운 증류 기법을 제안합니다. 대리 프롬프트를 활용하여 교사의 학습 분포를 모르는 상황에서도 일반 능력을 효과적으로 회복하고 도메인 성능을 보존합니다.
AI 안전을 위해 기존의 정렬(alignment)을 넘어 명시적인 제어 가능성(controllability)이 필수적임을 주장하는 논문입니다. 런타임 시 시스템을 중단하거나 제약할 수 있는 능력을 정의하고, 이를 평가하기 위한 벤치마크인 controlbench를 제안합니다.
Data Mesh의 한계를 극복하기 위해 AI 증강 Lakehouse 기반의 허브 앤 스포크 모델을 제안합니다. 중앙 허브는 AI를 통해 거버넌스를 자동화하고, 도메인 스포크는 비즈니스 가치에 집중하며 점진적으로 소유권을 확대하는 구조입니다.
본 논문은 모바일 GUI 네비게이션을 위한 VLM 기반 에이전트의 데이터 스케일링, 벤치마킹 및 추론을 연구합니다. 대규모 데이터셋 HyperTrack과 오픈 소스 툴킷 GUIEvalKit을 통해 강화 학습 기반 미세 조정의 우수성과 데이터 규모의 시너지 효과를 입증합니다.
다회차 에이전트 강화학습의 신용 할당 문제를 해결하기 위해 단계 인식 온라인 선호도 증류(StepOPSD) 프레임워크를 제안합니다. 궤적을 행동 중심의 단계 단위로 분해하여 보상을 재분배함으로써 에이전트의 성능을 최적화합니다.
ICCU는 모델 파라미터를 수정하지 않고 추론 시점에 거절 규칙을 적용하여 특정 데이터를 망각시키는 인컨텍스트 지속적 언러닝 프레임워크입니다. 기존 미세 조정 방식의 비용 문제와 유틸리티 손실, 요청 간 간섭 문제를 해결하며 순차적인 언러닝 요청에 효과적으로 대응합니다.
VitaBench 2.0은 장기적 상호작용에서 에이전트의 개인화 및 주도적 능력을 평가하는 새로운 벤치마크를 제안합니다. 기존 벤치마크가 간과한 사용자 선호도 추론과 능동적 정보 획득 능력을 중점적으로 측정합니다.
안전 필수 영역의 객체 탐지기 성능을 테스트하기 위한 SemProbe 도구를 제안합니다. 확산 모델 기반의 인페인팅 기술을 사용하여 의미론적으로 유의미한 이미지 변형을 생성하고, 모델의 강건성을 체계적으로 평가합니다.