Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
임상 및 웰니스 사용자를 위한 정서적 음악 추천 시스템인 AMRS를 소개합니다. 롤아웃 기반 월드 모델을 활용하여 온라인 실험의 윤리적 제약을 극복하고, 오프라인에서 직접 선호도 최적화(DPO)를 통해 정서적 상태를 예측하고 개선하는 방법론을 제시합니다.
CLIP 기반 클래스 증분 학습(CIL)에서 발생하는 치명적 망각 문제를 해결하기 위해 AREA 프레임워크를 제안합니다. 속성 추출과 집계 과정을 분리하여 초구형 임베딩 공간에 속성을 고정하고, 경량 전문가 모델을 통해 안정적인 학습을 구현합니다.
PEFT의 성능을 다운스트림 정확도뿐만 아니라 안정성-가소성 딜레마 관점에서 평가하는 새로운 벤치마크 PEFT-Arena를 제안합니다. 가중치 및 활성화 공간의 기하학적 분석을 통해 PEFT 방법론 간의 차이를 규명하고, 경로별 리와인딩을 통한 성능 개선 가능성을 제시합니다.
LLM의 환각 현상과 불확실성 추정(UE) 사이의 상관관계를 체계적으로 분석한 연구입니다. 다양한 추정 기법을 활용해 환각 유형별 유효성을 검증한 결과, 불확실성이 환각의 직접적인 지표로 사용되기에는 한계가 있음을 밝혀냈습니다.
분산 양자 컴퓨팅 환경에서 통신 비용을 최소화하기 위한 큐비트 할당 문제를 해결하는 Transformer 기반 강화학습 아키텍처 SQARL을 제안합니다. 이 방식은 하드웨어 구성 변화에 관계없이 재학습 없이 작동하며, 기존 휴리스틱 알고리즘 대비 우수한 성능을 보여줍니다.
On-policy 증류 과정에서 발생하는 'Off-policy 교사 감쇠' 문제를 해결하기 위해 조기 종료 롤아웃(ESR) 전략을 제안합니다. ESR은 롤아웃 생성을 초기 토큰으로 제한하여 학습 안정성과 GPU 효율성을 높이며, 교차 모델 시나리오에서 뛰어난 성능을 보입니다.
추천 시스템의 분포 변화 문제를 해결하기 위해 인과 표현 학습(CRL)을 적용한 새로운 방법론을 제안합니다. 정보 이론적 얽힘 해제 기준을 통해 인과적 구성 요소에 집중함으로써, 추가적인 추론 비용 없이도 분포 외 일반화 성능을 높였습니다.
LLM의 연산 효율성을 분석하기 위해 서브그래프를 추정하는 s-Trace 방법을 제안합니다. 연구 결과, LLM의 연산은 초기 레이어의 대략적인 예측과 후기 레이어의 정교화 과정이라는 모듈형 구조로 조직되어 있음을 발견했습니다.
저자원 언어인 마라티어를 위한 고품질 영어-마라티어 병렬 데이터셋 BhashaSetu를 제안합니다. 278만 개의 문장 쌍과 형태소 분석 정보를 포함하며, 데이터 전처리와 미세 조정 실험을 통해 데이터 중심 접근 방식의 중요성을 입증했습니다.
동적 그래프의 시간적 진화를 모델링하기 위해 시간적 이동 불변성(temporal translation invariance)을 도입한 CLDG 프레임워크를 제안합니다. CLDG++는 그래프 확산과 다중 스케일 대조 학습을 통해 전역적 문맥을 파악하며, 이상 탐지 및 노드 분류 작업에서 뛰어난 성능을 입증했습니다.
유럽 포르투갈어(EP)의 데이터 부족 문제를 해결하기 위해 의회 세션 음성 데이터를 활용한 대규모 화자 주석 코퍼스 FalAR를 제안합니다. 5,800시간의 음성 데이터와 화자 메타데이터를 포함하며, ASR 모델 성능을 크게 향상시킵니다.
이질적인 에이전트 환경에서 신뢰도, 비용, 불확실성을 고려하여 최적의 위임 결정을 내리는 적응형 오케스트레이션 연구를 다룹니다. 제안된 BOT-Orch 프레임워크는 에이전트 출력 분포를 OT 거리로 정규화하여 밴딧 문제로 해결하며, 기존 방식보다 우수한 성능을 입증했습니다.
검열된 피드백 환경에서 다중 에이전트의 협력 문제를 해결하기 위한 TAC-MAB 프레임워크를 제안합니다. 중앙 집중식 알고리즘의 성능 분석과 통신 효율을 극대화한 분산식 프로토콜 D-TAC의 성과를 다룹니다.
Grokking과 Double Descent 현상을 표현 학습(Encoder)과 판독 교정(Readout)의 속도 차이로 설명하는 새로운 분석 프레임워크를 제안합니다. 이 연구는 작업 불가지론적 관점에서 신경망의 일반화 역학을 진단하고 해석 가능성을 높이는 데 기여합니다.
본 논문은 오프-폴리시 강화학습의 불안정성을 해결하기 위해 Trust Region Q-Adjoint Matching(TRQAM) 알고리즘을 제안합니다. 투영된 이중 하강을 통해 경로 공간 KL을 적응적으로 제어함으로써, 크리틱 오류로 인한 모델 붕괴를 방지하고 안정적인 미세 조정을 달성합니다.
메모리 제한적인 환경에서 MoE 모델의 추론 효율을 높이기 위한 ReMoE 프레임워크를 제안합니다. 라우터 미세 조정을 통해 전문가 재사용성을 높여 I/O 오버헤드를 줄이고 디코딩 속도를 크게 향상시켰습니다.
본 연구는 RL 기반의 고비용 학습 대신 시스템 프롬프트 최적화만으로 수학 튜터링 성능을 높이는 방법을 제안합니다. 12가지 프롬프트 최적화 기법을 평가한 결과, 일부 방식이 강력한 RL 베이스라인을 능가하며 교육적 패턴 활용도가 더 높음을 입증했습니다.
가우시안 프로세스(GP)의 고차원 추론 문제를 해결하기 위해 MCMC 기반의 새로운 Wishart 사전 확률 구현 방식을 제안합니다. 룩백 윈도우를 활용한 자기 조립형 구조를 통해 커널 하이퍼파라미터 추론의 적응성을 높였습니다.
FA-OPD는 Flow Matching 교사와 MLP 학생을 공동 학습시키는 적대적 이중 온-폴리시 증류 기법을 제안합니다. 보상과 행동 채널을 통해 탐색과 활용을 동시에 최적화하여, 시연 데이터만으로도 체화된 제어 성능을 극대화합니다.
직교 데이터와 작은 초기값을 가진 2층 ReLU 네트워크의 경사 흐름 역학을 분석한 연구입니다. 초기화 규모가 작을 때 발생하는 안장점-안장점 점프 과정을 통해 뉴런이 점진적으로 활성화되는 현상을 증명했습니다.