Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
차선책 시연으로부터 자연어 피드백을 활용해 정책을 학습하는 '언어 비판(Language-Critique)' 프레임워크를 제안합니다. 기존의 스칼라 신호 대신 구조화된 언어 라벨을 사용하여 행동 복제 및 확산 정책의 성능을 높였습니다.
강화학습(RL) 사후 학습 시 모든 파라미터를 업데이트할 필요 없이, 특정 단일 Transformer 레이어 학습만으로도 전체 학습과 대등하거나 더 나은 성능을 낼 수 있음을 입증한 연구입니다. RL 이득이 모델의 중간 레이어에 집중되어 있다는 '레이어 기여도' 개념을 제시합니다.
릴레이 보조 시맨틱 통신 시스템에서 잠재 표현을 통한 의미론적 정보 누출 및 개인정보 취약성을 분석합니다. 이를 해결하기 위해 릴레이의 도청 능력을 고려한 반복적 적대적 학습 프레임워크를 제안하여 보안성을 강화합니다.
아기의 촉각 학습 메커니즘을 연구하기 위해 264,000개의 촉각 이벤트 데이터셋을 구축하고 이를 활용한 발달 기반 모델을 제안합니다. 촉각이 시각적 개념 학습에 미치는 영향을 정량화하고 분석하는 데 중점을 둡니다.
데일의 원리를 준수하는 생물학적 신경 회로 구조에서 효율적인 신용 할당을 위한 오차 확산(Error Diffusion) 기법을 연구합니다. 모듈로 오차 라우팅을 통해 MNIST와 CIFAR-10에서 높은 성능을 입증했으며, 강화 학습 환경에서도 경쟁력 있는 성능을 보여줍니다.
얼굴 검출 모델의 인구통계학적 편향을 연구하기 위해 WIDER-FACE 데이터셋에 인종과 성별 주석을 추가한 WIDER-FAIR 데이터셋을 제안합니다. 실험 결과, 특정 인종 그룹에 대한 성능 차이를 확인하였으며 공정성 평가를 위한 데이터셋의 중요성을 입증했습니다.
기존 LoRA가 Transformer의 자기 게이트 방식 FFN에서 발생하는 비선형 선택 가중치의 변화를 충분히 반영하지 못한다는 점을 지적합니다. 이를 해결하기 위해 비선형성을 인지하여 게이트 채널에 용량을 할당하는 NA-LoRA를 제안하며, 추가적인 추론 오버헤드 없이 성능을 향상시킵니다.
TTS 평가의 초점이 기존의 '자연스러움'에서 문맥에 맞는 '적절성'으로 이동하고 있음을 연구합니다. 5가지 도메인에서 SOTA TTS 시스템을 분석한 결과, 도메인별로 요구되는 음성 특성이 다르며 일률적인 평가 지표로는 한계가 있음을 입증했습니다.
LLM의 안전성 학습 과정에서 발생하는 과잉 거부(Over-Refusal) 문제를 해결하기 위한 새로운 연구를 소개합니다. 유해한 추론을 탐색 신호로 활용하여 유해 프롬프트와 무해 프롬프트를 더 정확히 구분하는 SEAR 모델을 제안합니다.
전이 확률을 모르는 MDP 환경에서 데이터 의존적 후회 한계를 달성하는 새로운 정책 최적화 알고리즘을 제안합니다. 낙관적 FTRL 기반의 알고리즘을 통해 적대적 및 확률적 손실 모두에 적응하며, 전이 의존적 복잡도 항을 포함한 새로운 이론적 한계를 규명했습니다.
Looped Transformer를 활용하여 잠재적 추론(Latent CoT)의 성능 한계를 극복한 LOTUS를 제안합니다. LOTUS는 3B 규모에서 명시적 CoT와의 성능 격차를 해소하며, 추론 지연 시간을 최대 6.9배까지 단축합니다.
에너지 수요 예측의 불확실성을 정량화하기 위해 STGNN과 테이블형 파운데이션 모델을 결합한 STOIC 프레임워크를 제안합니다. 이 모델은 인컨텍스트 학습을 통해 시공간적 의존성을 포착하며, 기존 방식보다 신뢰도 높은 예측 구간을 제공합니다.
트랜스포머의 FFN 레이어에 명시적 퍼지 논리를 도입하여 모델의 내부 동작을 판독 가능하게 만드는 연구입니다. 자기 망각 양화사를 통해 훈련 중 논리 구조가 붕괴되는 문제를 해결하고, 유닛이 문법적 허가(licensing)를 탐지하는 메커니즘을 규명했습니다.
심층 신경망의 층별 표현 공간을 3차원으로 제한하여 저차원 위상수학적 관점에서 분석한 연구입니다. ResNet의 스킵 연결과 Transformer의 어텐션 메커니즘이 연결수(linking number)를 변화시키는 능력이 유사함을 증명했습니다.
Transformer의 잔차 연결(Residual connection)을 개선하기 위해 현재 상태와 업데이트 제안을 모두 고려하는 'Review Residuals' 기법을 제안합니다. 이 방식은 모델의 깊이에 따른 학습 안정성을 확보하고, 모델 규모가 커질수록 성능 우위가 뚜렷해지는 창발적 특성을 보입니다.
Sequential RC-TGAN은 스펙트럼 포락선 이론을 활용하여 관계형 시계열 데이터의 주기적 구조를 보존하는 새로운 생성 프레임워크입니다. 범주형 및 연속형 시계열 모두에서 계절성과 주파수 영역 특징을 효과적으로 재현하며, 새로운 평가 지표를 통해 성능을 입증했습니다.
Conformal Prediction의 계산 비용 문제를 해결하기 위해 근사적 Leave-One-Out(ALO) 추정치를 활용한 가속화 방법을 제안합니다. 고차원 통계학 방법론을 적용하여 점근적 커버리지와 효율성을 입증하였으며, 시뮬레이션을 통해 실행 시간을 크게 단축하면서도 정확한 방법과 유사한 성능을 보임을 확인했습니다.
항공우주 복합재의 응집 구역 모델(CZM) 시뮬레이션 시 발생하는 수렴 문제를 해결하기 위해 인터페이스 인식 신경 뉴턴 프리컨디셔너(IA-NNP)를 제안합니다. 이 방법은 학습된 상태 의존적 보정을 통해 물리적 법칙을 보존하면서도 까다로운 수렴 성능을 개선합니다.
RMSNorm 아키텍처를 사용하는 모델 간에 스티어링 벡터나 SAE 등 좌표 기반 객체를 전송할 때 발생하는 부호-순열 게이지 문제를 다룹니다. 부호-한계화 헝가리안 매칭을 통해 좌표 보존 전송을 수행함으로써 체크포인트 간의 해석 가능성 도구와 학습 상태를 효과적으로 복구할 수 있음을 증명합니다.
유전 프로그래밍(GP) 기반 심볼릭 회귀(SR)에서 초기 개체군 초기화 방법이 솔루션의 정확도와 복잡도에 미치는 영향을 분석한 연구입니다. NSGA-II를 활용해 다양한 초기화 방식을 비교한 결과, 초기화 방법이 최종 파레토 프런트에 미치는 영향은 미미함을 확인했습니다.