Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
조합 최적화(CO) 문제의 검증 효율성을 높이기 위해 비지도 학습 기반의 신경 인증 가격 책정(NCP) 프레임워크를 제안합니다. 신경망이 인증 수준의 쌍대 가격을 예측하고 구조적 복구 레이어를 통해 실행 가능한 한계값을 구성하는 방식입니다.
양자 머신러닝(QML)과 고전적 머신러닝 모델의 성능을 지도 학습 및 강화 학습 관점에서 비교 분석한 연구입니다. 실험 결과 QML은 예측 성능이나 훈련 시간 면에서 고전적 모델을 능가하지 못했으나, 노이즈 필터링과 거짓 양성 제어 측면에서 잠재력을 확인했습니다.
비선형 및 신경망 동역학의 실시간 강건 최적 제어를 위해 GPU 병렬 선형화 오차 경계(LEB)를 개발한 연구입니다. 해석적 동역학 및 NN 검증 기술을 결합하여 정밀한 오차 경계를 도출하고, GPU를 통해 실시간 성능과 형식적 보장을 동시에 달성했습니다.
TiRex-2는 xLSTM 기반의 시계열 파운데이션 모델로, 단변량 모델을 다변량 및 스트리밍 환경으로 확장했습니다. 재귀적 설계를 통해 스트리밍 상황에서도 일정한 추론 비용을 유지하며, 변수 간 의존성과 미래 공변량을 효과적으로 통합합니다.
LLM이 특정 엔티티나 관점에 대해 가지는 은밀한 선호 편향을 탐지하는 새로운 방법론인 Distill to Detect(D2D)를 소개합니다. KV-cache prefix adapter를 활용해 숨겨진 로짓 분포의 변화를 증폭시켜, 텍스트 검사로는 발견하기 어려운 모델의 편향성을 효과적으로 드러냅니다.
Theoria는 LLM의 비형식적 추론 과정을 유형화된 상태 전이 시퀀스로 재작성하여 검증하는 새로운 아키텍처를 제안합니다. 각 전이 단계에 명시적인 정당화를 부여함으로써 숨겨진 전제나 오류를 독립적으로 감사할 수 있게 합니다. 벤치마크 결과, 기존의 전체론적 LLM 판정기보다 높은 정밀도와 오염된 증명 탐지 능력을 보여주었습니다.
Transformers가 다음 토큰 예측과 상태 저장을 동일한 계산 스트림에서 수행한다는 점에 주목하여, 이 두 역할을 분리하는 '상태 예측 분리 가설'을 제안합니다. 실험 결과, 두 기능을 분리한 모델이 데이터 및 계산 효율성을 높이고 검증 손실과 다운스트림 태스크 성능을 개선함을 입증했습니다.
차선책 시연으로부터 자연어 피드백을 활용해 정책을 학습하는 '언어 비판(Language-Critique)' 프레임워크를 제안합니다. 기존의 스칼라 신호 대신 구조화된 언어 라벨을 사용하여 행동 복제 및 확산 정책의 성능을 높였습니다.
강화학습(RL) 사후 학습 시 모든 파라미터를 업데이트할 필요 없이, 특정 단일 Transformer 레이어 학습만으로도 전체 학습과 대등하거나 더 나은 성능을 낼 수 있음을 입증한 연구입니다. RL 이득이 모델의 중간 레이어에 집중되어 있다는 '레이어 기여도' 개념을 제시합니다.
릴레이 보조 시맨틱 통신 시스템에서 잠재 표현을 통한 의미론적 정보 누출 및 개인정보 취약성을 분석합니다. 이를 해결하기 위해 릴레이의 도청 능력을 고려한 반복적 적대적 학습 프레임워크를 제안하여 보안성을 강화합니다.
아기의 촉각 학습 메커니즘을 연구하기 위해 264,000개의 촉각 이벤트 데이터셋을 구축하고 이를 활용한 발달 기반 모델을 제안합니다. 촉각이 시각적 개념 학습에 미치는 영향을 정량화하고 분석하는 데 중점을 둡니다.
데일의 원리를 준수하는 생물학적 신경 회로 구조에서 효율적인 신용 할당을 위한 오차 확산(Error Diffusion) 기법을 연구합니다. 모듈로 오차 라우팅을 통해 MNIST와 CIFAR-10에서 높은 성능을 입증했으며, 강화 학습 환경에서도 경쟁력 있는 성능을 보여줍니다.
얼굴 검출 모델의 인구통계학적 편향을 연구하기 위해 WIDER-FACE 데이터셋에 인종과 성별 주석을 추가한 WIDER-FAIR 데이터셋을 제안합니다. 실험 결과, 특정 인종 그룹에 대한 성능 차이를 확인하였으며 공정성 평가를 위한 데이터셋의 중요성을 입증했습니다.
기존 LoRA가 Transformer의 자기 게이트 방식 FFN에서 발생하는 비선형 선택 가중치의 변화를 충분히 반영하지 못한다는 점을 지적합니다. 이를 해결하기 위해 비선형성을 인지하여 게이트 채널에 용량을 할당하는 NA-LoRA를 제안하며, 추가적인 추론 오버헤드 없이 성능을 향상시킵니다.
TTS 평가의 초점이 기존의 '자연스러움'에서 문맥에 맞는 '적절성'으로 이동하고 있음을 연구합니다. 5가지 도메인에서 SOTA TTS 시스템을 분석한 결과, 도메인별로 요구되는 음성 특성이 다르며 일률적인 평가 지표로는 한계가 있음을 입증했습니다.
LLM의 안전성 학습 과정에서 발생하는 과잉 거부(Over-Refusal) 문제를 해결하기 위한 새로운 연구를 소개합니다. 유해한 추론을 탐색 신호로 활용하여 유해 프롬프트와 무해 프롬프트를 더 정확히 구분하는 SEAR 모델을 제안합니다.
전이 확률을 모르는 MDP 환경에서 데이터 의존적 후회 한계를 달성하는 새로운 정책 최적화 알고리즘을 제안합니다. 낙관적 FTRL 기반의 알고리즘을 통해 적대적 및 확률적 손실 모두에 적응하며, 전이 의존적 복잡도 항을 포함한 새로운 이론적 한계를 규명했습니다.
Looped Transformer를 활용하여 잠재적 추론(Latent CoT)의 성능 한계를 극복한 LOTUS를 제안합니다. LOTUS는 3B 규모에서 명시적 CoT와의 성능 격차를 해소하며, 추론 지연 시간을 최대 6.9배까지 단축합니다.
에너지 수요 예측의 불확실성을 정량화하기 위해 STGNN과 테이블형 파운데이션 모델을 결합한 STOIC 프레임워크를 제안합니다. 이 모델은 인컨텍스트 학습을 통해 시공간적 의존성을 포착하며, 기존 방식보다 신뢰도 높은 예측 구간을 제공합니다.
트랜스포머의 FFN 레이어에 명시적 퍼지 논리를 도입하여 모델의 내부 동작을 판독 가능하게 만드는 연구입니다. 자기 망각 양화사를 통해 훈련 중 논리 구조가 붕괴되는 문제를 해결하고, 유닛이 문법적 허가(licensing)를 탐지하는 메커니즘을 규명했습니다.