Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Ab initio 모델링의 대칭성을 활용하여 해석 가능한 신경망(NN) 기반의 핵 질량 모델을 제안합니다. SU(3) 및 SU(4) 카시미르 연산자를 기반으로 한 WINN 모델은 기존 모델 대비 낮은 오차를 기록하며 물리적 통찰을 제공합니다.
비볼록 및 비-Lipschitz 환경에서 Bregman ADMM의 2차 KKT 조건을 보장하는 이론적 분석을 제시합니다. 양방향 상대적 매끄러움을 활용하여 다항식 목적 함수를 포함하는 행렬 및 텐서 모델에 대한 수렴성을 입증했습니다.
Democratic ICAI는 페르소나 토론 방식을 통해 선호도 기반 정렬 과정에서 발생하는 복잡한 추론을 자연어 원칙으로 도출하는 새로운 연구입니다. 기존 방식보다 더 풍부한 설명을 제공하여 LLM의 의사 결정 모델링을 개선하고 선호도 예측 성능을 높입니다.
Masked Diffusion Model(MDM)의 성능을 높이기 위해 보상 유도 재마스킹 기술을 적용한 MDM-VGB 샘플러를 제안합니다. 이 방식은 백트래킹 랜덤 워크를 통해 고보상 샘플 생성을 유도하며, 기존 방식보다 효율적인 복잡도로 제약 조건 충족 문제를 해결합니다.
양성 전용 샘플만을 이용한 이진 분류 학습의 특성화를 다룬 연구입니다. 개념 클래스가 적절하게 학습 가능하기 위한 필요충분조건으로 VC 차원과 새로운 '균등 외부 분리 가능성' 조건을 제시합니다.
CARVE는 기존 순환 모델의 메모리 맹목적 게이팅 문제를 해결하기 위해 '키 축에서만 삭제'하는 원칙을 도입한 새로운 순환 모델입니다. GPU 메모리 텐서를 재사용하여 효율성을 높였으며, 기존 GDN-2 대비 성능과 메모리 효율성을 모두 개선했습니다.
선형 생성기가 구조화된 잠재 공분산을 가진 데이터로부터 저차원 부분 공간을 학습하는 고차원 GAN의 역학을 연구합니다. 다중 특징 판별기 설정에서 학습 과정이 유효 공분산에 의해 지배되는 결정론적 ODE로 수렴함을 증명했습니다.
공유 어휘를 사용하는 LLM 제품군에서 효율적인 소스 선택을 위한 새로운 연구인 FisherSketch를 소개합니다. FisherSketch는 계산 비용이 높은 Fisher 행렬 대신 활성화와 오차 공간의 코사인 유사도를 활용하여 태스크 간의 업데이트 기하학을 실용적으로 추정합니다.
정신과 전문의의 주석을 바탕으로 관계적 맥락에서의 정신 건강 상태를 모델링하기 위한 RSPC 벤치마크를 소개합니다. Reddit 데이터를 활용해 기분 장애, 관계적 트리거, 관계 단계를 분석하며 다양한 LLM의 성능을 비교합니다.
Ribbon은 고차원 모델의 예측 불확실성을 효율적으로 정량화하기 위한 새로운 근사법을 제안합니다. 반복적인 모델 재학습 대신 영향 함수(influence-function) 선형화를 사용하여 비용을 획기적으로 줄이면서도 베이지안 부트스트랩의 구조를 유지합니다.
소셜 미디어 내 조작적인 베팅 광고를 탐지하기 위한 설명 주석 데이터셋인 BetXplain을 제안합니다. 이 데이터셋은 광고의 기만적 요소를 식별하고 논리적 근거를 제공하며, 다중 작업 학습을 통해 모델의 설명력을 높이는 데 중점을 둡니다.
시계열 예측에서 모델 규모를 키우는 대신 전처리 최적화를 통해 선형 모델의 성능을 극대화하는 연구를 소개합니다. 릿지 회귀를 활용해 8개 벤치마크에서 컨텍스트 길이, 정규화, 증강 패턴을 분석한 결과, 최적화된 선형 모델이 Transformer나 CNN 등 복잡한 모델을 능가함을 입증했습니다.
관측된 해 데이터를 통해 지배 방정식을 학습하는 과학적 머신러닝 분야의 식별 가능성 문제를 다룹니다. 하우스도르프 거리를 도입하여 선형 및 비선형 ODE의 식별 가능성 경계를 설정하고, 방정식 복구에 필요한 샘플 복잡도를 정량적으로 분석합니다.
채용 검색 쿼리 생성을 위한 RLAIF 프레임워크와 보상 신호 설계 연구를 다룹니다. LLM이 보상을 해킹하여 문구를 그대로 복사하는 문제를 해결하기 위해 구조화된 보상 엔지니어링의 중요성을 입증했습니다.
아날로그 하드웨어의 물리적 제약을 극복하고 저전력 생성 모델링을 가능하게 하는 '아날로그 상호작용 시스템(AIS)' 프레임워크를 제안합니다. 시변 매개변수와 숨겨진 물리적 상태를 활용해 하드웨어와 소프트웨어 간의 표현력 격차를 줄이고, 디지털 대비 획기적인 에너지 효율을 달성했습니다.
하프스페이스 절단이 적용된 고차원 가우시안 분포를 학습하는 최적의 샘플 복잡도를 가진 새로운 알고리즘을 제안합니다. 기존 연구보다 효율적인 샘플 및 시간 복잡도를 달성하며, 상대적 절단 파라미터를 활용해 복잡한 경사 하강법 없이도 기저 가우시안을 복구할 수 있습니다.
제한된 실험 데이터와 높은 시뮬레이션 비용 문제를 해결하기 위해 다중 충실도 전이 학습 프레임워크를 제안합니다. CAE와 물리 기반 시뮬레이션을 결합하여 유도파 기반 구조물 손상 진단의 정확도와 효율성을 높였습니다.
본 연구는 온라인 최적화 프레임워크인 경사 평형(GEQ)과 Blackwell 접근 가능성(Blackwell approachability) 사이의 알고리즘적 동등성을 증명합니다. 이를 통해 GEQ가 후회 최소화 및 교정 프레임워크와 동일한 지형에 있음을 밝히고 효율적인 환원 방식을 제시합니다.
생성형 월드 모델의 환각 현상이 데이터 커버리지가 낮은 영역에서 발생한다는 가설을 검증하고, 이를 탐지 및 완화하는 방법을 제안합니다. MMBench2 데이터셋을 통해 세 가지 환각 모드를 식별하고, 커버리지 인식 샘플링과 호기심 보상을 활용한 효율적인 미세 조정 기술을 선보입니다.
LLM의 시퀀스 확률과 답변의 정확도 사이의 상관관계를 분석한 연구입니다. 시퀀스 확률이 특정 데이터셋 내에서는 정확도를 예측할 수 있으나, 디코딩 방법이나 하이퍼파라미터 변경을 통한 확률 상승이 반드시 정확도 향상으로 이어지지는 않음을 밝힙니다.