Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 LLM의 작동 메커니즘을 물리적 관점에서 분석하며, 인지장 이론(Cognitive Field Theory)을 적용했습니다. 트랜스포머 레이어 야코비안으로부터 이완 스펙트럼을 추출하여 TDOS와 메모리 자가 에너지 등을 정량적으로 측정했습니다. 그 결과, LLM의 역학이 적외선 느린 모드의 점진적 축적에 의해 지배됨을 보여주었습니다.
NAILS는 아이템 속성에 대한 목표 분포와 추천 출력을 정렬하는 새로운 방법을 제시합니다. 이 방법은 사용자 참여 최적화에만 집중된 기존 시스템의 한계를 극복하고, 공정성이나 다양성 같은 규범적 목표를 충족시키도록 돕습니다. 모델 재학습 없이도 원하는 속성 수준의 분포 유도가 가능하여 실용적입니다.
본 연구는 온라인 주성분 분석(PCA)의 bandit 피드백 버전을 다루며, 적대적 환경에서 학습자가 최소 후회(regret)를 달성하는 방법을 탐구합니다. 기존 알고리즘의 상한과 하한 경계를 개선하여 $r oot{d}T$ 순서의 minimax 후회를 확립했습니다. 특히, 새로운 온라인 미러 디센트와 적응형 적대자를 결합하여 이론적 성능을 크게 향상시켰습니다.
본 논문은 관측적 인과 추론에서 이질적인 치료 효과를 식별하는 방법을 제시합니다. 특히, 합성 잠재 결과(SPO) 모멘트를 재귀적으로 구성하여 치료 효과의 혼합을 복구하며, 이를 공유 프록시 신호 부분 공간으로 투영한 연산자 차이를 통해 잠재적 치료 효과를 추출할 수 있음을 보여줍니다.
GatedLinear는 시계열 예측의 이질성을 해결하기 위해 적응적 라우팅 프레임워크를 제안합니다. 이는 전역 추세, 차분 기반 증분, 위상 정렬 순환 등 세 가지 전문화된 선형 기저 풀을 활용하며, Tri-Factorized Fusion Gate를 통해 동적으로 오케스트레이션됩니다. 이 방식은 복잡한 모델 대비 높은 정확도와 작은 파라미터 크기를 달성합니다.
본 논문은 메타버스 플랫폼의 증가하는 사기 위험에 대응하기 위해 멀티모달, 멀티태스크 벤치마크 데이터셋인 TSAI-MetaFraud를 제안합니다. 이 데이터셋은 행동적, 거래적, 그래프 구조화된 정보를 통합하여 현실적인 사기와 자동화된 봇 시나리오를 포괄합니다. 이를 통해 메타버스 생태계의 신뢰할 수 있는 AI 발전을 위한 평가 기준을 제시합니다.
본 논문은 비침습적 EEG 디코딩을 위한 새로운 대조 학습 기반 사전 훈련 모델 CoCoT를 제안합니다. 기존의 마스크 복원 방식이 EEG 데이터에 최적이 아니라는 문제점을 지적하며, 다중 스케일 컨볼루션과 트랜스포머 인코더를 결합한 아키텍처를 설계했습니다. CoCoT는 다양한 벤치마크에서 높은 성능을 보여주며 대조 학습 기반 EEG Foundation Model의 가능성을 입증합니다.
본 논문은 현재 AI 시스템이 고정된 표현적 틀(representational frame) 내에서 작동하는 구조적 한계를 지적하며, 진정한 개방형 지능을 위해서는 새로운 표현적 원시 요소 생성 능력이 필요하다고 주장합니다. 저자들은 이 간극을 '어휘 격차'와 '검증자 격차'라는 두 가지 관점에서 분석하고, 이를 인지적 불일치 감소라는 틀로 해석했습니다.
본 논문은 VLM이 사물 개수(counting)에서 어려움을 겪는 현상을 분석하고, 그 원인을 내부 표현과 언어화된 출력 사이의 격차로 규명했습니다. 비선형 프로브 학습을 통해 모델이 잘못된 답을 내놓아도 올바른 정보를 인코딩함을 확인했으며, 이를 바탕으로 오류 감지 기반 자체 교정 방법을 제안하여 계수 정확도를 향상시켰습니다.
본 논문은 적대적 모델 트레이너가 대규모 깊은 피드포워드 신경망에 통계적으로 탐지 불가능한 백도어를 심을 수 있음을 이론적으로 증명했습니다. 이 백도어는 화이트박스 설정에서도 원본 모델과 구별하기 어려우며, 입력의 변동성을 조작하여 특정 출력으로 매핑하는 능력을 제공합니다.
본 논문은 난류 반응 유동의 DNS 가속화를 위해 물리 기반 기계 학습 프레임워크를 제안합니다. 이 모델은 상세 화학 소스 항을 대리 모델로 대체하고, 훈련 시 두 번째 열역학 법칙(비음성 엔트로피 생성)을 통합하여 물리적 일관성을 확보했습니다. 또한 잔여 데이터 증강 전략으로 계산 효율성과 정확도를 동시에 높였습니다.
본 논문은 확률적 회로(PCs)가 데이터 노이즈나 분포 변화에 취약한 문제를 해결하기 위해 PeTeR이라는 새로운 학습 후 강건화 프레임워크를 제안합니다. PeTeR은 사전 학습된 PC를 재학습 없이 분포 변화에 강건하게 만드는 데이터 프리 방식입니다.
본 논문은 Group Relative Policy Optimization (GRPO)의 한계를 극복하기 위해 AdaPrefix-GRPO라는 새로운 방법을 제안합니다. 이 방법은 참조 해답의 접두사 길이를 난이도에 따라 동적으로 조절하는 피드백 컨트롤러를 도입하여, 모델 학습 과정에서 가장 효과적인 기울기 신호를 얻도록 합니다. 이를 통해 어려운 문제 해결 능력을 크게 향상시키고 트레이스 길이는 줄일 수 있습니다.
본 논문은 PDE 기반 물리 시스템의 역설계를 위해 신경 연산자(DeepONet)와 진화 전략(CMA-ES)을 결합한 NOTES를 제안합니다. NOTES는 위상 정보를 활용하여 고차원 설계 공간에서 효율적이고 전이 가능한 글로벌 최적화를 수행하며, 나노광학 빔 디플렉터 및 구조 최적화 등 다양한 분야에서 우수한 성능을 입증했습니다.
본 연구는 인과적 셀프 어텐션의 2차 비용 문제를 해결하기 위해 트랜스포머 선형화 기법을 제안합니다. 모델 품질 보존에 초점을 맞춰, 상태 업데이트 설계와 구조적 개입(싱크 토큰 등)을 분석했습니다. LLaMA 및 Qwen 같은 대규모 모델까지 확장하여 MMLU에서 우수한 성능과 긴 컨텍스트 검색 능력을 입증했습니다.
본 논문은 MILP(혼합-정수 선형 계획법) 인스턴스를 생성하는 새로운 방법인 GraphBU를 제안합니다. 기존 방식의 한계를 극복하기 위해, GraphBU는 국부 서브문제와 그 인터페이스로 구성된 그래프 네이티브 생성기를 사용합니다. 이 접근법은 결합 노드를 마스터 제약 조건이나 경계 변수로 승격시켜 높은 호환성을 보장하며, 다운스트림 예측 및 검색 학습 성능을 개선하는 것으로 나타났습니다.
본 논문은 2단계 샘플링 프레임워크에서 커널 기반 연산자 학습을 연구하며, 오프라인 회귀와 온라인 재구성 과정을 다룹니다. 주요 이론적 기여는 데이터 크기($N, n, m$) 간의 명시적인 예산 할당 조건을 제시하여 전체 오차를 분석하고 수렴 스케일링 법칙을 도출했습니다. 또한, PDE 지식을 통합하는 물리 정보 기반 확장 방법을 제안합니다.
본 논문은 텐서 프로그램을 활용하여 무한 너비의 가우시안 프로세스 극한을 가진 랜덤 신경망을 연구하고, Wasserstein 거리에서의 정량적 수렴 이론을 제시합니다. 특히 유한 네트워크 실행과 그들의 가우시안 프로세스 극한 사이의 오차 경계를 명확히 합니다.
본 논문은 디더링 가우시안 메커니즘(dithered Gaussian mechanism)을 제안합니다. 이는 기존 이산 가우시안 메커니즘의 대안으로, 사적인 출력 자체를 이산화하여 표준 가우시안 메커니즘의 프라이버시 보장을 유지하면서 유한 정밀도 부동 소수점 취약점을 회피합니다. 또한, 증명 가능한 랜덤성 효율성을 통해 필요한 난수 비트 수를 크게 줄여 성능과 보안을 동시에 확보했습니다.
본 논문은 편미분 방정식(PDE)의 해 집합에 대한 유한 차원 임베딩을 학습하는 물리 정보 프레임워크를 제안합니다. 다중 헤드 Physics-Informed Neural Network를 사용하여 공유 본체가 잠재 다양체를 학습하고, 선형 헤드가 개별 해를 재구성합니다. 이 방법은 초기 조건의 변동성을 효과적으로 포착하며, 낮은 차원의 주성분으로 높은 분산 설명력을 보여줍니다.