Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
에이전트 기반 컴퓨터 사용(CUA) 연구에서 단일 실행 결과 보고가 초래하는 통계적 오류를 지적합니다. 데이터 추출과 실행 간 비결정성으로 인해 발생하는 높은 분산을 분석하며, 신뢰할 수 있는 평가를 위해 멀티 시드 기반 보고의 필요성을 강조합니다.
표준 SAE의 한계를 극복하기 위해 특징의 지속성을 학습하는 Persistent Sparse Autoencoders(Persistent SAEs)를 제안합니다. 이 모델은 빠른 특징과 느린 특징의 시간 척도를 학습하여, 주제 수준의 정보를 지속적인 상태로 유지하며 언어 모델의 해석 가능성을 높입니다.
자원이 부족한 아삼어의 음성 인식을 위해 Whisper 모델을 미세 조정(Fine-tuning)하는 연구를 제안합니다. 하드웨어 인지 최적화 파이프라인을 통해 성능을 크게 개선하였으며, 기존 Zero-shot 방식 대비 WER 및 CER 등 주요 지표에서 유의미한 향상을 달성했습니다.
고전적 Rate-Distortion 이론에 지각(Perception) 축을 추가한 RDP 이론을 다룹니다. 분포 유사성을 기반으로 한 RDP 함수(RDPF)의 계산 방법과 최적화 메커니즘을 설명하며, 정보 이론적 관점에서의 새로운 압축 한계를 제시합니다.
자원이 제한된 엣지 환경에서 MoE 모델의 추론 효율을 높이기 위한 OrderMoE 프레임워크를 제안합니다. 전문가 간의 기능적 유사성을 활용하여 통신 오버헤드를 줄이고 지연 시간을 단축하는 것이 핵심입니다.
Node4All은 데이터셋별 최적화 없이 임의의 그래프 데이터셋에 적용 가능한 범용 노드 표현 학습 모델입니다. Channel Graph Transformer와 합성 그래프 기반 자기지도 학습을 통해 뛰어난 일반화 성능을 구현했습니다.
Transformer 기반 LLM의 산술 작업 성능을 개선하기 위해 인간의 학습 전략을 적용한 연구입니다. 모델이 인간과 유사한 학습 패턴을 보임을 입증하고, 하위 작업 분해 및 인지 강화 방법을 통해 정확도를 향상시켰습니다.
불균형 회귀 문제를 해결하기 위해 밀도 정보를 활용하는 DADIR 프레임워크를 제안합니다. 타겟 공간의 적응형 분할과 DR-CVAE를 통한 희소 영역 보존을 통해 데이터 불균형을 효과적으로 해소합니다.
LLM 사후 학습의 한계를 극복하기 위해 RL과 온-정책 증류(OPD)를 결합한 'Distilled RL'을 제안합니다. 이 방식은 미세한 입도의 가이드를 제공하여 새로운 지식을 효과적으로 전달하며, 기존 방식보다 뛰어난 성능을 입증했습니다.
DynImmune-BERT는 Neural ODE를 활용하여 T 세포 수용체 레퍼토리의 종단적 변화를 모델링하는 연속 시간 Transformer 모델입니다. 기존 정적 모델의 한계를 넘어 클론의 확장, 수축, 재출현 등 동적인 면역 상태를 효과적으로 예측합니다.
양자화된 LLM의 신뢰성, 불확실성, 보정 및 강건성을 종합적으로 평가한 연구입니다. 모델의 비트 수에 따른 신뢰성 스케일링 법칙이 비선형적임을 밝히고, 4비트 양자화에서 최적의 트레이드오프가 발생함을 제시합니다.
생성 모델 워터마크의 포렌식 기능을 정보 이론적 관점에서 분석한 연구입니다. 워터마크를 통한 사용자 귀속, 페이로드 추출, 국지화의 비용을 샘플 길이와 엔트로피율의 관계로 정의하고 엄밀한 이론적 법칙을 제시합니다.
Flow Matching 기술을 활용하여 자이로키네틱 난류의 정상 상태 통계를 직접 추정하는 생성 모델 GyroFlow를 제안합니다. 기존의 자기회귀 방식이 가진 오차 누적 문제를 해결하고, 과도 단계를 거치지 않고도 포화된 스냅샷을 빠르게 생성하여 계산 효율성을 극대화합니다.
레이블 없는 데이터를 활용해 신경 데이터를 디코딩하는 MOJO 프레임워크를 소개합니다. 자기 지도 학습(SSL)과 지도 학습(SL)을 결합하여, 데이터가 부족한 상황에서도 높은 성능과 일반화 능력을 보여줍니다.
Evo 2 유전체 파운데이션 모델의 내부 표현을 활용하여 메타게놈 데이터 내 항생제 내성(AMR) 및 박테리아 독성을 탐지하는 연구입니다. 미세 조정 없이 선형 및 어텐션 프로브만으로 높은 판별 성능을 입증하며 생물 보안 스크리닝의 가능성을 제시합니다.
IKPLS 알고리즘의 계산 효율성을 높이기 위해 X 회전 및 Y 로딩 계산 과정을 가속화하는 새로운 전략을 제안합니다. 병렬화가 용이한 직접 평가 방식과 연산 비용을 획기적으로 줄이는 등가성 식별을 통해 CPU와 GPU 환경에서 성능을 크게 향상시켰습니다.
교차로 안전을 위해 LiDAR를 활용한 선제적 인프라 프레임워크인 PRISA를 제안합니다. 수동 주석 없이 궤적 예측 모델을 학습하며, 실시간 위험 탐지와 이중 안전 평가를 통해 다중 에이전트 상호작용을 모니터링합니다.
Riemannian conditional flow matching 모델인 ShellFlow를 통해 LHC 데이터를 기반으로 표준 모형(Standard Model)의 구조를 학습하는 연구입니다. 단일 트랜스포머 모델이 광범위한 질량 영역에서 입자 운동학 및 물리적 상관관계를 성공적으로 재현함을 입증했습니다.
주거용 단기 부하 예측(STLF)을 위해 행동 패턴을 Neural Process 모델 내에 내장한 '행동 조건부 Attentive Neural Process(ANP)' 프레임워크를 제안합니다. 이 모델은 이산 및 연속 잠재 변수를 활용하여 사용자별 이질적인 소비 패턴과 불확실성을 효과적으로 포착합니다.
동적 시스템의 제어를 위해 물리 법칙과 강화학습을 결합한 새로운 패러다임인 PEARL을 제안합니다. 자동 미분을 활용한 액터-인접 알고리즘을 통해 샘플 효율성을 높이고 고차원 시스템에서도 안정적인 제어가 가능함을 입증했습니다.