Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
자원이 제한된 엣지 환경에서 MoE 모델의 추론 효율을 높이기 위한 OrderMoE 프레임워크를 제안합니다. 전문가 간의 기능적 유사성을 활용하여 통신 오버헤드를 줄이고 지연 시간을 단축하는 것이 핵심입니다.
Node4All은 데이터셋별 최적화 없이 임의의 그래프 데이터셋에 적용 가능한 범용 노드 표현 학습 모델입니다. Channel Graph Transformer와 합성 그래프 기반 자기지도 학습을 통해 뛰어난 일반화 성능을 구현했습니다.
Transformer 기반 LLM의 산술 작업 성능을 개선하기 위해 인간의 학습 전략을 적용한 연구입니다. 모델이 인간과 유사한 학습 패턴을 보임을 입증하고, 하위 작업 분해 및 인지 강화 방법을 통해 정확도를 향상시켰습니다.
불균형 회귀 문제를 해결하기 위해 밀도 정보를 활용하는 DADIR 프레임워크를 제안합니다. 타겟 공간의 적응형 분할과 DR-CVAE를 통한 희소 영역 보존을 통해 데이터 불균형을 효과적으로 해소합니다.
LLM 사후 학습의 한계를 극복하기 위해 RL과 온-정책 증류(OPD)를 결합한 'Distilled RL'을 제안합니다. 이 방식은 미세한 입도의 가이드를 제공하여 새로운 지식을 효과적으로 전달하며, 기존 방식보다 뛰어난 성능을 입증했습니다.
DynImmune-BERT는 Neural ODE를 활용하여 T 세포 수용체 레퍼토리의 종단적 변화를 모델링하는 연속 시간 Transformer 모델입니다. 기존 정적 모델의 한계를 넘어 클론의 확장, 수축, 재출현 등 동적인 면역 상태를 효과적으로 예측합니다.
양자화된 LLM의 신뢰성, 불확실성, 보정 및 강건성을 종합적으로 평가한 연구입니다. 모델의 비트 수에 따른 신뢰성 스케일링 법칙이 비선형적임을 밝히고, 4비트 양자화에서 최적의 트레이드오프가 발생함을 제시합니다.
생성 모델 워터마크의 포렌식 기능을 정보 이론적 관점에서 분석한 연구입니다. 워터마크를 통한 사용자 귀속, 페이로드 추출, 국지화의 비용을 샘플 길이와 엔트로피율의 관계로 정의하고 엄밀한 이론적 법칙을 제시합니다.
Flow Matching 기술을 활용하여 자이로키네틱 난류의 정상 상태 통계를 직접 추정하는 생성 모델 GyroFlow를 제안합니다. 기존의 자기회귀 방식이 가진 오차 누적 문제를 해결하고, 과도 단계를 거치지 않고도 포화된 스냅샷을 빠르게 생성하여 계산 효율성을 극대화합니다.
레이블 없는 데이터를 활용해 신경 데이터를 디코딩하는 MOJO 프레임워크를 소개합니다. 자기 지도 학습(SSL)과 지도 학습(SL)을 결합하여, 데이터가 부족한 상황에서도 높은 성능과 일반화 능력을 보여줍니다.
Evo 2 유전체 파운데이션 모델의 내부 표현을 활용하여 메타게놈 데이터 내 항생제 내성(AMR) 및 박테리아 독성을 탐지하는 연구입니다. 미세 조정 없이 선형 및 어텐션 프로브만으로 높은 판별 성능을 입증하며 생물 보안 스크리닝의 가능성을 제시합니다.
IKPLS 알고리즘의 계산 효율성을 높이기 위해 X 회전 및 Y 로딩 계산 과정을 가속화하는 새로운 전략을 제안합니다. 병렬화가 용이한 직접 평가 방식과 연산 비용을 획기적으로 줄이는 등가성 식별을 통해 CPU와 GPU 환경에서 성능을 크게 향상시켰습니다.
교차로 안전을 위해 LiDAR를 활용한 선제적 인프라 프레임워크인 PRISA를 제안합니다. 수동 주석 없이 궤적 예측 모델을 학습하며, 실시간 위험 탐지와 이중 안전 평가를 통해 다중 에이전트 상호작용을 모니터링합니다.
Riemannian conditional flow matching 모델인 ShellFlow를 통해 LHC 데이터를 기반으로 표준 모형(Standard Model)의 구조를 학습하는 연구입니다. 단일 트랜스포머 모델이 광범위한 질량 영역에서 입자 운동학 및 물리적 상관관계를 성공적으로 재현함을 입증했습니다.
주거용 단기 부하 예측(STLF)을 위해 행동 패턴을 Neural Process 모델 내에 내장한 '행동 조건부 Attentive Neural Process(ANP)' 프레임워크를 제안합니다. 이 모델은 이산 및 연속 잠재 변수를 활용하여 사용자별 이질적인 소비 패턴과 불확실성을 효과적으로 포착합니다.
동적 시스템의 제어를 위해 물리 법칙과 강화학습을 결합한 새로운 패러다임인 PEARL을 제안합니다. 자동 미분을 활용한 액터-인접 알고리즘을 통해 샘플 효율성을 높이고 고차원 시스템에서도 안정적인 제어가 가능함을 입증했습니다.
MoE 모델 서빙 시 발생하는 가중치 메모리와 KV cache 간의 트레이드오프를 해결하기 위한 PagedWeight를 제안합니다. 런타임에 전문가 가중치를 동적으로 양자화하여 메모리 효율성과 모델 정확도 사이의 균형을 최적화합니다.
본 논문은 오프라인 강화학습(RL) 기반 치료 권고 연구에서 숨겨진 교란이나 모델 오지정 문제를 감지하기 위한 공변량 균형 진단 방법을 탐구합니다. 기존의 오프라인 RL 연구들은 편향 위험이 높거나, 현재 사용되는 공변량 균형 지표만으로는 충분히 평가할 수 없음을 보여줍니다.
본 논문은 컨텍스트 밴딧에 대해 오프라인 데이터만을 활용하여 오프-폴리시 평가를 수행하는 새로운 추정기인 Kernel-WIS를 제안합니다. 이 방법론은 점근적 일관성을 가지며, 행동 정책 사양 오류와 같은 복잡한 조건에서도 기존의 가중 중요 샘플링보다 우수한 성능을 보였습니다.
NeuronSoup은 기존 딥러닝의 동기적 계층 처리 방식을 공유 뉴런 풀을 이용한 비동기적 신호 전파로 대체하는 신경 계산 아키텍처입니다. 이 시스템은 유전 알고리즘으로 진화하며, 물리적으로 공유되는 은닉 뉴런들이 간섭 현상을 통해 정보를 전달합니다. MNIST 분류 실험에서 10,000세대 만에 85.9%의 테스트 정확도를 달성했습니다.