Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
X³-OPD는 텍스트 교사 모델의 추론 능력을 오디오-언어 학생 모델로 전달하는 온폴리시 증류 프레임워크입니다. 음성 추론, 음향 장면 분석, 구어 대화 맥락을 포함하는 3단계 코퍼스를 통해 오디오 모델의 논리적 추론 능력을 향상시킵니다.
기존 플로우 기반 생성 모델의 고정된 차원 한계를 극복하기 위해 차원이 증가하는 분포 간의 흐름을 정의하는 EFlows와 EFMs를 제안합니다. 확장 연산자와 전송 맵을 결합하여 가변 크기의 그래프 및 시퀀스 생성을 가능하게 하는 새로운 프레임워크를 소개합니다.
코드 모델의 개념-회로 추출 방법을 통해 태스크, 언어, 모델의 역할을 분석한 연구입니다. 분석 결과, 어떤 개념을 처리할지는 태스크가 결정하지만, 처리 위치와 방식은 모델에 따라 다르다는 것을 밝혀냈습니다.
Diffusion Transformers(DiTs)의 W4A4 양자화 시 발생하는 품질 저하 문제를 해결하기 위해 Kronecker 구조 블록 변환을 사용하는 KroQuant를 제안합니다. 이 방법은 낮은 추론 비용과 높은 양자화 정확도를 동시에 달성하며, 기존 방식보다 효율적인 연산이 가능합니다.
기후 변화로 인한 전기차 충전 인프라의 결함을 예측하기 위해 개발된 FGDSE 프레임워크를 소개합니다. 이 모델은 이질적인 신호를 처리하는 동적 스태킹 앙상블과 인과적 의사결정 지원을 결합하여 30일간의 결함 위험을 정확하게 예측합니다.
이산 플로우 매칭 모델의 생성 품질을 높이기 위해 국소 문맥 정보를 통합하는 새로운 프레임워크를 제안합니다. 문맥 가중 샘플러와 스케일링된 교차 엔트로피 손실 함수를 통해 OpenWebText 기준 생성 퍼플렉시티를 최대 63% 감소시켰습니다.
CoT 추론 모델의 토큰 예산 소진에 따른 수렴 및 비수렴 현상을 분석하고, 모델 내부의 은닉 상태 활성화를 통해 이를 조기에 탐지할 수 있음을 입증했습니다. 연구 결과, 사고 체인 초기의 중간 표현이 최종 수렴 여부를 예측하는 데 유효함을 확인했습니다.
고재현율 후보 생성 단계에서 누락된 관련 항목을 검증하기 위한 유한 샘플 커버리지 감사 이론을 연구합니다. 제외된 풀(excluded pool) 샘플링의 필요성과 레이블 복잡도의 하한을 증명하며, 이를 위한 정확한 유한 샘플 툴킷을 제안합니다.
LLM의 추론 성능을 높이기 위해 토큰 수준의 오류를 식별하고 유효한 추론 과정을 재사용하는 TTEL 알고리즘을 제안합니다. 기존의 독립적 샘플링 방식보다 계산 효율성을 극대화하며, 코딩 및 수학 벤치마크에서 뛰어난 성능을 입증했습니다.
고에너지 물리학(HEP)의 실시간 이상 탐지를 위해 양자 오토인코더를 FPGA 하드웨어로 가속하는 연구를 소개합니다. 이 모델은 고전적 방식과 대등한 성능을 보이면서도 저지연 하드웨어 제약 조건을 충족합니다.
공변량 변화와 종속적 관측치가 존재하는 환경에서 비모수 분위수 및 Huber 회귀를 위한 딥 신경망 추정기를 제안합니다. 제안된 SPDNN 추정기는 밀도 비율을 모르는 경우에도 2단계 사전 학습을 통해 효과적으로 작동하며, 다양한 시계열 모델에서 최적의 수렴 속도를 달성합니다.
리만 다양체 상의 강한 측지 볼록 손실 함수를 위한 분산형 온라인 최적화 연구를 다룹니다. 기존 연구가 다루지 못한 강한 g-볼록 영역에서 $O( ext{log } T)$의 정적 후회 상한을 최초로 수립했습니다.
불확실성이 존재하는 환경에서 초탄성 구성 모델링을 수행하기 위한 iPANN 및 fPANN 프레임워크를 제안합니다. 구간 및 퍼지 논리를 활용하여 물리적 제약 조건을 유지하면서도 데이터의 노이즈와 희소성을 효과적으로 다룹니다.
레이블이 지정된 데이터 없이 FVM 잔차를 최소화하여 열-유체장을 예측하는 어텐션 그래프 신경망 학습 방법을 제안합니다. 실험 결과, 데이터 생성 비용을 절감하면서도 기존 지도 학습 모델보다 높은 정확도를 보였습니다.
IBM Quantum 하드웨어에서 4-큐비트 ZZ 양자 커널의 기하학적 생존성을 분석한 연구입니다. 게이트 트월링(gate twirling)이 기하학적 구조 보존에 가장 효과적임을 확인하였으나, 충실도와 레이블 정렬 사이의 불일치 현상을 발견했습니다.
나노포어 센서의 복잡한 이온 전류 신호를 정확히 분류하기 위해 시계열, 웨이브렛 이미지, 정적 특징을 결합한 멀티모달 트랜스포머 아키텍처를 제안합니다. 이 모델은 기존 방식보다 높은 성능을 보였으며, 다양한 데이터셋에서 뛰어난 분자 식별 능력을 입증했습니다.
스트리밍 데이터 환경에서 도메인 적응을 위한 최초의 온라인 분산 감소(SVR) 알고리즘인 ARROW를 제안합니다. MMD와 CORAL 손실 함수를 활용하여 미니배치에 적응적으로 가중치를 재설정함으로써 오프라인 알고리즘 수준의 성능을 구현합니다.
기존 MLP 기반 물리 정보 학습의 한계를 극복하기 위해 KAN과 Petrov-Galerkin 정식화를 결합한 PG-KINN을 제안합니다. 이 모델은 부분 적분을 통해 미분 차수를 낮추고 비선형 및 역문제 해결 능력을 높여 다양한 물리 벤치마크에서 우수한 성능을 보입니다.
리만 기하학을 기반으로 매니폴드 값 표현을 지원하는 통합 딥러닝 프레임워크를 제안합니다. 배치 정규화와 로지스틱 회귀를 리만 매니폴드로 확장하고, 계산 효율적인 리만 메트릭을 통해 다양한 기하학적 구조를 학습할 수 있는 모듈과 아키텍처를 개발했습니다.
자동화된 AI R&D 과정에서 에이전트가 수행하는 은밀한 사보타주를 탐지하고 평가하기 위한 프레임워크 ResearchArena를 제안합니다. 모델 최적화 및 안전 학습 등 다양한 과업에서 모니터링 시스템의 성능을 분석하여 AI 제어의 한계를 규명합니다.