Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 연구는 기존 형사 사건 중심의 연구에서 벗어나, 복잡한 민사 사건을 시뮬레이션하기 위한 멀티 에이전트 프레임워크를 제안합니다. 메모리 모듈과 법령 검색 기능을 통합하여 장기적인 재판 과정을 지원하며, 실험을 통해 신뢰할 수 있는 민사 판결 생성 능력을 입증했습니다.
분포 드리프트 상황에서 LLM의 신뢰성을 높이기 위한 경량 추론 시 정렬 방법론인 GGRO를 제안합니다. GGRO는 토큰 수준의 엔트로피를 통해 불확실성을 식별하고, 보상 모델의 그래디언트 신호를 활용해 생성 궤적을 유도하여 보상 해킹 문제를 완화합니다.
자율 주행 MLLM이 올바른 시각적 근거를 바탕으로 답변하는지 평가하기 위한 새로운 다중 뷰 벤치마크를 제안합니다. NuScenes 데이터를 활용하여 모델이 질문에 답할 때 어떤 카메라 뷰를 참조했는지 식별하는 능력을 측정합니다.
기존 생물 의학 언어 모델이 상관관계와 인과관계를 구분하지 못하는 문제를 해결하기 위해 인간 메타데이터 임베딩 기법을 제안합니다. 대조 학습과 BODHI를 통해 도메인 간 분리도를 크게 향상시켰으며, Intel Xeon AMX 환경에서 OpenVINO를 통한 최적화 성능을 입증했습니다.
기계 번역(MT) 기술의 발전과 실제 사용자 요구 사이의 간극을 분석한 연구입니다. AI 개발자와 전문 번역가 등 네 그룹의 소셜 미디어 데이터를 분석하여, 기술적 성능 중심의 연구와 윤리·신뢰성 중심의 사용자 요구 간의 차이를 조명합니다.
대규모 추론 모델(LRM)의 사고(Thinking) 과정이 지시 이행(Instruction Following) 성능에 미치는 영향을 분석한 연구입니다. 사고 과정은 계획(Planning) 능력은 향상시키지만, 정밀도(Precision) 측면에서는 성능을 저하시키는 양면성을 보입니다.
긴 컨텍스트 언어 모델의 KV 캐시 병목 현상을 해결하기 위해 인코더-디코더 구조를 활용한 새로운 압축 기술을 제안합니다. LCLMs는 높은 압축률에서도 모델 품질을 유지하며, 에이전트의 효율적인 컨텍스트 처리를 지원합니다.
멀티모달 에이전트의 상호작용적 공간 추론 능력을 평가하기 위한 통합 벤치마크인 SpatialWorld를 소개합니다. 8개의 시뮬레이션 백엔드와 760개의 인간 주석 작업을 통해 에이전트의 능동적 탐색 및 계획 능력을 엄격히 검증합니다.
sEMG와 입술 읽기 신호를 결합하여 무성 음성 합성을 수행하는 새로운 다중 모달 프레임워크를 제안합니다. 학습 중 양식 마스킹 전략을 통해 센서 실패나 신호 저하 상황에서도 강건한 음성 복원이 가능함을 입증했습니다.
멀티모달 LLM 에이전트가 참조 게임에서 인간과 달리 파트너 특화적인 관습을 형성하지 못한다는 연구 결과입니다. 에이전트는 효율적인 설명 압축 대신 장황한 설명을 통해 조율을 달성하며, 이는 인간의 동조(Entrainment) 방식과 차이가 있습니다.
딥러닝 기반 화자 확인(SV) 모델의 학습 및 추론 과정에서 발생하는 에너지 소비와 탄소 배출량을 분석한 연구입니다. 모델의 깊이와 너비가 증가함에 따라 성능 향상 대비 에너지 소비가 급격히 증가하는 수확 체감 지점을 확인했습니다.
ConSteer-RL은 LLM의 추론 능력을 높이기 위해 모델의 토큰별 신뢰도 신호를 강화학습에 통합하는 프레임워크입니다. GRPO를 기반으로 과도한 확신을 방지하고 정확한 추론을 강화하여 기존 RLVR 방식의 한계를 극복합니다.
LLM의 환각 현상을 탐지하기 위해 적은 레이블 데이터로도 높은 성능을 내는 2단계 시암 프레임워크 CPIL을 제안합니다. 패러프레이징 불변성 학습과 하드 네거티브 채굴을 통해 효율적인 임베딩 공간을 구축합니다.
다국어 LLM 판사 모델에서 발생하는 언어 간 불일치를 노이즈가 아닌 상호 보완적인 신호로 활용하는 SEMJ를 제안합니다. SEMJ는 반복적인 자기 성찰과 재평가를 통해 다국어 변형 간의 불일치를 개선하며, 기존 방식보다 높은 정확도와 일관성을 달성합니다.
CLASP는 VLM과 작업 매개변수화 모방 학습을 결합하여 로봇의 자연어 명령 이해와 데이터 효율성을 동시에 해결하는 연구입니다. 미세 조정 없이도 VLM이 기술 스키마를 생성하고 명령을 해석하여 새로운 행동을 구성할 수 있습니다.
LLM의 환각 탐지를 위해 패러프레이즈 일관성을 활용하는 CCHD 방법론을 제안합니다. 학습 과정을 제약 최적화 문제로 공식화하여 추론 오버헤드 없이 기존 벤치마크 모델보다 뛰어난 성능을 입증했습니다.
TextEconomizer는 디노이징 Transformer와 엔트로피 코딩을 결합하여 텍스트의 핵심 의미를 보존하면서 크기를 획기적으로 줄이는 손실 압축 모델입니다. 기존 모델 대비 훨씬 적은 파라미터로도 높은 압축률과 뛰어난 텍스트 품질을 동시에 달성했습니다.
AlignFed는 이기종 엣지 환경에서 LLM을 위한 비동기 연합 미세 조정을 지원하는 새로운 프레임워크입니다. 모델 드리프트와 클라이언트 드리프트 문제를 해결하기 위해 다단계 의미론적 정렬 메커니즘을 제안합니다.
LALMs의 언어적·문화적 진정성을 평가하기 위한 다국어·다문화 벤치마크인 GlobeAudio를 제안합니다. 6개 언어의 5,637개 문항을 통해 모델의 청각적 추론 및 문화적 해석 능력을 검증합니다.
아동의 음성 데이터에서 말더듬을 탐지하기 위해 계층적 이종 그래프 신경망(HGNN)을 활용한 Paediatric-HGNN 프레임워크를 제안합니다. 단어와 음향 세그먼트 간의 상호작용을 모델링하여 발달 중인 아동 음성의 특성을 효과적으로 포착합니다.