Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
개인정보 보호 문제를 해결하기 위해 LLM을 활용하여 종단적 합성 임상 기록을 생성하는 모듈형 파이프라인을 제안합니다. 구조화된 데이터 생성부터 비구조화된 기록 생성까지 결합하여 임상적 일관성과 다양성을 확보한 데이터셋을 공개합니다.
제3자 벤더 통합이 심화됨에 따라 발생하는 사이버 보안 리스크와 거버넌스 문제를 '이행적 신뢰(transitive trust)' 개념으로 분석한 논문입니다. OpenAI-Mixpanel 보안 사고를 사례로 활용하여, 서비스 제공자와 벤더 간의 신뢰 관계가 어떻게 보안 책임 전이로 이어지는지 탐구합니다.
TAVR-VLM은 의료 영상 기반의 TAVR 계획 시 발생하는 진단적 환각 문제를 해결하기 위한 새로운 MLLM 프레임워크입니다. R-CGA 메커니즘을 통해 위험 요소와 해부학적 근거를 인과적으로 연결하여 생성의 정확도와 해석 가능성을 높였습니다.
패턴 보존 속성 검색을 위해 제안된 MO-DiT+HPPO 프레임워크를 소개합니다. Metric-Ordered 학습과 HPPO를 통해 검색 결과의 패턴 순도와 속성 지표를 동시에 최적화하는 연속적 생성형 검색 방식을 제안합니다.
LLM의 긴 문맥 추론 시 발생하는 KV 캐시 문제를 해결하기 위해 정보 이론적 신호를 활용한 InfoKV 프레임워크를 제안합니다. 기존 어텐션 기반 방식과 달리 예측 불확실성을 고려하여 미래 문맥에 실질적인 영향을 미치는 토큰을 효과적으로 압축합니다.
시각 및 언어 개념의 정렬을 개선하기 위해 최적 운송 흐름(OTF-CBM)을 제안하는 연구입니다. 동적인 교차 모달 운송 과정을 통해 세밀한 개념 국지화를 구현하며, 기존 방식보다 높은 분류 정확도와 개념 충실도를 달성했습니다.
비디오 추론 모델이 시각적 노이즈에 취약한 '맹목적 신뢰 문제'를 해결하기 위해, 프레임별 신뢰도를 고려하는 Robust-TO 프레임워크를 제안합니다. 이 모델은 도구 오케스트레이션과 신뢰도 기반 가중치 합성을 통해 열악한 환경에서도 높은 정확도를 유지합니다.
인도 의료 환경의 다국어 임상 ASR 성능을 감사하고 편향을 제거하는 SamaVaani 연구를 소개합니다. 8개의 최첨단 모델을 비교 분석하여 지역 언어 및 인구 통계학적 그룹 간의 성능 격차를 확인했습니다. Gemma3n과 OmniLingual을 미세 조정하여 공정성을 개선하는 통합 편향 제거 기술을 제안합니다.
멀티태스크 모델 병합 시 발생하는 파라미터 간섭 문제를 해결하기 위해 ReTeX 프레임워크를 제안합니다. 아핀 변환을 활용해 파라미터 오프셋을 예측함으로써 단일 병합 체크포인트에서 개별 태스크 전문가의 성능을 효과적으로 복구합니다.
LLM 강화학습 시 발생하는 '방향 불일치' 문제를 해결하기 위한 Geoalign 기법을 제안합니다. 롤아웃 큐레이션을 통해 보상 노이즈로 인한 학습 불안정성을 줄이고, 대화 정렬 및 수학적 추론 성능을 향상시킵니다.
자율 주행 차량의 안전을 위해 지연 시간을 최소화하면서 운전자 상태를 모니터링하는 비용 인식 선택적 추론 프레임워크를 제안합니다. RGB 영상과 생체 신호를 결합한 경량 모델과 월드 모델링을 통해 위험을 감지하고 안전하지 않은 결정을 방지합니다.
LLM 에이전트가 유사한 작업 간의 차이를 구분하지 못하는 '작업 무감각성(Task Insensitivity)' 문제를 분석하고 그 원인을 규명합니다. 모델이 지시문보다 학습된 패턴에 의존하는 현상을 발견하였으며, 이를 해결하기 위한 새로운 최적화 기법을 제안합니다.
Chai는 암호학적 오용 취약점을 탐지하고 검증하기 위한 새로운 AI 기반 시스템입니다. 차분 테스트 기법을 재고하여 라이브러리 수준의 결함을 탐지하고, 암호학적 의존성 그래프를 통해 이를 애플리케이션 취약점으로 연결합니다.
다중 참조 이미지 생성(MRIG)의 한계를 극복하기 위해 새로운 벤치마크인 OmniRef-Bench와 2단계 학습 프레임워크인 DyRef를 제안합니다. DyRef는 동적 보상 최적화를 통해 복잡한 참조 이미지 시나리오에서 모델의 성능과 일반화 능력을 크게 향상시킵니다.
역동적인 3D 환경에서 카메라가 서사적 의도에 따라 능동적으로 시각적 주의를 집중할 수 있도록 하는 Look-Before-Move 프레임워크를 제안합니다. 관찰 사양과 움직임 실행을 분리하여 서사에 부합하면서도 물리적으로 실행 가능한 카메라 경로를 생성합니다.
LLM 에이전트에서 CoT(사고의 사슬) 학습이 실제 행동 품질 개선에 미치는 영향을 분석한 연구입니다. 연구 결과, CoT 학습은 추론 과정을 통한 행동 수정보다는 프롬프트 자체로부터 행동을 예측하는 능력을 향상시키는 데 기여함을 밝혀냈습니다.
Einstein World Models(EWM)는 LLM의 추론 능력을 향상시키기 위해 시각적-시간적 롤아웃을 활용하는 새로운 연구 프레임워크입니다. 텍스트 기반 추론의 한계를 극복하고자 시각적 사고 실험을 통해 반사실적 사건을 시각화하고 검사 가능한 가설을 생성합니다.
경험적 베이즈(EB) 추정 시 커널 오지정으로 인해 발생하는 위험을 분석하고, 이를 해결하기 위한 XMSE 인지형 혼합 추정량을 제안합니다. 제안된 방식은 ML과 EB 사이를 최적으로 보간하여 커널 설정이 부적절할 때도 안정적인 성능을 보장합니다.
언어 모델의 의미론적 해석 능력과 물리 시뮬레이션의 사실성을 결합한 ICMPG 프레임워크를 제안합니다. LLM을 플래너로 사용하고 물리적 피드백을 통해 동작을 정제함으로써, 재학습 없이도 물리적으로 타당한 동작 합성을 가능하게 합니다.
정신 건강 지원을 위한 LLM 상호작용 시, 질문의 맥락적 프레이밍에 따라 모델의 응답이 불안정해지는 현상을 연구했습니다. 층별 프로빙과 활성화 스티어링을 통해 프레이밍이 모델의 내부 표현에 미치는 영향을 분석하고, 시스템의 신뢰성을 위한 강건성 확보의 중요성을 강조합니다.