Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
분자 그래프 신경망(GNNs)의 학습 파이프라인 내 '화학 인지적 허가' 단계를 고려한 새로운 백도어 공격 및 방어 연구를 다룹니다. 기존 공격의 한계를 지적하며, 화학적으로 유효한 모티프를 활용해 허가 단계를 통과하는 ChemBack 공격 모델을 제안합니다.
스위스 형사법 맥락에서 LLM의 과잉 정렬(Over-Alignment) 문제를 다룹니다. 다국어 벤치마크인 TF-RefusalBench를 통해 모델의 과도한 거부 현상을 측정하고, 프롬프팅 및 에블리터레이션(abliteration)을 통한 완화 방안을 제시합니다.
LLM의 비텍스트 데이터 확률적 모델링 한계를 극복하기 위해 조건부 확산 모델을 통합한 Diffusion-LLM 프레임워크를 제안합니다. 공유된 잠재 공간을 통해 의미론적 정렬을 개선하며, 초장기 및 퓨샷 시계열 예측 성능을 크게 향상시켰습니다.
Litmus는 소스 코드와 질의를 통해 평가 의도를 도출하여 AI 파이프라인을 위한 메트릭을 설계하는 제로 레이블 시스템입니다. 기존 방식과 달리 무엇을 왜 측정해야 하는지를 먼저 식별하여 정당화된 메트릭 포트폴리오를 구축합니다.
대규모 추론 모델의 긴 사고 사슬(CoT)을 효과적으로 분석하기 위한 오픈 소스 프레임워크 ReasoningLens를 소개합니다. 이 프레임워크는 추론 과정을 계층적으로 시각화하고 에이전트 기반 감사자를 통해 오류를 탐지합니다.
HyperQuant는 LLM과 확산 트랜스포머의 가중치 및 KV 캐시를 위한 통합 사후 학습 양자화 파이프라인입니다. Hadamard 변환과 격자 양자화 등을 결합하여 매우 낮은 비트에서도 품질 손실 없이 높은 압축률을 달성합니다.
LLM 에이전트의 '기술(skills)' 패키지를 통한 공격 표면을 방어하기 위한 2단계 탐지 프레임워크인 Locate-and-Judge를 제안합니다. 어텐션 메커니즘을 활용해 고위험 스팬을 선별하고 정밀 조사함으로써, 비용을 10배 절감하면서도 높은 탐지 성능을 확보했습니다.
식물 잎 질병 분류를 위해 EfficientNet, DenseNet, Swin-Tiny를 결합한 적응형 소프트 MoE 프레임워크를 제안합니다. 소프트 게이팅과 2단계 정제 학습을 통해 국소 및 전역 특징을 효과적으로 포착하며, 다양한 데이터셋에서 높은 성능을 입증했습니다.
AOHP는 Android Open Source Project(AOSP)를 기반으로 구축된 OS 레벨의 오픈 소스 에이전트 하네스입니다. 에이전트를 OS의 일급 객체로 취급하여 개인화된 서비스, 효율적인 인터페이스, 보안 정보 흐름을 제공하며 기존 시스템의 한계를 극복합니다.
2,140만 편의 논문을 분석한 결과, 과학적 초록 내 군사적 언어 사용이 급격히 증가하고 있음을 발견했습니다. 이러한 전쟁 프레임은 연구의 신뢰성, 자금 지원 의사, 정책 지지도를 낮추는 부정적인 결과를 초래할 수 있습니다.
의료 시각-언어 모델(VLM)의 지속적 적응 과정에서 발생하는 치명적 망각과 사전 분포 드리프트 문제를 해결하기 위한 CADRE 프레임워크를 제안합니다. LoRA와 개선된 EWC, 앵커-투-프라이어 페널티를 결합하여 매개변수 효율성을 유지하면서도 모델의 안정성을 극대화했습니다.
DVL-DeepONet은 물리 법칙을 가이드로 활용하는 심층 신경 연산자 프레임워크로, 노이즈가 심하거나 데이터가 불완전한 수중 환경에서 AUV의 속도를 정밀하게 추정합니다. 실제 실험을 통해 기존 모델 대비 40% 향상된 성능을 입증하며 탄력적인 수중 항법 가능성을 제시했습니다.
멀티모달 에이전트의 반복적인 추론 과정에서 발생하는 KV 캐시 재계산 문제를 해결하기 위한 Kamera 기술을 소개합니다. 훈련 없이도 위치 불변성을 유지하며 청크 간 조건화 손실을 복구하는 저차원 패치 방식을 제안합니다.
정전 보고서와 같이 엄격한 구조와 표준 준수가 필요한 도메인 특화 데이터 생성을 위해 최적화된 LLM인 POTracker를 제안합니다. 텍스트 유사성과 구조적 유사성을 동시에 고려하는 새로운 손실 함수인 POTrackerLoss를 통해 Qwen2.5-7B-Instruct를 미세 조정하였습니다.
자율 항공기 교통 밀도 증가에 대응하기 위해 다중 에이전트 강화학습(MARL)을 활용한 분산형 교통 관리 방식을 제안합니다. 단일 코리더에서 학습된 정책을 복잡한 다중 코리더 네트워크에 제로샷 방식으로 적용하여 높은 전이 성능을 입증했습니다.
신호 교차로의 폐쇄 루프 미세 시뮬레이션을 위한 에이전트 중심 생성 모델인 Enactor를 제안합니다. Transformer 기반의 공간 및 시간 어텐션 블록을 사용하여 차량의 움직임을 예측하며, 기존 궤적 예측기보다 높은 안정성과 정확도를 보여줍니다.
LLM이 모호하거나 모순된 부적절한 질문을 처리할 때 발생하는 내부 상태의 위상학적 구조를 분석하는 연구입니다. 지속성 호몰로지를 활용해 은닉 상태를 특징짓고, 이를 통해 모델의 응답을 명확화하거나 기권하도록 조정하는 기술을 제안합니다.
SPIRAL은 언어 모델의 추론 성능을 높이기 위해 순차적 추론, 병렬 샘플링, 결과 집합 과정을 통합하여 학습하는 새로운 강화학습 프레임워크입니다. 기존 방식과 달리 세 가지 요소를 엔드 투 엔드로 최적화하여 추론 연산 효율성을 극대화합니다.
Polycepta는 다중 객체 추적(MOT)을 위해 객체의 외형을 재귀적으로 추정하는 새로운 프레임워크를 제안합니다. 정적인 외형 기술자 대신 객체별 외형 상태를 지속적으로 업데이트하여, 미학습 클래스에서도 강건한 추적 성능을 제공합니다.
원격 환자 모니터링(RPM)의 낮은 설문 참여율을 해결하기 위해, 기존 QoR-15 설문을 최적화한 5개 항목의 QoR-compact를 개발했습니다. 연구 결과, 단 5개 문항만으로도 수술 후 회복 심각도와 재입원 이벤트를 기존 방식과 유사한 높은 정확도로 예측할 수 있음을 입증했습니다.