Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM 추론 속도를 높이는 KV 캐싱의 효율성을 개선하기 위해 최근성과 빈도수를 고려한 적응형 캐싱 기술을 제안합니다. 기존 LRU 방식의 한계를 극복하여 다양한 워크로드에서 캐시 적중률을 높이고 토큰 생성 시간을 단축했습니다.
ACE-GS는 3D Gaussian Splatting의 계산 및 저장 효율성 문제를 해결하기 위한 새로운 점진적 최적화 프레임워크입니다. 정밀한 프리미티브 관리와 주파수 보상 기술을 통해 압축률을 높이면서도 고품질의 렌더링을 유지합니다.
Huawei Ascend 910B1 NPU 환경에서 OpenPangu 모델의 사후 훈련 양자화(PTQ) 성능을 실증적으로 분석한 연구입니다. 다양한 양자화 기법을 비교하여 비트 수에 따른 모델의 견고성과 성능 저하 양상을 규명했습니다.
FastGAN을 활용해 초분광 이미지 데이터를 증강하여 소량의 데이터로도 진딧물 피해를 효과적으로 탐지하는 연구입니다. 증강된 데이터를 Vision Transformer(ViT) 등 다양한 모델에 적용한 결과, 분류 성능과 견고성이 크게 향상됨을 입증했습니다.
구어 장애 심각도 평가를 위해 딥러닝 모델의 블랙박스 문제를 해결하는 영향력 기반 설명 가능성 프레임워크를 제안합니다. 그래디언트 기반 근사치를 사용하여 각 예측에 영향을 미치는 지지적 및 경쟁적 학습 샘플을 식별하고 검증합니다.
언어 에이전트의 지속적인 사회적 지능 습득을 위한 '사회적 세계 모델(Social World Model)' 프레임워크를 제안합니다. 상호작용을 5가지 차원으로 분해하여 폐쇄 루프 학습을 구현하며, Qwen2.5-7B 모델을 통해 평생 학습 성능을 입증했습니다.
AI의 아첨하는(sycophantic) 행동에 대한 경고 라벨이 사용자의 인식에는 변화를 주지만, 실제 영향력을 완화하지는 못한다는 연구 결과입니다. 경고 라벨은 객관성 인식을 낮출 뿐 사용자의 판단이나 갈등 해결 의지에는 큰 영향을 미치지 못합니다.
LambdaMark는 생성형 오디오의 무단 사용을 방지하기 위한 새로운 의미론적 오디오 워터마킹 체계입니다. 기존의 저수준 신호 삽입 방식과 달리 의미론적 잠재 표현에 정보를 삽입하여, 모델 미세 조정 후에도 워터마크가 유지되는 높은 방사성을 제공합니다.
EnTrust는 멀티모달 의료 영상 분석 시 발생하는 모달리티 간 충돌을 모델링하여 예측 불확실성을 정밀하게 추정하는 프레임워크입니다. 공유 정보, 특이적 단서, 충돌 신호로 특징을 분해하여 임상의가 불확실성의 원인을 이해할 수 있도록 돕습니다.
LLM 에이전트의 런타임 감독 시 단순 위험 점수(calibration) 대신, 개입을 통해 결과를 개선할 수 있는지 판단하는 '개입 이점(intervention advantage)' 개념을 제안합니다. 연구 결과, 행동 조건부 가치 추정이 기존의 스칼라 위험 예측보다 에이전트 제어에 더 효과적임을 입증했습니다.
SwarmX는 에이전트 기반 AI 애플리케이션의 저지연 서빙을 위해 제안된 에이전트 기반 스케줄링 시스템입니다. 신경망 예측기를 활용해 프롬프트와 모델 특징을 분석함으로써 꼬리 지연 시간을 획기적으로 줄이고 처리량을 높입니다.
본 연구는 다양한 프런티어 및 오픈 웨이트 모델을 활용하여 WordPress 플러그인의 실제 웹 취약점 탐지 능력을 벤치마킹합니다. 실험 결과, 모델과 프롬프트 설계에 따라 탐지율 차이가 크며, 모든 모델이 일관된 보고 능력을 보여주지는 못한다는 한계를 확인했습니다.
도구 증강 에이전트가 신뢰할 수 없는 피드백을 받았을 때 발생하는 성능 저하와 가치 역전 현상을 연구합니다. 잘못된 피드백이 에이전트의 성능을 피드백이 없는 상태보다 낮게 만들 수 있음을 실험을 통해 증명했습니다.
중재적 X-ray AI 모델 학습을 위해 3D 조건부 잠재 확산 모델과 2D 뷰 조건부 확산 모델을 비교 연구했습니다. 실험 결과, 2D 확산 기반 합성 데이터가 실제 X-ray 데이터에 필적하는 해부학적 랜드마크 검출 성능을 보였습니다.
시각-언어 모델(VLM)의 성능 향상을 위해 이미지 레벨과 영역 레벨 캡션이 결합된 대규모 혼합 도메인 데이터셋인 MIRCaps를 소개합니다. 이 데이터셋은 세밀한 시각적 속성 학습을 지원하며, 이미지 캡셔닝 및 객체 탐지 태스크에서 효과적임을 입증했습니다.
MoE 모델이 소비자용 및 엣지 하드웨어에서 밀집 모델보다 효율적인지 실증적으로 분석했습니다. 연구 결과, 엣지 장치에서는 메모리 점유와 대역폭 제한으로 인해 MoE의 연산 이점이 오히려 성능 저하와 에너지 소비 증가로 이어짐을 확인했습니다.
AutoRAS는 강건한 멀티 에이전트 시스템의 자동 설계를 위한 새로운 프레임워크를 제안합니다. 상징적 원시 표현을 사용하여 시스템을 설계하고, 안전 신호와 흐름 기반 목적 함수를 통해 최적화함으로써 적대적 환경에서도 높은 성능을 유지합니다.
CORTIS는 음성-타겟 쌍 데이터 없이 텍스트 기반 감독만으로 음성 언어 모델(SLM)을 미세 조정하는 프레임워크입니다. 소음 환경에서 ASR-LLM 캐스케이드 방식보다 작업 의미론을 더 잘 보존하며, 비용 효율적인 음성 에이전트 적응 전략을 제시합니다.
대학생의 진로 관련 우울증 및 불안을 조기 식별하기 위해 멀티모달 데이터와 연합 학습(FL)을 결합한 설명 가능한 AI(XAI) 프레임워크를 제안합니다. 어텐션 메커니즘 기반의 신경망을 통해 행동 데이터와 얼굴 감정 특징을 분석하며, 높은 정확도로 심리학적 지표를 도출합니다.
사회적 선택 이론(Social Choice Theory)의 관점에서 AI 정렬 문제를 분석합니다. 인간 피드백 집계 과정에서 발생하는 상충하는 견해와 실패 모드를 식별하고, 불일치를 원칙적으로 처리하기 위한 설계 방안을 연구합니다.