Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
아프리카 언어 사용 시 발생하는 토큰화 비용, 지연 시간 및 컨텍스트 용량의 페널티를 정량적으로 분석한 연구입니다. 특정 언어와 문자의 경우 영어 대비 최대 8.9배의 비용과 지연 시간이 발생하며, 이는 디지털 격차를 심화시키는 구조적 문제임을 지적합니다.
CompressKV는 GQA 기반 LLM의 긴 문맥 추론 시 발생하는 KV 캐시 메모리 문제를 해결하기 위한 새로운 압축 프레임워크입니다. 의미론적 검색 헤드(SRHs)를 식별하여 중요한 토큰을 선별하고 레이어별로 캐시 예산을 효율적으로 할당합니다.
코딩 에이전트의 도구 사용 결정을 비용 민감형 순차 가설 검정으로 공식화한 베이지안 제어 방식을 제안합니다. 이 방식은 불확실성을 고려하여 증거 수집, 후보 개선, 검증 여부를 동적으로 결정하며 높은 효율성을 보여줍니다.
실시간 게임 에이전트를 위해 느린 추론형 VLM과 빠른 반응형 VLM을 결합하는 Latent Bridge 기술을 제안합니다. 텍스트 대신 임베딩 공간을 통해 정보를 전달하여 지연 시간을 줄이고 성능을 높였습니다.
G$^3$VLA는 VLA 모델의 시각적 토큰에 카메라의 기하학적 구조를 주입하여 로봇 조작 성능을 높이는 연구입니다. 기존 액션 공간을 변경하지 않고도 내적/외적 파라미터를 활용한 모듈을 통해 다중 카메라 환경에서의 공간 인지 능력을 개선합니다.
O-RAN 환경에서 UAV 궤적 최적화를 위해 지속적 전이 학습을 활용하는 새로운 프레임워크를 제안합니다. 사전 학습된 모델 라이브러리에서 최적의 모델을 선택하여 적응 시간을 단축하고, 유사 모델 부재 시 폴백 모델을 통해 성능을 보장합니다.
에이전트형 보안 시스템의 설계 결함과 보안 취약점을 심층 분석한 연구입니다. 공격자가 샌드박스를 탈출하여 API 키를 유출하거나 시스템을 장악할 수 있는 사이버 킬 체인을 제시하며, 이를 방어하기 위한 견고한 아키텍처 설계 원칙을 제안합니다.
파편화된 생물 의학 데이터 환경에서 인과 그래프 복구와 매개 분석을 수행하는 RetiSEM 프레임워크를 제안합니다. 도메인 제약 구조 방정식 모델링(SEM)을 통해 제한된 멀티모달 자원에서도 높은 인과 정확도를 달성합니다.
GUI 환경에서 컴퓨터 사용 에이전트(CUA)를 학습시키기 위해 자율 시각-언어 평가를 활용한 강화학습 프레임워크를 제안합니다. VLM을 통해 보상 신호를 생성하고, 평가기의 노이즈를 교정하여 정책 최적화 성능을 높였습니다.
Cold MoE 모델 서빙 시 발생하는 GPU 메모리 낭비 문제를 해결하기 위해 가중치와 KV-cache를 분리하는 CrossPool 엔진을 제안합니다. 공유 KV-cache 풀과 계층별 파이프라인 스케줄러를 통해 메모리 효율성을 극대화하고 긴 문맥 요청을 효과적으로 처리합니다.
노드 속성 예측을 위한 그래프 파운데이션 모델(GFM)의 공정한 평가를 다룬 연구입니다. 최근 제안된 GFM들이 서로 다른 평가 방식으로 인해 비교가 어렵다는 점을 지적하며, 9개의 GFM을 GNN 베이스라인과 엄격하게 재평가했습니다.
LLM 스케일링 지수가 에너지 측면에서 지속 불가능한 이유를 분석합니다. 데이터의 한계로 인한 수치적 편향 문제를 지적하며, 유체 난류 모델을 통해 데이터의 매끄러움이 스케일링 지수에 미치는 영향을 논의합니다.
터키어와 같은 저자원 언어 환경에서의 사기 전화 탐지를 위한 멀티모달 데이터셋과 LLM의 성능을 연구합니다. Gemini, GPT-4o, Qwen 모델을 활용해 오디오 및 전사 데이터 입력 방식에 따른 탐지 효율성을 분석했습니다.
멀티 에이전트 LLM 환경에서 발생하는 공유 메모리 관리 문제를 정의하고, 이를 해결하기 위한 관리형 공유 메모리 메커니즘을 제안합니다. MemClaw 구현과 ArgusFleet 평가를 통해 권한 유출, 정보 노후화 등 4가지 주요 실패 모드를 해결하는 시스템 수준의 프리미티브를 검증했습니다.
고전적 가치 투자 원칙을 현대적 머신러닝 모델의 리스크 제어 장치로 활용하는 연구를 다룹니다. S&P 500 데이터를 통해 XGBoost와 AutoGluon 모델을 테스트한 결과, Graham의 규칙을 결합했을 때 수익률과 리스크 관리 측면에서 더 우수한 성과를 보였습니다.
LLM의 취약점을 자동으로 탐색하는 레드팀 테스트 파이프라인인 AdversaBench를 제안합니다. 3인 심사위원 패널과 프롬프트 변이 연산자를 활용하여 추론, 지시 이행, 도구 사용 능력을 다각도로 평가합니다.
알츠하이머병 진행의 불확실성을 고려한 종단적 예측을 위해 확률적 프레임워크를 제안합니다. Temporal Fusion Transformer과 Mixture Density Network을 결합하여 질병 단계의 궤적과 불확실성을 정밀하게 추정합니다.
소규모 온프레미스 LLM이 형사 법률 문맥에서 특정 프롬프트에 대해 과도하게 답변을 거부하는 현상을 연구했습니다. 권위 있는 스타일의 접두사가 거부율을 최대 20배까지 높인다는 사실을 발견하여, 실제 법률 현장 도입 시 발생할 수 있는 편향 위험을 경고합니다.
ScaleToT는 상호작용 데이터가 부족한 수십억 명의 저활동 사용자를 위해 구조화된 LLM 추론을 확장하는 프레임워크입니다. Tree-of-Thought(ToT)와 OSIPO 기법을 통해 학습된 추론 능력을 경량 인코더로 전이하여, 비용 효율적으로 사용자 상태를 예측합니다.
ASALT는 다중 에이전트 강화학습(MARL)에서 도메인 간 상태 공간 차원이 불일치할 때 발생하는 문제를 해결하기 위한 새로운 방법론을 제안합니다. 관측 및 상태 수준의 어댑터를 통해 이질적인 도메인 간의 효과적인 지식 전이를 지원합니다.