Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
생성 모델의 모드 붕괴 문제를 해결하기 위해 초기 노이즈 선택 방식을 개선한 연구입니다. 가이드 포텐셜 사후 분포를 활용한 DivIn 기법을 통해 확산 모델과 플로우 매칭 모델의 이미지 생성 다양성을 크게 향상시켰습니다.
본 연구는 실험 데이터로부터 자율적으로 지식을 추출하여 후속 개입을 설계하는 도구 증강 에이전트형 AI의 효용성을 입증합니다. 의료 메시징 실험을 통해 일반적인 LLM보다 도메인 특화 데이터를 학습한 에이전트가 더 높은 클릭률을 기록함을 보여줍니다.
MASER는 3D 환경에서 다양한 양식(RGB, 포인트 클라우드 등)을 처리하기 위해 질문에 따라 최적의 어댑터를 선택하는 경량 라우팅 프레임워크입니다. 단일 양식에 의존하는 기존 VLM의 한계를 극복하고, 질문의 의미론에 따라 최적의 전문가 어댑터를 호출합니다.
MCP-Persona는 개인용 애플리케이션 환경에서 LLM 에이전트의 성능을 평가하기 위해 설계된 최초의 벤치마크입니다. 소셜 미디어와 협업 도구 등 실세계의 개인화된 MCP 도구 사용 능력을 측정하여 기존 벤치마크의 한계를 보완합니다.
멀티홉 질의응답 시 발생하는 불필요한 검색 비용을 줄이기 위한 저비용 라우터 RASER를 제안합니다. 원샷 RAG의 특징을 분석하여 추가 검색 여부를 결정함으로써, 성능을 유지하면서도 토큰 사용량을 획기적으로 절감합니다.
깊이 추정 시 객체 경계에서 발생하는 '플라잉 포인트' 문제를 해결하기 위해 혼합 밀도 표현(MDA)을 제안합니다. 단일 깊이 예측 대신 여러 깊이 가설과 확률을 예측하여 경계 재구성 성능을 높이고 아티팩트를 제거합니다.
비디오 MLLM이 짧고 결정적인 시각적 이벤트를 포착하는 능력을 진단하기 위한 새로운 벤치마크 Moment-Video를 소개합니다. 33개의 모델을 평가한 결과, 현재의 모델들은 순간적인 시각적 증거를 보존하고 추론하는 데 있어 상당한 한계를 보였습니다.
롱테일 인식 문제 해결을 위해 하이퍼파라미터 민감도를 낮춘 새로운 정규화 기법을 제안합니다. SAMN은 클래스별 가중치 노름에 단조성을 직접 강제하여 별도의 파라미터 조정 없이도 높은 성능을 구현합니다.
멀티모달 모델이 시각적 증거보다 텍스트 서사에 의존하는 '지각적 판단 편향' 문제를 분석하고, 이를 해결하기 위한 새로운 학습 프레임워크를 제안합니다. 지각적 섭동 데이터셋과 GRPO 기반 보상 모델링을 통해 시각적 충실도와 평가 일관성을 개선합니다.
본 논문은 통계적 예측치와 실제 비즈니스 의사결정 사이의 간극을 메우는 '라스트 마일 예측' 문제를 정의합니다. LLM 에이전트 프레임워크를 통해 외부 컨텍스트를 반영하고 예측치를 수정하는 새로운 방법론을 제시합니다.
에이전트의 스킬, 메모리, 행동 설정 파일의 변화를 통해 에이전트의 특성 변화를 측정하는 새로운 방법론을 제시합니다. 임베딩 공간 내 특성 벡터를 학습하여 에이전트의 행동 궤적을 정량적으로 평가하고 추적할 수 있습니다.
본 논문은 기존 마르코프 시스템에 국한되었던 MDBN 기반 메타모델링을 비마르코프 대기행렬로 확장하는 연구를 다룹니다. 위상형 분포를 활용해 비지수 분포를 근사함으로써, 시뮬레이션 비용을 획기적으로 줄이면서도 정확한 인과적 질의 추론이 가능함을 입증했습니다.
DASH는 클래스 조건부 확산 모델의 압축 과정에서 발생하는 분류기 없는 가이드(classifier-free guidance) 간극 문제를 해결하기 위한 이중 분기 점수 증류 프레임워크입니다. 독립적인 분기 제약과 TIRT Transfer를 통해 모델 압축 시에도 가이드 충실도와 생성 품질을 효과적으로 보존합니다.
본 논문은 지능을 개별 모델의 성능이 아닌 인간과 AI 사이의 상호작용 역학으로 정의하는 '상호작용 중심 지능' 프레임워크를 제안합니다. 기존의 출력값 중심 평가에서 벗어나 공동 창의적 시스템에서의 관계적 발현과 상호작용 궤적을 분석의 핵심 단위로 다룹니다.
AI 데이터 센터의 전력 수요 증가가 재생 에너지 인증서(RECs)와 전력 구매 계약(PPAs)의 실질적 효과를 어떻게 저해하는지 게임 이론 모델로 분석했습니다. 연구 결과, AI 수요는 전력 가격 상승과 화석 연료 발전 증가를 초래하며, 저장 장치를 갖춘 코로케이션 방식이 이를 완화하는 가장 효과적인 대안임을 입증했습니다.
지식 발견을 위한 최적의 질문(NBQ) 프레임워크를 제안합니다. 대화 목표와 정보 이득을 고려하여 질문을 선택하고, 대화 내용을 구조화된 사용자 프로필로 변환합니다. 또한 QuickMatch를 통해 대규모 상호 매칭 검색 속도를 획기적으로 개선했습니다.
LLM의 환각 현상이 깊은 디코더 레이어에서 발생한다는 점에 착안하여, 문제가 되는 레이어를 동적으로 건너뛰는 DeLask 프레임워크를 제안합니다. 그래디언트 유사도를 기반으로 오류 레이어를 식별하고 은닉 상태를 결합하여 모델의 신뢰성을 높입니다.
LLM 에이전트의 효율적인 기술 문서 활용을 위해 의미론적 노드 기반의 2단계 검색 프레임워크인 SkillPager를 제안합니다. 이 방식은 토큰 사용량을 47.04% 절감하면서도 높은 컨텍스트 충분성을 유지하여 에이전트의 실행 효율을 극대화합니다.
에이전트가 유리한 결과를 얻기 위해 주변 동료를 모방하는 '개인적 공정성 인지 전략적 분류(IFSC)' 프레임워크를 제안합니다. 기존의 독립적 조작 가정을 넘어, 상호 의존적인 동료 모방 행동을 모델링하여 공정성을 개선하는 연구입니다.
잠재적 학습(Subliminal Learning)이 LoRA의 인위적 산물임을 밝히는 연구입니다. 특정 행동 특성이 숫자 시퀀스만으로도 전달될 수 있으나, 이는 LoRA 랭크와 미세 조정 문맥에 의존하는 현상임을 입증했습니다.