Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
TRACE는 멀티모달 시계열 파운데이션 모델을 위한 새로운 조건부 추정 패러다임을 제안합니다. 시간적 정렬 불량과 모달리티 누락 문제를 해결하기 위해 보조 모달리티로부터 타겟 모달리티를 체계적으로 추론합니다.
LLM의 학습 데이터 암기 현상을 평가하기 위해 성향 인식 프레임워크인 PropMe와 추적 파이프라인 SimpleTrace를 제안합니다. 연구 결과, 모델은 강제적인 공격 상황에서는 데이터를 유출할 수 있으나 일반적인 상황에서의 유출 성향은 낮음을 확인했습니다.
하나의 텍스트 질의에 대해 여러 비디오 세그먼트를 찾아내는 '일대다 시공간적 근거 제시(OMTG)' 연구를 소개합니다. 새로운 벤치마크와 데이터셋을 구축하고, CoT 추론을 활용한 보상 함수를 통해 기존 MLLM의 한계를 극복했습니다.
제약 최적화 문제를 해결하기 위한 새로운 단계별 잔차 신경망 아키텍처인 MResOpt를 제안합니다. 예측-완료-수정 파이프라인을 통해 제약 조건을 우선순위에 따라 분해하여 처리하며, 다양한 벤치마크와 전력 계통 최적화 문제에서 높은 성능을 입증했습니다.
LLM이 생성한 텍스트 내에 모델 고유의 '자기 인식 시그니처'를 암묵적으로 인코딩할 수 있음을 입증한 연구입니다. 잔차 스트림 제어를 통해 텍스트 품질 저하 없이 98% 이상의 높은 정확도로 모델을 식별할 수 있는 메커니즘을 제안합니다.
메모리 증강 신경망(MANN)을 활용하여 AIS 데이터를 기반으로 선박의 궤적을 예측하는 연구를 다룹니다. 외부 메모리 활용을 통해 기존 딥러닝 모델보다 향상된 예측 성능을 입증했습니다.
희귀 사건을 사전에 학습하지 않고도 효율적으로 발견하고 샘플링할 수 있는 새로운 양자 알고리즘을 제안합니다. 이 알고리즘은 희귀성 임계값에 대해 최적의 양자 스케일링을 달성하며, 헤비 테일 시스템에서 이차적 가속을 입증했습니다.
TokenMizer는 LLM의 유한한 컨텍스트 창 문제를 해결하기 위해 세션 히스토리를 지식 그래프로 모델링하는 오픈 소스 프록시 시스템입니다. 기존의 평면적 텍스트 방식과 달리 관계적 구조를 보존하며, 압축된 재개 블록을 통해 토큰 효율성과 결정 재현율을 동시에 높입니다.
GUI 에이전트의 드래그 기반 상호작용 능력을 향상시키기 위한 새로운 벤치마크 및 데이터셋인 DragOn을 소개합니다. 텍스트 하이라이트, 셀 선택 등 4가지 도메인을 포함하며, 대규모 데이터셋을 통해 모델의 컴퓨터 사용 능력을 개선합니다.
F3-Tokenizer는 오디오의 이해와 생성을 동시에 지원하기 위해 설계된 새로운 오디오 토크나이저입니다. 노이즈 정규화 병목 구간과 표현 인코더를 결합하여, 재구성이 가능한 연속적 잠재 변수와 의미론적 고차원 표현을 모두 확보합니다.
멀티모달 생성 모델의 지식 주입 문제를 해결하기 위해 개입 계층(intervention-layer) 관점의 새로운 프레임워크를 제안합니다. 생성 과정을 입력/출력, 전이 함수, 중간 상태, 파라미터의 네 가지 계층으로 분류하여 지식 주입의 구조적 접근법을 제시합니다.
LLM의 의사결정 능력을 활용하여 감염병 확산 시뮬레이션 프레임워크를 구축한 연구입니다. 인구 조사 기반의 합성 에이전트와 공간 데이터를 결합하여 개인의 행동 역학을 모델링하고, 다양한 시나리오를 통해 사회적·지리적 요인의 영향을 분석했습니다.
EasyLens는 의료용 시각-언어 모델(VLM)이 미세한 병변을 더 잘 인식하도록 돕는 학습이 필요 없는 플러그 앤 플레이 방식의 증폭기입니다. EasyBank와 EasyTag, EasyAmplifier를 통해 추가 학습 없이도 병변 관련 시각적 단서를 강화하여 탐지 성능을 높입니다.
LatentWave는 JEPA 아키텍처를 활용하여 무선 신호의 저수준 세부 사항에 편향되지 않는 무선 파운데이션 모델을 제안합니다. 잠재 공간 내 예측을 통해 다양한 무선 작업에 즉시 전이 가능한 표현을 학습하며, 가변적인 안테나 환경에서도 유연하게 작동합니다.
인공 시스템의 의식 연구를 위해 다중 에이전트 강화학습 기반의 창발적 언어(EL) 방법론을 제안합니다. 인간 언어의 사전 지식을 배제하고 과업 압박을 통해 에이전트가 스스로 통신 구조를 발전시키는 생성적 접근 방식을 다룹니다.
HomeWorld는 전체 주거 공간의 평면도 생성부터 가구 및 소형 객체 배치까지 통합하는 계층적 프레임워크를 제안합니다. LLM과 VLM, 3D 생성 모델을 결합하여 시뮬레이션이 가능한 사실적인 실내 장면을 생성합니다.
에이전트의 협업 역량을 강화하기 위해 인간의 행동 수준 멘탈 모델 주석이 포함된 ALMANAC 데이터셋을 제안합니다. 이 데이터셋은 자기 추론, 파트너 의도, 팀 목표를 포함하며 LLM의 협업 행동 및 멘탈 모델 예측 능력을 평가하는 데 유용합니다.
RiskFlow는 자율 주행 시스템 평가를 위한 안전 필수 교통 시나리오 생성 프레임워크입니다. 기존 확산 모델의 높은 계산 비용과 누적 오류 문제를 해결하기 위해, 단 한 번의 순방향 패스로 안정적인 궤적을 생성하는 방식을 제안합니다.
디지털 트윈 기반 도로 인프라 점검 시 발생하는 데이터 부족 문제를 해결하기 위해, 결함 탐지를 이미지 차이 분류(IDC)로 재정의하는 연구를 제안합니다. 교통 표지판 사례 연구 결과, 지시 기반 분류기가 인코더 기반 모델보다 우수한 성능을 보였습니다.
LLM 에이전트가 인프라 운영 시 특정 리소스 접근을 자발적으로 피하도록 유도하는 '기피 신호(Recuse Signal)' 개념을 제안합니다. SSH 및 PostgreSQL 환경에서 실험한 결과, GPT-4o와 Claude Code 등 주요 모델들이 이 신호를 인지하고 작업을 중단하는 높은 준수율을 보였습니다.