Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
시각-언어 모델(VLM)의 속도를 높이기 위한 시각적 토큰 프루닝 과정에서 발생하는 텍스트 노이즈와 특징 파편화 문제를 해결하는 EADP 프레임워크를 제안합니다. 엔트로피를 활용해 노이즈를 필터링하고 서브모듈러 최대화 기법으로 중복 없는 시각적 표현을 보장합니다.
자율적인 AI 코딩 에이전트가 코드베이스에 지속성을 가질 때 발생하는 분산 공격 위험을 연구합니다. 공격자가 여러 PR에 걸쳐 페이로드를 분산시키는 '점진적 공격'이 단일 모니터링 시스템을 효과적으로 회피할 수 있음을 실험을 통해 증명했습니다.
긴 문맥 추론 능력을 향상시키기 위해 학습 없이 적용 가능한 'RECONTEXT' 방법론을 제안합니다. 모델 내부의 관련성 신호를 활용해 증거 풀을 구축하고 재귀적으로 재생함으로써, 문맥 활용도를 높이는 메커니즘을 다룹니다.
MLLM의 지속적인 지식 편집 시 발생하는 의미론적 경계 제어 문제를 해결하기 위한 ScopeEdit를 제안합니다. ScopeEdit는 국소 흡수 분기와 증거 게이트 공유 일반화 분기를 통해 편집의 전파 범위를 정밀하게 제어합니다.
OntoLearner는 LLM을 활용하여 텍스트로부터 구조화된 지식 모델을 구축하는 모듈형 온톨로지 학습 프레임워크입니다. 22개 도메인의 데이터셋과 벤치마킹 인프라를 제공하며, 모델의 성능이 온톨로지의 구조적 복잡성에 따라 결정됨을 입증합니다.
DCASE 2026 Challenge를 위해 제안된 이종 오디오 분류 프레임워크를 설명합니다. CLAP 기반의 오디오-텍스트 표현을 활용하며, 데이터 확장, 특징별 분기, 계층 인식 분류기를 통해 성능을 최적화했습니다.
MolSight는 분자 구조의 시각적 표현과 위상학적 정보를 효과적으로 포착하기 위해 설계된 그래프 인식 시각-언어 모델(VLM) 프레임워크입니다. 분자 위상 모듈과 그라운딩 모듈을 통해 기존 모델의 구조적 정렬 문제를 해결하고 화학 이미지 이해 능력을 혁신적으로 향상시켰습니다.
본 연구는 다양한 경량 CNN 모델들의 성능과 자원 효율성을 CIFAR 및 Tiny ImageNet 데이터셋을 통해 비교 분석합니다. 최신 설계가 항상 보편적인 이득을 제공하지 않으며, 하드웨어 환경에 따라 지연 시간이 달라질 수 있음을 입증합니다.
에이전트의 정체성을 유지하면서 지식을 통합하는 새로운 구조를 제안합니다. 에피소드 메모리를 의미론적 지식 계층으로 변환하는 결정론적 함수를 통해, 에이전트의 인증된 정체성(identity)을 변경하지 않고도 효율적인 지식 업데이트가 가능함을 증명합니다.
InduceKV는 멀티모달 LLM의 배포 메모리 제한을 해결하기 위해 제안된 고정된 발자국 연속 적응 방법론입니다. 백본 모델을 변경하지 않고, 검색 기반의 컴팩트한 KV 페이로드를 사용하여 메모리 예산 내에서 효율적인 작업 적응을 수행합니다.
배터리 에너지 저장 시스템(BESS)의 결함 진단을 위해 검색 증강 멀티 에이전트(RAG Multi-agent) 기술을 적용한 O&M 어시스턴트를 소개합니다. 운영 데이터와 도메인 지식을 결합하여 전압 불일치나 열적 이상 등의 문제를 추적 가능한 방식으로 진단합니다.
두 개의 2D 이미지로부터 기하학적 구조와 질감을 가진 3D 객체를 생성하는 새로운 3D 착시 기술인 Mirror Illusion Art를 소개합니다. 자동화된 설계 파이프라인인 AutoMIA를 통해 형태와 색상을 공동 최적화하여 매끄러운 3D 예술 작품을 생성합니다.
멀티모달 거대 언어 모델(MLLM)의 지속 학습 과정에서 답변 정확도는 유지되나 시각적·텍스트적 증거 활용 능력이 저하되는 '숨겨진 망각' 현상을 분석합니다. 이를 해결하기 위해 리플레이 없이 증거 의존성을 보존하는 새로운 프레임워크인 RCL을 제안합니다.
EEG 기반 우울증 인식을 위해 뇌 네트워크의 계층적 구조를 포착하는 SA-HGNN 모델을 제안합니다. 쌍곡선 기하학을 활용하여 유클리드 공간의 한계를 극복하고 개인화된 뇌 네트워크 토폴로지를 동적으로 구축합니다.
LLM 에이전트 평가의 높은 비용과 복잡성을 해결하기 위해 프록시 벤치마크 프레임워크인 PACE를 제안합니다. 소수의 비에이전트 평가 항목만으로도 타겟 에이전트 벤치마크의 성능을 저렴하고 정확하게 예측할 수 있음을 입증했습니다.
분리형 LLM 서빙 환경에서 프리필 노드의 포화와 디코드 노드의 저활용 문제를 해결하기 위한 새로운 스케줄링 기법을 제안합니다. 디코드 노드에서 청크 단위 프리필을 수행하는 '부하 인지형 프리필 편향'을 통해 노드 간 KV-캐시 전송 지연을 제거합니다.
모델의 안전한 완성을 평가하기 위해 의도(intent)만을 변화시키는 통제된 프롬프트 벤치마크인 OpenSafeIntent를 제안합니다. 기존의 단일 프롬프트 평가 방식이 가진 한계를 지적하며, 의도 변화에 따른 모델의 안전성 교정 능력을 측정하는 것이 중요함을 강조합니다.
LLM의 위기 상황 대응 능력 중 교차 언어적 공감과 문화적 접지를 평가하기 위한 새로운 벤치마크 SPLIT을 제안합니다. 영어와 우크라이나어를 대상으로 Gemini, LLaMA, DeepSeek 모델의 성능을 비교 분석했습니다.
시공간적 상관관계가 있는 데이터셋에서 발생하는 데이터 누수와 숨겨진 층화 문제를 해결하기 위한 새로운 프레임워크를 제안합니다. SASP 분할 방식과 CDRO 최적화 기법을 통해 모델의 일반화 성능과 신뢰도를 향상시킵니다.
설명 가능한 AI(XAI)를 위해 최적 결정 트리의 가설 공간을 전역적으로 분석하는 ADTC 프레임워크를 제안합니다. 대수적 모델 카운팅(AMC) 개념을 도입하여 최적화, 카운팅, 샘플링 문제를 통합된 계산 방식으로 해결합니다.