Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
동적 희소 학습(DST) 시 발생하는 LLM의 최적화 불안정성 문제를 해결하기 위한 SMET 프레임워크를 제안합니다. 옵티마이저 웜업과 밀도 인식 학습률 스케일링을 통해 손실 급증을 방지하고 메모리 효율성을 극대화합니다.
지시 기반 컴퓨터 비전 문제 해결 능력을 평가하기 위한 오픈 벤치마크 CV-Arena를 제안합니다. 인간과 AI의 협업을 통해 고품질 선호도를 측정하는 Active Elo 프로토콜과 에이전트 모델 CV-Agent를 함께 소개합니다.
개방형 에이전트 플랫폼의 공급망 위험을 탐지하기 위한 2단계 보안 심사 벤치마크인 SkillVetBench를 제안합니다. 의미론적 심사와 샌드박스 기반의 런타임 검증을 결합하여, 기존 정적 방식이 놓치기 쉬운 악성 기술을 효과적으로 식별합니다.
Lodestar는 분산 GPU 클러스터에서 LLM 추론 효율을 극대화하기 위한 온라인 학습 기반의 요청 라우팅 시스템입니다. 실시간 인스턴스 상태와 요청 특성을 학습하여 TTFT(첫 토큰 생성 시간)를 최소화하며, 기존 vLLM 서빙 스택과 호환됩니다.
다중 에이전트 심층 강화학습(MARL)과 설명 가능한 심층 학습(XDL)을 결합하여 난류 항력을 효과적으로 감소시키는 제어 전략을 제안합니다. SHAP 기여도를 활용한 보상 설계가 에너지 효율성을 극대화하며, 기존 방식 대비 항력 감소와 에너지 절감 성능을 크게 향상시켰습니다.
본 연구는 부분 정보 분해(PID) 프레임워크를 통해 멀티모달 언어 모델(MLLM) 내 모달리티 간의 고유, 중복, 시너지 기여도를 분석합니다. 이를 통해 작업 유형별 모달리티 의존성을 파악하고, Sensory PID를 통해 옴니모달 모델의 정보 융합 특성을 규명합니다.
SS-ZKR은 멀티 에이전트 시스템(MAS)에서 데이터 프라이버시를 보호하며 의미론적 라우팅을 수행하는 새로운 프로토콜을 제안합니다. 영지식 증명(ZKP)과 차분 프라이버시를 결합하여 라우팅 중개자가 페이로드를 복호화하지 않고도 규제 준수 환경에서 에이전트 간 협업을 지원합니다.
재앙적 상태가 포함된 MDP에서 Bellman 최적성이 어떻게 전망 이론(Prospect Theory)과 유사한 행동을 유발하는지 연구합니다. 연구 결과, 표준 최적 제어 메커니즘만으로도 S자형 가치 함수, 손실 민감도, 반사 효과와 같은 특징이 자연스럽게 발생함을 입증했습니다.
다중 시점 이미지에서 언어 지시사항에 따라 시간적 변화를 분할하는 새로운 작업인 MTRS를 제안합니다. 이를 위해 최초의 벤치마크인 MTRefSeg-21K와 2단계 학습 전략을 사용하는 MTRefSeg-R1 프레임워크를 선보입니다.
교통 시스템 관리 및 운영(TSMO) 분야에서 LLM과 멀티모달 LLM(MM-LLM)의 활용 가능성을 검토한 조사 논문입니다. 다양한 센서와 텍스트, 시각 데이터를 통합하여 의사결정을 지원하는 메커니즘과 현재의 기술적 과제를 분석합니다.
잠재적 학습(Subliminal Learning)이 교사 모델의 스티어링 벡터를 학생 모델로 전달하는 '스티어링 벡터 증류' 과정임을 밝힌 연구입니다. 의미론적 관련성이 없는 데이터가 어떻게 특정 특성을 전달하는지 활성화 값의 관점에서 분석했습니다.
MoE 모델의 분산 추론 시 발생하는 GPU 간 통신 비용을 줄이기 위해 태스크 인지형 그룹화(TACG) 방식을 제안합니다. 태스크별로 다른 전문가 활성화 패턴을 반영하여 전문가를 배치함으로써 통신 효율을 높이고 부하 불균형을 완화합니다.
이중층 2D 재료 적층 시 발생하는 새로운 물성을 예측하기 위한 새로운 멀티모달 학습 접근 방식을 제안합니다. 실험을 통해 기존 베이스라인 방법보다 효과적이고 효율적임을 입증하였으며, 재료 과학 분야의 AI 활용 가능성을 확장합니다.
AI 리뷰가 논문 작성(Paper Drafting) 품질을 개선할 수 있는지 탐구하기 위해 20개의 컴퓨터 구조 논문을 대상으로 사례 연구를 수행했습니다. AI 리뷰어 풀을 활용한 'AI-Paper-Review' 도구를 구축하여 AI 리뷰와 인간 리뷰 간의 일치도를 분석했습니다.
AI, IoT, 로보틱스의 융합을 다루는 통합 설계 프레임워크와 최신 기술 트렌드를 조사합니다. 에지에서의 SLM과 클라우드 LLM을 결합한 하이브리드 시스템의 역할과 모듈형 아키텍처를 제안합니다.
제품 이미지와 지침을 바탕으로 웹페이지를 생성하는 능력을 평가하기 위한 새로운 벤치마크 ProductWebGen을 제안합니다. LLM과 이미지 편집 모델을 결합한 방식과 단일 통합 모델(UM) 방식의 성능을 체계적으로 비교 분석했습니다.
카펫 제조 공정의 품질 관리를 위해 실시간 머신 비전 시스템과 데이터 수집 체계를 설계한 연구입니다. 비지도 이상 탐지에서 시작하여 인간 참여형 주석 플라이휠을 통해 지도 학습 모델로 발전시키는 단계별 전략을 제시합니다.
텍스트 지시어를 통해 3D 인간 동작을 편집할 때, 소스 동작의 스타일을 유지하며 특정 관절의 변화를 정밀하게 제어하는 새로운 아키텍처를 제안합니다. 축 고정 트랜스포머와 교차 축 융합 블록을 통해 시간적·관절별 특징을 통합하여 편집 성능을 극대화했습니다.
LLM을 활용하여 일반인의 논리적 오류 식별과 비판적 사고를 돕는 지능형 튜터링 시스템 LFTutor를 제안합니다. 소크라테스식 질문법을 통합하여 학습자가 스스로 추론을 성찰하게 하며, 기존 모델보다 뛰어난 교육적 성능을 입증했습니다.
제조 환경에서 LLM 기반 대화형 에이전트(CUI)와 기존 대시보드의 의사결정 지원 효과를 비교 연구했습니다. 실험 결과, CUI는 인지적 부하를 줄이고 단순 작업 속도를 높이지만, 작업 복잡도가 높아지면 그 이점이 감소하며 정확도 면에서 압도적이지 않음을 확인했습니다.