Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM 안전성 벤치마크의 중복성과 샌드배깅 문제를 해결하기 위해 문항 반응 이론(IRT)을 적용한 연구입니다. 192개 모델을 분석하여 안전성 요인을 규명하고, 평가 비용을 최대 99% 절감하며 모델의 변화를 탐지하는 방법을 제시합니다.
장기 탐색 에이전트 학습을 위해 정답에서 역추적하여 중간 단서를 복구하고, 각 단계의 유용성을 평가하는 ABC 프레임워크를 제안합니다. 이를 통해 희소한 결과를 조밀한 단계별 보상으로 변환하여 에이전트의 성능을 극대화합니다.
LLM 에이전트의 장기 추론을 위해 계층적 그래프 메모리 프레임워크인 HiGram을 제안합니다. 경로 수준의 국지화와 재작성 기술을 통해 검색 시 무관한 문맥을 줄이고 메모리 업데이트의 효율성을 높였습니다.
얕은 깊이의 양자 회로에서 공유된 고전적 무작위성을 도입한 채널 모델이 유니터리 Born 모델보다 더 넓은 표현력을 가짐을 증명했습니다. 얽힘 이론을 통해 특정 분포의 장거리 상관관계를 재현하는 데 있어 두 모델 간의 엄격한 표현력 분리를 확립했습니다.
프라이버시를 보호하면서 교실 내 사고를 감지할 수 있는 효율적인 동작 추론 프레임워크를 제안합니다. 생성형 비디오와 실제 포즈 데이터를 결합한 하이브리드 벤치마크를 도입하고, 지식 증류를 통해 경량화된 모델로 높은 성능을 구현했습니다.
분산 최적화 환경에서 통신 비용을 낮추면서 로컬 차분 프라이버시를 달성하기 위한 SSTQ 프레임워크를 제안합니다. 과완전 등규격 타이트 프레임을 활용하여 기존 벡터 양자화 방식의 분산 문제를 해결하고 통신 효율성을 높였습니다.
LLM의 긴 문맥 추론 제약을 해결하기 위해 제안된 '체인형 재귀 언어 모델(Chained RLM)'에 관한 연구입니다. 단일 경로 추론 대신 문제를 부분 작업으로 나누고, 압축된 요약과 아티팩트를 통해 모델을 반복 호출하여 추론의 정확도를 높이는 아키텍처를 다룹니다.
멀티모달 거대 언어 모델(MLLM)의 시각적 추론 성능을 높이기 위해 모달리티 균형을 활용한 새로운 자기 증류 방식인 OPD-V를 제안합니다. 텍스트가 시각 정보를 압도하는 모달리티 불균형 문제를 해결하여 훈련 비용을 줄이면서도 추론 성능을 향상시켰습니다.
NVIDIA Nemotron 모델을 현대 그리스어 RAG 시스템에 최적화하기 위한 엔드 투 엔드 적응 연구를 소개합니다. 코퍼스 마이닝부터 리랭커, 리더 미세 조정을 통해 검색 성능과 생성 답변의 정확도를 획기적으로 향상시켰습니다.
OctoLong은 AST 파서와 언어 서버를 활용해 수백만 토큰 규모의 의존성이 풍부한 코드 컨텍스트를 구축하는 파이프라인입니다. 이를 통해 학습된 OctoLong-Instruct 모델은 기존 모델 대비 리포지토리 수준의 코드 이해와 장기 에이전트 작업에서 탁월한 성능을 보입니다.
본 연구는 저심도 양자 회로와 고전적 언어 모델(LLM) 사이의 무조건적 분리를 증명합니다. 양자 회로가 생성하는 분포와 확산 언어 모델(DLM) 간의 분포적 차이 및 특정 함수 계산 시 고전적 트랜스포머가 요구하는 거대한 너비를 수학적으로 제시합니다.
LLM의 추론 능력을 높이는 테스트 시간 스케일링 과정에서 프롬프트 복잡도와 모델 확신도를 기반으로 샘플링 예산을 동적으로 조절하는 적응형 방식을 제안합니다. 퍼지 컨트롤러를 통해 연산 효율성을 높이면서도 성능을 유지하는 해석 가능한 추론 메커니즘을 제시합니다.
교육학적 원칙을 반영하여 ESL 학습자를 위한 적응형 영어 튜터를 개발하는 TACT 프레임워크를 제안합니다. 새로운 분류 체계와 TACTCorpus를 통해 Qwen3.5-4B 모델을 사후 학습시켜 기존 모델보다 뛰어난 튜터링 성능을 입증했습니다.
ReflectRL은 전문가 모델의 실패 사례인 '골든 네거티브 궤적'을 활용하여 LLM의 추론 능력을 향상시키는 새로운 온폴리시 학습 프레임워크입니다. 결함이 있는 궤적을 성찰하여 학습한 뒤 이를 직접 추론으로 전이함으로써, 어려운 문제에서도 효율적인 성능 향상을 이끌어냅니다.
비디오 스트림을 활용한 차세대 멀티모달 딥리서치 에이전트인 Video-DR을 제안합니다. 양식 편향과 파라미터 지식 누출 문제를 해결하기 위해 분리된 인지-탐색 파이프라인과 2단계 학습 레시피를 도입했습니다.
음성 전사와 키보드 입력 시 발생하는 다양한 섭동(perturbations)이 LLM의 성능에 미치는 영향을 분석한 연구입니다. 새로운 벤치마크인 HIVE를 통해 모델의 강건성을 평가하고, 입력 방식에 따른 성능 저하 원인을 규명합니다.
GUI 시각적 접지(visual grounding) 모델이 좌표를 숫자 토큰으로 생성할 때 발생하는 보안 취약점을 분석한 연구입니다. 자릿값 구조를 악용하여 클릭 위치를 의도적으로 변위시키는 새로운 적대적 공격 방법론인 MissClick을 제안합니다.
3D 집적 회로(3D-IC)의 설계 변경(ECO) 과정을 자동화하기 위한 에이전트 기반 프레임워크 AgenticECO를 제안합니다. 이 프레임워크는 증거 기반 도구 사용 워크플로우와 최소 간섭 라우팅 기술을 결합하여 기존 방식보다 높은 결함 해결률을 기록했습니다.
LLM을 활용하여 중의성이 해소된 대규모 지식 베이스를 직접 구축하는 방법론인 GPTKB 2.0을 제안합니다. 엔티티, 관계, 클래스에 대한 실시간 중의성 해소를 통해 확장성과 정확도를 동시에 확보했습니다.
의료용 LLM의 환자 분류(Triage) 능력을 평가하기 위한 새로운 벤치마크인 CARE-Bench를 소개합니다. 500개의 사례를 통해 11개 모델을 평가한 결과, 프롬프팅이 성능을 향상시키기는 하지만 여전히 행동 타이밍과 관련된 임계값 오류가 지속됨을 확인했습니다.