Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
멀티 에이전트 시스템에서 의도적인 오정보 주입이 에이전트 간 상호작용을 통해 어떻게 전파되는지 연구합니다. 오정보가 성능 저하를 유발하지만, 의사 결정 프로토콜에 따라 이를 완화할 수 있음을 보여줍니다.
개인화된 컴퓨터 사용 에이전트를 평가하기 위한 새로운 벤치마크인 MyPCBench를 소개합니다. 실제 사용자의 컨텍스트와 로그인 환경을 반영한 Linux 데스크톱 환경에서 모델의 성능을 측정하며, Claude Opus 4.6이 가장 높은 성능을 기록했습니다.
LLM이 유럽 포르투갈어와 브라질 포르투갈어 사이에서 보이는 언어적 편향을 측정하기 위한 새로운 벤치마크 P3B3를 소개합니다. 실험 결과 대부분의 모델이 브라질 포르투갈어에 편향되어 있음을 확인하였으며, 언어 변체 간의 균형 잡힌 표현의 필요성을 강조합니다.
LLM 에이전트의 기술 역량을 강화하기 위해 집합적 기술 트리 탐색(CSTS) 프레임워크를 제안합니다. 집합 지성을 활용해 기술 노드를 생성하고 평가함으로써, 모델이 복잡한 과업을 수행할 수 있는 재사용 가능한 기술 트리를 자동으로 구축합니다.
LLM의 개인정보 보호를 위한 새로운 분할 학습(Split Learning) 프레임워크인 MIXGUARD를 제안합니다. Mixup 기반의 난독화 기술을 통해 데이터 유용성을 유지하면서도 데이터 재구성 공격에 대한 강력한 방어 성능을 입증했습니다.
항공우주 설계의 안전성과 설명 가능성을 위해 LLM 및 VLM 기반의 시각적 코드 완성 코파일럿 시스템을 제안합니다. ReAct 방법론을 활용한 코파일럿과 전용 플러그인 Wingbuilder, 그리고 항공우주 시각적 프로그래밍 데이터셋(AVPD)을 함께 소개합니다.
텍스트 감독 없이 이미지와 음성 설명만을 사용하여 쓰인 단어와 발화 사이의 매핑을 학습하는 새로운 방법을 제안합니다. 이미지 캡셔닝과 비지도 단어 발견 기술을 결합하여 음성 단어 어휘를 구축하며, 기존 신경망 베이스라인보다 높은 성능과 해석 가능성을 보여줍니다.
최소한의 레이블로 LLM의 추론 능력을 확장하는 준지도 학습 프레임워크를 제안합니다. 경량 검증기와 엔트로피 기반 필터링을 통해 고신뢰도 추론 흔적을 선별하여 모델을 미세 조정합니다.
본 연구는 검색기(retriever)의 특성에 맞춰 LLM이 질의 구성 전략을 적응시키는 환경 인식 정보 검색 방식을 제안합니다. 강화학습(RL)을 통해 검색기별 최적의 질의 스타일을 학습하며, 이를 통해 더욱 정교한 RAG 시스템 구축이 가능함을 입증했습니다.
LLM 기반 검색 에이전트가 웹 콘텐츠 조작에 의해 잘못된 정보를 승인하게 되는 '승인 오염' 취약성을 측정하는 프레임워크 SearchGEO를 제안합니다. 13개 LLM 백엔드를 평가한 결과, 모델 제품군마다 취약성 패턴이 다르며 Claude는 과도한 거부, GPT는 과도한 신뢰 경향을 보임을 확인했습니다.
MoE 아키텍처의 메모리 효율성을 높이기 위해 연속적인 트랜스포머 레이어 간에 전문가 파라미터를 공유하는 'Expert Tying' 방식을 제안합니다. 이 방식은 모델 성능 저하 없이 메모리 사용량을 최대 2배까지 절감할 수 있음을 입증했습니다.
Transformer Grammars(TGs)에서 구문 트리의 선형화 방식이 모델 성능에 미치는 영향을 연구했습니다. 기존의 깊이 우선 순회(DFT)를 넘어 너비 우선 순회(BFT)와 새로운 하이브리드 방식인 생성 규칙 순회(PRT)를 제안하고 성능을 검증했습니다.
LLM의 제로샷 반어법 탐지 성능을 높이기 위해 신경-기호 게이팅과 압축된 CoT를 결합한 RDS 프레임워크를 제안합니다. 이 방식은 미세 조정 없이도 기존 지도 학습 모델에 필적하는 높은 정확도와 환각 억제 능력을 보여줍니다.
Diffusion LLM의 디코딩 과정에서 발생하는 오류 전파와 국소적 오류 강화 문제를 해결하기 위한 ASRD 프레임워크를 제안합니다. 앵커 토큰을 활용해 신뢰할 수 있는 컨텍스트를 식별함으로써 디코딩 정확도와 추론 속도를 동시에 개선합니다.
LLM의 인컨텍스트 러닝(ICL) 환경에서 부정 표현에 대한 행동적 및 표현적 체계성을 분석한 연구입니다. 모델이 부정문의 범위(scope)를 인식하는 데 있어 출력 형식의 영향을 받으며, 특정 작업에 대한 함수 벡터 구축의 한계를 밝힙니다.
Reddit의 자기 공개 서사를 활용하여 2023~2025년 사이의 사기 트렌드와 경로를 분석한 연구입니다. LLM 지원 방식을 통해 사기 체인을 라벨링하고, 사기 프로세스가 다중 경로 형태를 띠며 연도별로 변화함을 밝혀냈습니다.
LLM이 전자 건강 기록(EHR) 질의응답 시 추론 단계(hop count)가 늘어날수록 정확도가 급격히 하락하는 현상을 분석한 연구입니다. Transformer의 구성성 한계로 인해 복잡한 추론이 요구될수록 모델의 실패 가능성이 높아짐을 입증했습니다.
기호적 비형식화(Symbolic Informalization)는 형식 수학을 정밀도 손실 없이 자연어로 변환하는 기술입니다. Informath 프로젝트는 Dedukti와 GF를 활용해 다양한 증명 시스템과 자연어 간의 상호 운용성을 제공합니다.
Contrastive-Difference CKA(CKA_Delta)를 통해 서로 다른 LLM 아키텍처 간의 개념적 구조 정렬을 분석한 연구입니다. 기하학적 수렴과 기능적 전이 사이의 해리 현상을 규명하며, 훈련이 필요 없는 새로운 진단 도구를 제안합니다.
자연과학 전반의 이질적인 작업을 통합하는 범용 생성 파운데이션 모델인 LOGOS를 제안합니다. 과학적 객체와 상호작용을 공통 어휘로 인코딩하여, 별도의 기하학적 신경망 없이도 복잡한 구조를 순차적으로 예측할 수 있습니다.