Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
기존 ROUGE나 BERTScore 같은 지표가 가진 의미적 유사성 판단 오류를 해결하기 위해 MATCHA를 제안합니다. MATCHA는 정답과의 근접성과 모순과의 거리를 동시에 측정하는 이중 관점을 통해 인간의 평가와 더 높은 일치도를 보입니다.
시각-언어 모델(VLM)이 어휘 판단 시 유용한 시각적 증거와 부수적인 이미지 문맥을 제대로 구분하는지 분석한 연구입니다. 실제 이미지 문맥이 오히려 모델의 정렬을 저해하고 가짜 시각적 단서에 민감하게 반응할 수 있음을 발견했습니다.
본 논문은 양화사를 사용하는 ASP(Q)의 확장 모델인 2-ASP(Q)^w의 복잡도와 구현 방안을 다룹니다. 이론적 완전성 분석과 함께 CEGAR 기술을 활용한 Casper 시스템의 새로운 계산 전략을 제안하며, 벤치마크를 통해 실용성을 입증했습니다.
의미론적 변화를 모델링하는 SSD의 확장판인 'interaction SSD'를 소개합니다. 이 방법론은 인종 정체성과 같은 중재 변수에 따른 의미론적 기울기 변화를 통계적으로 테스트하고 해석할 수 있게 합니다.
LLM이 기계 번역에서 탈직역 가설을 어떻게 적용하는지 검증한 연구입니다. WMT24++ 데이터셋을 통해 LLM이 반복적 수정을 거칠수록 번역이 덜 직역된다는 점과 인간의 번역 방식에 근접하고 있음을 확인했습니다.
에이전트형 AI가 복잡한 작업을 수행할 때 최적의 도구와 모델을 선택할 수 있도록 돕는 Neural Router 프레임워크를 제안합니다. 의미론적 콘텐츠 매칭 기술을 통해 고차원 벡터 공간에서 사용자의 의도와 도구 간의 관계를 분석하여 최적의 경로를 결정합니다.
역할 수행 에이전트의 페르소나 충실도를 높이기 위해 사실적 인지와 페르소나 기반 통찰을 분리한 DualMem 프레임워크를 제안합니다. 새로운 데이터셋 RoleMemo를 통해 기존 방식의 한계를 증명하고, SFT와 RL로 학습된 4B 모델의 우수성을 입증했습니다.
CMAP는 시각-언어 모델의 교차 모달 텍스트 임베딩 공간을 활용하여 멀티 도메인 태스크 증분 학습의 한계를 극복하는 방법론입니다. 텍스트 공간 라우팅과 대칭적 게이팅을 통해 매개변수 효율성을 높이면서도 기존 SOTA 성능을 상회하는 결과를 보여줍니다.
SwiGLU 활성화 함수가 저정밀도 LLM 학습 시 유발하는 수치적 불안정성 문제를 해결하기 위해 새로운 PowLU를 제안합니다. PowLU는 유리 거듭제곱 함수를 통해 적응형 비선형성을 구현하여 모델의 표현력을 높이고 학습 안정성을 개선합니다.
자기회귀적 다중 특성 에세이 채점을 위한 새로운 사후 학습 프레임워크인 TAPO를 제안합니다. 보상을 샘플과 특성 차원으로 분해하여 채점 일관성과 특성 간 의존성을 보존하며, SFT 개선을 통해 모델의 특성 이해도를 높입니다.
LLM의 추론 비용을 줄이기 위해 정밀도가 중요한 구간은 명시적 CoT로 유지하고, 중복 구간만 잠재 표현으로 압축하는 SLT 프레임워크를 제안합니다. 신뢰도 기반 게이팅과 강화학습을 통해 정확도 손실을 최소화하면서 추론 길이를 획기적으로 단축했습니다.
정적인 데이터 중심의 기존 평가 방식을 넘어, 실시간 UGC 유입에 대응하는 스트리밍 사용자 프로파일링 벤치마크인 StreamProfileBench를 제안합니다. 12만 개 이상의 실제 데이터를 통해 LLM이 사용자의 관심사 변화를 얼마나 잘 추적하는지 평가합니다.
LLM 평가 비용을 절감하기 위해 벤치마크 질문의 일부 서브셋만으로 전체 점수를 예측하는 효율적인 벤치마킹 기술을 제안합니다. 다중 회귀와 mRMR 알고리즘을 활용하여 기존 방식보다 낮은 예측 오차와 높은 상관관계를 달성했습니다.
역사적 문서의 고정밀 정보 추출을 위해 모델 간 합의를 활용하는 2계층 Human-in-the-loop 프레임워크인 Double Triangle Annotation을 제안합니다. MLLM의 교차 검증과 인간의 개입을 결합하여 환각을 최소화하고 대규모 자동화를 달성했습니다.
기존의 단계별 개체 해상도(ER) 방식의 한계를 극복하기 위해, 매칭과 클러스터링을 통합한 단일 프레임워크 Alper를 제안합니다. LLM의 강력한 추론 능력과 그래프 레이블 전파의 효율성을 적응적으로 결합하여 비용 효율적인 그래프 정제를 수행합니다.
SAMark는 문장 순서 변경과 같은 문단 수준의 패러프레이징 공격에 강한 자기 앵커링 텍스트 워터마킹 프레임워크를 제안합니다. 의미 공간 내 그린 영역 구축과 다채널 쌍곡선 스코어링을 통해 탐지 성능을 높이고 생성 품질을 유지합니다.
PIIBench를 활용하여 DeBERTa 모델의 개인 식별 정보(PII) 탐지 성능을 연구했습니다. 복잡한 계층적 모델보다 직접적인 토큰 분류 미세 조정 방식이 다양한 데이터셋에서 더 높은 F1 점수를 기록하며 우수성을 입증했습니다.
LLM의 불확실성을 활용하여 답변, 명확화, 기권 중 최적의 대화 전략을 선택하는 '신념 증강 생성(BAG)' 기술을 제안합니다. 기존 모델이 불확실성을 무시하는 문제를 해결하며, 다회차 질의응답 환경에서 정확도를 향상시킵니다.
사이버 위협 인텔리전스(CTI)에서 MITRE ATT&CK 기법을 정확하게 추출하기 위한 새로운 프레임워크 TTPrint를 제안합니다. '발산 후 수렴' 설계를 통해 후보 기법을 광범위하게 생성한 뒤 증거 기반으로 엄격히 검증하여 재현율과 정밀도를 동시에 높였습니다.
Auto-Robotist는 로봇 설계 과정에서 발생하는 형태 탐색 흔적을 자연어 기술 라이브러리로 증류하는 자가 진화형 LLM 에이전트입니다. 설계 지식을 명시적인 라이브러리로 저장하여 검색 및 재사용이 가능하게 함으로써, 기존 유전 알고리즘보다 뛰어난 설계 전이 성능을 보여줍니다.