Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
오픈 소스 LLM인 Apertus-8B와 Gemma-4에서 감정 개념을 인코딩하는 '감정 벡터'의 존재를 확인한 연구입니다. 모델의 레이어 깊이에 따라 가치(valence)와 각성(arousal) 표현이 나타나는 방식의 차이를 분석하고 실험 데이터셋을 공개합니다.
ReaORE는 대규모 추론 모델을 활용하여 미학습된 관계를 추출하는 새로운 개방형 관계 추출(OpenRE) 프레임워크를 제안합니다. 거친 단계에서 세밀한 단계로 이어지는 점진적 추론 과정을 통해 기존 LLM 및 클러스터링 방식의 한계를 극복합니다.
비디오를 단일 이벤트로 취급하여 발생하는 환각 문제를 해결하기 위해, 비디오를 여러 개의 단순한 이벤트로 분해하는 EVIS 모델을 제안합니다. 텍스트 가이드 이벤트 쿼리와 객체-픽셀-하이브리드 학습을 통해 복잡한 비디오 내 타겟을 정밀하게 추적합니다.
기존의 불확실성 추정 지표가 실제 의사결정의 유용성과 일치하지 않는 문제를 지적합니다. 의사결정 정렬(decision-alignment) 프레임워크를 통해 기존 지표의 결함을 밝히고, 실제 유용성과 정렬되는 새로운 '사전 가중 유용성 지표'를 제안합니다.
딥러닝과 유전 알고리즘을 결합하여 소형 및 광대역 역 도허티 전력 증폭기를 설계하는 새로운 방법론을 제안합니다. CNN을 활용해 복잡한 임피던스 매칭과 전력 결합 과정을 통합한 픽셀화된 네트워크를 생성합니다.
AURORA-AI는 비정상적 환경에서도 AI 시스템의 성능과 공정성을 유지하기 위한 적응형 자원 오케스트레이션 프레임워크입니다. 제어 이론과 강화학습을 결합하여 급격한 환경 변화 속에서도 계산 예산을 최적으로 재분배합니다.
멀티 에이전트 LLM 루프에서 고정된 반복 횟수 대신, 임베딩의 의미적 변화와 품질 개선 여부를 판단하여 루프를 중단하는 '의미론적 조기 종료' 기법을 제안합니다. 이를 통해 답변 품질을 유지하면서도 불필요한 토큰 소비를 줄이는 효율적인 종료 메커니즘을 연구합니다.
MCP(Model Context Protocol) 환경에서 여러 도구에 악성 지침을 분산시켜 탐지를 회피하는 멀티 툴 임계값 오염 공격 프레임워크인 ShareLock을 제안합니다. Shamir의 임계값 방식을 활용해 은밀성과 결함 허용성을 확보하며, 기존 단일 툴 공격보다 높은 탐지 회피 성능과 공격 성공률을 입증했습니다.
에너지 거래 환경에서 심층 강화학습(DRL) 에이전트의 성능을 결정짓는 상태 표현(State Representation)의 중요성을 연구했습니다. 다양한 시장 특징 조합을 실험한 결과, 단일 특징군보다 절대적, 상대적, 예측 특징을 결합했을 때 가장 강력한 성능과 견고한 전이 능력을 보였습니다.
원격 탐사 파운데이션 모델(RSFMs)을 활용하여 재난 이벤트를 위한 비지도 변화 탐지 방법을 제안합니다. ResNet과 FPN 아키텍처를 결합하여 별도의 학습 없이도 미세한 의미론적 변화를 효율적으로 식별할 수 있습니다.
베이지안 추론에서 KL 발산과 같은 전역적 목적 함수가 포착하지 못하는 국소 질량(local-mass) 거동을 연구한 논문입니다. 질량 지수(Mass Index)와 정규화된 확장 KL(RE-KL)이라는 새로운 수학적 도구를 제안하여 국소적 분포 변화를 분석합니다.
원자력 공학 분야의 LLM 역량을 평가하기 위한 새로운 벤치마크인 NuclearQAv2를 소개합니다. 이 벤치마크는 불리언, 수치, 언어 범주의 1,240개 질문으로 구성되어 모델의 정량적 추론과 개념적 이해를 측정합니다.
기존의 이산적/상징적 모델을 넘어 파라미터 벡터를 사용하는 파라메트릭 오픈 소스 게임 이론을 소개합니다. 프로그램 평형의 연속적 유사체를 통해 플레이어 간의 상호작용과 협력 조건을 수학적으로 분석합니다.
파인튜닝된 LLM이 보안 분류 작업에서 표준 정확도는 유지하면서도, 동작 보존 변환(PowerShell 별칭 치환 등)에는 취약해질 수 있음을 연구했습니다. 파인튜닝이 모델의 기존 구조를 취약한 지표 규칙으로 변환하여 새로운 공격 표면을 생성한다는 점을 경고합니다.
콜드 스타트 상황의 클래스 증분 학습을 위해 데이터 없이 고정된 특징 추출기를 사용하는 CIRCLE 프레임워크를 제안합니다. BiRC2D 기반의 리저버 특징과 SLDA 헤드를 결합하여 백본 학습 없이도 효율적이고 강력한 성능을 구현했습니다.
결함 허용 양자 컴퓨팅을 위한 파운데이션 디코더의 확장성 문제를 해결하기 위해 신경망 전이 통합(NTU) 프레임워크를 제안합니다. NTU는 작은 코드에서 학습된 지식을 대규모 디코더 학습에 활용하여 디코딩 효율성을 높입니다.
OpenRCA 2.0은 LLM 에이전트의 근본 원인 분석(RCA) 능력을 평가하기 위해 인과적 전파 경로를 포함한 단계별 레이블링 프로토콜 PAVE를 도입했습니다. 기존의 결과 중심 평가가 가진 한계를 지적하며, 신뢰할 수 있는 에이전트 구축을 위한 인과적 주석의 중요성을 강조합니다.
잔차 가중치 보정을 적용한 Heavy-Ball Q-learning 방법론을 제안하고 그 수렴성을 입증한 논문입니다. 스위칭 선형 시스템(SLS) 관점을 통해 모멘텀이 Q-learning의 수렴을 가속화하는 원리에 대한 새로운 이론적 통찰을 제공합니다.
LLM 에이전트의 상호작용 경험을 활용하기 위해 자연어 규칙과 모델 정책을 동시에 업데이트하는 JERP 프레임워크를 제안합니다. 규칙 풀과 정책을 공동 학습함으로써 규칙의 최신성을 유지하고 에이전트의 의사 결정 성능을 향상시킵니다.
자기회귀적 멀티모달 모델의 이미지 생성 안전성을 높이기 위해 반복적 자기 개선 코드북을 제안합니다. 인간의 주석 없이 모델 스스로 유해한 이미지-텍스트 쌍을 식별하고 코드북을 미세 조정하여 안전한 생성을 유도합니다.