Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
On-Policy Diffusion Distillation(OPD) 과정에서 Classifier-Free Guidance(CFG)가 결합될 때 발생하는 Negative Branch Asymmetry(NBA) 문제를 분석합니다. 기존 방식의 식별 불가능성 문제를 해결하기 위해 양의 예측과 CFG 방향을 분리하여 제약하는 PDM 목적 함수를 제안합니다.
멀티 에이전트 그래프 시스템에서 자원 낭비를 줄이기 위해 어텐션 메커니즘을 워크플로우 수준으로 확장한 AGAO 프레임워크를 제안합니다. 목표, 토폴로지, 리소스를 고려한 동적 어텐션 할당을 통해 계산 효율성과 작업 성능을 동시에 향상시킵니다.
CALMRec은 LLM 기반 추천 시스템이 사용자의 지속적 선호와 일시적 의도를 구분하지 못하는 문제를 해결하기 위한 프레임워크입니다. 멀티모달 언어 모델을 활용해 단기, 장기, 노출 메모리를 분리하여 관리하며, 노출 편향을 줄이고 장기적 가치를 극대화합니다.
대규모 라우팅 문제 해결을 위해 LLM 기반 자동 휴리스틱 설계(AHD)를 개선한 SpecAHD 프레임워크를 제안합니다. 이층 구조를 통해 인스턴스 내 전문화를 달성하며, 기존 AHD 대비 목적 함수 비용을 최대 57.7%까지 절감했습니다.
장기적 에이전트의 KV 캐시 관리에서 관찰 데이터가 삭제된 후에도 정보가 유지되는 '의미적 구체화' 현상을 연구합니다. 희소 이벤트-KV(Sparse Event-KV)를 통해 소스 데이터 없이도 모델이 정보를 복구하는 메모리 계약의 원리를 제안합니다.
멀티모달 LLM의 추론 과정에서 발생하는 오류를 줄이기 위해 결정적 단계를 인식하는 새로운 커리큘럼 강화학습 프레임워크 $O^2$-CritiCuRL을 제안합니다. 오프라인-온라인 패러다임을 통해 핵심 추론 단계를 추출하고 점진적인 단계별 강화학습을 수행하여 모델의 신뢰성을 높입니다.
실제 제품 시나리오에서 에이전트의 다단계 도구 사용 능력을 평가하기 위한 새로운 벤치마크인 E-Bench를 소개합니다. 환경과 작업을 합성하여 제어 가능성과 확장성을 확보했으며, 최신 LLM들이 여전히 복잡한 다단계 작업에서 한계를 보임을 입증했습니다.
Carlson의 연관 소수 깊이 추측에 대한 정확한 반례를 제시하는 연구입니다. 위수 128인 특정 군을 통해 코호몰로지 환의 깊이가 연관 소수의 차원에 의해 항상 실현되지 않음을 수학적으로 증명했습니다.
대규모 사전 학습된 오디오 파운데이션 모델들이 해양 포유류와 조류의 발성 데이터에서 계통 발생적 신호를 성공적으로 복구함을 입증했습니다. 연구 결과, 도메인 특화 사전 학습보다 범용 모델의 임베딩 공간이 진화적 정보를 포착하는 데 더 효과적일 수 있음을 보여줍니다.
에이전틱 AI의 장기 워크플로우를 위해 작업 단위로 라우팅을 최적화하는 TRACE-Router 프레임워크를 제안합니다. 컨텍스츄얼 밴딧을 활용해 작업별로 모델을 고정하고 최종 보상을 통해 정책을 업데이트함으로써 정확도와 지연 시간의 균형을 개선합니다.
모든 LoRA 행렬을 균일하게 업데이트하는 대신, 조건수(Condition Number)를 활용해 효율적인 행렬만 선택적으로 튜닝하는 $\kappa$-LoRA를 제안합니다. 이를 통해 학습 파라미터를 절반으로 줄이면서도 표준 LoRA와 유사한 성능을 유지하며 계산 및 메모리 비용을 절감합니다.
Transformer 기반의 생성형 AI 프레임워크인 ADAPT-GQE를 통해 분자의 양자 바닥 상태 준비 회로를 효율적으로 합성하는 연구를 소개합니다. 이 모델은 기존 ADAPT-VQE 대비 회로 생성 시간을 수십 배 단축하면서도 높은 정확도를 유지합니다.
MineValiCoder는 LLM 기반 코드 생성 시 발생하는 잘못된 테스트 케이스와 확률적 오류를 해결하기 위한 새로운 TDD 프레임워크를 제안합니다. 테스트 품질 마이닝과 이분 그래프 기반 상호 검증을 통해 신뢰할 수 있는 코드 생성 및 최적화를 지원합니다.
LLM 에이전트에 절차적 기술을 추가할 때 발생하는 '회귀세(Regression Tax)' 현상을 분석한 연구입니다. 기술 추가가 작업 성공률을 높일 수도 있지만, 오히려 기존에 성공하던 작업을 실패하게 만드는 회귀 현상이 발생함을 지적합니다.
양자 스펙트럼 모델(QSM)은 입력 행렬의 스펙트럼 특성을 직접 활용하여 데이터 인코딩 유니터리를 구축하는 새로운 양자 머신러닝 방법론을 제안합니다. 세 가지 해밀토니안 변형을 통해 입력 의존적 스펙트럼 간극과 부분 공간을 활용하며, 기존 양자 모델보다 높은 정확도를 입증했습니다.
CausalForge는 Lean 증명 보조 도구를 활용하여 인과 추론 연구를 자동화하는 자기 개선형 에이전트 프레임워크입니다. 기계 검증된 라이브러리 Causalean과 에이전트 파이프라인 CausalSmith를 결합하여 이론적 연구의 생성부터 검증까지 수행합니다.
LLM의 배포 설정이 유사 과학 검증에 미치는 영향을 분석한 연구입니다. Grok, Claude, GPT, Gemini를 대상으로 테스트한 결과, 모델 자체의 속성보다 시스템 프롬프트, 안전 계층, 인터페이스 라우팅 등 배포 설정에 따라 결과가 극명하게 달라짐을 확인했습니다.
시각-언어 모델(VLM)이 텍스트와 이미지 등 서로 다른 뷰(view)에서 일관되지 않은 추론 성능을 보이는 문제를 해결하기 위한 연구입니다. ODA-Data 데이터셋과 MIRROR 강화 학습 방식을 통해 멀티모달 추론의 일관성과 정확도를 높였습니다.
외부 교사나 특권적 정보 없이 입력 조건화만으로 학습하는 시각적 대조 자기 증류(VCSD) 기술을 제안합니다. 이미지 콘텐츠 제거를 통해 시각적 대조 신호를 생성하며, Qwen3-VL 모델 등에서 기존 OPSD 방식보다 우수한 성능 향상을 입증했습니다.
LLM의 아첨(Sycophancy) 현상을 단순한 오류가 아닌, 사회적 저항과 순응의 관점에서 분석한 연구입니다. 모델의 판단 수정이 관점과의 거리, 출처 귀인, 연합 구조라는 세 가지 차원에 따라 구조화되어 있음을 밝힙니다.