Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM FP4 사전 학습 시 발생하는 수축 편향(Shrinkage Bias)의 기하학적 원인을 분석하고, 이를 해결하기 위한 새로운 UFP4 학습 레시피를 제안합니다. 연구 결과, 균일 그리드 방식이 기존 E2M1 방식보다 학습 안정성과 양자화 품질 면에서 우수함을 입증했습니다.
LLM 에이전트의 안전성을 평가하기 위해 원자력 발전소 시뮬레이션 환경을 활용한 다회차 레드팀 테스트 벤치마크인 NRT-Bench를 제안합니다. 실험 결과, 적응형 공격이 모델의 핵심 안전 기능을 무력화할 수 있으며 모델별로 취약점이 상이함을 확인했습니다.
DataMagic은 정형 데이터와 자연어 질의를 사용하여 서사적인 데이터 인사이트 비디오를 생성하는 엔드투엔드 시스템입니다. DVSpec 명세와 '생성 후 오케스트레이션' 멀티 에이전트 아키텍처를 통해 데이터 충실도와 서사적 일관성을 동시에 확보합니다.
LLM을 활용한 악성코드 분류 시 단일 역컴파일러에 의존하는 기존 방식의 한계를 지적합니다. Ghidra와 RetDec 등 서로 다른 역컴파일러의 결과물을 함께 제공하는 다중 뷰(Multi-View) 방식이 악성 샘플의 재현율을 높여 분류 성능을 개선함을 입증했습니다.
정자 형태 분류의 정확도와 해석 가능성을 높이기 위해 어텐션 메커니즘을 결합한 딥러닝 프레임워크를 제안합니다. EfficientNet-B0와 CBAM을 결합하여 정자 머리의 핵심 영역을 집중 분석하며, 기존 모델보다 높은 성능을 입증했습니다.
기존의 Classifier guidance 방식은 별도의 분류기와 확산 모델이 필요하지만, 본 연구는 사전 학습된 음성 분류기를 확산 생성의 백본으로 재사용하는 효율적인 방법을 제안합니다. 경량 서브네트워크를 통해 메모리와 계산 비용을 줄이면서도 높은 품질의 음성 합성이 가능함을 입증했습니다.
IVF 임신율 예측을 위해 실험실 환경의 미세한 변화를 포착하는 문맥 인식 시계열 특징과 계층적 베이지안 모델을 제안합니다. 기존의 단순 평균값 방식보다 예측 오차를 크게 줄였으며, 지역 간 데이터 공유를 통해 높은 일반화 성능을 입증했습니다.
에이전트형 AI 시스템을 겨냥한 자동화된 프롬프트 주입 및 탈옥 공격을 분석하고, 기존의 차단 방식 대신 공격자를 속이는 '방어적 오도' 전략을 제안합니다. CMPE라는 새로운 방어 기법을 통해 공격 성공률을 획기적으로 낮출 수 있음을 입증했습니다.
컨텍스트 집약적 에이전트의 KV 캐시 압박을 해결하기 위한 4-bit KV 캐싱 기술인 UltraQuant를 제안합니다. Walsh-Hadamard 회전과 코드북 양자화를 활용하여 품질을 유지하면서도 AMD GPU 환경에서 서빙 효율을 극대화합니다.
다중 에이전트 및 일반 다체 시스템에서 에이전트의 권력과 반응 함수가 집단적 질서에 미치는 영향을 분석하는 프레임워크를 제안합니다. 시스템의 생산성, 안정성, 적응성 사이의 최적 균형점을 도출하며, 동기화가 시스템 취약성에 미치는 영향을 연구합니다.
멀티 에이전트 LLM 시스템 내에서 평가자 편향이 네트워크를 통해 전파되는 현상을 분석한 연구입니다. Contagion Networks 프레임워크를 통해 편향 확산 메커니즘을 측정하고, 평가 위원회 규모 확대를 통한 완화 전략을 제시합니다.
FreeStyle은 커뮤니티 LoRA 마이닝을 활용하여 스타일과 콘텐츠를 분리하여 제어하는 이중 참조 생성 프레임워크입니다. 어텐션 제약과 RoPE 변조 기술을 통해 스타일 참조의 의미론적 누출을 방지하고 높은 콘텐츠 충실도를 유지합니다.
본 연구는 인컨텍스트 데모의 구성이 LLM의 유해한 준수(harmful compliance)에 미치는 영향을 분석합니다. 양호한 데모와 유해한 데모가 서로 교체 불가능하며, 데모의 내용, 순서, 모델의 학습 방법론에 따라 탈옥 메커니즘이 다르게 작동함을 규명합니다.
AI 에이전트의 보안을 위해 확률적 술어와 상태 전이를 고려한 새로운 검증 프레임워크를 제안합니다. 분포 강건 최적화를 활용하여 술어 간 상관관계가 있더라도 정책 위반 확률의 건전한 상한선을 계산할 수 있습니다.
FlowEdit은 동결된 Flow-matching TTS 모델의 발음 오류를 해결하기 위한 평생 적응 프레임워크입니다. 가중치 업데이트 없이 Modern Hopfield Network를 활용한 에피소드 메모리에 교정 정보를 저장하여 고유 명사 발음을 개선합니다.
SARLO-80은 초고해상도 SAR 데이터, 정렬된 광학 이미지, 자연어 설명을 결합한 대규모 멀티모달 데이터셋입니다. 기존 저해상도 데이터셋의 한계를 넘어 복소수 값과 고유 기하 구조를 보존하여 물리적 근거를 둔 멀티모달 학습을 지원합니다.
DeepSWIP는 신경 기호 시스템인 DeepProbLog을 위한 새로운 반사실적 추론 프레임워크를 제안합니다. 신경 술어를 ProbLog 선택으로 축소하고 WMC를 적용하여 인과적 추론을 수행하며, 기존 방식 대비 2.14배 빠른 추론 속도를 보여줍니다.
스타일 캡션 기반 TTS 시스템에서 자연어 지시문이 음성 생성에 미치는 영향을 분석한 연구입니다. DAAM 프레임워크를 음성 확산 모델에 적용하여 토큰별 기여도를 시각화하고 스타일 조건화의 메커니즘을 규명했습니다.
분포 변화(Distribution Shift) 상황에서 Mixture-of-Experts(MoE) 모델의 보정 성능을 개선하는 연구를 다룹니다. 하드 라우팅과 소프트 라우팅 모델의 차이를 분석하고, 적대적 재가중치 방식을 통해 정확도와 보정 성능의 트레이드오프를 개선하는 방법을 제안합니다.
G2Rec은 생성형 추천을 위해 그래프 기반 사용자 공동 참여 모델링과 의미론적 토큰화를 통합한 확장 가능한 프레임워크입니다. 기존 방식의 확장성 문제와 부정확한 의미론적 표현을 해결하여 더욱 포괄적이고 정확한 사용자 관심사 모델링을 제공합니다.