Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
비상 대피 시 인간의 불완전한 인지, 감정, 성격을 반영한 새로운 에이전트 기반 시뮬레이션 프레임워크를 제안합니다. 이 모델은 공포, 기억, OCEAN 성격 모델을 통합하여 현실적인 군중 행동과 대피 지연 현상을 구현합니다.
MoPe는 동적 환경에서 단안 가우시안 스플래팅 SLAM의 고스팅 현상을 해결하기 위해 '동작 영속성' 개념을 도입한 연구입니다. 과거의 동적 정보를 시간적으로 전파하여 객체의 동적 정체성을 유지함으로써 로봇 자율 주행을 위한 더욱 안정적인 장면 표현을 제공합니다.
복강경 수술 로봇을 위한 시각-언어-행동(VLA) 모델 평가용 벤치마크인 SurgVLA-Bench를 제안합니다. SurRoL 시뮬레이션을 통해 계층적 작업 분류 체계를 구축하고, 자기회귀 및 흐름 매칭 모델의 성능을 다각도로 비교 분석했습니다.
고출력 레이저 시설의 광학 부품 검사 시 발생하는 가짜 손상 부위를 식별하기 위해 신뢰도 피드백 가중 그래프 매칭 네트워크를 제안합니다. 이 모델은 노드 매칭 신뢰도를 피드백하여 방해 부위의 영향을 억제하고 매칭 정확도를 높입니다.
LLM 추론 성능 향상을 위해 GRPO 기반 강화학습에서 발생하는 세 가지 구조적 병리 현상을 해결하는 PASS(Process Advantage Signal Shaping) 방법론을 제안합니다. PASS는 이점 융합, 청크 기반 가치 할당, 길이 분할 기술을 통해 프로세스 감독 신호를 효과적으로 정제합니다.
LLM을 활용한 금융 데이터 압축 과정에서 발생하는 정보 충실도(Information Fidelity) 저하 문제를 다룹니다. 압축된 문맥이 원본 자료의 의사결정 방향을 왜곡하는 현상을 분석하고, 이를 해결하기 위한 에이전트 기반 문맥 압축 방식을 제안합니다.
온폴리시 자기 증류(OPSD)의 한계를 극복하기 위해 은닉 상태의 흐름을 정렬하는 PHF(Privileged Hidden Flow) 기법을 제안합니다. 토큰 수준의 분포뿐만 아니라 은닉 벡터의 전이 방향과 궤적 기하학을 정렬하여 모델 성능을 개선합니다.
복잡한 쿼리에 대응하기 위해 컨텍스트 선택을 정보 수요 커버리지 최적화 문제로 재구성한 GeoRAG를 제안합니다. Sinkhorn-Wasserstein 거리를 최소화하여 다차원 수요를 포괄하며, 기존 top-k 방식보다 높은 정확도를 보여줍니다.
제로섬 게임에서 내쉬 균형이 다수 존재할 때, 솔버의 알고리즘 특성에 따라 서로 다른 균형점이 선택되는 현상을 분석합니다. R-NaD와 같은 정규화된 방법은 최대 엔트로피 구성원을 선택하는 반면, CFR 계열은 낮은 엔트로피의 면으로 표류함을 입증했습니다.
DexCompose는 사전 학습된 숙련된 조작 정책을 재사용하여 단일 손으로 다중 작업을 수행할 수 있게 하는 새로운 프레임워크입니다. 손가락 수준의 행동 소유권을 통해 기존 기술을 유지하면서도 새로운 작업을 수행할 수 있도록 잔차 구성 방식을 제안합니다.
파킨슨병 환자의 회전 시 걸음 수를 정확하게 측정하기 위한 비디오 기반의 coarse-to-fine 프레임워크를 제안합니다. 3D 인간 메쉬 복원과 광학 흐름을 결합하여 미세한 보행 역학을 포착하며, 기존 웨어러블 방식의 불편함을 개선합니다.
긴 영상 이해를 위해 외부 시각적 증거를 활용하는 Reflect-R1 프레임워크를 제안합니다. 직관, 검증, 중재의 3단계 파이프라인과 단계 분리형 강화학습(SD-GRPO)을 통해 모델의 환각 현상을 줄이고 자기 수정 능력을 극대화했습니다.
Home3D 1.0은 단일 참조 이미지를 기반으로 고품질 3D 에셋을 생성하는 모듈형 시스템입니다. Geometry, Texture, Material, Parts의 네 가지 모듈을 통해 PBR 재질이 포함된 정교한 메쉬를 생성합니다.
에이전트형 AI를 활용하여 이동성 마이크로데이터를 통해 개인을 재식별할 수 있는 새로운 위협 모델을 제시합니다. LLM 에이전트가 자율적으로 웹 정보를 교차 참조하여 높은 성공률로 개인을 식별할 수 있음을 입증하며, 기존 익명성 보호 체계의 한계를 경고합니다.
단백질 언어 모델을 활용하여 특정 아미노산 조성을 가진 단백질 서열을 생성하는 2단계 미세 조정 방법론을 제안합니다. 도메인 적응형 미세 조정과 강화학습을 결합하여 서열의 다양성을 유지하면서도 목표하는 영양 가치를 충족하는 단백질 설계를 가능하게 합니다.
RelBall은 지식 그래프 완성(KGC)을 위해 쿼터니언 회전을 활용한 새로운 모델입니다. 기존 모델이 해결하지 못한 비교환적 합성 패턴과 의미론적 계층 구조, 그리고 다양한 관계 유형(일대다 등)을 효과적으로 모델링합니다.
ProMSA는 지식 기반 시각적 질의응답(KB-VQA)을 위해 제안된 점진적 멀티모달 검색 에이전트입니다. 고정된 검색 방식 대신 도구 호출을 통해 이미지 및 텍스트 검색을 반복하며, TN-GSPO 강화학습을 통해 최적화되었습니다.
SHARD는 밀집 임베딩의 기하학적 구조를 이용한 개인정보 유출 공격을 방어하기 위한 새로운 임베딩 변환 방식입니다. 공개 접두사와 비밀 키 기반의 셀 분할 잔차를 사용하여 검색 성능을 유지하면서도 정렬 저항성을 확보합니다.
픽셀 공간 자기회귀(AR) 이미지 생성 시 발생하는 오차 누적과 느린 샘플링 문제를 해결하기 위한 PRA 프레임워크를 제안합니다. 저차원 중간 상태를 활용해 병렬 학습과 픽셀 피드백 근사를 동시에 달성하며, ImageNet-1K 생성에서 SOTA 성능을 기록했습니다.
구별 불가능한 객체를 활용하여 확률적 그래픽 모델의 추론 속도를 높이는 리프팅된 인과 추론(LCI) 기술을 소개합니다. PCFGs를 통해 인과 지식을 통합하고, 기존 명제적 추론 대비 획기적인 속도 향상을 달성했습니다.