Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 다중 에이전트 시스템의 출력에 대한 신뢰도를 생성하고 평가하는 세 가지 새로운 프로토콜을 제안합니다. 기존 연구와 달리, 이 방법들은 원시 신뢰도 신호를 변환한 후 소프트 투표나 베이지안 융합 같은 확률적 방법을 통해 단일 집계된 신뢰도를 만듭니다. 이는 개별 에이전트나 표준 토론 방식보다 높은 판별력과 안정적인 정확도를 보여줍니다.
본 논문은 다중 에이전트 시스템(MAS)의 오케스트레이션을 위한 새로운 자기 지도 학습 프레임워크인 OrchRM을 제안합니다. OrchRM은 인간 주석 없이도 중간 아티팩트를 활용하여 보상 모델 훈련에 필요한 승리-패배 쌍을 구성합니다. 이는 기존 방식 대비 효율성과 성능 면에서 큰 개선을 가져와, MAS 테스트 및 오케스트레이터 훈련의 확장성을 높입니다.
본 논문은 과학 연구에서 합성 데이터의 활용 증가 추세와 그 잠재적 위험성을 다룹니다. 특히, 합성 데이터가 편향되거나 노이즈를 가질 수 있다는 우려에 대응하여, '작업 교환성(task exchangeability)'이라는 새로운 통계적 원칙을 제안합니다. 이 원칙은 연구자가 현재 관심 있는 작업이 과거의 실제 작업들과 수학적으로 교환 가능해야 함을 요구하며, 이를 통해 유효한 추론 방법을 개발했습니다.
슬로바키아어를 위한 포괄적인 MTEB 스타일 텍스트 임베딩 벤치마크인 SkMTEB가 공개되었습니다. 이 벤치마크와 함께, 연구진은 Multilingual E5 모델에 어휘 트리밍 및 파인튜닝을 적용하여 로컬 배포가 가능한 슬로바키아어 전용 임베딩 모델(e5-sk-small/large)을 개발했습니다. 이는 자원이 부족한 언어의 임베딩 성능 향상에 기여할 것으로 기대됩니다.
본 논문은 정교 로봇공학의 난제인 관절형 도구 조작 문제를 해결하기 위해 Mana(Manipulation Animator)라는 범용 시뮬레이션-실제(sim-to-real) 프레임워크를 제시합니다. 애니메이션 기법에서 영감을 받은 Mana는 파지 키프레임을 모션 플래닝 및 강화학습을 통해 정교한 조작 궤적으로 변환하는 통합 파이프라인을 사용합니다.
본 논문은 LLM을 활용하여 양자 회로 설계를 자동화하는 자율 에이전트 프레임워크를 제안합니다. 이 시스템은 탐색, 생성, 검증 등 7가지 구성 요소가 통합된 폐쇄 루프 워크플로우를 통해 작동합니다. 평가 결과, 생성된 특징 맵과 안자츠 모두 기존 방법론을 능가하는 성능을 보여주며, LLM 기반 에이전트가 과학적 최적화에 활용될 수 있음을 입증했습니다.
본 논문은 안전성이 중요한 물리 시스템에 적용하기 어려운 흐름 기반 생성 모델의 한계를 극복하고자 PolyFlow를 제안합니다. PolyFlow는 다면체 제약 조건을 모델과 흐름 역학에 직접 임베딩하는 프레임워크로, 투영 없는 아키텍처와 이산 시간 흐름 공식화를 도입했습니다. 이를 통해 계산 오버헤드 없이 엄격한 제약 조건 만족을 보장하며 높은 효율성을 달성합니다.
본 논문은 LLM 기반 에이전트가 규제 산업의 품질 관리 프로세스를 자동화하는 과정에서, 기존의 외부 모니터링 방식으로는 부족하다고 지적합니다. 대신, 도메인에 내재된 기호적 구조(규정, 컴플라이언스 제약 등)를 에이전트 의사결정의 핵심 아키텍처 구성 요소로 활용해야 한다고 주장합니다.
본 논문은 교차 쌍 데이터 없이도 일반적인 다중 샷 카메라 클로닝을 수행하는 OmniDirector라는 프레임워크를 제안합니다. 이 프레임워크는 카메라 움직임을 그리드 모션 비디오로 인코딩하여, 캐릭터, 액션, 카메라에 대한 감독 수준의 통합적 제어를 제공합니다. 이를 통해 높은 성능과 뛰어난 제어 가능성을 입증했습니다.
본 논문은 기계 학습 평가가 중립적이지 않으며, 레이블 생성 프로세스에 의해 조건화됨을 지적합니다. 따라서 분류 성능 향상 대신, 서로 다른 '레이블 권한 체제' 하에서의 성능 측정 타당성을 조사하는 다중 트랙 평가 프레임워크를 제안합니다.
본 논문은 LLM이 보여주는 '주체성'이나 '도덕적 행위자'라는 주장이 오해라고 반박합니다. LLM의 작동 방식은 데이터 기반 확률적 입력-출력 매핑에 불과하며, 진정한 의도성이나 약속 이행을 위한 자기 귀속된 행동이 결여되어 있음을 주장합니다.
본 논문은 장문 텍스트와 음성이 혼합된 대화 환경에서 발생하는 ASR(자동 음성 인식) 교정의 한계를 극복하기 위한 새로운 프레임워크를 제안합니다. 이 방법은 이전 상호작용 기록을 온톨로지 메모리로 구성하여 개체, 용어, 의미 관계 등을 저장하고 검색 가능한 노드로 활용합니다. 실험 결과, 이 프레임워크는 기존 방식보다 문맥 의존적 ASR 오류에 대해 더 정확하고 증거 기반의 교정을 제공함을 입증했습니다.
본 글은 MiniMax-M3 시리즈를 위한 개체(population)-수준 테스트 시간 스케일링 프레임워크인 MaxProof를 소개합니다. MaxProof는 증명 생성, 검증, 복구 기능을 통합하여 모델의 성능을 향상시켰습니다. 이 방법을 통해 M3 모델은 IMO 2025와 USAMO 2026 등 주요 수학 경시대회에서 인간 금메달리스트 수준을 초과하는 높은 점수를 달성했습니다.
본 연구는 자율주행 분야에서 사용되는 비전-언어 모델(VLMs)의 강건성을 분석했습니다. 단순히 임베딩 안정성만 보는 것이 아니라, 손상으로 인한 '태스크 정렬 위험 점수' 변화를 측정하여 모델의 취약점을 파악했습니다. 그 결과, 다양한 종류의 드리프트와 손상이 비대칭적인 실패 모드(오경보/거짓 음성)를 유발함을 밝혀냈습니다.
DuoBench는 양손 로봇 시스템의 협응 능력을 평가하기 위해 설계된 확장 가능한 벤치마킹 프레임워크입니다. 이 프레임워크는 시뮬레이션과 실제 하드웨어 환경에서 총 11개의 작업을 포함하며, 네 가지 협응 범주를 다룹니다. DuoBench는 단순 성공 여부를 넘어선 세밀한 의미론적 실패 분석을 지원하여 로봇 정책 연구에 기여합니다.
본 논문은 클래스 내 응집성과 클래스 간 분리성을 강화하는 품질 적응형 각도 마진 학습 프레임워크 QLung을 제안합니다. 이 프레임워크는 오디오 녹음 품질에 따라 각도 마진을 동적으로 조정하며, 특히 아웃-오브-디스트리뷰션(OOD) 환경에서 뛰어난 성능을 입증했습니다.
본 논문은 GPU 기반 LLM 서빙 시스템에서 발생하는 소프트웨어 노화 현상을 연구하는 경험적 방법론을 제안합니다. 기존 CPU 중심의 연구와 달리, 변동성이 큰 워크로드를 처리하는 LLM 환경에 초점을 맞췄습니다. 216시간 캠페인과 통계적 분석을 통해 모든 배포 환경에서 메모리 노화를 확인하고, 그 원인이 서빙 런타임 및 구성에 크게 의존함을 밝혀냈습니다.
본 연구는 대규모 추론 모델(LRMs)의 공간 추론 능력 부족 문제를 다룹니다. 기존 방식이 외부 데이터에 의존하는 것과 달리, 본 논문은 정답 주석 없이 내부 추론 과정의 '논리적 일관성'을 강화하는 자기 지도 RL 프레임워크를 제안합니다. 이를 통해 모델이 기하학적/의미적 일관성을 학습하여 공간 추론 능력을 향상시킬 수 있음을 입증했습니다.
본 연구는 호흡 소리 분류(RSC)의 한계점을 극복하기 위해 State Space Models (SSMs)를 대안 백본으로 제안합니다. 여기에 스펙트럼 인식 레이어 정규화와 이중 축 패치-믹스 대조 학습을 결합하여 강력한 표현 학습을 수행했습니다. ICBHI 벤치마크에서 AST 대비 성능 향상을 입증하며, 관련 코드를 공개했습니다.
본 논문은 감시 영상 속 사고를 '언제', '무엇을', '어디서'로 분해하는 3단계 파이프라인을 제안합니다. 비전-언어 유사성, 메타데이터 기반 다중 프롬프트 추론, 오픈 어휘 검출기를 활용하여 충격 발생 시점을 정확히 식별하고 사고 유형과 공간적 위치를 국소화했습니다.