Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
신념 함수는 불확실성을 수학적으로 다루는 강력한 프레임워크로, 특히 확률 분포 학습이 어려운 상황에서 유용합니다. 본 설문조사는 신념 함수 기반 추론 체인의 핵심 단계인 '추론'에 초점을 맞춥니다. 구체적으로 통계적 데이터로부터 어떻게 신념 측정값을 효과적으로 학습하고 이를 활용하는지에 대한 주요 기여들을 검토합니다.
본 연구는 머신러닝 기반의 예측적 자원 할당이 가진 근본적인 한계점, 즉 알레아토릭 불확실성을 해결할 수 없다는 점에 주목합니다. 따라서 스크리닝 단계와 알고리즘적 표적화 단계를 결합한 2단계 최적 할당 프레임워크를 제안합니다. 이 프레임워크는 자원을 가장 위험도가 높은 단위와 예측 모델의 한계(margin)에 있는 단위에 전략적으로 배분하여, 제한된 예산 하에서 할당 효율성을 극대화하는 방법을 제시합니다.
Text-to-CAD(텍스트를 3D 모델로 변환)는 디자인 워크플로우에 혁신적 잠재력을 가지고 있지만, 이를 평가할 수 있는 체계적인 방법론이 부족했습니다. 본 논문은 입력 프롬프트가 요구하는 기하학적 및 위상적 제약 조건을 검증하는 자동 테스트 기반의 'CADTests'를 소개합니다. 나아가 CADTests를 활용하여 Text-to-CAD 모델을 포괄적으로 평가할 수 있는 최초의 벤치마크인 'CADTestBench'를 구축하고 공개했습니다.
본 기사는 대규모 언어 모델(LLMs)의 신뢰성 평가에 대한 새로운 접근 방식을 제안합니다. 기존의 확률적 정확도 추정치나 단순한 '자신감' 지표가 LLM의 실제 성능을 예측하는 데 한계가 있음을 지적하며, 인간 심리학의 인지 평가 이론(cognitive appraisal theory)을 차용했습니다. 이에 따라 자신감 외 6가지 추가적인 평가 기반 차원을 도입하여 모델 자기 평가를 다차원적으로 분석하고, 이를 통해 LLM 실패를 더 효과적으로 예측할 수 있음을 입증합니다.
본 기사는 딥러닝 모델의 신뢰성 확보에 필수적인 Out-of-distribution (OOD) 탐지 문제를 다룹니다. 기존 OOD 탐지 방식들이 이미지의 풍부한 문맥 정보를 간과하고 단순성 편향으로 인해 근접 OOD 탐지에 어려움을 겪는 점을 지적합니다. 이에 따라, 인간 시각 시스템에서 영감을 받아 객체 동시 발생(Object Co-occurrence, OCO) 패턴을 포착하는 새로운 객체 중심 OOD 탐지 프레임워크를 제안합니다.
MPD$^2$-Router는 녹내장 선별 및 진단을 위한 새로운 마스크 인식 다중 전문가 사전 정규화 이중 헤드 지연 라우터 프레임워크입니다. 이는 기존의 표준 공식들이 간과했던 전문가 가용성, 판독자 행동의 이질성, 작업 부하 불균형 등 복잡한 현실적 제약들을 고려하여 안과 분류(ophthalmic triage)를 재구성합니다. MPD$^2$-Router는 샘플별 가용성을 엄격하게 강제하는 마스크 인식 Gumbel--sigmoid 게이팅과 이중 헤드 지연/할당 정책을 결합하여, 어려운 사례를 가장 적절한 전문가에게 안전하게 라우팅하는 것을 목표로 합니다.
본 연구는 희소 컨텍스트-상태 믿음 전파를 활용하여 가변 차수 마르코프 모델에 정규 제약 조건을 정확하게 적용하는 방법을 제시합니다. 기존의 방법들이 1차 마르코프 체인에 국한되었던 한계를 넘어, 생성기가 가변 차수/백오프 모델일 때 필요한 상태 공간을 식별하고 믿음 전파 추론을 수행할 수 있도록 확장했습니다. 이는 복잡한 언어 구조와 제약 조건을 동시에 만족시키며 시퀀스를 생성하는 데 기여합니다.
본 논문은 확률적 경사 하강법으로 학습되는 넓은 신경망의 숨겨진 가중치 스펙트럼 변화를 연구하며, 특히 벌크(bulk)와 아웃라이어(outlier) 스펙트럴 다이내믹스를 공동 추적하는 2단계 동역학 평균장 이론(DMFT)을 개발했습니다. 이 프레임워크는 무한 너비의 비선형 네트워크와 고차원 극한의 깊은 선형 네트워크 두 가지 설정에 적용되었습니다. 연구 결과, 아웃라이어 스펙트럼이 훈련 시간, 네트워크 너비, 출력 스케일 등 다양한 매개변수에 따라 어떻게 진화하는지 예측할 수 있음을 보여줍니다.
본 연구는 참가자들이 새로운 비디오 게임을 플레이하는 동안의 fMRI 데이터를 활용하여, 최신 대규모 추론 모델(LRMs)이 인간의 학습 및 의사 결정 과정을 얼마나 잘 모방할 수 있는지 탐구했습니다. 연구진은 LRM의 게임 플레이 능력, 인간 행동 일치도, 그리고 뇌 활동 예측 능력을 종합적으로 평가했으며, 이를 기존 강화학습 에이전트 및 베이지안 이론 기반 모델과 비교했습니다. 그 결과, 최신 LRM들이 게임 발견 과정에서 인간의 행동 패턴과 가장 유사하게 나타났으며, 특히 대뇌 및 피하피질 영역 전반에 걸쳐 기존 RL 대체 모델보다 우수한 뇌 활동 예측 능력을 보였습니다. 또한, 이러한 '뇌 정렬(brain alignment)'은 다운스트림 계획보다는 게임 상태에 대한 인컨텍스트 표현을 반영함을 입증했습니다.
본 기사는 텍스트 생성 과정에서 사용되는 이산 흐름 매칭(Discrete flow matching)의 효율성 문제를 다룹니다. 기존 방식이 수백 번의 순방향 패스를 요구하는 반면, 증류를 통해 학생 모델이 이를 몇 단계로 재현하도록 학습합니다. 저자들은 성능 저하의 원인이 단순히 학생 모델의 용량 부족이 아니라, 오히려 학습에 사용되는 '궤적(trajectory)' 자체의 병목 현상에 있다고 주장하며, 궤적-샤프티(Trajectory-Shap) 기법을 제안합니다.
본 논문은 개별화된 차분 프라이버시(IDP) 환경에서 발생하는 유틸리티 불균형 문제를 다룹니다. 민감한 데이터를 가진 소유자들이 더 강력한 프라이버시 요구사항을 설정할 때, 기존 알고리즘들은 이들의 데이터가 모델 훈련 과정에서 과소 대표되어 성능 저하를 초래하는 문제가 발생합니다. 이를 해결하기 위해 INO-SGD라는 새로운 알고리즘을 제안하며, 이는 각 배치 내 데이터를 전략적으로 다운-가중치하여 모든 반복 과정에서 높은 프라이버시 요구사항을 가진 데이터의 모델 성능을 개선합니다.
TraceFix는 대규모 언어 모델(LLM) 기반의 다중 에이전트 협업 시스템을 위한 검증 우선 파이프라인입니다. 이 시스템은 하나의 에이전트가 작업 설명으로부터 프로토콜 토폴로지를 합성하고, PlusCal 로직을 생성하며, TLA+ 모델 체커(TLC)에서 얻은 카운터예제를 활용하여 프로토콜을 반복적으로 복구 및 검증합니다. 최종적으로 검증된 프로세스는 에이전트별 시스템 프롬프트와 런타임 모니터를 통해 실행되어 협업 연산의 무결성을 보장합니다.
본 논문은 고차원 또는 이상치로 오염된 환경에서 발생하는 어려운 비볼록 최적화 문제를 해결하기 위한 통합 프레임워크를 제안합니다. 전통적인 머신러닝 접근 방식의 한계점(지역 최소값에 빠지는 문제 등)을 극복하기 위해, 양자 중첩 개념에서 영감을 받은 양자 영감 진화 최적화(QIEO) 기법을 활용하여 전역 탐색 능력을 확보하는 것이 핵심입니다.
본 연구는 다양한 대규모 언어 모델(LLM)을 대상으로 도구 호출(Tool Calling) 메커니즘을 분석하여, 선택된 도구의 정체성이 모델 내부 활성화 값에 선형적으로 인코딩되어 있음을 발견했습니다. 이는 단순히 프롬프트에서 도구 이름을 변경하는 것만으로도 높은 정확도로 모델이 다른 도구를 선택하도록 조종할 수 있음을 의미합니다. 또한, 이러한 내부 표현 차이를 활용하여 잠재적인 오류를 사전에 감지하고 플래그 지정하는 것도 가능함을 보여줍니다.
스파이킹 신경망(SNNs)은 에너지 효율적이고 생물학적으로 그럴듯한 대안으로 주목받고 있지만, 스파이크 함수의 비미분성 때문에 훈련 시 유사 기울기(surrogate gradients)를 사용해야 하며 이는 근사 오차를 누적시킵니다. 본 연구는 이 문제를 해결하기 위해 병렬 순방향 임계 네트워크의 볼록화 기법을 병렬 순환 임계 네트워크로 확장하는 방법을 제안합니다.
본 논문은 LLM 에이전트가 다중 에이전트 환경에서 컨텍스트 창 확장이 오히려 협력적 의도를 저해하는 '기억의 저주(memory curse)' 현상을 발견했습니다. 500라운드 이상의 실험 결과, 접근 가능한 히스토리 증가는 상당수의 모델-게임 설정에서 협력을 떨어뜨리는 패턴을 보였습니다. 연구진은 이 실패가 단순한 편집증 증가보다는 에이전트의 미래 지향적 의도 침식과 관련되어 있음을 분석하고, 이를 검증하기 위해 미래 지향적인 내용으로만 훈련된 LoRA 어댑터를 제안했습니다.
본 기술 기사는 '루브릭 기반 강화학습(rubric-grounded reinforcement learning)'이라는 새로운 프레임워크를 제안합니다. 이 방법은 LLM 심사위원을 활용하여 응답을 여러 개의 가중치 부여되고 검증 가능한 기준(루브릭)으로 분해하고, 각 기준별로 점수를 매겨 부분 점수 최적화 신호를 제공하는 것이 핵심입니다. 이를 통해 정책이 단일한 전체 점수가 아닌 구조적이고 다중 기준의 보상에 따라 최적화될 수 있도록 합니다.
본 논문은 기존 Flow Matching (FM) 기반의 텍스트-이미지 생성 모델이 직면하는 보상 희소성 및 기울기 간섭 문제를 해결하기 위해 'Flow-OPD'라는 새로운 온-정책 증류(On-Policy Distillation) 사후 훈련 프레임워크를 제안합니다. Flow-OPD는 단일 보상 GRPO 미세 조정을 통해 도메인 특화 교사 모델들을 육성하고, 이를 활용하여 범용적인 텍스트-이미지 모델의 정렬 성능을 향상시킵니다.
본 기사는 대규모 언어 모델(LLM)의 추론 시간 성능 개선 기법인 Self-Consistency를 다루며, 특히 후보 답변에 신뢰도 값을 할당하여 가중치 다수결 투표를 수행하는 CISC 방식의 정확성을 설명합니다. 하지만 이 과정에서 각 후보의 추론 과정을 비평가 LLM(critic LLM)을 호출하여 점수를 매겨야 하므로, 오버헤드와 비용이 크게 증가하는 문제가 있습니다.
EmambaIR은 이벤트 기반 이미지 재구성을 위해 설계된 효율적인 시각 상태 공간 모델(SSM)입니다. 기존의 CNN이나 ViT 기반 방법들이 가지는 전역적 특징 포착의 어려움과 높은 시간 복잡도 문제를 해결합니다. 이 프레임워크는 크로스 모달 Top-k Sparse Attention Module (TSAM)과 Gated State-Space Module (GS)를 도입하여 공간적으로 희소하고 시간적으로 연속적인 이벤트 스트림을 효율적으로 처리하며 고해상도 재구성을 가능하게 합니다.