Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 의료 영상 분야에서 계층적 다중 라벨 학습(Multi-Label Learning)을 위한 새로운 '지연 학습(Learning to Defer, L2D)' 프레임워크를 제안합니다. 기존 연구가 평평한 라벨 공간을 가정했던 것과 달리, 본 연구는 임상 분류학에 기반한 계층적 구조를 도입하여 위임 결정의 복잡성을 다룹니다. 특히, 이 계층적 구조에서 발생하는 '위임 불일치(delegation violations)' 문제를 해결하기 위해, 일관된 계층적 위임을 공식화하고 두 가지 개선된 모델인 Exact Coherent Projection과 Taxonomic Belief Propagation (TBP) with Recursive Policy Optimisation (RPO)을 제시합니다. 실험 결과, 제안된 방법들이 기존 방식보다 불일치를 효과적으로 제거하면서도 높은 성능을 유지함을 입증했습니다.
본 논문은 온톨로지에서 유도된 의미적 손실(semantic loss)을 추가한 그래프 신경망(GNN)을 활용하여 지식 그래프(KGs)의 계층 인식 임베딩을 학습하는 방법을 제안합니다. 이 방법론은 효모 유전자 결손 효과 예측에 적용되어, 기존 모델 대비 높은 성능($R^2$=0.377)을 달성하며 도메인 지식을 효과적으로 반영함을 입증했습니다. 나아가, 학습된 임베딩을 활용하여 세포 성장 예측뿐만 아니라 새로운 데이터(삼중 유전자 knockouts)에도 일반화 가능성을 보여주었으며, 생물학적 가설 생성 및 검증에 기여할 잠재력을 제시합니다.
본 연구는 기존 방법론이 포착하지 못했던 일상생활의 1인칭 시각적 맥락을 파악하기 위해 생태학적 순간 평가(EMA)와 시각 언어 모델(VLM)을 결합했습니다. 이를 통해 참가자들이 생성한 사진에서 녹지 추정치를 추출하여, 이것이 순간적인 감정과 만성 스트레스에 유의미하게 영향을 미치는 것을 입증했습니다. 나아가 대규모 LLM 기반 파이프라인을 개발하여 실제 이미지에서 정신 건강과 관련된 환경적 특징을 객관적으로 정량화할 수 있는 '시각 노출계(visual exposomics)' 패러다임을 제시했습니다.
FUS3DMaps는 공유 볼록 맵 내에서 밀집(dense) 및 인스턴스(instance) 레벨의 오픈-보컬리 세맨틱 레이어를 동시에 유지하는 온라인 이중 레이어 세맨틱 매핑 방법입니다. 이 접근 방식은 두 가지 세맨틱 매핑 방법을 결합하여 추가적인 볼록 레벨의 세맨틱 융합을 가능하게 합니다. FUS3DMaps는 인스턴스 및 밀집 레이어의 품질을 개선하고, 공간 슬라이딩 윈도우에 제한되지 않는 확장 가능하면서도 정확한 인스턴스 레벨 매핑을 제공하여 다층 건물 규모에서 높은 성능을 입증했습니다.
본 논문은 장기 실행 자율 AI 에이전트가 직면하는 메모리 일관성 문제를 해결하기 위해 MEMTIER라는 계층형 메모리 구조를 제안합니다. MEMTIER는 JSONL 스토어, 신호 가중치 검색 엔진, 주의력 귀속 업데이트 루프 등 여러 구성 요소를 포함하며, 에피소드 사실을 의미론적 계층으로 촉진하는 비동기 통합 데몬을 특징으로 합니다. 이 구조를 통해 기존의 평면 메모리 시스템 대비 현저히 개선된 성능을 보여주었으며, 특히 장기간의 복잡한 추론 및 다중 세션 합성 능력에서 우위를 입증했습니다.
본 논문은 블록체인 스마트 컨트랙트의 보안 취약점을 탐지하기 위한 LLM 기반 프레임워크를 제안합니다. 기존 방식의 한계를 극복하기 위해, 15개 플랫폼에서 수집된 대규모 주석화 데이터셋을 활용하고 AST(Abstract Syntax Tree) 기반 컨텍스트 추출과 특화된 프롬프트 디자인을 결합했습니다. 이 접근법은 다양한 취약점 카테도리별 맞춤형 탐지기를 구현하여, 높은 평균 양의/음의 재현율(recall)을 달성하며 스마트 컨트랙트 보안 분석에 새로운 가능성을 제시합니다.
본 논문은 사건 인과성 식별(ECI) 작업에서 대형 언어 모델(LLM)의 성능 한계를 극복하기 위해 구조적 예제 검색(Structural Example Retrieval, SERE) 프레임워크를 제안합니다. LLM이 ECI에서 겪는 인과 추론 편향 및 환각 문제를 완화하는 것이 목표입니다. SERE는 개념적 경로 지표, 문법적 지표, 그리고 인과 패턴 필터링이라는 세 가지 구조적 메커니즘을 통합하여, 주어진 작업에 가장 관련성 높은 예제를 검색하고 LLM의 인과 추론 능력을 효과적으로 안내합니다.
본 논문은 제로샷 명사 인식(ZS-NER)이 도메인이나 스키마가 변경될 때 취약한 문제를 해결하기 위해 SAM-NER이라는 새로운 프레임워크를 제안합니다. SAM-NER는 '의미 원형 매개(Semantic Archetype Mediation)'라는 개념을 도입하여, 엔티티 정보를 도메인 불변의 원형 공간으로 투영하고 이를 통해 교차 도메인 전이의 안정성을 확보합니다. 이 3단계 프레임워크는 엔티티 발견, 추상 매개, 의미 보정 과정을 거쳐 높은 성능과 일반화 능력을 보여줍니다.
본 기사는 LoRA 파인튜닝에서 요구되는 랭크($r$) 임계값에 대한 기존 이론적 접근 방식(특히 $r o 12$ 등)을 재고찰합니다. 연구진은 이진 분류와 같은 특정 설정에서 더 낮은 랭크 값, 특히 $r=1$이 충분함을 입증하는 세 가지 새로운 결과를 제시했습니다. 이는 LoRA의 용량 요구사항을 크게 낮추어 모델 효율성을 높이는 데 기여하며, 실제 실험에서도 기존 규정($r=12$)과 경쟁할 만한 성능을 보였습니다.
LLM 발전으로 인해 인간과 LLM이 공동 작성한 텍스트에서 각 부분을 정확히 분리하는 것이 중요해졌습니다. 본 논문은 이러한 문제를 해결하기 위해, 텍스트를 인간 작성 부분과 LLM 작성 부분으로 분할하는 알고리즘을 제안합니다. 이 접근 방식은 시간계열 분석의 변화점 탐지(change point detection) 개념을 차용하여, 공동 작성 텍스트 내에서 출처가 바뀌는 지점을 효과적으로 식별하고 성능을 입증했습니다.
본 연구는 VLM(Visual Language Model) 에이전트가 단순히 관측된 정보에 의존하는 것을 넘어, 능동적인 호기심 기반 탐색을 통해 내부 세계 모델을 개선할 수 있는 방법을 제시합니다. 제안된 GLANCE 프레임워크는 에이전트의 언어적 예측과 시각적 현실 간의 불일치를 활용하여 내재적 호기심 신호를 생성하고, 이를 강화 학습(RL) 과정에 통합합니다. 이 접근 방식은 에이전트가 내부 모델이 불확실한 영역을 능동적으로 탐색하도록 유도함으로써, 복잡하거나 희소 보상 환경에서의 일반화 성능을 크게 향상시킵니다.
본 기술 기사는 운영적으로 중요한 분야를 위한 '신뢰할 수 있는 에이전트 AI' 개발을 목표로 하는 교차 도메인 공학 프레임워크인 TRACE를 소개합니다. TRACE는 네 가지 레이어의 참조 아키텍처, 고전 ML과 LLM 검증기 분리(L2a/L2b), 상태 기반 오케스트레이션 및 에스컬레이션 정책을 포함합니다. 특히 GUM/VIM/ISO 17025에 매핑된 계량적 신뢰 지표와 계산적 간결성 비율(CPR)이라는 새로운 설계 원칙을 도입하여, AI 시스템의 신뢰성과 투명성을 공학적으로 확보하는 방법을 제시합니다.
본 논문은 사용자의 자연어 미션 목표를 받아 시스템이 자율적으로 실행하는 에이전트 강화 LLM 프레임워크를 제시하며, 이를 웹 오브 드론(Web of Drone) 환경에 적용했습니다. 이 프레임워크는 LLM 기반 에이전트 코어와 W3C WoT 표준을 결합하여 드론, 센서, 서비스를 표준화된 'Thing'으로 노출함으로써 코드 생성 없이도 구조화된 상호작용과 안전한 액추에이션을 가능하게 합니다. 실험 결과, 일반 목적 LLM만으로는 신뢰할 수 있는 군집 작업을 수행하기 어려우며, 미션 특화 계획 도구와 런타임 가드레일이 필수적임을 입증했습니다.
ScrapMem은 자원이 제한된 엣지 디바이스에서 대규모 언어 모델(LLM) 에이전트의 장기 개인화 메모리 문제를 해결하기 위해 설계된 프레임워크입니다. 이 프레임워크는 '광학 망각(Optical Forgetting)'이라는 압축 메커니즘을 도입하여 오래된 기억의 해상도를 점진적으로 줄여 저장 비용을 획기적으로 낮춥니다. 또한, 주요 사건들을 인과-시간적 구조로 조직하는 Episodic Memory Graph (EM-Graph)를 구축하여 높은 성능과 뛰어난 메모리 효율성을 동시에 달성합니다.
Agentic-imodels는 데이터 과학 분야에서 에이전트가 자체적으로 해석할 수 있는 도구를 진화시키도록 설계된 자동 연구 루프입니다. 기존 시스템들이 인간 중심의 통계 도구에 의존하는 것과 달리, 이 프레임워크는 에이전트가 직접 활용하고 개선할 수 있도록 최적화된 데이터 과학 도구를 개발합니다. 구체적으로, scikit-learn 호환 회귀기 라이브러리를 제공하며 예측 성능과 LLM 기반의 해석 가능성 지표를 동시에 향상시키는 것을 목표로 합니다.
본 논문은 로보틱 모바일 Fulfillment Systems (RMFS)의 효율성을 극대화하기 위해 주문 할당과 로봇 스케줄링을 실시간으로 공동 최적화하는 SOAR 프레임워크를 제안합니다. 기존 방법들이 직면했던 응답성 및 전역 최적성 간의 상충 관계 문제를 해결하고자 합니다. SOAR는 이 복잡한 시스템을 이벤트 기반 마르코프 결정 과정(MDP)으로 형식화하고, 심층 강화학습과 Heterogeneous Graph Transformer를 결합하여 비동기 환경에서 동시 스케줄링을 수행합니다.
본 논문은 분산 협력 지능(DCI) 시스템의 구조적으로 피할 수 없는 위험 문제를 해결하기 위해 '기계적 양심(Mechanical Conscience, MC)'이라는 새로운 수학적 프레임워크를 제안합니다. MC는 단일 에이전트 및 다중 에이전트 DCI 환경 모두에서 행동 궤적 전체에 걸쳐 규범적인 허용 가능성을 보장하는 감시 필터 역할을 합니다. 이 프레임워크는 누적 편차를 최소화하여 시스템의 안전성과 신뢰성을 향상시키며, 해석 가능한 '양심 점수'와 같은 새로운 개념들을 도입합니다.
본 논문은 단순히 최종 정답의 정확성만으로는 대규모 언어 모델(LLM)의 추론 과정의 품질이나 신뢰성을 충분히 반영할 수 없다는 문제를 지적하며, 이를 해결하기 위해 플래너-실행기 훈련 프레임워크인 TraceLift를 제안합니다. TraceLift는 LLM이 생성하는 추론을 소비 가능한 중간 산출물로 취급하고, 고정된 실행기를 통해 이 추론을 검증하여 '실행기 기반 보상'을 계산합니다. 이 보상은 단순히 정답 여부뿐만 아니라, 추론의 품질과 유용성을 측정하여 모델이 높은 품질의 중간 추형을 생성하도록 훈련시킵니다.
MCJudgeBench는 다중 제약 지시 따르기(Multi-constraint instruction following)에서 LLM의 판사 평가를 개선하기 위해 개발된 새로운 벤치마크입니다. 기존에는 전체 응답에 대한 판단만 내려졌으나, MCJudgeBench는 개별 제약 조건 수준에서의 상세한 라벨링을 제공합니다. 이 벤치마크는 정확성뿐 아니라 프롬프트 및 응답 변형 하의 '불일치성'까지 측정하여 LLM 판사의 신뢰성이 다차원적임을 입증하며, 강력한 성능이 항상 일관된 안정성을 보장하지 않음을 보여줍니다.
EvoLM은 외부 인간 주석이나 독점 API에 의존하지 않고 언어 모델이 자체적으로 평가 능력을 진화시키는 새로운 프레임워크입니다. 이 방법은 판례 생성기(case generator)를 통해 최적화된 판별적 기준을 만들고, 이를 기반으로 보상 신호를 구성하여 정책을 훈련합니다. EvoLM은 Qwen3-8B 모델과 OLMo3-Adapt 시리즈에서 GPT-4.1 및 기존 최고 성능의 보상 모델 대비 높은 성능 향상을 입증하며, 모델 자체의 평가 능력만으로도 강력한 자기 개선이 가능함을 보여줍니다.