Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
결정 구조 발견을 위한 강화학습 및 베이지안 최적화용 Gymnasium 호환 환경인 SciVerseGym을 소개합니다. 원자 단위의 편집과 평가를 통합하여 폐쇄 루프 재료 탐색을 위한 재현 가능한 테스트베드를 제공합니다.
기존 멀티모달 벤치마크의 시각적 의존성 부족, 성능 포화, 신뢰성 문제를 해결하기 위해 새로운 벤치마크 MMGist를 제안합니다. 3단계 필터링 파이프라인을 통해 변별력을 높였으며, 27개의 LVLM을 대상으로 실험하여 모델 간 차이를 효과적으로 구분함을 입증했습니다.
폐색전증(PE) 진단 및 예후 평가를 위한 멀티모달 벤치마크 데이터셋인 INSPECT를 제안합니다. CTPA 영상과 EHR 데이터를 결합하여 소형 멀티모달 언어 모델(MLLM)의 임상적 성능을 평가하고 그 잠재력을 확인했습니다.
DreamUV는 생성적 플로우 매칭(Flow Matching)을 활용하여 아티스트의 스타일을 반영한 3D UV 언랩 레이아웃을 생성하는 엔드투엔드 프레임워크입니다. 기존 방식의 한계를 넘어 직선적인 심(seam)과 축 정렬된 아일랜드를 생성하며 실제 제작 공정에 적합한 결과를 제공합니다.
기존 예측 중심의 체화된 세계 모델을 넘어, 환경과의 상호작용을 통해 인과적 표현을 구축하는 자기 진화적 인지 프레임워크를 제안합니다. 인과적 세계 모델링, 개입 기반 추론, 지속적 인지 정교화를 통합하여 인식론적 지능으로의 전환을 목표로 합니다.
LLM이 상충하는 지시문을 받았을 때의 해결 능력을 평가하는 새로운 프레임워크인 PRIME을 소개합니다. 모델의 규모보다 상충 유형이 행동에 더 큰 영향을 미친다는 점을 밝혀냈습니다.
SAM을 활용하여 폐 결절 분할을 수행하는 인간 참여형(human-in-the-loop) 프레임워크인 Hi-Seg를 제안합니다. 인간의 반복적인 프롬프트 정제를 통해 SAM의 성능을 극대화하며, 기존 딥러닝 모델 및 SAM 변형 모델보다 높은 정확도를 달성했습니다.
SCOPE는 개방형 환경에서 체화된 작업의 장기 계획 수립을 위해 상징적 세계를 스스로 진화시키는 자기 적응형 프레임워크입니다. SESim과 SASMem 모듈을 통해 상징적 표현의 불완전성을 극복하고 계획의 성공률과 적응성을 높입니다.
LLM 기반의 설계 에이전트를 활용하여 실리콘 온 인슐레이터(SOI) 방향성 결합기를 설계하는 연구를 소개합니다. LLM은 기하학적 치수를 제안하고, 결정론적 솔버를 통해 고유 모드 및 FDTD 시뮬레이션을 수행하며 설계를 최적화합니다.
에이전트 AI의 성공적인 스케일링을 위해 환경의 결정론(determinism)이 필수적임을 논증합니다. 긴 체인의 실행 과정에서 발생하는 실패율을 수학적으로 분석하고, 이를 해결하기 위한 새로운 프레임워크를 제안합니다.
LLM 에이전트의 컨텍스트 압축 과정에서 안전 제약 조건이 누락되어 발생하는 '거버넌스 붕괴' 현상을 분석합니다. 연구팀은 이를 측정하기 위한 벤치마크 ConstraintRot을 제안하고, 압축으로 인한 위반율 상승과 공격 가능성을 입증했습니다.
계층적 강화학습(HRL) 환경에서 안전 제약 조건을 충족하며 장기 과업을 수행하기 위한 새로운 방법론을 제안합니다. 학습 가능한 세계 모델과 상위/하위 정책을 결합하여, 상상된 롤아웃을 통해 안전하지 않은 행동을 최소화하고 성공률을 높였습니다.
합성 데이터와 실제 데이터 간의 도메인 간극을 줄이기 위해 물리 기반 셰이딩(PBS)을 활용한 연구를 소개합니다. 조명 구성과 배경 복잡도가 객체 탐지 성능에 미치는 영향을 분석하여, 산업 자동화에 최적화된 가상 장면 설계 가이드라인을 제시합니다.
시스템 호출 기반 HIDS가 특정 CVE를 넘어 동일한 CWE 유형의 미지의 공격을 탐지할 수 있는지 연구합니다. Isolation Forest와 SGD One-Class SVM을 활용해 실험한 결과, CWE 유형에 따라 일반화 성능의 차이가 크게 나타남을 확인했습니다.
PaperClaw는 연구 주제 선정부터 논문 작성까지 전 과정을 수행하는 자율적 멀티 에이전트 시스템입니다. '제안-테스트-성찰' 루프를 통해 가설을 검증하며, 인간이 개입하여 연구를 정교화할 수 있는 Human-in-the-Loop 구조를 지원합니다.
시각-언어 모델(VLM)의 내부 작동 원리를 이해하기 위해 희소 오토인코더(SAE)를 활용하여 시각적, 텍스트적, 멀티모달 개념을 추출하는 새로운 프레임워크를 제안합니다. 기존 방식의 한계를 넘어 멀티모달 개념을 체계적으로 식별하고 시각적 개념의 품질을 크게 향상시켰습니다.
QBioFusion-QSAR는 소규모 데이터 환경에서 리간드 분류 성능을 높이기 위해 양자 다중 커널 학습(QMKL)을 제안합니다. Morgan/Tanimoto 커널과 양자 충실도 커널을 결합하여 활성 절벽(activity-cliff) 문제를 개선하고 예측 정확도를 향상시켰습니다.
신경 세포 자동체(NCA) 환경에서 에이전트들이 서로 다른 통신 프로토콜을 사용할 때 발생하는 집단적 합의 과정을 연구했습니다. 언어적 거리가 합의 속도와 집단 간 발산에 미치는 영향을 분석하며, 불일치 상황에서의 강건성을 탐구합니다.
비언어적 발성(NVVs) 환경에서도 화자의 정체성을 일관되게 식별하기 위한 새로운 프레임워크를 제안합니다. MoE 모듈과 조건부 증류 기술을 활용하여 음성 성능 저하 없이 NVV에 대한 화자 확인 성능을 크게 개선했습니다.
자율 주행 플릿의 원격 제어를 돕기 위해 벡터화된 V2N 메시지를 사용하는 MLLM 어시스턴트 FleetAgent를 제안합니다. VecFormer 인터페이스를 통해 데이터 전송 비용과 메모리 사용량을 획기적으로 줄이면서도 효율적인 모니터링과 설명 가능한 피드백을 제공합니다.