Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
적층 제조 공정의 기공률 예측 및 파라미터 최적화를 위해 Multi-Head Attention을 통합한 Soft Actor-Critic(SAC) 알고리즘을 제안합니다. 기존 강화학습 방식보다 빠른 수렴 속도와 높은 보상 값을 통해 제조 결함을 최소화하는 성능을 입증했습니다.
IHUBERT는 벡터 기반 의미론적 중복 제거 기술을 적용하여 정제된 페르시아어 코퍼스로 학습된 새로운 사전 학습 언어 모델(PLM)입니다. RoBERTa-base 구조를 기반으로 하며, 다양한 NLU 벤치마크에서 뛰어난 성능을 입증했습니다.
Rectified Flow를 기반으로 지시어에 따라 오디오를 편집하는 하이브리드 2단계 확산 트랜스포머 아키텍처를 제안합니다. 저해상도 단계의 결합 주의 집중과 고해상도 단계의 교차 주의 집중을 교차 활용하여 효율성과 정밀도를 동시에 높였습니다.
센서리모터 월드 모델(SMWM)은 역역학 규제화를 통해 행동에 정렬된 잠재 월드 모델을 학습하는 새로운 방법론을 제안합니다. 이를 통해 표현 붕괴를 방지하고, 제어 가능한 환경 정보에 집중하여 안정적인 잠재 상태를 구축합니다.
자연어 생물학 실험 프로토콜을 로봇 제어 명령으로 변환하는 이중 에이전트 프레임워크를 제안합니다. 파서 에이전트와 이기종 LLM 검증 에이전트를 통해 프로토콜의 정확성을 검증하고 자기 수정 루프를 통해 실행 가능한 명령을 생성합니다.
ScaffoldAgent는 개방형 심층 연구(OEDR)를 위해 개요를 동적으로 최적화하는 프레임워크입니다. 효용 가이드 피드백을 통해 개요를 확장, 축소, 수정하며 검색 이득과 구조적 일관성을 극대화합니다.
이 논문은 로봇 동작 생성 시 이질적인 제어 주파수 문제를 해결하기 위해 주파수 인식 플로우 매칭(FAFM)을 제안합니다. DCT를 활용해 동작을 주파수 영역에서 모델링하고 시간 미분 정규화를 통해 연속적이고 부드러운 동작을 구현합니다.
정적 프롬프트의 한계를 극복하기 위해 교육적 특징을 기반으로 한 과목 인지 프롬프팅 시스템을 제안합니다. 시뮬레이션과 실제 고등학생 대상 테스트를 통해 적응형 프롬프트 라우팅이 교육 효율성을 높이고 상호작용 횟수를 줄임을 입증했습니다.
메타휴리스틱 최적화 도구의 탐색 동작을 제어하기 위한 추론 에이전트 제어 계층(RACL) 방법론을 제안합니다. RACL은 운영 메모리를 관찰하고 가설을 수립하여 최적화 도구의 내부 동작을 제어하며, 실험 결과 기존 정책 대비 우수한 성능을 입증했습니다.
BIM-Edit은 IFC 형식의 빌딩 정보 모델링(BIM) 데이터를 자연어로 편집하는 능력을 평가하기 위한 새로운 LLM 벤치마크입니다. 기하학적, 의미론적, 위상적 일관성을 기준으로 모델을 평가하며, 현재 LLM의 엔지니어링 설계 역량이 부족함을 보여줍니다.
LLM이 에세이 품질 정보를 은닉 표현 내에 선형적으로 인코딩한다는 사실을 입증한 연구입니다. 다양한 데이터셋과 모델을 통해 에세이 채점 뉴런을 식별하고, 레이어별 정보 분포와 해석 가능성에 대한 통찰을 제공합니다.
사전 학습된 ANN의 임베딩을 활용하여 고성능 SNN을 구현하는 하이브리드 ANN-SNN 파이프라인을 제안합니다. 국소 학습 규칙을 통해 생물학적 타당성을 확보하며, ImageNet 벤치마크에서 기존 딥 네트워크와 대등한 성능을 입증했습니다.
PINNs 학습 시 모델 용량이 커짐에 따라 발생하는 기능적 모듈성 문제를 해결하기 위한 ModSync 프레임워크를 제안합니다. 과매개변수화된 네트워크가 작업별로 분리되어 발생하는 그래디언트 간섭 문제를 구조적 최적화를 통해 완화합니다.
기존 그래프 기반 의미 인식 통신의 한계를 극복하기 위해 하이퍼그래프를 활용한 새로운 프레임워크 HISR를 제안합니다. 고차원적 암시적 상관관계를 포착하여 정보 손실 상황에서도 견고한 의미 추론을 가능하게 합니다.
MedRLM은 긴 문맥의 임상 추론과 멀티모달 데이터를 처리하기 위한 재귀적 의료 지능 프레임워크를 제안합니다. 환자 정보를 재귀적으로 조사하고 검증하며, 센서 데이터와 EHR을 통합하여 정교한 임상 의사결정을 지원합니다.
원격 탐사(Remote Sensing) 분야 MLLM의 부정문 이해 능력을 평가하기 위한 최초의 벤치마크인 RS-Neg를 소개합니다. 연구 결과 모델들이 부정문 처리 시 환각 현상을 보임을 확인하였으며, 이를 개선하기 위한 테스트 시간 학습 방법인 NeFo를 제안합니다.
HilDA는 시각 파운데이션 모델을 활용해 LiDAR 백본을 자가 지도 학습시키는 새로운 계층적 증류 프레임워크입니다. 다층 증류와 전역 문맥 증류, 시간적 점유 확산 방식을 결합하여 자율 주행에 필요한 시공간 정보를 효과적으로 학습합니다.
LLM의 심리적 프로필이 모델의 실제 특성이 아닌, 측정 도구의 인위적 결과물(measurement artifact)임을 밝힌 연구입니다. 모델 간 차이의 대부분은 성격 특성이 아닌 응답 편향에 기인하며, 기존 심리 측정 도구의 타당성 문제를 지적합니다.
기존 머신러닝 평가 지표가 놓치기 쉬운 모델의 논리적 제약 조건 준수 여부를 측정하기 위해 '규칙 위반 점수(RVS)'를 제안합니다. RVS는 엄격한 규칙과 소프트 규칙을 구분하여 모델의 논리적 일관성을 정량화하며, 다양한 벤치마크를 통해 그 유효성을 입증했습니다.
FlowMaps는 Flow Matching 기술을 활용하여 3D 공간 내 동적 객체의 미래 위치를 다중 모드 분포로 예측하는 모델입니다. 인간의 상호작용 패턴을 학습하여 객체 위치의 시공간적 변화를 모델링하며, 로봇의 객체 탐색(Object Navigation) 성능을 크게 향상시킵니다.