Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Swift Sampling은 테일러 급수를 활용해 비디오 내 정보량이 높은 '시간적 놀라움' 프레임을 식별하는 학습이 필요 없는 알고리즘입니다. 시각적 궤적의 속도와 가속도를 계산하여 예측 경로를 벗어나는 프레임을 효율적으로 추출합니다.
야생 환경의 대규모 건물 및 래스터화된 평면도에서도 작동 가능한 3D 기반 평면도 위치 추정 기술을 제안합니다. 3D 장면을 2D 밀도 맵으로 투영하고 파운데이션 모델을 미세 조정하여 이미지와 평면도 간의 외형 차이를 극복합니다.
Claw AI Lab은 단일 프롬프트로 맞춤형 역할과 협업 워크플로우를 갖춘 자율 연구 팀을 생성하는 플랫폼입니다. Claw-Code Harness를 통해 로컬 코드와 데이터셋을 실험에 연결하며, 실험의 완결성과 결과의 무결성을 보장합니다.
MLLM의 시공간 추론 능력을 정밀하게 평가하기 위한 새로운 비디오 벤치마크인 VGenST-Bench를 제안합니다. 생성 모델과 멀티 에이전트 파이프라인을 활용하여 고도로 제어된 비디오와 QA 쌍을 능동적으로 합성하는 것이 특징입니다.
LLM의 설득력을 높이기 위해 마음 이론(ToM)을 활용한 새로운 추론 프레임워크인 TTBYS를 제안합니다. BDI 프레임워크와 대규모 데이터셋 ToM-BPD를 통해 모델이 타인의 정신 상태를 더 정교하게 추론하도록 설계되었습니다.
Spreadsheet-RL은 강화학습(RL)을 활용하여 복잡한 스프레드시트 작업을 수행하는 LLM 에이전트의 성능을 높이는 새로운 프레임워크입니다. Microsoft Excel 환경에서 다단계 워크플로우를 처리할 수 있도록 설계되었으며, 새로운 벤치마크 데이터셋과 Spreadsheet Gym 환경을 함께 제안합니다.
AtelierEval은 텍스트-이미지(T2I) 시스템의 프롬프트 작성 숙련도를 평가하기 위한 최초의 통합 벤치마크입니다. 인간과 MLLM의 프롬프트 작성 능력을 정량화하며, 인간 전문가와 높은 상관관계를 보이는 에이전트 기반 평가자인 AtelierJudge를 함께 제안합니다.
금융 분야의 복잡한 스프레드시트 워크플로우를 수행하는 LLM 에이전트를 평가하기 위한 새로운 벤치마크인 WorkstreamBench를 소개합니다. 정확도, 수식, 형식을 포함한 다차원적 평가 체계를 통해 에이전트의 실질적인 금융 모델링 능력을 측정합니다.
시계열 예측 문제에서 모델의 성능이 높을수록 오히려 예측력이 떨어지는 역스케일링(inverse scaling) 현상을 분석했습니다. 특히 금융이나 전염병과 같이 꼬리 위험(tail risk)이 중요한 상황에서 상위 꼬리 예측 오류가 두드러짐을 발견했습니다.
Gated DeltaNet-2는 선형 어텐션의 한계를 극복하기 위해 삭제와 쓰기 과정을 채널별 게이트로 분리한 새로운 모델입니다. 기존 KDA와 Gated DeltaNet을 일반화하여 긴 문맥 처리와 검색 성능을 획기적으로 개선했습니다.
AI가 과학적 진보를 예측할 수 있는지 평가하기 위한 새로운 벤치마크인 CUSP를 제안합니다. 연구 결과, 현재의 최첨단 모델들은 연구 방향은 식별하지만 실제 실현 여부와 시점을 예측하는 데는 체계적인 한계를 보였습니다.
UAV가 지상 로봇(UGV)의 경로 탐색을 돕는 이기종 로봇 협업 프레임워크인 SAP를 제안합니다. GNN을 활용해 정보 이득을 예측함으로써 계산 비용을 줄이고 실시간 계획을 가능하게 하여 지상 로봇의 이동 비용을 크게 절감했습니다.
분쟁 지역에서 LLM 배포 시 발생할 수 있는 정렬 실패(Alignment Failure)를 분석한 연구입니다. OpenAI, Anthropic, DeepSeek, xAI의 모델들을 대상으로 거짓 등가성 및 집단 학살 부정 등의 위험성을 테스트했습니다.
본 논문은 1차 답변 집합 프로그래밍(ASP)에서 매개변수와 내포성 문장을 활용한 매개변수형 모듈식 논리 프로그램이라는 새로운 형식주의를 제안합니다. 이를 통해 서브프로그램의 구조화와 인스턴스화를 가능하게 하는 집합적 제어 기능을 입증하고 이론적 토대를 제공합니다.
웨어러블 센서 데이터를 개인화된 건강 통찰력으로 변환하기 위한 대규모 파운데이션 모델을 제안합니다. 500만 명의 코호트에서 추출한 1조 분 이상의 데이터를 사전 학습하여 심혈관, 수면, 정신 건강 등 35개 작업에서 뛰어난 성능을 입증했습니다.
LLM 사전 학습 시 데이터 순서가 시간 민감적 사실 지식 습득에 미치는 영향을 연구했습니다. 시간 순서대로 정렬된 학습이 일반 성능은 유지하면서도 최신 지식의 정확도와 신선도를 향상시킨다는 것을 입증했습니다.
무작위 작업 도착이 발생하는 유연한 작업 숍 스케줄링(FJSP) 문제를 해결하기 위해 이벤트 기반 심층 강화학습(DRL) 접근 방식을 제안합니다. PPO 알고리즘과 MLP를 활용하여 총 완료 시간을 최소화하며, 기존 디스패칭 규칙 및 MILP 솔루션보다 우수한 성능을 입증했습니다.
LLM의 은밀한 정치적 편향을 식별하고 이를 완화하기 위한 새로운 학습 방법론인 정치적 일관성 학습(PCT)을 제안합니다. 감성 및 유용성 일관성 지표를 통해 편향을 측정하며, 모델의 유용성을 유지하면서도 편향을 효과적으로 감소시킵니다.
LLM의 수학적 추론 신뢰성 문제를 해결하기 위해 Lean 언어를 활용한 형식 증명 생성 및 검증 연구를 소개합니다. 에이전트가 미해결 Erdős 문제와 OEIS 추측을 자율적으로 해결하며 AI 기반 형식 증명 탐색의 가능성을 입증했습니다.
주도적 작업 지향 대화(TOD)를 위해 사용자의 잠재적 우려 사항을 조건화하는 새로운 연구를 소개합니다. 인지적 사용자 시뮬레이터와 비대칭 뷰 정책 최적화 기법을 통해 LLM의 수동적인 성향을 극복하고 설득력을 높이는 방법을 제안합니다.