Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
창의성을 정보 압축의 관점에서 정의하고, 진정한 창의적 통합(CI)을 판별할 수 있는 결정 가능한 기준을 제시합니다. 단순한 재기술과 실제 갈등을 해결하는 통합을 구분하기 위해 기술 길이(description length) 감소를 핵심 지표로 활용합니다.
일본어 텍스트의 저자성 식별을 위해 문체론적 특징과 임베딩 시스템을 결합한 가능도비(Likelihood Ratio) 프레임워크 연구를 소개합니다. 이 결합 모델은 일본어 디지털 텍스트 환경에서 판별력을 향상시키고 로그 가능도비 비용을 낮추는 성과를 보였습니다.
사용자와의 대화를 통해 소프트웨어 엔지니어링 문제를 해결하는 코딩 에이전트의 능력을 평가하기 위한 새로운 벤치마크인 Dialogue SWE-Bench를 소개합니다. 페르소나 기반 사용자 시뮬레이터와 스키마 가이드 에이전트를 제안하며, 코딩 능력과 대화 능력의 차이를 분석합니다.
텍스트 및 오디오 기반 언어 모델이 '동사+Up' 구동사를 어떻게 저장하는지 분석한 연구입니다. 모델이 구동사를 개별 단어의 조합이 아닌 하나의 총체적 표현으로 저장한다는 증거를 제시하며 언어 사용 기반 이론을 뒷받침합니다.
에이전트 기반 브라우저에서 동일 출처 정책(SOP) 위반 가능성을 체계적으로 연구한 논문입니다. SOP 위반 평가를 위한 벤치마크인 SOPBench를 구축하고, 보안을 강화하기 위한 맞춤형 메커니즘인 SOPGuard를 제안합니다.
LLM이 사용자의 유도에 따라 유익하거나 유해한 방향으로 반응하는 '순응 비대칭성'을 분석한 연구입니다. 도덕적 판단에서 모델이 유해한 유도에도 무분별하게 순응하는 '방향성 맹목성' 현상을 발견했습니다.
KGERMAR은 긴 문맥 언어 모델링을 위해 동적 지식 그래프를 구축하고 이를 메모리 아키텍처와 통합하는 새로운 프레임워크를 제안합니다. 의미적 유사성과 명시적 엔티티 관계를 동시에 활용하여 긴 문맥에서도 일관된 이해를 유지합니다.
의료 긴급 상황을 위한 스트리밍 화자 분할 모델의 압축 기술을 연구합니다. 구조적 가지치기와 저비트 양자화를 통해 모델 크기를 줄일 때 발생하는 성능 저하와 지연 시간 간의 트레이드오프를 분석합니다.
의역이나 스타일 전이 공격에 취약한 기존 기계 텍스트 탐지기의 한계를 극복하기 위해, 다중 관점 가우시안 프로세스 앙상블 기반의 비매개변수적 탐지 프레임워크를 제안합니다. 다양한 특징 관점을 결합하여 공격 비용을 높이고, 분포 외 데이터에 대한 신뢰할 수 있는 예측을 제공합니다.
소아 뇌종양 MRI의 정확한 세그멘테이션과 임상 해석을 위해 확산 모델 기반의 2단계 딥러닝 프레임워크를 제안합니다. Swin-UNETR로 거친 예측을 수행한 후, 확산 모델을 통해 종양 경계를 정교화하고 다중 모달 언어 모델로 방사선 보고서를 자동 생성합니다.
LLM의 성별 편향을 평가하기 위해 개발된 새로운 벤치마크 GAMA-Bench를 소개합니다. 실험 결과, 동일한 잘못에 대해 남성 행위자에게 더 처벌적이고 비난 중심적인 프레이밍을 적용하는 성별 비대칭성이 확인되었습니다.
웹 규모 비디오 검색을 위한 CoRe 시스템을 소개합니다. 멀티모달 관련성 모델을 보상 소스로 활용하여 프로덕션 환경의 데이터 드리프트에 대응하며, 효율적인 지속적 보상 미세 조정을 통해 검색 성능을 최적화합니다.
바이트 수준 토큰화 모델이 유효한 UTF-8 시퀀스를 생성하는 능력과 학습 규모 사이의 관계를 연구합니다. Perplexity가 안정화된 이후에도 UTF-8 유효성 확보를 위해서는 더 많은 학습 데이터가 필요함을 입증했습니다.
음향 이벤트의 의미론적 정체성과 시공간적 궤적을 동시에 파악하기 위한 새로운 오디오 언어 모델링 연구를 소개합니다. ST-AudioQA 데이터셋과 ST-AudioLM 모델을 통해 소리의 정체성, 위치, 움직임을 통합적으로 추론하는 성능을 입증했습니다.
일상적인 건강 관리를 위한 계층적·이벤트 중심적 아키텍처인 '개인 맞춤형 케어 유틸리티(PCU)'를 제안합니다. LLM의 추론 능력과 검증된 임상 로직을 분리하여, 연속적인 생체 신호를 의미 있는 건강 이벤트로 전환하고 실시간 중재를 제공하는 청사진을 제시합니다.
LLM 기반 생성형 추천(GR)에서 시맨틱 ID 사용으로 인한 추론 방해 문제를 해결하기 위해 경량 암시적 추론 패러다임인 PauseRec을 제안합니다. PauseRec은 명시적 추론 과정 없이도 성능을 높이고 학습 비용과 추론 속도를 획기적으로 개선합니다.
소형 언어 모델(SLM) 구축 시 가지치기(Pruning)와 처음부터 학습하기(Training from Scratch)의 성능을 비교 연구했습니다. 학습 토큰 예산이 제한적일 때는 가지치기가 유리하지만, 예산이 충분하다면 처음부터 학습하는 방식이 거친 구조적 가지치기에 대해 경쟁력을 가질 수 있음을 밝혀냈습니다.
CacheRL은 소형 에이전트 모델이 다단계 도구 호출 작업에서 높은 정확도를 달성하도록 돕는 새로운 학습 시스템입니다. 캐시된 롤아웃과 하이브리드 보상 방식을 통해 연산량을 100배 절감하면서도 GPT-5에 근접하는 성능을 구현했습니다.
멀티 LLM 에이전트 시스템의 프롬프트 엔지니어링을 자동화하기 위한 GTBP 프레임워크를 제안합니다. DAG 기반의 그래프 구조를 통해 로컬 타겟 출력을 역방향으로 전파하여 단계별 프롬프트를 최적화하며, 기존 방식보다 뛰어난 성능과 수렴 안정성을 입증했습니다.
인간 행동 시뮬레이션을 위한 파운데이션 모델 OdysSim과 분류 체계 SOUL을 제안합니다. 62개 데이터셋과 23개 벤치마크를 통합하여 기존 LLM의 동질적 말투 문제를 해결하고, 인간과 유사한 행동을 구현하는 훈련 레시피를 개발했습니다.