Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 연구는 데이터 부족 문제를 해결하기 위해 GPT-4o를 활용하여 수어 번역(SLT)의 타겟 문장을 패러프레이징하는 증강 기법을 제안합니다. Signformer 모델을 사용하여 사전 학습과 미세 조정을 수행하며, 실험 결과 PHOENIX14T 데이터셋에서 성능 향상을 확인했습니다.
LLM 에이전트에게 제공되는 기술 문서의 세분성이 작업 성공률에 미치는 영향을 연구한 논문입니다. 실험 결과, 기술 가용성은 성능 향상에 결정적이지만, 가이드의 추상화 수준이나 예시 추가 여부는 모델에 따라 효과가 작고 불확실함을 확인했습니다.
FAM-Bench는 특정 건강 상태에 따른 음식의 적합성을 판단하는 멀티모달 벤치마크입니다. 기존의 단순 영양소 추정을 넘어, 임상 영양 제약 조건을 고려한 고차원적 추론 능력을 평가합니다.
CYK 알고리즘을 신경망 구조에 직접 주입하는 CYKNN 구조를 제안합니다. 문맥 자유 문법 분석을 위해 행렬-벡터 곱셈을 활용한 RNN 구조를 사용하며, 기존 대규모 언어 모델보다 뛰어난 성능을 입증했습니다.
SpeechLLM의 디코더 전용 아키텍처를 활용하여 별도의 학습 없이 장문 동시 음성-텍스트 번역을 수행하는 DOA(Decoder-Only Attention) 기술을 제안합니다. 셀프 어텐션에서 프록시 정렬 신호를 도출하여 저지연 스트리밍 번역을 가능하게 합니다.
본 논문은 속성 감성 삼중항 추출(ASTE)의 신뢰성을 높이기 위해 진단적 추론 감독 기반의 검증 프레임워크인 FiVeD를 제안합니다. FiVeD는 유효성 분류와 품질 점수 추정을 통해 추출된 삼중항을 검증하며, 기존 모델의 성능을 최대 3.53 F1 포인트 향상시킵니다.
강화학습의 거대한 상태 공간 문제를 해결하기 위해 Answer-Set Programming(ASP)을 활용한 CARCASS 프레임워크의 추상화 방식을 제안합니다. Blocks World와 Minigrid 사례 연구를 통해 ASP 기반 구현이 도메인 지식을 활용한 효과적인 추상화 도구임을 입증했습니다.
정보 비대칭 상황에서 LLM 에이전트의 협상 능력과 정직성, 신뢰성을 게임 이론 관점에서 분석한 연구입니다. 미세 조정이 협상력은 높이지만 부정직함을 유발하여 에이전트 안전성에 위협이 될 수 있음을 경고합니다.
PithTrain은 에이전트 친화적(Agent-Native) 설계를 통해 MoE 학습 프레임워크의 효율성을 높인 시스템입니다. 기존 프레임워크의 높은 운영 비용을 해결하기 위해 에이전트-태스크 효율성(ATE) 개념을 도입하고, ATE-Bench를 통해 성능을 검증했습니다.
GPU 커널 최적화 과정에서 발생하는 반복적인 하드웨어 측정 비용을 줄이기 위해 LLM을 선택적 대리 모델로 활용하는 연구를 소개합니다. LLM이 커널 성능을 예측하고 스스로의 불확실성을 판단함으로써, 제한된 GPU 예산 내에서 더 효율적인 커널 탐색을 가능하게 합니다.
AutoSci는 과학 연구의 전 과정을 자동화하기 위해 설계된 메모리 중심 에이전트 시스템입니다. 장기 지식과 활성 연구 메모리를 분리하여 관리하며, 피드백을 통해 연구 절차를 스스로 개선하는 구조를 갖추고 있습니다.
헝가리어 대화형 ASR 성능 향상을 위해 기존 85시간 규모의 BEA-Dialogue 코퍼스를 200시간으로 확장한 BEA-Dialogue+를 제안합니다. 화자 분리 기준을 완화하여 데이터 양을 늘렸으며, Whisper 및 FastConformer 모델을 통해 SOT 기반 미세 조정의 효과를 검증했습니다.
LLM의 추론 능력을 높이기 위해 탐색 이력을 명시적인 트리 구조로 표현하는 LinTree 방법론을 제안합니다. 기존의 선형화된 추적 방식이 가진 한계를 극복하여 백트래킹과 분기 전환 시 탐색 효율성을 크게 향상시켰습니다.
GNN의 메모리 병목 현상을 해결하기 위해 I/O 및 연산 강도 중심의 새로운 GPU 커널을 제안합니다. SpMM, 리덕션, 어텐션 기반 레이어를 최적화하여 데이터 이동을 줄이고 그래프 확장성을 크게 개선했습니다.
에이전트 강화학습(Agentic RL)에서 성공적인 궤적을 추상적 패턴으로 압축하여 일반화 성능을 높이는 ReuseRL 방법론을 제안합니다. MDL 원칙을 기반으로 기술 사전을 추출하고 특이 행동에 페널티를 부여하여 성능을 개선합니다.
LLM의 의인화된 속성이 모델 고유의 특성이 아닐 수 있음을 Age of Empires II 환경의 신경망 실험을 통해 지적합니다. 특정 속성은 기질(substrate)에 따라 달라질 수 있으므로, 실험 시 의인화된 속성을 가정하는 대신 비유일성을 가정하는 '귀무 가설'을 제안합니다.
3D 장면 재구성 시 계산 자원을 효율적으로 배분하기 위한 적응형 특징 최적화 프런트엔드 기술을 제안합니다. 질감, 재현성, 판별력 등을 기준으로 특징 점수를 매겨 뷰별로 예산을 할당함으로써 재구성 품질을 높입니다.
RayDer는 카메라 추정, 장면 재구성, 렌더링을 하나의 백본으로 통합한 피드포워드 트랜스포머 모델입니다. 실제 비디오의 동적 요소를 학습 신호로 활용하여, 정적 장면의 신규 시점 합성(NVS) 성능을 데이터 규모에 따라 멱법칙으로 확장합니다.
Transformer 모델의 어텐션 헤드가 위치 기반 또는 기호 기반으로 학습되는 역학을 연구합니다. 숫자와 문자 작업의 구조적 차이에 따른 메커니즘을 분석하고, RoPE 기하학을 통해 긴 시퀀스에 대한 외삽 성능 차이를 규명합니다.
시각-언어 모델(VLMs)이 모호한 입력 상황에서 직업-성별 스테레오타입을 어떻게 출력하는지 분석한 연구입니다. 모델이 내부적으로는 여성 연관성을 인코딩하더라도, 출력 단계에서 남성 신호가 증폭되고 여성 신호가 억제되는 현상을 발견했습니다.