Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
VLM의 사고 사슬(CoT) 추론 능력을 보존하면서 모델 크기를 줄이는 새로운 구조적 가지치기 프레임워크 MuCRASP를 제안합니다. 기존 방식이 놓치던 피벗 토큰과 모달리티 간 활성화 분포 차이를 고려하여 높은 압축률에서도 추론 품질을 유지합니다.
LLM의 기권 학습을 위해 궤적 정보 기반 이점 재가중(TIAR) 방식을 제안하는 논문입니다. GRPO 학습 과정에서 궤적을 신뢰도 지표로 활용하여 기권 보상을 동적으로 재가중함으로써 환각을 줄이고 지식의 경계를 탐색합니다.
RLVR의 높은 라벨링 비용과 학습 붕괴 문제를 해결하기 위해 능동적 검증 가능 보상을 활용하는 RLAVR 방식을 제안합니다. CAG 지표와 CARE 정책을 통해 가치 있는 샘플을 선별하여 제한된 예산 내에서 학습 안정성과 성능을 높입니다.
단일 언어 사전 학습 모델들을 병합하여 다국어 능력을 확보하려는 시도의 한계를 연구했습니다. 실험 결과, 모델 병합 시 발생하는 간섭 현상으로 인해 성능 붕괴가 나타남을 확인했습니다.
LLM 에이전트의 장기 메모리 저장 방식에서 발생하는 출처-역할 붕괴 문제를 해결하기 위해 MemIR이라는 새로운 중간 표현 방식을 제안합니다. MemIR은 메모리를 구조화된 원자 단위로 기록하여 출처 모니터링 오류를 방지하고 정보의 신뢰성을 높입니다.
LLM의 내부 은닉 상태에는 인과적 정보가 존재하지만, 실제 Yes/No 답변으로는 이를 출력하지 못하는 '인과적 혀 묶임' 현상을 발견했습니다. 이는 모델의 내부 인지 능력과 언어적 출력 사이의 불일치를 시사합니다.
이질적인 모델들의 은닉 표현을 자연어로 설명하기 위한 통합 프레임워크인 UAV를 제안합니다. 공유 디코더와 경량 어댑터를 활용하여 모델 간 경계를 넘나드는 교차 모델 활성화 설명을 가능하게 합니다.
법률 LLM이 겪는 시간적 편향 문제를 해결하기 위해 강화학습 기반의 LegalSearch-R1 프레임워크를 제안합니다. 로컬 RAG와 웹 검색을 결합하여 사건의 시간적 맥락에 맞는 정확한 법령 및 판례를 인용하도록 설계되었습니다.
학습자 코퍼스(Learner Corpus)를 활용한 지속적 사전 학습(DAPT)이 자동 에세이 채점(AES) 성능에 미치는 영향을 연구했습니다. 연구 결과, 도메인 데이터와 평가 데이터 간의 숙달도 및 장르 일치 여부가 성능 개선의 핵심 요인임을 확인했습니다.
1억 미만 파라미터 규모의 디코더 언어 모델을 대상으로 양자화 인식 학습(QAT) 시 비트 너비에 따른 최적의 학습률 스케줄 변화를 연구했습니다. 실험 결과, INT8/INT6 환경에서는 비트 너비와 상관없이 FP16의 스케줄을 그대로 사용할 수 있으나, INT4의 경우 50M 파라미터 기준으로 스케줄링 양상이 달라짐을 확인했습니다.
KSAA-2026 Task 2에서 1위를 차지한 Thaka 시스템을 소개합니다. 소량의 데이터로 아랍어 음성 성조 표기를 수행하기 위해 CATT 텍seq 인코더와 Whisper 음성 인코더를 결합한 멀티모달 모델을 제안합니다.
LLM의 창의적 생성 능력을 객관적으로 평가하기 위한 새로운 벤치마크 QUIET를 제안합니다. 기존의 객관식 방식에서 벗어나 다중 빈칸과 내용 제약 조건을 활용하며, 정보 이론 기반의 자동 점수 산정 프로토콜을 통해 창의성과 논리적 충족도를 동시에 측정합니다.
LLM 에이전트가 의미적 노이즈와 표현 방식의 노이즈를 다르게 처리하는 현상을 분석한 연구입니다. 실험 결과, 의미적 변화가 단순 포맷 변경보다 최종 답변에 더 큰 영향을 미치며, 이는 추론 과정 중 '스텔스 발산'을 통해 나타남을 확인했습니다.
사용자의 명시적 요청이 없는 유휴 시간 동안 미래의 요구를 예측하여 준비하는 선제적 에이전트 아키텍처 ProAct를 제안합니다. ProAct는 지속적 메모리를 활용해 지식 격차를 해소하며, 새로운 벤치마크인 ProActEval을 통해 성능을 입증했습니다.
RWKV의 선형 시간 효율성과 이산 확산 모델의 양방향성을 통합한 B³D-RWKV 모델을 제안합니다. Triplet-block layout을 통해 추론 효율성을 유지하면서도 확산 모델의 병렬적 특성을 결합했습니다.
본 논문은 창의적 품질 지표를 엔지니어링 관점에서 구현하고, CoT 미세 조정을 통해 전문가의 암묵적 지식을 전이하는 CQA 방법론을 제안합니다. 적은 데이터와 작은 모델 환경에서도 아키텍처의 쌍대성을 통해 생성 품질이 개선됨을 이론적·경험적으로 입증합니다.
SafeCtrl-RL은 모델 재학습 없이 추론 단계에서 프롬프트를 동적으로 조정하여 LLM의 안전성을 제어하는 강화학습 기반 프레임워크입니다. 대화 생성을 순차적 의사 결정 과정으로 정의하여 안전하지 않은 행동을 억제하고 응답 품질을 향상시킵니다.
의료 RAG 에이전트 학습 시 NLI 체크 모델의 출력 분포가 그래디언트 제공에 미치는 영향을 분석했습니다. 로그 확률 기반 점수는 신호 붕괴를 유발하는 반면, 보정된 분류기는 안정적인 학습을 지원함을 발견했습니다.
MAGIC은 대규모 시각-언어 모델(LVLM)의 지시어 튜닝을 위해 효율적인 데이터 코어셋을 구축하는 학습 불필요(Training-free) 방법론입니다. 멀티모달 이득, 브릿징 관련성, 스킬-뉴런 시그니처라는 세 가지 신호를 활용하여 데이터 중복을 줄이고 학습 효율을 극대화합니다.
필리핀어-영어 코드 스위칭 환경에서 NeoBERT를 활용한 치매 탐지 성능을 벤치마킹한 연구입니다. 연구 결과, 모델 아키텍처보다 이중 언어 미세 조정(bilingual fine-tuning)을 통한 언어적 커버리지 확보가 다국어 임상 NLP 성능에 결정적임을 입증했습니다.