Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
SIREM은 실시간 MRI(rtMRI)의 해상도와 획득 속도 간의 상충 관계를 해결하기 위해 동기화된 음성 정보를 교차 모달 사전 정보로 활용하는 새로운 재구성 프레임워크입니다. 음성 데이터로부터 성도 구조를 예측하는 오디오 브랜치와 k-공간 데이터를 활용하는 MRI 브랜치를 결합하여, 해부학적으로 정확하면서도 빠른 재구성을 가능하게 합니다.
지식 그래프의 링크 예측 성능을 높이기 위해 T5-small 모델과 관계형 그래프 어텐션 네트워크(RGAT)를 결합한 GA-S2S 프레임워크를 제안합니다. 이 모델은 기존 Seq2Seq 모델이 놓치기 쉬운 그래프의 구조적 토폴로지와 텍스트 특징을 동시에 인코딩하여 멀티홉 관계 패턴을 효과적으로 포착합니다. CoDEx 데이터셋 실험 결과, 기존 베이스라인 대비 링크 예측 정확도에서 최대 19%의 성능 향상을 기록했습니다.
긴 조건부 접두사를 사용하는 LLM 추론 시 발생하는 어텐션 계산량 증가와 영향력 약화 문제를 해결하기 위해 '어텐션 상태 메모리(Attention-state memory)' 방식을 제안합니다. 이 방식은 사전 계산된 어텐션 상태를 경량화된 조회 기반 메모리로 외재화하여, 추가 학습 없이도 정확도를 높이고 지연 시간을 단축합니다. 실험 결과 LLaMA-3.1-8B 모델에서 인컨텍스트 학습보다 높은 정확도와 향상된 추론 효율성을 입증했습니다.
본 연구는 저자원 아프리카 언어를 활용한 다회차 대화가 상용 LLM의 안전 가드레일을 우회할 수 있는지 조사했습니다. 실험 결과, 단회차 번역 공격은 효과가 낮았으나 다회차 대화 방식은 모델에 따라 최대 83.6%의 높은 유해 응답률을 기록하며 탈옥에 성공했습니다. 특히 번역 품질이 높을수록 탈옥 성공률이 증가하며, 인간 레드팀이 자동화된 방식보다 더 높은 탈옥률을 보였습니다.
SomaliWeb v1은 소말리어 전용 토크나이저와 언어 식별 벤치마크를 포함한 최초의 고품질 사전 학습 코퍼스입니다. 기존 다국어 데이터셋의 중복 문제와 글자 깨짐(Mojibake) 결함을 분석하고, GPT-4보다 효율적인 BPE-16K 토크나이저를 제안합니다.
본 논문은 LLaDA 및 Dream과 같은 마스크 확산 언어 모델(MDLMs)을 위한 최초의 머신 언러닝 프레임워크인 MDU(Masked Diffusion Unlearning)를 제안합니다. MDU는 확산 관점에서 지식 학습 과정을 재검토하여, 온도 스케일링을 통해 프라이버시와 유용성 사이의 균형을 조절하며 특정 지식을 효과적으로 제거합니다. 실험 결과, MDU는 기존 LLM 언러닝 방식보다 뛰어난 성능을 입증했습니다.
CodeBind는 멀티모달 표현 정렬 시 발생하는 데이터 부족과 모달리티 간 불일치 문제를 해결하기 위해 제안된 새로운 프레임워크입니다. 공유 구성 요소와 모달리티 특화 구성 요소로 분리된 코드북 설계를 통해, 완전한 쌍을 이룬 데이터 없이도 다양한 모달리티를 효과적으로 정렬합니다. 9가지 다양한 모달리티에 대해 검증되었으며, 멀티모달 분류 및 검색 작업에서 최첨단 성능을 보여줍니다.
SD-Search는 외부 교사 모델이나 추가적인 주석 없이도 검색 증강 추론(Search-augmented reasoning) 에이전트의 성능을 높이는 온폴리시 사후 시각 자기 증류 기법을 제안합니다. 단일 모델이 롤아웃의 결과를 요약하는 교사 역할과 컨텍스트만 보는 학생 역할을 동시에 수행하며, 이를 통해 거친 궤적 보상을 조밀한 단계별 신호로 변환하여 학습 효율을 극대화합니다.
본 연구는 수학이나 코딩을 넘어 지식 집약적 도메인에서 LLM의 추론 능력을 향상시키기 위한 RLVR(검증 가능한 보상을 활용한 강화학습) 프레임워크인 K2V를 제안합니다. K2V는 자동화된 데이터 합성 기술을 통해 고품질 데이터를 확보하고, 최종 정답뿐만 아니라 추론 과정 자체를 검증함으로써 기존 RLVR의 한계를 극복합니다.
Infini-News는 13억 개 이상의 Common Crawl 뉴스 기사를 효율적으로 검색하고 분석할 수 있도록 설계된 새로운 툴킷이자 인덱스입니다. 텍스트 정제, 언어 감지, 지리적 귀속 정보를 포함한 풍부한 메타데이터를 제공하며, Suffix-array 기반의 Infini-gram 인덱스를 통해 대규모 아카이브 내 텍스트 패턴을 1초 미만으로 검색할 수 있습니다.
본 연구는 조건문에서의 전제 투영(Presupposition projection) 능력을 바탕으로 인간과 LLM의 추론 방식을 비교 분석합니다. 실험 결과, 인간은 확률적 및 화용적 단서를 통합하여 판단하는 반면, LLM은 화용적 역량보다는 표면적인 패턴 매칭에 의존하는 경향을 보였습니다.
LLM 에이전트의 핵심 요소인 메모리 능력을 평가하기 위해 자기 진화적 관점에서 설계된 통합 벤치마크 EvoMemBench를 제안합니다. 이 벤치마크는 메모리 범위와 내용이라는 두 가지 축을 기준으로 에이전트의 정보 저장, 업데이트 및 검색 능력을 체계적으로 분석합니다. 연구 결과, 현재의 메모리 시스템은 작업 유형에 따라 성능 차이가 크며 단일 솔루션으로 모든 상황을 해결하기 어렵다는 점을 시사합니다.
본 연구는 시각-언어 모델(VLM)이 중간 시각적 단계를 시뮬레이션하는 '잠재적 시각적 추론' 과정에서 겪는 한계를 분석합니다. 실험 결과, 현재 모델들은 잠재 토큰을 인과적으로 활용하지 못하고 있으며, 이는 정보가 부족한 데이터셋과 추론 시 발생하는 잠재 토큰의 표현 붕괴(collapsing) 현상 때문인 것으로 밝혀졌습니다.
본 보고서는 BERT와 T5 모델을 활용하여 개체명 인식(NER) 작업을 수행하고 두 아키텍처의 성능을 비교 분석합니다. BERT는 인코더 전용 구조와 분류 헤드를 사용하고, T5는 시퀀스 투 시퀀스 구조와 퓨샷 프롬프트를 활용하여 미세 조정을 진행했습니다. 다양한 하이퍼파라미터 절제 연구와 성능 지표 분석을 통해 각 모델의 특성과 오류 패턴에 대한 통찰을 제공합니다.
Prompt2Fingerprint(P2F)는 텍스트 설명을 통해 LLM의 식별 신호를 생성하는 새로운 핑거프린팅 프레임워크입니다. 기존의 미세 조정 방식과 달리 추가적인 재학습 없이 단 한 번의 순전파만으로 저차원 파라미터 증분을 생성하여 모델 출처를 추적할 수 있습니다. 이를 통해 계산 비용을 획기적으로 줄이면서도 높은 정확도와 강건성을 유지하며 모델 소유권을 관리할 수 있습니다.
소규모 다중 도메인 연구 코퍼스를 대상으로 Vector RAG와 LLM이 컴파일한 마크다운 위키 방식의 성능을 비교 분석했습니다. 연구 결과, 위키 방식은 논문 간 내용 연결과 인용 정확도 측면에서 우수했으나, RAG는 단일 사실 조회와 비용 효율성 측면에서 강점을 보였습니다.
고대 그리스어에서 현대 그리스어로의 번역을 위한 새로운 병렬 코퍼스인 AG-MG를 소개하며, 데이터 부족 문제를 해결하기 위한 새로운 데이터 생성 파이프라인을 제시합니다. NMT 모델과 LLM을 대상으로 한 미세 조정 실험을 통해, Llama-Krikri-8B의 전체 파라미터 미세 조정이 가장 높은 성능을 기록함을 입증했습니다.
본 논문은 LLM의 추론 성능을 높이기 위해 도구 호출과 실행을 분리하는 '도구 통합 추론(TIR)' 개념을 제안합니다. 기존의 즉각적인 도구 상호작용이 추론의 일관성을 해치는 문제를 해결하기 위해 지연 실행과 계층적 제어 프레임워크를 도입한 IH-GRPO 알고리즘을 개발했습니다. 실험 결과, Qwen3 모델 시리즈를 대상으로 다양한 수학적 추론 벤치마크에서 유의미한 성능 향상을 입증했습니다.
인컨텍스트 학습(ICL)에서 최적의 예시를 찾는 비용을 줄이기 위해, 예시를 찾는 것보다 성공 여부를 판단하는 것이 더 효율적이라는 가설을 바탕으로 DiSP 프레임워크를 제안합니다. DiSP는 쿼리 난이도를 예측하고 샘플링된 예시의 성공률을 판단하는 방식을 통해, 기존 방식 대비 정확도를 높이면서도 추론 속도를 최대 23배까지 개선했습니다.
연속적 확산 모델(Continuous Diffusion)이 이산적 접근 방식에 비해 확장성이 낮다는 기존의 통념을 깨고, RePlaid를 통해 이산적 DLM과 경쟁 가능한 수준의 성능을 입증했습니다. RePlaid는 자기회귀 모델과의 연산 격차를 20배로 줄였으며, OpenWebText 벤치마크에서 연속적 DLM 중 최첨단(SOTA) PPL을 달성했습니다. 또한 노이즈 스케줄 최적화를 통해 디노이징 난이도를 균등하게 분산시키는 이론적 통찰을 제시합니다.