Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
외부 메모리를 사용하는 LLM 에이전트 학습 시 커리큘럼 구성이 성능에 미치는 영향을 실증적으로 분석한 연구입니다. 혼합 벤치마크 학습이 가장 높은 성능을 보였으며, 단일 GPU 환경에서 GRPO를 사용할 때의 보상 함수 설계 전략을 제시합니다.
역할 프롬프트에서 페르소나와 태스크가 잔차 스트림 내에서 선형적으로 분해된다는 사실을 발견했습니다. 하지만 페르소나 효과는 단일 벡터로 압축될 수 없으며, 생성 과정 전반에 걸쳐 어텐션 메커니즘을 통해 분산되어 작용함을 증명했습니다.
분할 추론(Split Inference) 환경에서 LLM의 중간 활성화 값을 통해 클라이언트 입력을 재구성할 수 있는 보안 취약성을 분석합니다. 새로운 공격 기법인 ActInv와 취약성 지표인 PAF를 제안하며, 이를 방어하기 위한 PriPert 방법론을 제시합니다.
테스트 시점에 퓨샷 프롬프트의 연속적 임베딩을 최적화하여 인컨텍스트 러닝(ICL) 성능을 개선하는 새로운 방법을 제안합니다. 로그 확률을 활용한 자기 지도 학습 기반의 신뢰도 대리 지표를 통해 파인튜닝 없이도 모델의 추론 능력을 향상시킵니다.
가자 지구 전쟁 관련 YouTube 댓글 10,000개를 분석하여 아랍어 희망적 발화(Hope speech)를 분류한 AraHopeCorpus 데이터셋을 소개합니다. 이 데이터셋은 종교적 격려와 연대 등 건설적인 디지털 담론 연구를 위한 주석 프레임워크를 제공합니다.
수어 대화의 맥락을 반영한 감정 인식 연구를 위해 eJSL Dialog 데이터셋을 제안합니다. 기존의 고립된 문장 중심 데이터셋의 한계를 극복하고, 멀티모달 대화 아키텍처를 통한 체계적인 벤치마킹을 수행했습니다.
본 논문은 LLM을 정치적 담론 분석에 활용할 때 발생하는 문화적 편향 문제를 다룹니다. 영어 중심 데이터의 한계를 극복하기 위해 번역, 담론, 온톨로지 수준의 문화적 적응 방법론과 새로운 평가 매트릭스를 제안합니다.
사용자마다 다른 선호도와 계획 전략을 반영하기 위한 개인화된 에이전트 강화학습(PAR) 프레임워크를 제안합니다. PARPO 알고리즘을 통해 작업 품질과 개인 선호도 보상을 분리하여 학습 안정성을 높이고, PSGM 메모리를 통해 개인화된 기술 검색을 지원합니다.
본 연구는 음향 모음 역동성이 개별 화자의 조음 전략에 의해 결정된다는 사실을 입증합니다. 초음파 혀 영상 데이터를 통해 구개 모음 /i/ 생성 시의 혀 모양과 포먼트 전이 사이의 상관관계를 분석하였습니다.
LLM이 생성한 텍스트의 언어적 유사성을 평가하기 위해 코퍼스 언어학 관점의 새로운 프레임워크를 제안합니다. MMD와 67가지 어휘-문법적 특징을 활용하여 문맥(register)에 따른 인간 유사성을 측정하며, 모델 크기보다 레지스터 적합성이 중요함을 밝힙니다.
데이터가 부족한 언어를 위해 고자원 언어의 지식을 효과적으로 전이하는 LINK 방법론을 제안합니다. 이중 언어 어휘집을 활용한 어휘 치환 방식을 통해 추가 학습 비용 없이 다국어 모델의 성능과 학습 속도를 크게 개선했습니다.
중국어 환경에서 LLM의 독성을 평가하기 위한 새로운 프레임워크인 CITA를 제안합니다. CITA는 유해 의도 학습, 암시성 강화, 은폐 변형의 3단계를 통해 기존 탐지기를 우회하는 공격을 수행하며, 이를 통해 방어 모델의 강건성을 높이는 연구를 다룹니다.
GHI는 속성 기반 감성 분석(ABSA)을 위해 설계된 조건부 하이퍼그래프 인시던스 기반 Graphormer 프레임워크입니다. 토큰과 하이퍼엣지 간의 관계를 활용하여 구조적 추론을 강화하며, 적은 파라미터로도 대규모 모델에 근접하는 성능을 보여줍니다.
안전 분류기가 민감한 데이터로 학습될 때 발생하는 개인정보 보호 취약점을 분석한 연구입니다. 경계 타겟 선택 전략을 통해 모델의 암기 현상을 이용한 멤버십 추론 공격(MIA) 성능을 기존보다 3.5배 향상시켰습니다.
아랍어의 불규칙 복수형(Broken Plurals)을 처리하기 위해 기존의 어근-패턴 모델을 뒤집은 '패턴-및-어근' 모델을 제안합니다. 형태음운론적 규칙 없이 사전만으로 형태론적 분석이 가능하도록 설계된 새로운 분류 체계를 제시합니다.
단어의 상황적 의미를 구조적으로 표현하기 위한 '장면 추상화(Scene Abstraction)' 프레임워크를 제안합니다. LLM의 퓨샷 프롬프팅을 활용해 문맥적 장면과 표현 프로필을 구축하며, 새로운 데이터셋인 COCA-Scenes를 통해 그 유효성을 입증했습니다.
본 연구는 기계 번역이 언어 간 도덕적 가치와 미묘한 의미론적 단서를 얼마나 잘 보존하는지 폴란드어를 통해 검증합니다. LaBSE, CKA, LLM-as-judge 등 4단계 파이프라인을 통해 번역된 데이터가 교차 언어 머신러닝에 실용적임을 입증했습니다.
관용구의 표면적 형태와 실제 의미 사이의 간극을 해결하기 위한 새로운 검색 벤치마크 IdioLink를 소개합니다. 기존 임베딩 모델들이 관용적 표현의 심층적 의미를 파악하지 못하고 주제적 단서에 의존한다는 한계를 지적합니다.
LLM의 복잡한 추론 능력을 향상시키기 위해 고품질 데이터를 효율적으로 선택하는 새로운 지표인 High-Entropy Sum(HES)를 제안합니다. HES는 별도의 학습 없이 엔트로피를 활용해 데이터 품질을 정량화하며, SFT, RFT, RL 등 다양한 학습 패러다임에서 성능 향상과 계산 비용 절감을 입증했습니다.
미분 방정식 관점에서 확산 모델(Diffusion Models)의 수학적 원리를 설명하는 튜토리얼입니다. 순방향 ODE/SDE 과정부터 역시간 역학 유도, 스코어 매칭, 그리고 DDPM 및 DDIM과의 관계를 심도 있게 다룹니다.