Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
다국어 의료 정보 검색 능력을 평가하기 위한 새로운 벤치마크인 MMed-Bench-IR을 소개합니다. 교차 언어 정렬, 개념 판별, 증거 검색의 세 가지 핵심 능력을 6개 언어로 측정하며, 기존 모델들의 심각한 다국어 성능 격차를 입증했습니다.
확률적 양자 신경망(SQNN)을 활용하여 적대적 공격에 강건한 네트워크 침입 탐지 이론을 제시합니다. 탈분극 채널과 게이트별 드롭아웃의 정규화 효과를 수학적으로 증명하고, 실제 데이터셋에서 기존 모델보다 뛰어난 방어 성능을 입증했습니다.
SURGELLM은 NLP 태스크 간의 귀납적 편향 불일치와 클래스 불균형 문제를 해결하기 위한 통합 트랜스포머 프레임워크입니다. 수술적 특징 게이트와 인스턴스 가중 정규화(IWN)를 통해 다양한 태스크에서 성능을 크게 향상시켰습니다.
잘못된 컨텍스트가 LLM의 성능 저하와 모드 붕괴를 유발하는 'Pigeonholing' 현상을 분석한 연구입니다. 잘못된 답변의 반복이나 좁은 답변 세트로의 수렴 문제를 다루며, RLVR을 통한 완화 방안을 제시합니다.
추론 언어 모델의 신뢰도를 사고 전과 후로 구분하여 교정하는 CALIBER 프레임워크를 제안합니다. 사고 전에는 프롬프트 해결 확률을, 사고 후에는 답변의 정답 가능성을 예측하도록 설계하여 교정 오차를 획기적으로 줄였습니다.
AVOC는 긴 형식의 오디오-비디오 이해를 위해 검색 기반 토큰 압축 기술을 도입한 프레임워크입니다. 관련성, 중요도, 다양성 기준을 활용해 컨텍스트 예산 내 최적의 토큰을 검색함으로써 멀티모달 LLM의 성능을 극대화합니다.
30년간의 연구를 통해 완성된 체코어 언어 리소스인 Prague Dependency Treebank Consolidated 2.0(PDT-C 2.0)을 공개합니다. 약 400만 토큰 규모의 이 코퍼스는 상호 참조와 담화 관계를 포함한 복잡한 언어 계층을 체계적으로 주석화하여 NLP 연구에 기여합니다.
Transformer 기반 언어 모델의 아키텍처 분류와 2023년 이후의 주요 기술적 발전을 리뷰합니다. 다양한 모델 변형과 학습 방법론을 정리하고, 도메인별 활용 사례 및 파라미터와 에너지 비용 간의 트레이드오프를 비판적으로 평가합니다.
Czech어의 대규모 트리뱅크인 Prague Dependency Treebank-Consolidated(PDT-C)를 Universal Dependencies(UD) 형식으로 변환하는 과정을 다룬 논문입니다. 기존 PDT 대비 규모와 장르 다양성이 확대되었으며, 두 주석 체계 간의 구조적 차이를 극복하는 방법론을 제시합니다.
석유 공학 도메인의 검색 성능 향상을 위해 웹 데이터를 정제된 도메인 코퍼스와 합성 지도 학습 데이터로 변환하는 PETRA 파이프라인을 제안합니다. PETRA는 대규모 데이터셋을 통해 밀집 검색 및 재순위화 성능을 크게 개선하며, 효과적인 학습 레시피의 중요성을 입증합니다.
WordNet을 활용하여 Al-Mawrid 아랍어-영어 사전의 의미에 자동으로 품사 태깅을 수행하는 알고리즘을 제안합니다. 이 방식은 자원이 부족한 언어를 위한 효율적인 NLP 도구 구축을 목표로 합니다.
굴절과 파생 규칙을 활용하여 언어의 형태론적 처리를 효율화하는 MorfFlex 아키텍처를 제안합니다. 체코어 사례를 통해 방대한 사전 데이터를 획기적으로 압축하고 관리하는 방법을 입증했습니다.
TFHE 암호 체계를 기반으로 프라이버시 보호 애플리케이션 개발을 돕는 오픈 소스 C++ 라이브러리 ComputeFHE를 소개합니다. 암호화된 데이터에 대한 다양한 연산을 지원하며, 최적화된 ALU 아키텍처를 통해 성능을 크게 향상시켰습니다.
LLM 평가 시 프롬프트 순위가 평가 조건 변화에 따라 불안정할 수 있음을 연구했습니다. 성능과 분산을 동시에 고려하는 안정성 인지 선택 전략을 제안하여 프롬프트 선택의 견고성을 높였습니다.
LLM 기반 문서 필드 추출 시 신뢰도를 정확히 측정하기 위한 새로운 엔진인 ExtractConf를 제안합니다. Hunter와 Mapper라는 두 가지 상이한 추출 방식을 활용하여 발생하는 불일치를 분석함으로써, 기존 로그 확률 방식보다 훨씬 정교한 신뢰도 추정이 가능함을 입증했습니다.
LLM 에이전트가 오류를 성공으로 오인하는 '자기 확증의 함정'을 해결하기 위한 EDV 프레임워크를 제안합니다. 실행, 증류, 검증 단계를 분리하여 에이전트의 경험 학습 신뢰도를 높이는 연구입니다.
BEA 2026 Shared Task 1을 위한 L1 인지 어휘 난이도 예측 시스템을 제안합니다. 다국어 문맥 표현과 다양한 엔지니어링 특징을 결합하여 스페인어, 독일어, 중국어에서 우수한 RMSE 성능을 달성했습니다.
차량 사양 추출을 위한 세밀한 개체명 인식(NER) 데이터셋인 AutoSpecNER를 제안합니다. 복잡한 차량 속성을 정밀하게 식별할 수 있도록 설계되었으며, 벤치마크 테스트를 통해 모델 성능 향상 효과를 입증했습니다.
Nature 계열 논문의 태스크를 기반으로 AI 코딩 에이전트의 과학적 발견 능력을 평가하는 NatureBench를 소개합니다. 실험 결과, 최신 에이전트들도 실제 SOTA 성능을 따라잡는 데 한계가 있음을 보여줍니다.
LLM의 매개변수 지식이 언어별로 불균형하게 접근되는 문제를 해결하기 위해 교차 언어 탐색 전략을 제안합니다. 17개 언어 벤치마크를 통해 교차 언어 프롬프팅이 지식 전이와 사실적 회상 능력을 크게 향상시킴을 입증했습니다.