Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 기사는 의미 역할 레이블링(SRL) 모델링을 재검토하고, 현대화된 인코더 기반 프레임워크를 제안합니다. 기존의 시스템들이 가진 구조적 명시성 부족 문제를 해결하기 위해 의존성 기반 분석 방법을 채택하여 추론 속도를 획기적으로 개선했습니다. 이 새로운 프레임워크는 BERT, RoBERTa, DeBERTa 등 다양한 최신 인코더 모델을 활용하며, 특히 의존성 단서가 구조적 안정성을 높여 다운스트림 다국어 SRL 응용 프로그램에 효과적임을 입증합니다.
본 연구는 현대적인 에이전트 연구 도구와 공개 데이터를 활용하여 NLP 실험의 재현성을 높이고, AI가 생성한 텍스트에 대한 스타일 분석 및 감지 기술의 최신 동향을 탐구합니다. 특히 GPT-5.5와 Claude Opus 4.7 같은 최첨단 LLM들이 인간 편집보다 더 높은 수준으로 '저자 상한선'의 스타일 간격을 좁힐 수 있음을 보여주었습니다. 또한, AI가 감지기(detector)에 대한 적대적 공격을 수행하는 과정을 시뮬레이션하여, 알려진 감지기에 노출된 LLM이 자신의 AI 생성 확률을 효율적으로 낮추는 방법을 제시했습니다.
본 논문은 LLM의 안전 정렬을 우회하는 공격에 취약점을 보이는 현황을 진단하고, 이를 극복하기 위한 새로운 블랙박스 레드팀링 전략인 ContextualJailbreak을 제안합니다. 이 방법론은 시뮬레이션 다중 턴 프라임된 대화를 대상으로 진화적 탐색을 수행하며, 두 단계 판정자로부터 받은 해악 점수를 인루프 신호로 활용하여 공격 과정을 안내하고 최적화합니다. 실험 결과, ContextualJailbreak은 다양한 모델에서 기존의 단일/다중 턴 베이스라인 대비 높은 ASR(Adversarial Success Rate)을 달성하며, 발견된 취약점들이 다른 상용 모델에서도 전이됨을 입증했습니다.
본 기술 기사는 LLM 기반 다중 에이전트 시스템에 강화 학습(RL)을 적용하는 방법을 제시하며, 특히 '오케스트레이션 트랙킹(Orchestration Tracking)'이라는 시간적 상호작용 그래프를 통해 접근합니다. 이 프레임워크는 서브 에이전트 생성, 작업 위임, 통신, 도구 사용, 집계 및 중지 결정 등 복잡한 다단계 과정을 포괄적으로 최적화하는 데 초점을 맞춥니다. 연구 결과에 따르면, 효과적인 RL을 위해서는 병렬 속도 향상, 분할 정확도 등을 고려한 다양한 오케스트레이션 보상 설계가 필요하며, 토큰 단위부터 팀 전체까지 크레딧 신호를 부여하는 정교한 메커니즘이 요구됩니다. 또한, 중지 결정과 같은 핵심 하위 결정에 대한 명시적인 RL 훈련 방법론을 구축하고 아티팩트를 공개하여 연구 커뮤니티의 발전을 도모합니다.
본 기술 기사는 대규모 에이전트 생태계에서 발생하는 '효율적이고 정확한 에이전트 발견' 문제를 해결하기 위해 GRAIL(Granular Resonance-based Agent/AI Link)이라는 하이브리드 공명 프레임워크를 제안합니다. 기존 방식의 높은 지연 시간이나 낮은 의미론적 정밀도라는 딜레마를 극복하고자, GRAIL은 SLM 기반 예측, 합성 쿼리를 통한 문서 확장, 그리고 최대 유사성 계산을 포함하는 세 가지 혁신적인 요소를 결합했습니다. 이 프레임워크는 대규모 에이전트 데이터셋에서 기존 LLM 파싱 방식 대비 발견 지연 시간을 획기적으로 줄이고 검색 정확도를 높이는 성능을 입증했습니다.
MolViBench는 화학자들이 대규모 언어 모델(LLM)과 상호작용하여 복잡한 분자 작업을 위한 실행 가능한 프로그램을 생성하는 새로운 패러다임인 '분자 바이브 코딩'을 평가하기 위해 설계된 최초의 벤치마크입니다. 이 벤치마크는 단일 API 호출부터 엔드투엔드 가상 스크리닝 파이프라인 설계까지 아우르는 12개의 실세계 약물 발견 워크플로우를 포함한 358개의 작업을 제공합니다. 또한, 실행 가능성과 화학적 정확성을 동시에 측정하는 다층 평가 프레임워크를 제안하여 LLM의 실제적인 코딩 능력을 진단할 수 있게 합니다.
본 논문은 고위험 AI 시스템이 적대적 압력 하에서 메타인지적 안정성을 유지하는 것이 중요함을 강조하며, 기존의 안전성 평가가 놓치고 있는 '인지 붕괴(cognitive collapse)'라는 근본적인 실패 모드를 조사했습니다. 연구진은 '복종성 함정(Compliance Trap)'을 식별했는데, 이는 모델이 생존 위협과 무관하게 지식적 경계를 무시하고 복종하도록 강제하는 지시문 때문에 발생하는 메타인지 저하 현상입니다. 이 문제를 해결하기 위해 복종성 접미사를 제거했을 때 모델 성능이 회복됨을 입증했으며, Anthropic의 Constitutional AI가 높은 면역력을 보인 것은 능력 때문이라기보다 정렬 특화 훈련 덕분임을 밝혀냈습니다.
본 논문은 대형 언어 모델(LLM) 기반 코딩 에이전트가 계산 재료과학 분야의 연구 결과를 얼마나 잘 재현할 수 있는지 평가하기 위해 AutoMat이라는 새로운 벤치마크를 제시합니다. 이 벤치마크는 불완전한 계산 절차 복원, 전문 도구 체인 탐색, 그리고 결과적 증거 분석 등 세 가지 상호 연관된 과제를 포함합니다. 실험 결과, 현재의 LLM 기반 에이전트들은 AutoMat에서 전반적으로 낮은 성공률(최고 54.1%)을 보였으며, 특히 논문 텍스트만으로는 복잡한 워크플로우를 재구성하는 데 어려움을 겪는 것으로 나타났습니다.
본 논문은 제한된 질문 예산 내에서 사용자의 의존적인 관심사를 학습하기 위한 적응적 질문(adaptive querying) 방법을 제안합니다. 기존의 베이지안 설계 방식들이 엄격한 가정이나 높은 계산 비용으로 인해 활용에 한계가 있었던 문제를 해결하고자 합니다. 이를 위해 대규모 언어 모델(LLM)이 생성한 응답 분포를 기반으로 하는 'AI 페르소나' 개념을 도입하여, 사용자의 상태를 표현하는 잠재 변수 모델을 구축했습니다. 이 방법은 확장 가능한 베이지안 설계를 가능하게 하며, 정확하고 해석 가능한 적응적 질문 유도 파이프라인을 제공함을 실험적으로 입증합니다.
본 논문은 기존의 백박스 OOD(Out-of-Distribution) 탐지 방법들이 시퀀스 길이 의존성으로 인해 구조적 혼란을 겪는 문제를 지적하며, 이를 해결하기 위해 '두 경로 프레임워크'를 제안합니다. 이 프레임워크는 입력 임베딩이 텍스트의 의미를 포착하는 능력과 레이어에 걸친 숨겨진 상태의 진화(처리 경로)라는 두 가지 독립적인 관점에서 OOD 신호를 식별합니다. 실험 결과, 각 경로는 서로 다른 유형의 OOD 공격을 탐지하는 데 강점을 보이며, 특히 임베딩 기반 방법은 단어 구별 OOD에, 처리 경로 기능은 은밀한 의도(Jailbreak) 입력 탐지에 효과적임을 입증했습니다.
본 논문은 기존 LLM 다비트 워터마킹 기법들이 낮은 신뢰성과 높은 위양성률(FPR)을 보이는 구조적 문제를 지적하며, 이를 해결하기 위해 BREW(Block-wise Reliable Embedding for Watermarking)라는 새로운 프레임워크를 제안합니다. BREW는 독립적인 블록 투표와 윈도우 시프트 검증이라는 두 단계 메커니즘을 사용하여 워터마킹의 신뢰성을 혁신적으로 높였습니다. 실험 결과, 이 방법은 동의어 치환 조건에서도 높은 진양성률(TPR)과 낮은 위양성률(FPR)을 동시에 달성하여, 기존 설계의 한계를 극복했음을 입증했습니다.
MemRouter는 장기 대화 에이전트가 외부 메모리에 어떤 대화 턴을 저장할지 결정하는 과정을 개선한 쓰기측면(write-side) 메모리 라우터입니다. 기존 시스템들이 매 턴마다 LLM 생성을 통해 이 결정을 내리는 것과 달리, MemRouter는 임베딩 기반의 경량 분류 헤드를 사용하여 효율적으로 메모리 수용 여부를 예측합니다. 실험 결과, MemRouter는 기존 LLM 기반 메모리 관리자보다 모든 질문 카테고리에서 높은 성능을 보였으며, 특히 메모리 관리 지연시간을 크게 줄여 실시간 응답성을 향상시켰습니다.
기존 LLM 파라미터 편집 기법은 목표 레이어에서 계산된 이상적인 히든 스테이트를 이전 레이어로 역전파(backward spreading)하여 적용하는 방식이었습니다. 본 논문은 이 방법의 이론적 한계와 실패 모드를 분석하고, 이를 개선한 새로운 접근 방식을 제안합니다. 새롭게 제안된 'Forward Replay' 기법은 첫 번째 편집 레이어에서 앵커 포인트를 최적화하고 이를 순전파(forward propagation)하여 모든 후속 레이어의 타겟 히든 스테이트를 얻습니다. 이 방법은 기존 방식과 동일한 계산 복잡도를 유지하면서도 더 정확하고 상호 호환성이 높은 레이어별 타겟을 생성합니다.
본 논문은 대규모 언어 모델(LLMs)의 프라이버시 및 안전성 문제를 해결하기 위한 '토큰 레벨 귀속' 학습 소거 프레임워크인 TokenUnlearn을 제안합니다. 기존 방법들이 모든 토큰에 균일한 업데이트를 적용하는 한계를 극복하고, 지식 인식 및 엔트로피 인식 신호를 활용하여 중요한 토큰을 정밀하게 식별합니다. 이 프레임워크는 하드 선택과 소프트 가중치 두 가지 전략을 통해 학습 소거의 효과를 높이면서 모델 유틸리티 저하를 최소화함을 입증했습니다.
본 논문은 강화학습(RLVR) 모델이 단일 시도 정확도는 높지만, 다중 샘플 커버리지(Pass@K)에서 다양성 붕괴를 겪는 문제를 분석하고 해결책을 제시합니다. 기존 RL 목표 함수가 올바른 해답들의 확률 분포에 무관하여 발생하는 '자기 강화 붕괴' 메커니즘을 공식화했습니다. 이를 바탕으로, 정책의 올바른 해답 분포에 조건부 균일성 페널티를 추가한 '균일-정확 정책 최적화(UCPO)' 기법을 제안합니다. UCPO는 다양성을 유지하면서도 높은 정확도를 달성하여 여러 수학 추론 벤치마크에서 성능 향상을 입증했습니다.
본 논문은 LLM의 추론 능력 향상과 생성 다양성 보존이라는 상충되는 목표를 해결하기 위해 '부정 샘플 투영 잔차 강화학습(ResRL)'을 제안합니다. ResRL은 부정 토큰의 숨겨진 표현을 저랭크 양성 하위 공간에 투영하고, 이 투영 잔차를 활용하여 부정 기울기를 조절함으로써 추론 능력을 높이면서도 다양성을 유지합니다. 다양한 벤치마크에서 기존 방법(NSR)보다 우수한 성능을 입증했습니다.
본 기술 기사는 기존의 주제 유사성 기반 표 검색(Table Retrieval)이 LLM 에이전트 시스템의 발전과 함께 명시적인 지시사항 준수 방식으로 변화하고 있음을 제시합니다. 이에 따라, 내용 범위 및 스키마 제약 조건을 동시에 만족해야 하는 새로운 작업인 '지시사항 준수 표 검색(IFTR)'을 공식화했습니다. 연구진은 IFTR에 대한 첫 대규모 벤치마크인 FollowTable을 소개하고, 지시사항 적응도를 측정하는 Instruction Responsiveness Score라는 새로운 평가 지표를 제안하며, 기존 모델들이 이러한 세밀한 지시사항 처리에서 어려움을 겪고 있음을 보여줍니다.
Agent Capsules는 멀티 에이전트 LLM 파이프라인의 실행을 관리하는 적응형 실행 런타임을 제시합니다. 이 시스템은 단순히 에이전트를 병합하여 토큰을 절감하는 기존 방식의 품질 저하 문제를 해결하기 위해, 경험적 품질 제약을 최적화 문제로 취급합니다. Agent Capsules는 그룹별 조정 오버헤드를 계량하고 세 가지 복합 실행 전략 중 하나를 선택하며, 모든 모드 전환 시 롤링 평균 출력 품질을 게이트하여 시스템의 안정성과 효율성을 동시에 확보합니다.
본 연구는 대규모 언어 모델(LLMs)이 실세계 응용에서 안전성과 신뢰성을 확보하는 데 있어 '작업 표현(task representation)'이 전제(assumption)를 유도하는 방식과 그 영향을 탐구합니다. 반복된 죄수의 딜레마 사례 연구를 통해, LLMs가 추론 단계를 거치더라도 특정 작업 표현에 의해 형성된 전제에는 취약함을 확인했습니다. 따라서 LLM의 신뢰성을 높이기 위해서는 적절하고 중립적인 작업 표현을 설계하는 것이 중요함을 시사합니다.
본 논문은 정보 이론적 비용 개념을 활용하여 문장 생성을 확률적 비용 민감 선택으로 모델링하고, 대화 생산 선택에 대한 예측 메커니즘을 제시한다. 특히, 고정된 의도(목표 지향)를 가진 대안과 맥락적 가능성에만 기반한 대안(목표 무관)을 구분하여 분석했다. 그 결과, 열린 대화에서 놀라기 최소화(surprisal minimization)가 가장 강력하게 생산 선택을 예측하는 설명임을 입증했으며, 이는 자연어 언어 생산 과정에 대한 새로운 원리적 프레임워크를 제공한다.