Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
유방암 임상 워크플로우 전 과정을 지원하는 멀티모달 거대 언어 모델인 BreastGPT를 제안합니다. 5가지 영상 양식과 136개 작업 템플릿을 포함하는 BreastStage 코퍼스와 벤치마크를 통해 임상 추론 능력을 입증했습니다.
양방향 경사 최적화를 활용하여 LLM의 출력에 대한 학습 데이터의 기여도를 산정하는 새로운 방법론을 제안합니다. 경사 상승법과 하강법을 통해 모델을 섭동시켜 데이터의 사실적 및 스타일적 기여도를 측정하며, 기존 방식보다 뛰어난 해석 가능성을 제공합니다.
LLM의 확산으로 인해 크라우드소싱 데이터의 유효성이 위협받는 상황을 연구자 155명을 대상으로 조사했습니다. 응답자의 44%가 데이터 수집 과정에서 LLM 사용을 목격했으며, 현재의 탐지 전략과 대응책이 여전히 불충분함을 시사합니다.
Diffusion LLM의 효율성을 높이기 위해 의미적 경계를 기반으로 동적 블록을 생성하는 SemBlock 프레임워크를 제안합니다. 고정된 블록 대신 의미적 경계를 예측하여 디코딩 성능을 최적화하며, 다양한 벤치마크에서 기존 방식보다 우수한 성능을 입증했습니다.
LLM이 위험 결정 과업에서 인간과 유사한 결과를 내더라도, 실제 의사결정 메커니즘은 인간과 다를 수 있음을 St. Petersburg game 실험을 통해 증명했습니다. 연구 결과, 표면적인 행동 정렬이 내부적인 메커니즘 정렬을 보장하지 않으므로 고위험 평가 시 메커니즘 수준의 검토가 필요함을 강조합니다.
확산 기반 언어 모델(DLLM)의 높은 추론 비용 문제를 해결하기 위해 스캐폴드 인식 반복 디코딩(SAID) 프레임워크를 제안합니다. 스캐폴드 토큰에 계산량을 우선 할당하여 구조를 잡은 뒤 세부 토큰을 완성함으로써, 성능 저하 없이 추론 속도를 최대 9.1배 가속화합니다.
GARL은 다중 에이전트 시스템의 전략적 의사결정을 위해 게임 이론을 결합한 강화학습 프레임워크입니다. 에이전트 간의 자원 할당과 중재 과정을 2단계 게임으로 공식화하여 정책 최적화를 유도합니다. 법률 도메인 실험을 통해 소규모 오픈 소스 LLM이 폐쇄형 모델과 경쟁할 수 있음을 입증했습니다.
Transformer의 계층 간 정보 재사용 문제를 해결하기 위해 Attention 모듈 내부에서 이전 계층의 값을 혼합하는 Depth-Attention 기법을 제안합니다. 추가적인 파라미터나 추론 캐시 비용 없이도 모델의 정확도를 높이고 Perplexity를 낮추는 효과를 입증했습니다.
TaDA는 태스크와 도메인 LoRA 어댑터를 효율적으로 결합하는 새로운 훈련 불필요 알고리즘입니다. 레이어 깊이에 따른 비대칭성을 활용한 게이팅과 서브스페이스 인식 병합을 통해 추론 오버헤드 없이 높은 성능을 구현합니다.
파운데이션 모델 연구 시 비용 절감을 위해 사용하는 프록시 실험, 스케일링 법칙, 관찰 연구 등의 전략이 초래하는 타당성 위협을 분석합니다. 인과 추론 프레임워크를 통해 각 연구 전략이 가진 통계적, 내부, 외부, 구성 타당성의 한계를 규명합니다.
LLM의 단방향 CoT 추론에서 발생하는 오류 누적 문제를 해결하기 위해 양방향 논리 주입 프레임워크인 TRI를 제안합니다. 중간 채우기(FIM) 방식을 활용하여 오류 구간을 논리적으로 재구성함으로써 추론의 강건성을 높입니다.
이산 그래피컬 모델의 추론 성능과 확장성 문제를 해결하기 위해 자기회귀 Graph Transformer인 ICG-I를 제안합니다. Tensor-Train 압축과 가중 콘포멀 예측(WCP)을 결합하여 정확도와 수렴성을 동시에 확보했습니다.
LLM의 자기 일관성(Self-Consistency) 성능을 높이기 위해 답변 선택을 랭킹 문제로 재정의한 RISC 방법론을 제안합니다. LambdaRank 모델을 활용해 답변 빈도와 의미적 중심성 등 5가지 특징을 결합하여 최적의 답변을 도출합니다.
본 연구는 인컨텍스트 학습 과정에서 유도되는 함수 벡터(Function Vectors)의 설계 요소를 분석합니다. 어텐션 헤드 선택과 스티어링 방식이 LLM 제어 성능에 미치는 영향을 연구하며, 효율적인 그래디언트 기반 기여도 산출법을 제안합니다.
임상 에이전트의 역동적인 의사결정 능력을 평가하기 위해 표준화 환자(SP) 개념을 도입한 MedSP1000 벤치마크를 제안합니다. 연구 결과, 기존 정적 벤치마크 성능이 실제 임상 시나리오로 전이되지 않으며 현재 LLM의 의료 현장 적용에는 한계가 있음을 확인했습니다.
언어 모델이 경가동사와 완전동사의 용법 차이를 구분할 수 있는지 조사하기 위한 최소 쌍(Minimal-Pair) 데이터셋을 제안합니다. 실험을 통해 모델이 목적어 유형에 따라 두 용법을 구별하는 패턴을 보임을 입증했습니다.
Base LLM이 별도의 학습 없이도 외부 판사의 평가 점수를 예측할 수 있는 잠재적 능력이 있음을 발견했습니다. 연구팀은 이를 끌어내기 위한 '자기 평가 유도(SEE)' 기법을 제안하여, 최소한의 데이터로도 모델의 평가 예측 성능을 크게 향상시켰습니다.
본 논문은 트랜스포머의 MLP 활성화 값을 활용하여 인컨텍스트 러닝을 위한 샘플을 선택하는 능동 학습 방법론을 분석합니다. Llama-3.2-3B 및 Qwen2.5-3B 모델 실험 결과, 활성화 기반 샘플링이 예시 품질이나 성능과 상관관계가 낮음을 발견했습니다.
오디오-언어 모델(ALM)이 명확한 오디오 증거가 있음에도 충돌하는 텍스트를 따르는 '중재 역전 현상'을 분석했습니다. 연구 결과, 오디오 정보가 인코딩은 되지만 중재 과정에서 손실됨을 확인하였으며, 이를 해결하기 위한 새로운 디코딩 규칙인 GACL을 제안합니다.
LLM의 학습 데이터 귀속(TDA) 문제를 해결하기 위해 활성화 공간에서 데이터의 효과를 모델링하는 STRIDE 프레임워크를 제안합니다. 기존의 그래디언트 기반 방식보다 10배 빠르며, 압축 센싱을 활용해 개별 데이터의 영향력을 효율적으로 복구합니다.