Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
기업용 AI 에이전트 평가 시 발생하는 정적 스냅샷의 한계를 극복하기 위한 새로운 평가 시스템을 제안합니다. 실제 연구 데이터를 기반으로 시간 흐름에 따라 변화하는 기업 환경을 생성하고, 특정 시점의 데이터를 재현하여 에이전트의 성능을 정밀하게 검증합니다.
InferScale은 개인화된 컨텍스트를 위해 반복되는 프리필 과정을 생략하고, 사전 계산된 KV 상태를 vLLM의 페이지 캐시에 직접 주입하는 GPU 네이티브 메모리 시스템입니다. 이를 통해 검색되는 메모리 양이 늘어나도 첫 번째 토큰 생성 시간(TTFT)을 낮게 유지하며 높은 처리량을 제공합니다.
NASA의 방대한 지구과학 데이터셋을 효율적으로 탐색하기 위해 에이전트 기반 검색 시스템을 도입했습니다. LLM과 지식 그래프를 결합하여 자연어 질의에 최적화된 데이터셋을 찾아내며, 기존 검색 방식보다 뛰어난 성능을 입증했습니다.
Object Aligner(OA)는 LLM의 JSON 출력과 정답 간의 유사도를 결정론적으로 측정하는 오픈 소스 Python 라이브러리입니다. 그래프 구조를 지원하는 참조 정렬 기술을 통해 복잡한 데이터 구조에서도 정확한 점수 산출과 수정 제안이 가능합니다.
워크플로 언어와 AI 어시스턴트를 결합하여 시각적 분석(VA) 프로토타입 제작 시간을 수개월에서 단 하루로 단축하는 방법을 제시합니다. ATWL 스캐폴딩과 전문가 지식 주입의 중요성을 강조하며 효율적인 AI 협업 워크플로를 설명합니다.
지식 그래프 기반 Graph RAG의 멀티홉 검색 성능을 높이기 위해 쿼리 인식 확산 활성화(Spreading Activation) 방식을 제안합니다. 단일 Cypher 쿼리로 Neo4j 내에서 검색을 완결하여 데이터베이스 통합 문제를 해결하고 검색 지연 시간을 대폭 단축했습니다.
결함 탐지 결과를 제약 조건 인식 회복 동작으로 변환하는 LLM 에이전트 기반의 결함 허용 제어(FTC) 프레임워크를 제안합니다. 멀티 에이전트 워크플로우, 디지털 트윈, Graph RAG를 결합하여 복잡한 플랜트 환경에서 안전하고 검증된 제어 명령을 생성합니다.
선형 모델 진단을 위한 잔차 도표 평가를 자동화하는 R 패키지 autovi와 Shiny 앱을 소개합니다. 컴퓨터 비전 모델을 활용해 시각적 신호 강도를 예측함으로써 분석가의 주관성을 줄이고 효율성을 높입니다.
FLKit은 보건 및 생명 과학 분야의 연합 학습(Federated Learning) 프로젝트를 위한 구조화된 온보딩 툴킷입니다. 다학제적 팀이 거버넌스, 인프라, 데이터 정제, 분석의 생애주기를 효율적으로 관리할 수 있도록 역할별 진입점과 템플릿을 제공합니다.
자율 비상 제동(AEB) 시스템의 지연 및 오탐 이벤트를 효율적으로 식별하기 위한 자동화된 주석 프레임워크를 제안합니다. 클래스 불균형과 비대칭 레이블 노이즈 문제를 해결하기 위해 특화된 데이터 증강과 노이즈 억제 기술을 적용했습니다.
UMAR는 MD&A, 재무 비율, CAM 에이전트를 활용하여 감사 위험을 평가하는 멀티 에이전트 프레임워크입니다. Dempster-Shafer 이론을 통해 에이전트 간 증거 충돌과 불확실성을 정량화하여 기존 모델보다 높은 예측 성능과 해석력을 제공합니다.
소비자용 Ampere GPU에서 Diffusion Transformer의 INT8 연산 속도를 최적화하기 위해 Fused Triton INT8 GEMM 커널을 구현했습니다. 기존의 역양자화 방식 대신 텐서 코어를 직접 활용하여 FP8 및 NF4보다 빠른 성능을 달성했습니다.
클라우드-에지 컨티뉴엄 환경에서 발생하는 시계열 예측의 콜드 스타트 문제를 해결하기 위한 자동화된 아키텍처를 제안합니다. 공개 데이터셋인 TimeTrack과 로컬 데이터를 혼합하고 NAS 엔진을 활용하여 정확도 높은 베이스라인 모델을 자동으로 생성합니다.
AI와 파운데이션 모델의 도입으로 변화된 HPC 워크플로 설계 방식을 다룹니다. 반복적이고 확률적인 AI 워크플로의 특성을 고려하여 효율적이고 확장 가능한 시스템을 구축하기 위한 12가지 실질적인 팁을 제공합니다.
보험 계리 분야의 사망률 예측을 위해 LLM을 활용한 신뢰할 수 있는 인터페이스 설계 방안을 제안합니다. LLM을 결정론적 예측 파이프라인을 위한 오케스트레이션 계층으로 사용하여 자연어 입력을 구조화된 설정으로 변환합니다.
Tangram은 비균일 KV 캐시 압축을 활용하여 멀티턴 LLM 서빙의 효율성을 극대화하는 새로운 시스템입니다. 결정론적 예산 할당, 헤드 그룹 페이지, AOT 부하 분산 기술을 통해 메모리 파편화와 스케줄링 오버헤드를 해결합니다. 실험 결과 모델 정확도를 유지하면서 처리량을 최대 2.6배 향상시켰습니다.
단일 검색기에 의존하는 기존 RAG의 한계를 극복하기 위해, 다양한 쿼리 분포에 맞춰 최적의 검색기 하위 집합을 자동으로 선택하는 'Retriever Portfolios' 방식을 제안합니다. 이 방식은 기존 방식보다 높은 답변 품질을 제공하면서도 병렬 처리를 통해 지연 시간과 비용을 효과적으로 절감합니다.
Sparse Autoencoder(SAE)를 활용하여 LLM 사후 학습 데이터의 다양성, 난이도, 품질을 모델 내부 신호로 모델링하는 SAERL 프레임워크를 제안합니다. 이 방식은 데이터 필터링과 커리큘럼 학습을 최적화하여 강화학습 효율을 높입니다.
Frontier는 현대적인 LLM 서빙 시스템의 복잡한 구조를 모델링하기 위해 설계된 이산 이벤트 시뮬레이터입니다. 기존 시뮬레이터가 해결하지 못한 Prefill-Decode 분리(PDD) 및 Attention-FFN 분리(AFD)와 같은 최신 아키텍처를 정확하게 반영하며, 실제 GPU 환경과 매우 유사한 성능 예측을 제공합니다.
LLM 에이전트의 실패 원인을 수동으로 분석하는 한계를 극복하기 위해, 코퍼스 수준에서 체계적인 행동 패턴을 진단하는 멀티 에이전트 시스템인 Insights Generator(IG)를 제안합니다. IG는 스카우트-조사관(scout-investigator) 아키텍처를 통해 트레이스 전반의 가설을 제안하고 테스트하여 근거 있는 자연어 통찰 보고서를 생성합니다. 실험 결과, IG의 보고서를 활용한 전문가는 스캐폴드 성능을 30.4pp 향상시켰으며 코딩 에이전트의 성능 또한 일관되게 개선되었습니다.