Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Loihi 2 뉴로모픽 하드웨어에서 합성 희소 코딩(Convolutional Sparse Coding)을 구현하기 위한 Locally Competitive Algorithm(LCA) 연구를 소개합니다. 기존 비합성 방식과 달리 공간적 구조와 가중치 공유를 포함하며, GPU 베이스라인과의 비교를 통해 뉴로모픽 시스템의 효율성을 검증합니다.
이 기술 기사는 대규모 언어 모델(LLM)의 사후 학습 양자화(Post-Training Quantization, PTQ)를 위한 하드웨어 인지적 방법론인 Scaled Outer Product (SOP)을 소개합니다. SOP는 레이어별 LUT 디코딩이 가능한 하드웨어에서 가중치당 4.5~6비트 수준의 손실 없는 충실도를 제공하도록 설계되었습니다. 이 방법론은 코드북 탐색, 블록별 부호화 스케일링, 활성화 가중 코사인 선택 등을 결합하며, 새로운 하드웨어 효율적 LUT 출력 형식(HIF)을 통해 성능과 에너지 효율성을 개선합니다.
Slot-MPC는 객체 중심 표현을 활용하여 목표 조건부 모델 예측 제어(Goal-Conditioned Model Predictive Control, MPC)를 가능하게 하는 새로운 프레임워크입니다. 이 방법은 슬롯 기반 표현을 학습하여 개별 객체를 인코딩하고, 이를 통해 행동 조건부 객체 중심 역학 모델을 구축합니다. Slot-MPC는 MPC를 사용하여 에이전트가 이전에 경험하지 못한 상황에서도 일반화된 행동 계획을 수행할 수 있게 하며, 특히 그래디언트 기반 MPC를 활용하여 계산 효율성을 높였습니다.
본 연구는 알츠하이머병(AD) 진단을 위한 새로운 경량 고성능 모델인 DeepTokenEEG를 제안합니다. 이 모델은 공간 및 시간 토크나이저를 활용하여 EEG 신호에서 AD 관련 바이오마커를 효과적으로 포착하며, 적은 파라미터 수(0.29백만 개)로도 높은 정확도를 달성했습니다. 결합 데이터셋에서 DeepTokenEEG는 특정 주파수 대역에서 최대 100%의 기록된 정확도를 보여, 기존 최신 기술 대비 성능 향상을 입증하며 AD 조기 탐지 및 선별에 큰 잠재력을 가집니다.
SpeakerLLM은 오디오 우선 에이전트 환경에서 필수적인 화자 특화 이해를 통합하기 위해 설계된 새로운 audio-LLM 프레임워크입니다. 이 모델은 누가 말하고 있는지, 목소리가 어떻게 들리는지, 녹음 조건의 영향을 포착하는 것을 목표로 합니다. 기존 시스템들이 제공하지 못했던 언어적 근거와 구조화된 추론 과정을 통합하여, 단일 발화 화자 프로파일링, 녹음 조건 이해, 그리고 증거 기반 검증 추론을 수행할 수 있습니다. SpeakerLLM은 계층적 화자 토크나이저를 사용하여 다양한 세밀도의 화자 정보를 포착하며, 구조화된 추적을 통해 최종 결정의 근거를 명확히 제시합니다.
본 연구는 딥러닝 모델의 효율성을 높이기 위해 동적 배치 민감도를 활용한 새로운 옵티마이저인 Dynamic Batch-Sensitive Adam (DBS-Adam)을 제안합니다. DBS-Adam은 그래디언트 노름과 배치 손실의 지수 이동 평균에서 도출된 '배치 난이도 점수'를 사용하여 학습률을 동적으로 조절하며, 어려운 배치에는 더 많은 업데이트를, 쉬운 배치에는 적은 업데이트를 적용하여 학습 안정성과 수렴 속도를 향상시킵니다. 이 옵티마이저는 차량 사고 부상 심각도 예측 태스크에 Bi-LSTM과 결합되어 기존 최신 옵티마이저들 대비 통계적으로 유의미한 성능 개선을 입증했습니다.
본 논문은 하드웨어 회로 자동 구축의 어려운 과제인 Reactive synthesis에 대한 새로운 접근 방식을 제시합니다. 알고리즘적으로는 대규모 추론 모델을 모델 체커와 결합한 신경-심볼릭(neuro-symbolic) 방법을 통해 Verilog 구현을 반복 수정하며, 결정 불가능한 매개변수화된 시스템까지 확장 가능함을 보여줍니다. 또한, 명세 작성의 어려움을 해결하기 위해 자연어 명세를 형식화하는 자동 형식화(autoformalization) 단계를 도입하여, 이를 엔드 투 엔드 워크플로우로 완성했습니다.
Vision-Language-Action (VLA) 모델은 복잡하고 장기적인 환경에서 오류가 누적되기 쉬워 숙련된 조작에 어려움을 겪습니다. 대화형 모방 학습(IIL)을 통해 인간의 개입 데이터를 활용하여 정책 개선이 가능하지만, 고자유도 로봇 손에 적용할 경우 개입 시점의 원격 조작과 정책 실행 간 명령 불일치 문제가 발생합니다.
본 논문은 양자 컴퓨팅 파이프라인의 핵심 단계인 큐비트 매핑 문제를 해결하기 위한 새로운 접근 방식을 제시합니다. 기존 방식들이 무작위 할당이나 휴리스틱에 의존하여 SWAP 게이트 오버헤드를 최소화하는 데 한계가 있었으나, 본 연구는 이 문제를 조합 최적화(CO) 문제로 정식화하고 강화학습(RL) 정책을 학습하여 해결책을 찾습니다. 그 결과, 기존 양자 컴파일러 대비 SWAP 오버헤드를 65-85%까지 감소시키는 극적인 개선 효과를 입증했습니다.
본 논문은 MedSAM과 같은 의료 세그멘테이션 모델을 위한 구조적 프루닝 프레임워크인 MedCore를 제안합니다. MedCore는 SAM에서 MedSAM으로의 적응 과정에서 중요해진 구조와 높은 경계 레버리지를 가진 구조 두 가지를 보존하는 것이 핵심입니다. 이 방법론은 '경계 레버리지 원리'를 도입하여 압축이 경계 지표에 미치는 영향을 분석하고, 용종 세그멘테이션 벤치마크에서 파라미터와 FLOPs를 대폭 줄이면서도 높은 Dice 및 Boundary F1 점수를 유지함을 입증했습니다.
본 기사는 스트리밍 워크로드에서 발생하는 과도한 프리필 비용 문제를 해결하기 위해 상태 유지 세션(stateful sessions) 기반의 데이터 중심 계산 모델을 제안합니다. 이 모델은 지속적으로 업데이트되는 KV 캐시를 활용하여, 쿼리 지연 시간을 누적 컨텍스트 크기와 무관하게 O(|q|)로 낮춥니다. 또한, Flash Queries와 같은 기능을 통해 유휴 GPU 사이클을 활용하고, 개선된 연속 배치 스케줄러를 통해 여러 상태 유지 세션이 단일 GPU에서 효율적으로 공존할 수 있음을 입증했습니다.
본 연구는 기존의 순차적이라는 인식 때문에 확장성이 떨어진다고 여겨졌던 순환 신경망 양자 상태(RNN quantum states)에 대한 관점을 재검토한다. 병렬화 가능한 순환 구조와 자기회귀 파동 함수를 결합하여, 1D 및 2D 공간에서 변분 Monte Carlo 내에서 효율적으로 학습할 수 있는 '병렬 스캔 순환 신경 양자 상태(PSR-NQS)'라는 새로운 변분 안사츠를 개발했다. 이 접근 방식은 대규모 스핀 격자에 대한 정확한 시뮬레이션 능력을 입증하며, 순환 아키텍처가 확장 가능한 신경 양자 상태 시뮬레이션을 위한 실용적인 경로임을 제시한다.
본 논문은 대규모 언어 모델(LLM) 양자화의 새로운 접근 방식인 '다중 그리드'를 제안합니다. 이는 기존의 고정된 부동 소수점 그리드를 가정하는 대신, 각 값 그룹에 대해 여러 4비트 그리드 중 최적의 것을 선택할 수 있도록 확장한 개념입니다. 연구 결과, 이 다중 그리드 접근 방식은 특히 가중치와 활성화 값 모두를 처리할 때 단일 그리드 FP4 대비 정확도를 지속적으로 향상시키는 것으로 나타났습니다.
본 연구는 생성 모델 추론 가속화를 위한 표준 기술인 양자화(Quantization)의 한계를 극복하고자 합니다. 기존 BFP 스케일 선택 방식이 최적화되지 않을 수 있다는 문제점을 지적하며, 주어진 분포에서 양자화 오차를 최소화하는 새로운 전략인 ScaleSearch를 제안합니다. ScaleSearch는 미세 조정 검색을 통해 가수부 비트(mantissa bits)를 활용하여 스케일을 결정하고, 이를 기존 PTQ 및 저정밀도 어텐션 방법론에 통합함으로써 성능 향상을 입증했습니다.
본 논문은 고도로 다중 모드 액션 분포를 가진 복잡한 제어 문제에 사용되는 생성적 정책의 높은 표현력과 그로 인한 추론 비용 문제를 해결하기 위해 '흐름 맵 정책(flow map policies)'이라는 새로운 클래스의 생성적 정책을 제안합니다. 이 정책은 기존 생성 역학을 가로지르는 임의 크기의 점프를 학습하여 빠른 액션 생성을 목표로 합니다. 실험 결과, 흐름 맵 정책(FMQ)은 로봇 조작 및 이동 작업에서 이전의 단일 단계 정책보다 평균 성공률이 21.3% 향상되는 등 최고 성능을 달성했습니다.
본 기술 기사는 오픈 웨이트 언어 모델의 높은 품질과 개방성을 언급하며, 이를 활용한 연구 및 배포의 용이성을 설명합니다. 핵심적으로는 'Deep Low-Rank Residual Distillation'이라는 방어 기법을 소개하여, 이 방법이 완전한 지식을 가진 적응형 공격자(adaptive attackers)에 대한 방어 능력을 입증하는 동시에 원래 모델의 기능을 유지할 수 있음을 주장하고 있습니다.
본 논문은 CNN 훈련에서 레이어별로 다른 정규화 강도가 필요하다는 점에 착안하여, 과적합-과소적합 지표(OUI)를 활용한 적응형 가중치 감쇠 스케줄러인 OUIDecay를 제안합니다. OUIDecay는 각 레이어의 활성화 패턴을 온라인으로 모니터링하고, 이 정보를 기반으로 네트워크 내 다른 레이어들과 상대적으로 가중치 감쇠를 주기적으로 재조정합니다. 이는 검증 데이터 없이도 구조적 동작에 기반한 효과적인 적응형 정규화 방법이며, 다양한 CNN 아키텍처에서 기존 방식 대비 우수한 성능을 입증했습니다.
본 논문은 기존 신호등 제어 시스템의 비효율성 문제를 해결하기 위해 심층 강화학습(DRL) 기반의 새로운 에이전트를 제안합니다. 이 에이전트는 차량과 보행자 교통 모두를 고려하여 공정성을 명시적으로 통합함으로써, 실시간 수요 변화에 따라 흐름을 동적으로 균형 있게 조정할 수 있습니다. 실험 결과는 이 시스템이 교통 혼잡을 효과적으로 줄이는 동시에 모든 도로 이용자에게 공평한 서비스를 제공함을 입증하며, 스마트 시티의 지능형 교통 관리에 기여합니다.
본 기사는 우크라이나어 다중 도메인 문서 이해를 목표로 하는 UNLP 공유 과제에 참여하여 개발된 검색 증강 생성(RAG) 파이프라인을 소개합니다. 이 시스템은 컨텍스트 청킹, 질문 인식 밀집 검색, 그리고 질문과 답변 옵션을 모두 고려하는 재순위 지정 단계를 포함합니다. 특히, Qwen3-Embedding-8B와 미세 조정된 Qwen3-Reranker-8B를 사용하여 검색 및 순위를 개선하고, 이를 통해 높은 답변 정확도(최대 0.9674)와 리더보드 점수(비공개 0.9598)를 달성했습니다.
MASS-DPO는 Plackett--Luce (PL) 모델 하의 다중 부정적 선호도 최적화를 위한 새로운 방법론입니다. 이 방법은 대규모 부정 풀에서 중복적인 기울기 계산 문제를 해결하기 위해, PL 특이적 피셔 정보량 목적 함수를 사용하여 간결하고 정보가 풍부한 부정 부분 집합을 능동으로 선택합니다. 그 결과, 정책 업데이트에 상호 보완적인 정보를 제공하는 최적의 샘플들을 선별하여, 기존 방법들보다 효율적이면서도 강력한 모델 정렬(alignment) 성능을 달성합니다.