Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Mammal은 보호자가 착용하는 컴퓨팅 의류를 통해 영아의 수유 상태를 모니터링하는 연구입니다. 신체 간 신호 전달 기술을 활용하여 영아에게 센서를 부착하지 않고도 심박수, 젖물림 지속 시간, 우유 섭취량 등을 정밀하게 추정합니다.
RISC-V의 Zfh 및 Zvfh 확장을 활용하여 자원이 제한된 싱글 코어에서 float16 기반 온디바이스 학습을 구현하는 프레임워크를 제안합니다. float32 대비 메모리 사용량을 50% 절감하면서도 모델 성능 저하를 최소화하는 하드웨어-소프트웨어 공동 설계 방식을 다룹니다.
비볼록 및 볼록 최적화를 결합한 새로운 다단계 칩 플로어플래닝 프레임워크를 제안합니다. 이차 배치, Adam 기반 투영 경사법, 로그 변환 모델을 순차적으로 적용하여 와이어 길이와 모듈 중첩을 효과적으로 최소화합니다.
디지털 파형 데이터에 대한 LLM의 시계열 추론 능력을 평가하기 위한 오픈 소스 벤치마크인 WaveformQA를 제안합니다. 다중 신호 상관관계와 이벤트 순서 등 8개 카테고리의 질문을 통해 모델의 한계를 분석합니다.
엣지 컴퓨팅 환경에서 지속 학습(Continual Learning)을 가속화하기 위한 새로운 IMC 시스템인 CLASP를 제안합니다. BEOL 호환 ECRAM 장치를 활용하여 데이터 이동 문제를 해결하고, 기존 GPU 학습 대비 67배 빠른 속도와 132배의 에너지 절감을 달성했습니다.
Apple M5의 전용 Neural Accelerator를 활용하여 LLM 추론 성능을 극대화하는 Metal 기반 런타임 BaseRT를 소개합니다. BaseRT는 Metal 4 텐서 API를 통해 행렬 연산을 가속하며, llama.cpp 및 MLX 대비 압도적인 프롬프트 처리량을 제공합니다.
DNN 추론 시 비트 위치별 결함 민감도를 분석하여, 중요도가 낮은 비트는 보호하지 않고 상위 비트만 선택적으로 보호하는 불균등 오류 보호(UEP) 기법을 제안합니다. 이를 통해 ECC 면적을 줄이고 에너지 효율을 높이면서도 모델의 성능을 유지할 수 있음을 입증했습니다.
AlphaRoute는 VLSI 글로벌 라우팅의 복잡한 조합 최적화 문제를 해결하기 위해 LLM을 의미론적 정책 최적화 도구로 활용하는 새로운 프레임워크입니다. SHAP 기반 오버플로 분해와 동적 페널티 조정을 통해 기존 방식보다 월등한 성능을 보여줍니다.
PolySim은 CiM(Compute-in-Memory) 하드웨어에서 확률적 임베딩을 효율적으로 처리하기 위한 결정론적 다항식 대리 모델 프레임워크입니다. 몬테카를로 샘플링 대신 저차 다항식 기저를 사용하여 확률적 정보를 보존하면서도 단일 행렬-벡터 곱셈으로 추론이 가능하게 합니다.
칩렛 기반 AI SoC의 신뢰성을 높이기 위해 기존 KGD 선별 방식을 넘어선 KGRD(Known Good Reliable Die) 선별 방법론을 제안합니다. 베이지안 확률 모델과 제약된 추론을 통해 조립 전 데이터를 바탕으로 조립 후의 고장 가능성을 예측하고 보증하는 연구입니다.
GPU 메모리 계층의 NUMA 아키텍처를 분석하기 위한 새로운 방법론인 DGNA를 제안합니다. NVIDIA A100 및 H100 GPU를 대상으로 마이크로벤치마킹과 가우시안 혼합 모델을 활용해 L2 캐시 및 DRAM의 지연 시간과 메모리 할당 전략을 규명했습니다.
본 논문은 순차적 프로그래밍 모델을 유지하면서도 세밀한 파이프라인 제어가 가능한 새로운 HLS 도구를 제안합니다. 가시성 제어(Visibility Control) 기술을 통해 스톨링, 바이패싱 등 해저드 해결 전략을 통합하여 RTL 수준의 성능을 달성합니다.
CPU 기반 CKKS 완전 동형 암호(FHE) 연산 시 발생하는 하드웨어 결함에 대응하기 위한 효율적인 결함 허용 체계를 제안합니다. 세 가지 수준의 최적화를 통해 오버헤드를 최소화하면서도 100%의 결함 탐지율을 달성했습니다.
유연 소자(FE) 내 혼성 신호 회로 테스트를 위한 분산 지연 기반 BIST 프레임워크를 제안합니다. IGZO-TFT 기반의 링 발진기와 VCO를 활용하여 기존 설계 대비 면적과 전력을 획기적으로 줄였습니다.
격자 기반 양자 내성 암호(PQC)를 위한 새로운 NTT 가속기 PIP-NTT를 제안합니다. 메모리 병렬화 전략과 곱셈 없는 리스케일링 아키텍처를 통해 면적 효율성을 극대화했습니다. FPGA 실험 결과, 기존 가속기 대비 뛰어난 면적-시간 곱(ATP) 효율성을 입증했습니다.
LLM을 활용한 RTL 설계 생성 시 발생하는 이해 오류를 줄이기 위해 명세 정제 단계를 도입한 VeriRefine 연구를 소개합니다. 명세를 점진적으로 구체화하고 5단계 감사를 거쳐 Verilog 생성 전 오류를 수정함으로써 합성 가능한 설계를 보장합니다.
자원 제약 환경에서 CNN 추론 효율을 높이기 위한 FPGA 기반 가속기 SparHiXcel-v2를 제안합니다. 열 기반 커널 압축과 하드웨어-알고리즘 공동 설계 프레임워크를 통해 희소성 유연성과 하드웨어 효율성 사이의 균형을 최적화했습니다.
동형 암호(HE) 환경에서 신경망의 신뢰성을 보장하며 효율적으로 프루닝하는 PSAP 기법을 제안합니다. 가중치 크기와 다항식 민감도를 결합하여 결함 허용 영역에 프루닝을 집중함으로써, 성능 저하를 최소화하고 비트 오류에 대한 취약성을 크게 낮춥니다.
엣지 플랫폼에서 LLM 추론 효율을 높이기 위해 연산자 형태와 백엔드 전환 비용을 고려한 '전이 인지형 백엔드 디스패치' 기술을 제안합니다. NVIDIA Jetson 환경에서 실험한 결과, 기존 정적 정책 대비 지연 시간과 에너지 소비를 크게 개선했습니다.
컨테이너 및 VM 환경에서 공유 스토리지의 페이지 캐시(Page-Cache)를 통해 발생하는 사이드 채널 공격 취약성을 분석합니다. I/O 경로가 공유될 때 발생하는 타이밍 신호를 통해 격리 경계를 넘어 데이터 존재 여부를 파악할 수 있음을 입증했습니다.