Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
CPU 기반 CKKS 완전 동형 암호(FHE) 연산 시 발생하는 하드웨어 결함에 대응하기 위한 효율적인 결함 허용 체계를 제안합니다. 세 가지 수준의 최적화를 통해 오버헤드를 최소화하면서도 100%의 결함 탐지율을 달성했습니다.
격자 기반 양자 내성 암호(PQC)를 위한 새로운 NTT 가속기 PIP-NTT를 제안합니다. 메모리 병렬화 전략과 곱셈 없는 리스케일링 아키텍처를 통해 면적 효율성을 극대화했습니다. FPGA 실험 결과, 기존 가속기 대비 뛰어난 면적-시간 곱(ATP) 효율성을 입증했습니다.
LLM을 활용한 RTL 설계 생성 시 발생하는 이해 오류를 줄이기 위해 명세 정제 단계를 도입한 VeriRefine 연구를 소개합니다. 명세를 점진적으로 구체화하고 5단계 감사를 거쳐 Verilog 생성 전 오류를 수정함으로써 합성 가능한 설계를 보장합니다.
자원 제약 환경에서 CNN 추론 효율을 높이기 위한 FPGA 기반 가속기 SparHiXcel-v2를 제안합니다. 열 기반 커널 압축과 하드웨어-알고리즘 공동 설계 프레임워크를 통해 희소성 유연성과 하드웨어 효율성 사이의 균형을 최적화했습니다.
동형 암호(HE) 환경에서 신경망의 신뢰성을 보장하며 효율적으로 프루닝하는 PSAP 기법을 제안합니다. 가중치 크기와 다항식 민감도를 결합하여 결함 허용 영역에 프루닝을 집중함으로써, 성능 저하를 최소화하고 비트 오류에 대한 취약성을 크게 낮춥니다.
엣지 플랫폼에서 LLM 추론 효율을 높이기 위해 연산자 형태와 백엔드 전환 비용을 고려한 '전이 인지형 백엔드 디스패치' 기술을 제안합니다. NVIDIA Jetson 환경에서 실험한 결과, 기존 정적 정책 대비 지연 시간과 에너지 소비를 크게 개선했습니다.
컨테이너 및 VM 환경에서 공유 스토리지의 페이지 캐시(Page-Cache)를 통해 발생하는 사이드 채널 공격 취약성을 분석합니다. I/O 경로가 공유될 때 발생하는 타이밍 신호를 통해 격리 경계를 넘어 데이터 존재 여부를 파악할 수 있음을 입증했습니다.
LLM 기반 에이전트의 EDA 워크플로우 자동화 능력을 평가하기 위한 벤치마크인 FluxBench를 제안합니다. RTL 생성부터 GDS 도달까지의 엔드투엔드 과정을 분석하며, 에이전트 아키텍처와 비용 효율성(Token ROI)의 중요성을 입증합니다.
질량 분석(MS)의 개방형 수정 검색(OMS) 워크로드를 가속하기 위한 다양한 컴퓨팅 플랫폼 간의 성능 및 트레이드오프를 분석한 연구입니다. 이진 하이퍼디멘셔널 컴퓨팅(HDC)을 활용하여 차세대 메모리 및 스토리지 중심 아키텍처에서 높은 효율성을 달성했습니다.
광 OFDM 트랜시버의 FFT IP 코어를 위해 저정밀도 부동 소수점 형식을 적용하는 새로운 공동 설계 방법론을 제안합니다. 12nm FinFET 공정 실험 결과, 기존 고정 소수점 방식 대비 전력은 최대 19.8%, 면적은 12.0% 절감하면서도 우수한 성능을 입증했습니다.
SEAM-V는 RISC-V 벡터 확장을 위한 하이브리드 분리형 실행 아키텍처를 제안합니다. 태스크 수준의 분리와 실행 패킷(EP) 컨텍스트를 활용하여 벡터 명령어 공급 공백을 줄이고 처리량을 극대화합니다.
자원이 제한된 엣지 장치에서 효율적인 온디바이스 모델 적응을 위해 Hailo-8L 가속기를 활용한 이기종 적응 파이프라인을 제안합니다. 백본은 가속기에서 INT8로 실행하고 분류 헤드만 CPU에서 미세 조정하여 연산 효율과 에너지 절감을 동시에 달성했습니다.
CV-QKD의 고속 LDPC 디코딩을 위한 고정 소수점 산술 기반의 하드웨어 가속 프레임워크를 연구합니다. SPA, MSA, NMS 디코더의 성능을 수치 정밀도와 비교 분석하여 최적의 균형점을 제시합니다.
FPGA SoC 환경에서 CNN 가속기의 결함 허용을 위해 제안된 계층적 디지털 트윈 프레임워크인 EIR을 소개합니다. 프로세싱 시스템(PS)의 유휴 자원을 활용하여 하드웨어 중복 없이도 효율적인 결함 탐지와 정밀한 복구를 구현합니다.
ArchSim은 컴퓨터 구조 시뮬레이션 연구의 복잡성을 해결하기 위해 제안된 새로운 프레임워크입니다. 선언적 그래프와 상태가 없는 러너를 통해 시뮬레이션 과정을 자동화하고 구조화하여 연구의 재현성과 확장성을 높였습니다.
ViT의 추론 지연 시간을 줄이기 위해 하드웨어와 소프트웨어를 공동 설계한 N:M 희소 트랜스포머 프레임워크를 제안합니다. MD-SpMM CUDA 커널과 3단계 휴리스틱 탐색을 통해 정확도를 유지하면서도 2.2배 이상의 속도 향상을 달성했습니다.
3D IC 설계 초기 단계에서 열, 배선, 캐시 효과를 통합적으로 평가할 수 있는 CLIP-3D 프레임워크를 제안합니다. 기존 시뮬레이터의 한계를 극복하여 실제 구현 가능한 BIPS를 예측하고 최적의 3D 레이아웃을 탐색합니다.
HeteroMosaic은 엣지 SoC의 CPU, iGPU, NPU를 효율적으로 활용하기 위한 이기종 우선 스케줄링 프레임워크입니다. 마이크로 배치 분해와 트레이스 가이드 공동 최적화를 통해 LLM 추론 속도를 높이고 에너지 소비를 크게 절감합니다.
Diffusion Transformers(DiTs)의 추론 효율성을 높이기 위해 공간적·시간적 중복성을 줄이는 DSTAR 프레임워크를 제안합니다. 혼합 정밀도 양자화와 희소 어텐션 재사용을 결합한 소프트웨어-하드웨어 공동 설계 방식을 통해 성능 저하 없이 가속화를 달성했습니다.
하드웨어 및 메모리 결함으로 인한 DNN의 신뢰성 저하 문제를 해결하기 위해 CoG(무게 중심) 유도 가중치 교정 방법을 제안합니다. 재학습 없이 거리 인식 교정 규칙을 통해 결함을 탐지하고 복구하며, 다양한 네트워크 구조에서 높은 결함 허용 능력을 입증했습니다.