Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
VR 헤드셋의 전력 소비를 줄이기 위해 시야(FoV) 외 영역의 비트를 절단하는 SPORT 프레임워크를 제안합니다. WS-PSNR 최적화를 통해 화질 저하를 최소화하면서 메모리 전력과 대역폭을 최대 51.6%까지 절감할 수 있음을 입증했습니다.
클라우드 GPU 환경에서 특권 권한 없이도 물리적 가속기의 신원, 하드웨어 토폴로지 및 위치를 검증할 수 있는 소프트웨어 기반 인증서 기술을 제안합니다. CUDA 프로브와 지연 시간 측정을 통해 Blackwell 등 최신 GPU의 물리적 지문을 정확히 식별합니다.
SafeGen은 자동차 칩 설계의 기능 안전을 위해 LLM과 하이퍼 지식 그래프(HyperKG)를 결합한 새로운 프레임워크입니다. 설계 문서와 RTL 정보를 활용해 검증 가능한 어설션을 생성하고, 결함의 중요도를 의미론적으로 평가합니다.
FPGA 네트워크를 활용하여 100만 개의 p-bits를 갖춘 대규모 프로그래밍 가능한 확률적 컴퓨터를 구현했습니다. 단일 칩의 용량 한계를 극복하고 초당 1조 번 이상의 Gibbs 샘플링 속도를 달성하며, 분산 시스템의 성능을 결정하는 설계 규칙을 제시합니다.
GB-scale Last-Level Cache(LLC)를 활용하여 LLM 추론 성능을 극대화하는 새로운 캐시 상주 실행 모델을 제안합니다. 가중치 중심 연산자와 KV-캐시 관리를 분리하여 파이프라인 깊이와 관계없이 효율적인 추론이 가능하도록 설계되었습니다.
물리적 제약 조건을 고려하지 못하는 기존 에이전트의 한계를 극복하기 위해, 하드웨어 준수 컴퓨팅 시스템을 자율 설계하는 멀티 에이전트 엔진을 제안합니다. 진화적 지식 그래프와 알고리즘적 사고의 사슬을 활용하여 하드웨어-소프트웨어 공동 설계의 새로운 패러다임을 제시합니다.
FPGA 상에서 MSDF Digit-Serial 산술 연산을 활용하여 U-Net 아키텍처를 에너지 효율적으로 가속하는 MMA(Merged Multiply-Add) 구조를 제안합니다. 통합 파이프라인 설계를 통해 연산 지연을 줄이고 처리량을 높여, 기존 CPU 대비 최대 10배 높은 에너지 효율을 달성했습니다.
Croc는 RISC-V 플랫폼을 기반으로 한 엔드투엔드 오픈 소스 SoC 설계 및 제작 흐름을 제공합니다. 폐쇄형 EDA 도구 대신 오픈 소스 IP와 PDK를 활용하여 도메인 특화 칩 설계 교육을 가능하게 합니다.
숙련된 로봇 손을 위해 방향성 강성을 조절할 수 있는 파라메트릭 이중 나선(PDS) 순응형 관절을 제안합니다. 나선형 템플릿과 비대칭 비율을 통해 강성을 맞춤화하며, 내장형 유도성 고유 수용 감각을 통해 정밀한 상태 추정이 가능합니다.
Kolmogorov-Arnold 네트워크(KAN)에서 영감을 받아, 아날로그 소자의 비선형성을 활용한 저전력 물리적 신경망 구조를 제안합니다. 이 방식은 연속 제어 및 로봇 운동학 분야에서 기존 MLP보다 적은 노드로 효율적인 계산이 가능하며, CMOS 구현 시 약 30μW의 초저전력 동작을 목표로 합니다.
SNN의 불규칙한 희소성을 활용하여 에너지 효율을 극대화하는 범용 풀-이벤트 뉴로모픽 아키텍처 ExSpike를 제안합니다. 이벤트 기반 데이터플로우 최적화와 이벤트 압축 기술을 통해 기존 FPGA 기반 가속기 대비 높은 에너지 효율을 달성했습니다.
우주 잔류 물체(RSO) 탐지를 위해 FPGA 가속을 활용한 뉴로모픽 비전 시스템을 제안합니다. 이벤트 기반 카메라와 분산 처리 아키텍처를 결합하여 저전력 및 초저지연 성능을 구현했습니다.
메모리 중심 컴퓨팅(Processing-in-DRAM) 패러다임 전환에 따른 보안적 이점과 과제를 분석합니다. DRAM 기반의 진난수 생성기 및 PUF 기술을 통한 보안 강화 가능성과 함께, 읽기 방해 및 메모리 타이밍 채널과 같은 새로운 공격 표면 문제를 다룹니다.
A3C3는 AI 알고리즘과 가속기를 개별적으로 설계하던 기존 방식에서 벗어나, 신경망 구조와 하드웨어 구현을 동시에 최적화하는 통합 방법론입니다. 이를 통해 정확도, 지연 시간, 에너지 효율성 간의 균형을 맞춘 최적의 모델-가속기 쌍을 자동으로 생성할 수 있습니다.
COMPOSE는 재귀 제한 루프 가속을 위해 정적 타이밍 정보를 활용하여 PE(Processing Element)를 동적으로 형성하는 결합 가능한 CGRA 아키텍처입니다. 루프 간 연산을 공간적으로 융합하고 타이밍 슬랙을 활용하여 처리량을 높이고 데이터 이동 오버헤드를 줄입니다.
LLM을 이용한 RTL Assertion 생성 시 발생하는 품질 문제, 증명 비용 가변성, 실패 트레이스 해석의 어려움을 해결하기 위한 경량 오픈 소스 프레임워크를 제안합니다. 변이 유도 정제, 솔버 선택, 인과적 서사 합성을 결합하여 생성된 속성의 신뢰도를 높이는 품질 인지형 폐쇄 루프를 구현했습니다.
첨단 공정 노드에서 아날로그 및 혼성 신호(AMS) 레이아웃 자동화를 위한 양자화된 행 높이 기반 합성 방법론을 제안합니다. 이 방법론은 회로 요구 사항에 맞춰 행 높이를 최적화하여 설계 격차를 줄이고 면적 효율성을 높입니다.
기존 트랜지스터의 에너지 스케일링 한계를 극복하기 위해 새로운 3단자 로직 소자인 고체 상태 트랜스커패시터(TCAP)를 제안합니다. TCAP는 소산성 수송 전류 대신 변위 전류를 사용하여 CMOS의 전압 및 전류 변조 한계를 극복하고 에너지 소비를 100배 낮출 수 있는 경로를 제시합니다.
NVIDIA L40 GPU의 L2 캐시 지연 시간이 SM(Streaming Multiprocessor) 위치에 따라 비균일하게 나타난다는 연구 결과입니다. 이를 통해 장치의 물리적 정체성을 식별하는 지문 인식(fingerprinting)이 가능하며, 지연 시간 기반 작업 분산 시 성능을 최대 11% 향상할 수 있습니다.
반도체 산업이 2.5D 칩렛 생태계로 전환됨에 따라 발생하는 하드웨어 보안 위협과 대응 전략을 다룹니다. 인터포저 기반 통합 환경에서 발생하는 상호 연결 공격 및 캐시 일관성 악용 문제를 해결하기 위한 능동형 인터포저 기반의 보안 방어책을 제안합니다.