Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
기밀 가상 머신(CVM) 환경에서 발생하는 데이터베이스 쿼리 성능 저하 문제를 해결하기 위해 CVM 인지 비용 보정 방식을 제안합니다. 기존 옵티마이저의 비용 모델이 비암호화 VM에 맞춰져 있는 문제를 물리적 프록시를 통한 모델링으로 해결하여 성능을 최대 48% 개선했습니다.
Apple M4 Pro 칩셋에서 GPU 작업 종료 후 남겨지는 잔류 캐시 상태를 분석한 연구입니다. GPU 커널 실행 후 CPU 성능에 미치는 캐시 변위 현상을 규명하고, 이를 완화할 수 있는 소프트웨어 복구 메커니즘을 제안합니다.
CHIA는 에이전트 기반 AI를 활용하여 하드웨어와 소프트웨어를 공동 설계할 수 있는 오픈 소스 프레임워크입니다. 복잡한 설계 워크플로우를 유향 순환 그래프 형태인 'CHIA 루프'로 구조화하여 대규모 시스템 설계 연구를 지원합니다.
본 논문은 에지 컴퓨팅 환경에서 CGRA의 설계 요소인 프로세싱 엘리먼트의 이질성과 Scratchpad Memory(SPM)가 연산 성능에 미치는 영향을 분석합니다. FFT, GEMM 및 트랜스포머 워크로드를 통해 데이터 이동 최적화와 에너지 효율성 간의 트레이드오프를 평가합니다.
VR 헤드셋의 전력 소비를 줄이기 위해 시야(FoV) 외 영역의 비트를 절단하는 SPORT 프레임워크를 제안합니다. WS-PSNR 최적화를 통해 화질 저하를 최소화하면서 메모리 전력과 대역폭을 최대 51.6%까지 절감할 수 있음을 입증했습니다.
클라우드 GPU 환경에서 특권 권한 없이도 물리적 가속기의 신원, 하드웨어 토폴로지 및 위치를 검증할 수 있는 소프트웨어 기반 인증서 기술을 제안합니다. CUDA 프로브와 지연 시간 측정을 통해 Blackwell 등 최신 GPU의 물리적 지문을 정확히 식별합니다.
SafeGen은 자동차 칩 설계의 기능 안전을 위해 LLM과 하이퍼 지식 그래프(HyperKG)를 결합한 새로운 프레임워크입니다. 설계 문서와 RTL 정보를 활용해 검증 가능한 어설션을 생성하고, 결함의 중요도를 의미론적으로 평가합니다.
GB-scale Last-Level Cache(LLC)를 활용하여 LLM 추론 성능을 극대화하는 새로운 캐시 상주 실행 모델을 제안합니다. 가중치 중심 연산자와 KV-캐시 관리를 분리하여 파이프라인 깊이와 관계없이 효율적인 추론이 가능하도록 설계되었습니다.
물리적 제약 조건을 고려하지 못하는 기존 에이전트의 한계를 극복하기 위해, 하드웨어 준수 컴퓨팅 시스템을 자율 설계하는 멀티 에이전트 엔진을 제안합니다. 진화적 지식 그래프와 알고리즘적 사고의 사슬을 활용하여 하드웨어-소프트웨어 공동 설계의 새로운 패러다임을 제시합니다.
숙련된 로봇 손을 위해 방향성 강성을 조절할 수 있는 파라메트릭 이중 나선(PDS) 순응형 관절을 제안합니다. 나선형 템플릿과 비대칭 비율을 통해 강성을 맞춤화하며, 내장형 유도성 고유 수용 감각을 통해 정밀한 상태 추정이 가능합니다.
SNN의 불규칙한 희소성을 활용하여 에너지 효율을 극대화하는 범용 풀-이벤트 뉴로모픽 아키텍처 ExSpike를 제안합니다. 이벤트 기반 데이터플로우 최적화와 이벤트 압축 기술을 통해 기존 FPGA 기반 가속기 대비 높은 에너지 효율을 달성했습니다.
LLM을 이용한 RTL Assertion 생성 시 발생하는 품질 문제, 증명 비용 가변성, 실패 트레이스 해석의 어려움을 해결하기 위한 경량 오픈 소스 프레임워크를 제안합니다. 변이 유도 정제, 솔버 선택, 인과적 서사 합성을 결합하여 생성된 속성의 신뢰도를 높이는 품질 인지형 폐쇄 루프를 구현했습니다.
첨단 공정 노드에서 아날로그 및 혼성 신호(AMS) 레이아웃 자동화를 위한 양자화된 행 높이 기반 합성 방법론을 제안합니다. 이 방법론은 회로 요구 사항에 맞춰 행 높이를 최적화하여 설계 격차를 줄이고 면적 효율성을 높입니다.
NVIDIA L40 GPU의 L2 캐시 지연 시간이 SM(Streaming Multiprocessor) 위치에 따라 비균일하게 나타난다는 연구 결과입니다. 이를 통해 장치의 물리적 정체성을 식별하는 지문 인식(fingerprinting)이 가능하며, 지연 시간 기반 작업 분산 시 성능을 최대 11% 향상할 수 있습니다.
2차원 분절 이온 트랩 양자 프로세서에서 T-접합을 활용한 셔틀링 효율성을 연구합니다. 1차원 선형 아키텍처와 비교하여 2D 아키텍처가 양자 회로 빌딩 블록의 확장성 측면에서 더 우수한 성능을 보임을 입증합니다.
AgentDSE는 LLM 코딩 에이전트를 활용하여 비효율적인 기존 아키텍처 설계 공간 탐색(DSE) 과정을 자동화하는 새로운 방법론입니다. 시뮬레이터를 블랙박스로 취급하는 대신 인간 설계자처럼 추론을 통해 탐색을 가이드함으로써 평가 횟수를 획기적으로 줄입니다.
SkyWater 130nm 공정을 활용하여 설계된 오픈 소스 확률적 Leaky Integrate-and-Fire(LIF) 뉴런에 관한 연구입니다. LFSR 기반의 무작위성을 통해 면적 효율성을 높였으며, 엣지 하드웨어에 최적화된 설계와 특성을 분석했습니다.
MOCAP은 웨이퍼 스케일 칩(WSC) 환경에서 LLM의 프리필(prefill) 단계를 가속화하기 위한 새로운 프레임워크입니다. 메모리 불균형과 지연 시간 불균형 문제를 해결하여 긴 컨텍스트 처리를 최적화합니다.
생물학적 데이터의 폭증으로 인한 기존 컴퓨팅 시스템의 한계를 분석하고, 이를 해결하기 위한 Arch4Health 이니셔티브를 소개합니다. 고성능, 에너지 효율성, 보안 및 개인정보 보호를 갖춘 의료 특화 컴퓨터 아키텍처의 필요성을 강조합니다.
HeteroViT는 차세대 X-선 검출기의 방대한 데이터를 실시간으로 축소하기 위해 설계된 단일 레이어 Vision Transformer 컨셉입니다. 하드웨어 공동 설계를 통해 ASIC, FPGA, GPU 파이프라인에 모델을 매핑하여 엣지 단계에서 데이터를 효율적으로 처리합니다.