Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
멀티 프리시전 공간 아키텍처에서 혼합 정밀도 DNN을 최적화하기 위한 새로운 방법론 SEADA를 제안합니다. SEADA는 시스템 수준의 비용 모델과 비트 수준 엔트로피 기반의 정밀도 선택을 통해 효율적인 매핑을 지원합니다.
본 논문은 현대 기술 시스템 설계의 복잡성을 해결하기 위해 딥러닝과 생성형 AI를 활용한 계산 설계 합성(CDS) 프레임워크를 제안합니다. e-drive 시스템과 공간 차원 결정 사례를 통해 시뮬레이션 기반 최적화를 넘어선 자율 설계의 가능성을 제시합니다.
뉴로모픽 컴퓨팅을 위한 비매개변수적 1-Bit 희소 모델의 고주파 기하학적 노이즈 완화 방법을 제안합니다. 8-bit 변환 행렬을 통해 초희소 이진 코드를 생성하며, 하드웨어 레벨의 저역 통과 필터로 재구성 오차를 최소화하는 프레임워크를 제시합니다.
DRAM의 비용 문제를 해결하기 위한 신흥 메모리 기술인 LtRAM의 단점을 극복하기 위한 새로운 하드웨어/소프트웨어 인터페이스 설계를 제안합니다. 애플리케이션 읽기 전용 메모리(AROM) 개념을 도입하여 LtRAM 관리 책임을 하드웨어에서 운영체제로 전환함으로써 성능과 비용 효율성을 동시에 달성하고자 합니다.
궤도 데이터 센터(ODC)에서 LLM 학습 시 발생하는 열 간섭 문제를 해결하기 위한 연구를 소개합니다. 열 인지형 이질성 테제를 바탕으로 워크로드를 최적의 냉각 유닛으로 이동시키는 TLB 프레임워크를 제안합니다.
SOLAR는 PyTorch 및 JAX 소스 코드로부터 AI 모델의 이론적 최소 실행 시간인 광속(Speed-of-Light) 경계를 자동으로 도출하는 프레임워크입니다. LLM과 결정론적 흐름을 결합하여 검증된 경계를 생성하며, 모델 최적화 및 하드웨어 프로비저닝을 위한 통찰력을 제공합니다.
기밀 가상 머신(CVM) 환경에서 발생하는 데이터베이스 쿼리 성능 저하 문제를 해결하기 위해 CVM 인지 비용 보정 방식을 제안합니다. 기존 옵티마이저의 비용 모델이 비암호화 VM에 맞춰져 있는 문제를 물리적 프록시를 통한 모델링으로 해결하여 성능을 최대 48% 개선했습니다.
Apple M4 Pro 칩셋에서 GPU 작업 종료 후 남겨지는 잔류 캐시 상태를 분석한 연구입니다. GPU 커널 실행 후 CPU 성능에 미치는 캐시 변위 현상을 규명하고, 이를 완화할 수 있는 소프트웨어 복구 메커니즘을 제안합니다.
CHIA는 에이전트 기반 AI를 활용하여 하드웨어와 소프트웨어를 공동 설계할 수 있는 오픈 소스 프레임워크입니다. 복잡한 설계 워크플로우를 유향 순환 그래프 형태인 'CHIA 루프'로 구조화하여 대규모 시스템 설계 연구를 지원합니다.
본 논문은 에지 컴퓨팅 환경에서 CGRA의 설계 요소인 프로세싱 엘리먼트의 이질성과 Scratchpad Memory(SPM)가 연산 성능에 미치는 영향을 분석합니다. FFT, GEMM 및 트랜스포머 워크로드를 통해 데이터 이동 최적화와 에너지 효율성 간의 트레이드오프를 평가합니다.
VR 헤드셋의 전력 소비를 줄이기 위해 시야(FoV) 외 영역의 비트를 절단하는 SPORT 프레임워크를 제안합니다. WS-PSNR 최적화를 통해 화질 저하를 최소화하면서 메모리 전력과 대역폭을 최대 51.6%까지 절감할 수 있음을 입증했습니다.
클라우드 GPU 환경에서 특권 권한 없이도 물리적 가속기의 신원, 하드웨어 토폴로지 및 위치를 검증할 수 있는 소프트웨어 기반 인증서 기술을 제안합니다. CUDA 프로브와 지연 시간 측정을 통해 Blackwell 등 최신 GPU의 물리적 지문을 정확히 식별합니다.
SafeGen은 자동차 칩 설계의 기능 안전을 위해 LLM과 하이퍼 지식 그래프(HyperKG)를 결합한 새로운 프레임워크입니다. 설계 문서와 RTL 정보를 활용해 검증 가능한 어설션을 생성하고, 결함의 중요도를 의미론적으로 평가합니다.
GB-scale Last-Level Cache(LLC)를 활용하여 LLM 추론 성능을 극대화하는 새로운 캐시 상주 실행 모델을 제안합니다. 가중치 중심 연산자와 KV-캐시 관리를 분리하여 파이프라인 깊이와 관계없이 효율적인 추론이 가능하도록 설계되었습니다.
물리적 제약 조건을 고려하지 못하는 기존 에이전트의 한계를 극복하기 위해, 하드웨어 준수 컴퓨팅 시스템을 자율 설계하는 멀티 에이전트 엔진을 제안합니다. 진화적 지식 그래프와 알고리즘적 사고의 사슬을 활용하여 하드웨어-소프트웨어 공동 설계의 새로운 패러다임을 제시합니다.
숙련된 로봇 손을 위해 방향성 강성을 조절할 수 있는 파라메트릭 이중 나선(PDS) 순응형 관절을 제안합니다. 나선형 템플릿과 비대칭 비율을 통해 강성을 맞춤화하며, 내장형 유도성 고유 수용 감각을 통해 정밀한 상태 추정이 가능합니다.
SNN의 불규칙한 희소성을 활용하여 에너지 효율을 극대화하는 범용 풀-이벤트 뉴로모픽 아키텍처 ExSpike를 제안합니다. 이벤트 기반 데이터플로우 최적화와 이벤트 압축 기술을 통해 기존 FPGA 기반 가속기 대비 높은 에너지 효율을 달성했습니다.
LLM을 이용한 RTL Assertion 생성 시 발생하는 품질 문제, 증명 비용 가변성, 실패 트레이스 해석의 어려움을 해결하기 위한 경량 오픈 소스 프레임워크를 제안합니다. 변이 유도 정제, 솔버 선택, 인과적 서사 합성을 결합하여 생성된 속성의 신뢰도를 높이는 품질 인지형 폐쇄 루프를 구현했습니다.
첨단 공정 노드에서 아날로그 및 혼성 신호(AMS) 레이아웃 자동화를 위한 양자화된 행 높이 기반 합성 방법론을 제안합니다. 이 방법론은 회로 요구 사항에 맞춰 행 높이를 최적화하여 설계 격차를 줄이고 면적 효율성을 높입니다.
NVIDIA L40 GPU의 L2 캐시 지연 시간이 SM(Streaming Multiprocessor) 위치에 따라 비균일하게 나타난다는 연구 결과입니다. 이를 통해 장치의 물리적 정체성을 식별하는 지문 인식(fingerprinting)이 가능하며, 지연 시간 기반 작업 분산 시 성능을 최대 11% 향상할 수 있습니다.