Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
SABLE은 산업용 EDA 워크플로우에서 보안을 유지하며 아날로그 회로를 최적화하는 LLM 프레임워크입니다. 민감한 PDK 및 회로 정보를 정제하여 클라우드에 노출하지 않으면서도, 폐쇄 루프 방식으로 회로 설계를 자동화합니다.
SPICE netlist를 사람이 읽을 수 있는 회로도(Schematic)로 변환하는 결정론적 컨버터 Weave를 소개합니다. 계층적 그래프 레이아웃과 round-trip 검증 방식을 통해 기존 LLM 기반 방식보다 높은 연결성 보존력과 정확도를 제공합니다.
대규모 입도 메모리 시스템(LGMS)에서 발생하는 읽기 증폭 문제를 해결하기 위해 타일 중심 레이아웃을 제안하는 TileLens 연구를 소개합니다. 2차원 메모리 레이아웃을 통해 LLM 추론 성능 저하를 방지하며, 소프트웨어와 하드웨어 확장을 통해 효율적인 데이터 액세스를 지원합니다.
Ascend NPU에서 LLM 추론을 최적화하기 위해 학습 없이 4-bit FlashAttention을 구현하는 HiFA4 기술을 제안합니다. Smooth-QK와 P-Reordering 메커니즘을 통해 양자화로 인한 정확도 손실을 최소화하고 연산 효율을 높입니다.
DNN 가속의 효율성과 유연성 사이의 트레이드오프를 해결하기 위해 재구성 가능한 ISA 기반 아키텍처를 제안합니다. 동적 정밀도와 분리된 실행 제어를 통해 높은 에너지 효율과 프로그래밍 가능성을 동시에 달성했습니다.
디지털 회로의 신뢰성 분석을 위해 머신러닝과 몬테카를로 시뮬레이션을 결합한 SMART 프레임워크를 제안합니다. 랜덤 포레스트와 베이지안 최적화를 활용하여 공정 변동 및 트랜지스터 노화 문제를 신속하고 정확하게 분석합니다.
확률적 계산의 효율성을 높이기 위해 분포 파라미터와 샘플을 직접 저장하는 통합 메모리 프리미티브인 p-MEM을 제안합니다. p-MEM은 기존 방식 대비 높은 처리량과 낮은 지연 시간, 에너지 효율을 제공하여 신뢰할 수 있는 에지 인텔리전스 구현을 지원합니다.
HackRF One과 Raspberry Pi 5를 결합하여 실내외 및 수풀 환경에서 RF 데이터를 수집할 수 있는 소형 배터리 구동 시스템을 제안합니다. SigMF 형식으로 IQ 데이터를 기록하며, 다양한 환경에서의 전파 특성과 간섭 패턴을 분석하는 연구를 수행했습니다.
KernelSight-LM은 LLM의 추론 성능을 커널 수준에서 정밀하게 시뮬레이션하는 새로운 프레임워크입니다. 하드웨어 사양과 커널 모델을 활용하여 GPU 세대가 바뀌더라도 낮은 오차로 지연 시간을 예측하고 병목 현상을 분석할 수 있습니다.
SoC 확장에 따른 AXI4 네트워크 온 칩(NoC)의 데드락 문제를 해결하기 위한 새로운 아키텍처를 제안합니다. 물리 인지형 선점형 가상 채널(Preemptive VCs)을 통해 기존 멀티플레인 방식 대비 링크 리소스를 최대 76% 절약하면서도 높은 효율을 달성했습니다.
표준 셀 라이브러리에 하드웨어 트로이잔(HT)을 삽입하여 보안을 위협하는 새로운 공격 모델과 위험 평가 방법을 제안합니다. Saed32nm 및 Sky130nm 라이브러리를 활용해 공격의 효능을 입증하고 설계 특성 분석을 통해 이를 탐지하는 연구를 수행했습니다.
MxGLUT는 혼합 정밀도 GEMM 연산을 위해 설계된 재구성 가능한 LUT 중심 브로드캐스트 데이터플로우 가속기입니다. 별도의 FP 데이터패스 없이 단일 LUT 메커니즘으로 FP8-INT4 및 FP8-FP8 연산을 통합 지원하여 하드웨어 효율성을 극대화합니다.
LLM 서빙 시 발생하는 프리필-디코드(PD) 분리 기술과 텐서 병렬성(TP) 간의 트래픽 경합 문제를 해결하기 위한 3DLS 아키텍처를 제안합니다. 3D 적층 칩렛 구조를 통해 KV-캐시 전송과 TP 통신을 물리적으로 분리하여 성능을 극대화합니다.
벌크 음향파(BAW) 지연선을 활용하여 열적으로 안정적이고 저전력인 새로운 시분할 다중화 이징 머신을 제안합니다. 2,048개의 스핀을 지원하며 숫자 분할 및 스도쿠 문제 해결에서 우수한 성능을 입증했습니다.
FPGA 환경에서 Vision Transformer(ViT)의 셀프 어텐션 연산을 효율적으로 수행하기 위한 BRAM-free 근사 어텐션 가중치 산출 방식을 제안합니다. 분산 LUT 패브릭을 활용한 구간 선형 함수로 소프트맥스를 근사하여 자원 소모를 최소화하면서도 높은 정확도를 유지합니다.
HySpecPro는 스펙트럼 임베딩 공간에서 엔드 투 엔드 최적화를 수행하는 단일 레벨 하이퍼그래프 분할 기법입니다. 기존 멀티레벨 방식의 구조적 왜곡 문제를 해결하며, GPU 가속을 통해 선형적인 확장성과 높은 컷 품질을 동시에 제공합니다.
양자 내성 암호(PQC)의 핵심 연산인 NTT를 가속하기 위한 고성능 하드웨어 아키텍처를 제안합니다. 중복 수 표현과 통합 버터플라이 유닛을 통해 연산 오버헤드를 줄이고 FPGA 리소스 효율성을 극대화했습니다.
이온 트랩 하드웨어에서 양자 알고리즘 실행 시 발생하는 노이즈와 오버헤드를 줄이기 위해, 이산적 게이트 대신 연속적인 복합 펄스 가젯을 사용하는 통합 펄스 합성 전략을 제안합니다. GRAPE 알고리즘을 활용해 $H_2$ 분자 시뮬레이션을 수행한 결과, 실행 시간 단축과 제어 지연 시간 제거 효과를 확인했습니다.
궤도 데이터 센터(ODC)에서 LLM 학습 시 발생하는 열 간섭 문제를 해결하기 위한 연구를 소개합니다. 열 부하 분산(TLB) 프레임워크를 통해 워크로드를 최적의 냉각 유닛으로 동적 이동시켜 하드웨어 수명을 연장하고 효율을 높입니다.
양자 오류 정정(QEC) 신드롬 전송의 대역폭 및 전력 문제를 해결하기 위한 극저온 압축 프레임워크 CryoZip을 제안합니다. 22nm FDSOI 공정에서 구현된 이 설계는 기존 압축기 대비 높은 압축률과 에너지 효율을 달성했습니다.