Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.

Qualcomm이 메모리 벽 문제를 해결하기 위해 LPDDR DRAM 스택 아래에 AI 가속기를 배치하는 HBC(High-Bandwidth Compute) 근접 메모리 아키텍처를 공개했습니다. 이 방식은 HBM 대비 와트당 대역폭이 6배 높으며, 고가의 인터포저 없이 표준 패키징을 사용하여 비용 효율성을 극대화합니다.

Valve의 Steam Machine이 일본 시장에서 출시 48시간 만에 초도 물량이 완판되었습니다. 높은 가격에 대한 논란이 있음에도 불구하고, 별도의 설정 없이 바로 사용할 수 있는 편의성이 소비자들에게 어필한 것으로 보입니다.

AMD의 FSR 4.1 기술이 RX 7900 XTX 그래픽 카드에서 사이버펑크 2077의 4K RT 울트라 설정 프레임률을 약 2배 향상시켰습니다. FSR 4.1은 이전 버전보다 높은 성능을 요구하지만, 더 뛰어난 그래픽 품질을 제공하며 RDNA 3 아키텍처에서 눈에 띄는 성능 개선을 보여줍니다.
OpenAI가 Broadcom과 협력하여 개발한 맞춤형 추론 ASIC인 Jalapeño 칩을 공개했습니다. 이 칩은 트랜스포머 모델의 메모리 대역폭 병목 현상을 해결하도록 설계되어, 기존 GPU 대비 토큰당 추론 비용을 약 50% 절감할 수 있습니다.

LaCie가 256TB의 압도적인 용량을 자랑하는 초고용량 DAS인 '8big Pro5'를 출시했습니다. Thunderbolt 5 인터페이스를 지원하여 RAID 0 구성 시 최대 2,800 MB/s의 빠른 전송 속도를 제공합니다.

OpenAI가 Broadcom과 협력하여 LLM 추론 특화 칩인 Jalapeño를 공개했습니다. 또한 Google의 Gemini 3.5 Flash에 Computer Use 기능이 통합되었으며, Alibaba는 오픈 웨이트 언어 세계 모델인 Qwen-AgentWorld를 발표했습니다.

퀄컴이 HBM 대신 범용 메모리를 사용하는 AI 데이터센터용 칩과 서버 CPU를 공개했습니다. 저렴한 메모리와 저전력 설계를 통해 구축 비용과 전력 부담을 낮추며 엔비디아 의존도를 낮추는 전략을 취하고 있습니다.
FPGA 네트워크를 활용하여 100만 개의 p-bits를 갖춘 대규모 프로그래밍 가능한 확률적 컴퓨터를 구현했습니다. 단일 칩의 용량 한계를 극복하고 초당 1조 번 이상의 Gibbs 샘플링 속도를 달성하며, 분산 시스템의 성능을 결정하는 설계 규칙을 제시합니다.
FPGA 상에서 MSDF Digit-Serial 산술 연산을 활용하여 U-Net 아키텍처를 에너지 효율적으로 가속하는 MMA(Merged Multiply-Add) 구조를 제안합니다. 통합 파이프라인 설계를 통해 연산 지연을 줄이고 처리량을 높여, 기존 CPU 대비 최대 10배 높은 에너지 효율을 달성했습니다.
Croc는 RISC-V 플랫폼을 기반으로 한 엔드투엔드 오픈 소스 SoC 설계 및 제작 흐름을 제공합니다. 폐쇄형 EDA 도구 대신 오픈 소스 IP와 PDK를 활용하여 도메인 특화 칩 설계 교육을 가능하게 합니다.


HPE의 Slingshot 인터커넥트가 벤치마크에서 최고 성능을 기록하며 AI 워크로드에 최적화된 저지연 통신을 입증했습니다. 동시에 중국이 자체 개발 프로세서로 구축한 1.2 엑사플롭스급 슈퍼컴퓨터를 공개하며 HPC 분야의 기술 경쟁이 심화되고 있습니다.
Mac Studio M3 Ultra 환경에서 1-bit GLM-5.2 GGUF 모델을 실행한 결과, 초당 약 21.6 토큰의 속도를 기록했습니다. Claude 4.8 Opus 및 GPT-5.5와 동일한 프롬프트로 성능을 비교 분석했습니다.

Qualcomm이 에이전틱 AI를 위한 데이터 센터용 CPU인 'Dragonfly C1000'을 공개했습니다. Meta를 첫 주요 고객으로 확보하며 스마트폰 중심에서 데이터 센터 및 AI 인프라 시장으로 사업 영역을 공격적으로 확장하고 있습니다.

OpenAI가 Broadcom과 협력하여 맞춤형 추론 프로세서인 'Jalapeño'를 공개했습니다. 이 칩은 OpenAI 모델의 추론 워크로드에 최적화되어 전력 대비 성능이 뛰어나며, Nvidia GPU 의존도를 낮추고 운영 비용을 절감하는 것을 목표로 합니다.

OpenAI와 Broadcom이 LLM 추론 가속을 위해 맞춤형 ASIC인 Jalapeño 칩을 발표했습니다. 이 칩은 프리필 및 디코드 단계를 가속하여 비용과 지연 시간을 낮추지만, 시스템 운영 측면의 'AI 조정 격차' 문제는 여전히 과제로 남습니다.

중국이 엔비디아 GPU 없이 자체 CPU와 HBM을 활용해 슈퍼컴퓨터 세계 1위를 탈환했습니다. 이는 미국의 제재가 오히려 중국의 반도체 자급자족과 메모리 기술 발전을 가속화하는 결과를 초래했음을 보여줍니다.

휴머노이드 로봇의 메모리 구조가 서버 기반의 장기 기억과 로컬 기반의 반사신경으로 분리되는 추세를 분석합니다. 향후 전력 효율을 극대화한 로봇 전용 메모리(HBF)의 등장과 메모리 기술이 로봇의 성능을 결정짓는 핵심 요소가 될 것임을 시사합니다.
OpenAI가 Broadcom과 협력하여 LLM 추론에 특화된 AI 칩 'Jalapeño'를 공개했습니다. 이는 모델 최적화를 통해 인프라 통제력을 강화하려는 전략적 움직임으로, 향후 AI 서비스의 운영 비용 구조를 혁신할 것으로 기대됩니다.
OpenAI가 Broadcom과 협력하여 추론 전문 AI 칩인 'Jalapeño'를 공개했습니다. 이는 NVIDIA 의존도를 낮추고 모델부터 하드웨어까지 직접 통제하는 풀스택 전략의 일환입니다.
OpenAI와 Broadcom이 LLM 추론 전용 가속기 'Jalapeño'를 발표하고, Google의 Gemini 3.5 Flash가 GA되었습니다. 이는 AI 경쟁의 축이 모델 지능을 넘어 추론 비용과 전용 하드웨어 최적화로 이동하고 있음을 시사합니다.