Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.

Zhipu AI의 오픈 웨이트 모델인 GLM 5.2가 보안 취약점 탐지 벤치마크인 IDOR 테스트에서 Claude Code를 능가하는 성능을 보였습니다. GLM 5.2는 MoE 구조를 통해 효율적인 추론 비용을 유지하며, 대규모 컨텍스트 처리 능력을 바탕으로 코딩 및 보안 작업에서 강력한 성능을 입증했습니다.

MAX 모델을 Apple silicon GPU에서 실행할 수 있는 기능이 26.4 릴리스를 통해 지원됩니다. M1부터 M5까지의 칩셋에서 LLM, 비전, 이미지 확산 모델을 구동할 수 있으며, 특히 M5 시스템의 Neural Accelerators를 활용해 최적의 성능을 제공합니다.

Princeton 연구진이 강화학습과 확산 모델을 활용해 복잡한 무선 주파수 집적 회로(RFIC)를 설계하는 기술을 개발했습니다. 이 방식은 기존의 수동 설계 방식보다 훨씬 빠르게 혁신적인 레이아웃을 생성하며 설계 시간을 획기적으로 단축합니다.
Transformer 아키텍처와 하이브리드 모델 간의 성능을 토큰 수준에서 비교 분석한 연구입니다. 모델의 효율성과 연산 특성을 심층적으로 다룹니다.
GPT2-BASIC은 DOS급 저사양 환경에서도 실행 가능한 BASIC 언어 기반의 고정 소수점 트랜스포머 런타임입니다. 양자화와 정수 산술을 활용하여 현대적 LLM의 핵심 알고리즘을 하드웨어 제약이 심한 시스템에서도 구현할 수 있음을 증명합니다.
LLM의 추론 능력을 활용하여 네트워크 취약점에 실시간으로 적응하고 스스로 확산하는 '적응형 컴퓨터 웜'에 관한 연구입니다. 오픈 웨이트 모델을 사용하여 중앙 집중식 AI 안전 제어를 우회하며, 감염된 기기의 자원을 기생적으로 활용해 자율적인 공격을 수행합니다.

위성 군집과 로켓 발사가 성층권 오존층 및 지구 온난화에 미치는 영향을 다룬 연구들을 소개합니다. 로켓 배출물과 우주선 재진입 시 발생하는 금속 입자가 대기 화학에 미치는 잠재적 위험성을 경고합니다.

Fastly는 경제학의 지니 계수를 활용하여 에지(Edge) 인프라의 용량 계획을 수립합니다. 트래픽 불평등도를 핵심 신호로 사용하여 대규모 이벤트나 급격한 워크로드 변화에 대응하는 효율적인 용량 모델을 구축했습니다.

3B 파라미터 규모의 소형 언어 모델인 VibeThinker-3B를 소개하며, 검증 가능한 추론 성능을 극대화하는 최적화 파이프라인을 제안합니다. 실험 결과, 이 모델은 대규모 플래그십 모델들과 대등한 수준의 추론 및 코딩 성능을 보여주었습니다.

LLM 추론 시 발생하는 커널 실행 오버헤드와 동적 형상 처리 문제를 해결하기 위한 'Event Tensor' 컴파일러 추상화를 제안합니다. 타일링된 작업 간 의존성을 인코딩하여 동적 특성을 지원하며, 최첨단 LLM 서빙 지연 시간을 달성합니다.
Apache TVM 기반의 오픈 소스 ML 커널용 DSL 및 컴파일러인 TIRx를 소개합니다. TIRx는 빠르게 변화하는 하드웨어와 커널 요구사항에 대응하기 위해 하드웨어 네이티브 제어를 지원하며, GPU 및 AI 가속기를 대상으로 설계되었습니다.

Raspberry Pi와 Platypush를 활용하여 클라우드 의존성을 최소화한 완전한 로컬 음성 비서를 구축하는 방법을 소개합니다. OpenWakeWord, Vosk, Piper를 통해 호출어 탐지부터 음성 합성까지 온디바이스로 처리하는 파이프라인을 제안합니다.

LLM이 시스템 프롬프트, 사용자 메시지, 모델의 추론 등을 하나의 연속된 텍스트 스트림으로 처리하는 구조적 결함과 이로 인한 프롬프트 인젝션 발생 원인을 분석합니다. 모델이 '역할(Role)'을 인식하는 방식의 한계를 지적하며, 이를 통해 새로운 공격 생성 및 기계 해석 가능성을 제시합니다.

현재 AI 붐의 핵심 기술인 Transformer, 사전 학습, 신경망 증류, 잔차 학습 등의 기원이 1991년 Jürgen Schmidhuber의 뮌헨 공과대학교 연구실에서 시작되었음을 설명합니다. 현대 LLM을 지탱하는 기술적 토대가 30년 전 이미 마련되었음을 역사적 타임라인을 통해 조명합니다.

Qualcomm NPU의 성능을 극대화하기 위해 SDK를 역공학하여 VTCM 메모리 배치 및 최적화 알고리즘을 분석한 기술 보고서입니다. HTP의 MILP 기반 배치 방식과 숨겨진 시뮬레이터 Hextimate의 존재를 밝혀냈습니다.
Lighthouse가 에이전틱 브라우징(Agentic Browsing) 카테고리를 통해 웹사이트의 기계 상호작용 준비 상태를 평가하는 방식을 설명합니다. 점수 대신 통과 비율과 상태를 제공하며, WebMCP 통합 및 접근성 트리를 중심으로 검증합니다.
ChromiumFish는 JavaScript 패치가 아닌 C++ 엔진 레벨에서 브라우저 지문을 스푸핑하여 탐지를 우회하는 Chromium 포크입니다. Playwright와 호환되며, 일관된 페르소나 유지와 네이티브 AI 에이전트 기능을 제공합니다.

Elasticsearch를 활용하여 에이전트의 장기 메모리(Long-term memory)를 구축하는 아키텍처를 소개합니다. 하이브리드 검색, 리랭커, 데이터 대체 및 DLS를 통해 컨텍스트 윈도우의 한계를 극복하고 지속 가능한 메모리 계층을 구현하는 방법을 다룹니다.

정교해진 사회 공학적 기법과 기술적 허점을 이용한 신원 도용 사기 수법을 경고합니다. 구직 과정을 가장한 피싱과 SSO 로그인 탈취를 통해 개인의 금융 자산과 계정 권한을 완전히 장악하는 실제 사례를 다룹니다.

Stack Overflow가 AI 코딩 에이전트들을 위한 API 우선 지식 교환 플랫폼인 'Stack Overflow for Agents'를 발표했습니다. 에이전트들이 겪는 휘발성 지능 격차를 해결하고, 검증된 기술 지식을 실시간으로 공유하여 에이전트의 신뢰성과 효율성을 높이는 것을 목표로 합니다.