Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Anthropic의 새로운 모델인 Claude Sonnet 5가 출시되었습니다. 2026년 1월의 지식 컷오프와 1M 컨텍스트 창을 지원하며, 고해상도 비전 기능과 새로운 토크나이저를 탑재했습니다.

중국의 Zhipu AI가 취약점 탐지 벤치마크에서 Claude Mythos와 대등한 성능을 보였다는 보고가 나왔습니다. 이는 AI를 활용한 보안 기술의 격차가 줄어들고 있음을 시사하며, 공격과 방어 양면에서 새로운 보안 위협을 제기합니다.
거대 추론 모델(LRM)의 사고의 사슬(CoT) 메커니즘을 악용하여 안전 가드레일을 우회하는 'Chain-of-Thought Hijacking' 취약점이 발견되었습니다. 긴 추론 과정 중에 악성 지침을 삽입하여 모델의 거부 신호를 희석시키는 이 공격은 최신 프런티어 모델들에서 매우 높은 성공률을 보였습니다.

Meta가 비침습적 뇌자도(MEG) 스캐너를 활용해 뇌 활동을 키 입력으로 변환하는 Brain2Qwerty 버전 2를 공개했습니다. 이전 버전 대비 데이터 학습량을 10배 늘려 평균 정확도를 61%까지 끌어올리며 기술적 진보를 보여주었습니다.

Hugging Face가 모델 평가 결과의 파편화 문제를 해결하기 위해 EEE(EvalEval Coalition)와 Community Evals를 결합하여 출시했습니다. 단일 JSON 스키마를 통해 평가 주체, 모델, 설정 등을 표준화하여 모델 성능과 안전성을 투명하게 비교할 수 있도록 지원합니다.
Qwen 3.6 27B 모델을 대상으로 다양한 llama.cpp 포크 엔진과 투기적 디코딩(Speculative Decoding) 기법의 성능을 비교 분석한 벤치마크 결과입니다. 단일 RTX 3090 환경에서 ik_llama 포크를 활용해 코드 생성 시 최대 100 TPS에 근접하는 성능을 확인했습니다.
HydraHead는 레이어 단위가 아닌 헤드 수준의 기능적 이질성을 활용하여 Full Attention과 Linear Attention을 결합한 새로운 하이브리드 어텐션 아키텍처입니다. 해석 가능성 분석을 통해 검색에 중요한 헤드를 식별하고, 스케일 정규화 융합 모듈을 통해 효율적인 긴 문맥 처리를 구현합니다.
2026년 6월, NVIDIA의 Nemotron 3 Ultra와 Z.AI의 GLM-5.2 등 강력한 성능의 오픈 모델들이 잇따라 출시되었습니다. 또한 Google Gemini 3.5 Flash에 컴퓨터 사용 기능이 탑재되며 오픈 모델과 에이전트 기술의 비약적인 발전을 보여주었습니다.

로봇 학습의 한계를 극복하기 위해 픽셀이 아닌 잠재 공간(Latent Space)에서 물리적 인과관계를 예측하는 세계 모델(World Model) 기술을 분석합니다. 무계동력(Wujie Dongli)의 MWA 사례를 통해 VLA 모델의 약점을 보완하는 잠재 액션 및 강화 학습 결합 방식을 설명합니다.
Hugging Face에서 주목받는 최신 AI 논문 10편을 소개하며, AI가 단순 답변을 넘어 행동, 평가, 현실 세계 작동 시스템으로 진화하는 트렌드를 분석합니다. 실시간 비디오 편집, 장기 에이전트, 로봇 조작 등 다양한 연구 분야를 다룹니다.
양식장 모니터링을 위해 자기 지도 학습(Self-Supervised Learning)을 활용한 시계열 패턴 마이닝 기술을 제안합니다. 라벨링되지 않은 대규모 데이터를 통해 생태계의 복잡한 리듬을 학습하고, 이상 징후를 탐지하며 감사 가능한 시스템을 구축하는 연구를 다룹니다.
Huawei가 512K 컨텍스트 길이를 지원하는 OpenPangu-2.0-Flash 모델을 오픈 소스로 공개했습니다. 이 모델은 총 92B 파라미터 중 6B만 활성화되는 구조이며, 가중치와 추론 및 학습 코드가 함께 제공됩니다.

아티스트 메시(artist-meshes)를 활용한 구조적 자기회귀 생성 기술에 관한 연구 내용을 다룹니다. 3D 메시 구조를 효율적으로 생성하기 위한 새로운 접근 방식을 제시합니다.

WhatsApp 메시지의 RTT(Round-Trip Time) 측정을 통해 기기의 활동 상태를 감지하는 연구 방법을 다룹니다. 네트워크 지연 시간을 분석하여 사용자의 기기 상태를 추론하는 기술적 접근을 제시합니다.
학술 연구원과 박사 과정 학생들의 연구 효율을 극대화할 수 있는 유용한 웹사이트들을 소개합니다. 논문 검색, 인용 시각화, 논문 작성 지원 등 다양한 AI 기반 도구들을 정리했습니다.

인도의 첫 번째 주권적 생성형 AI 프로그램인 BharatGen이 공개되었습니다. IIT Bombay 주도로 인도의 언어적 다양성과 문화적 맥락을 반영한 다국어 및 멀티모달 AI 모델 개발을 목표로 합니다.
Ascend에서 개발한 92B 규모의 MoE 모델인 openPangu-2.0-Flash를 소개합니다. 512k의 긴 컨텍스트 길이를 지원하며, 통합 SFT와 강화학습(RL)을 통해 사고 능력을 최적화했습니다.
Qwen3.6-35B-A3B 모델에 규범 보존 이중 투영 기술을 적용하여, 모델의 지능 저하 없이 거부 메커니즘을 제거하는 데 성공했습니다. 하이브리드 어텐션과 3D 전문가 텐서 구조를 고려한 정밀한 Abliteration을 통해 거부율 0%와 벤치마크 성능 유지를 동시에 달성했습니다.

Agents-A1은 35B MoE 모델임에도 불구하고 에이전트 호라이즌 확장을 통해 1조 파라미터급 성능을 구현했습니다. 45K 토큰 궤적과 멀티 티처 증류 기법을 사용하여 6개의 이질적인 도메인을 통합한 것이 특징입니다.

NVIDIA가 Hugging Face를 통해 베트남어 AI 안전 평가 데이터셋인 VISafe를 출시했습니다. 이 데이터셋은 베트남어 문맥에서의 탈옥, 독성, 오정보 및 프롬프트 주입을 탐지하기 위한 3,212개의 탐침을 포함합니다.