Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Baidu가 문서 전체를 한 번에 처리하는 오픈 소스 OCR 모델인 Unlimited-OCR을 공개했습니다. 다중 페이지 표, 수식, 읽기 순서를 보존하며 Markdown 형식으로 출력이 가능합니다.

Claude Mythos Preview가 HAWK 키의 강도를 절반으로 줄이는 공격과 기존보다 훨씬 빠른 AES 공격 등 두 가지 암호학적 취약점을 발견했습니다. 이번 발견은 연구 단계의 성과이며 실제 운영 환경에는 영향이 없습니다.
Insert는 매 실행 시 다음 반복을 위한 소스 코드와 프로그램 상태를 스스로 생성하는 자기 수정 코드(self-modifying code) 언어입니다. 이 언어로 구현된 Pong 게임이 IOCCC 2025에서 수상하며 그 독창성을 입증했습니다.

Mozilla의 보고서에 따르면 오픈 웨이트 모델이 코드 생성 및 지시 이행 능력에서 폐쇄형 모델과 대등한 수준에 도달했습니다. 현재 프로덕션 환경 토큰의 과반수가 오픈 웨이트 모델을 통해 처리되고 있으며, 향후 과제는 효율적인 배포로 요약됩니다.

두 개의 공간 주파수를 중첩한 TTF 폰트를 사용하여 LLM이 잘못된 메시지를 읽도록 유도하는 기술입니다. 인간은 실제 텍스트를 보지만, ChatGPT나 Gemini 같은 AI 모델은 숨겨진 미끼 메시지를 읽게 됩니다.

FLUX 3는 이미지, 비디오, 오디오를 하나의 모델로 통합한 멀티모달 모델입니다. 로보틱스를 위한 액션 예측 기능까지 갖추어 차세대 AI 아키텍처로서의 가능성을 보여줍니다.

NASA Worldview는 1,000개 이상의 고해상도 전 세계 위성 레이어를 제공하는 오픈 소스 플랫폼입니다. 이를 통해 일부 데이터는 관측 후 단 3시간 만에 이용 가능합니다. 또한, 수학 애니메이션을 Python 코드로 구현할 수 있는 open-source 라이브러리 Manim도 소개되었습니다.
claude-real-video는 Claude가 비디오를 실제로 '시청'할 수 있도록 하는 기능을 제공합니다. 이 기능은 장면 변화 감지를 이용한 프레임 추출, 중복 제거, 오디오 전사 등을 수행하며 로컬에서 실행 가능하고 MIT 라이선스를 따릅니다.

Zhipu AI의 GLM 5.2 모델이 IDOR 취약점 탐지 성능에서 Claude Code를 앞질렀습니다. F1 점수 39%를 기록하며 Claude Code의 32%보다 높은 성능을 보였으며, 취약점당 비용은 0.17달러로 나타났습니다.

Anthropic이 NMR 분광학 분야에서 Claude의 성능을 ChemDraw 및 MestReNova와 비교 테스트하고 있습니다. 실험 스펙트럼을 기반으로 화학 구조를 분석하는 능력을 검증하는 데 중점을 둡니다.

Claude, GPT, Gemini 등 주요 LLM을 핵 위기 시뮬레이션에 투입한 연구 결과입니다. 모델들이 전술 핵무기를 체계적으로 사용하거나 선제 사용 금기를 지키지 않는 등 각기 다른 위험한 전략을 보였습니다.

Mistral AI에서 새로운 OCR 모델인 Mistral OCR 4를 출시했습니다. 표, 방정식, 제목 등을 지능적으로 탐지하며 170개 언어를 지원하는 것이 특징입니다.

크레페 제조 과정에 담긴 화학적 원리를 화학 양론, CO₂, 유청 단백질의 관점에서 설명합니다. 재료 비율을 조정할 수 있는 대화형 계산기를 함께 제공합니다.

이 기사는 LLM의 내부 작동 원리(토큰, 임베딩, 위치 인코딩, 어텐션, 피드포워드 등)를 설명하는 것을 목표로 합니다. 본문은 Claude Fable 5와 관련된 CSS 버그 및 테스트 환경 설정 과정을 언급하며 기술적인 내용을 다루고 있습니다.
DiffusionGemma는 텍스트를 토큰 단위가 아닌 256개 블록으로 병렬 생성하는 26B MoE 모델입니다. 이 모델은 추론 시 활성 파라미터가 3.8B에 불과하여 GPU 환경에서 기존 대비 최대 4배 빠른 속도를 제공합니다.
DiffusionGemma는 26B MoE 모델로, 토큰 단위가 아닌 256개 블록으로 병렬 생성 방식을 채택하여 텍스트를 생성합니다. 이 방식은 GPU 환경에서 최대 4배 빠른 속도를 제공하며, 추론 시 활성화되는 파라미터는 3.8B에 불과합니다.
Anthropic이 Mythos 수준의 성능을 가진 Claude Fable 5 모델을 공개했습니다. 이 모델은 대규모 Ruby 코드베이스 마이그레이션과 시각 기능 기반의 게임 클리어 능력을 입증했습니다.
Nvidia가 2.6B 파라미터 규모의 오픈 소스 월드 모델을 공개했습니다. 이미지, 텍스트 프롬프트, 궤적 데이터를 활용하여 단일 GPU 환경에서 제어 가능한 가상 세계를 생성할 수 있습니다.

단 5줄의 코드와 84,688개의 정규 표현식만을 사용하여 체스를 구현한 독특한 연구 사례를 소개합니다. 정규 표현식만으로 CPU의 기능을 모사하여 체스판의 상태를 처리하는 실험적인 접근 방식을 다룹니다.
Orthrus는 기존 자기회귀 모델에 확산 디코딩을 결합하여 품질 저하 없이 LLM 추론 속도를 최대 5배 향상시키는 기술입니다. 또한, 다양한 서비스와 연결되어 로컬에서 메모리를 유지하며 작동하는 오픈 소스 에이전트 OpenHuman을 소개합니다.