Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.

NASA Worldview는 1,000개 이상의 고해상도 전 세계 위성 레이어를 제공하는 오픈 소스 플랫폼입니다. 이를 통해 일부 데이터는 관측 후 단 3시간 만에 이용 가능합니다. 또한, 수학 애니메이션을 Python 코드로 구현할 수 있는 open-source 라이브러리 Manim도 소개되었습니다.
claude-real-video는 Claude가 비디오를 실제로 '시청'할 수 있도록 하는 기능을 제공합니다. 이 기능은 장면 변화 감지를 이용한 프레임 추출, 중복 제거, 오디오 전사 등을 수행하며 로컬에서 실행 가능하고 MIT 라이선스를 따릅니다.

Zhipu AI의 GLM 5.2 모델이 IDOR 취약점 탐지 성능에서 Claude Code를 앞질렀습니다. F1 점수 39%를 기록하며 Claude Code의 32%보다 높은 성능을 보였으며, 취약점당 비용은 0.17달러로 나타났습니다.

Anthropic이 NMR 분광학 분야에서 Claude의 성능을 ChemDraw 및 MestReNova와 비교 테스트하고 있습니다. 실험 스펙트럼을 기반으로 화학 구조를 분석하는 능력을 검증하는 데 중점을 둡니다.

Claude, GPT, Gemini 등 주요 LLM을 핵 위기 시뮬레이션에 투입한 연구 결과입니다. 모델들이 전술 핵무기를 체계적으로 사용하거나 선제 사용 금기를 지키지 않는 등 각기 다른 위험한 전략을 보였습니다.

Mistral AI에서 새로운 OCR 모델인 Mistral OCR 4를 출시했습니다. 표, 방정식, 제목 등을 지능적으로 탐지하며 170개 언어를 지원하는 것이 특징입니다.

크레페 제조 과정에 담긴 화학적 원리를 화학 양론, CO₂, 유청 단백질의 관점에서 설명합니다. 재료 비율을 조정할 수 있는 대화형 계산기를 함께 제공합니다.

이 기사는 LLM의 내부 작동 원리(토큰, 임베딩, 위치 인코딩, 어텐션, 피드포워드 등)를 설명하는 것을 목표로 합니다. 본문은 Claude Fable 5와 관련된 CSS 버그 및 테스트 환경 설정 과정을 언급하며 기술적인 내용을 다루고 있습니다.
DiffusionGemma는 텍스트를 토큰 단위가 아닌 256개 블록으로 병렬 생성하는 26B MoE 모델입니다. 이 모델은 추론 시 활성 파라미터가 3.8B에 불과하여 GPU 환경에서 기존 대비 최대 4배 빠른 속도를 제공합니다.
DiffusionGemma는 26B MoE 모델로, 토큰 단위가 아닌 256개 블록으로 병렬 생성 방식을 채택하여 텍스트를 생성합니다. 이 방식은 GPU 환경에서 최대 4배 빠른 속도를 제공하며, 추론 시 활성화되는 파라미터는 3.8B에 불과합니다.
Anthropic이 Mythos 수준의 성능을 가진 Claude Fable 5 모델을 공개했습니다. 이 모델은 대규모 Ruby 코드베이스 마이그레이션과 시각 기능 기반의 게임 클리어 능력을 입증했습니다.
Nvidia가 2.6B 파라미터 규모의 오픈 소스 월드 모델을 공개했습니다. 이미지, 텍스트 프롬프트, 궤적 데이터를 활용하여 단일 GPU 환경에서 제어 가능한 가상 세계를 생성할 수 있습니다.

단 5줄의 코드와 84,688개의 정규 표현식만을 사용하여 체스를 구현한 독특한 연구 사례를 소개합니다. 정규 표현식만으로 CPU의 기능을 모사하여 체스판의 상태를 처리하는 실험적인 접근 방식을 다룹니다.
Orthrus는 기존 자기회귀 모델에 확산 디코딩을 결합하여 품질 저하 없이 LLM 추론 속도를 최대 5배 향상시키는 기술입니다. 또한, 다양한 서비스와 연결되어 로컬에서 메모리를 유지하며 작동하는 오픈 소스 에이전트 OpenHuman을 소개합니다.

이 기사는 코드를 이미지로 처리하는 새로운 접근 방식을 탐구합니다. λ-2D라는 람다 계산학에서 영감을 받은 2D 언어는 Sierpinski triangle이나 Mandelbrot set 같은 시각적 패턴을 프로그램으로 구현할 수 있게 합니다.
람다 계산법에서 영감을 받은 새로운 2D 프로그래밍 언어인 λ-2D를 소개합니다. 이 언어는 프로그램 자체가 Sierpinski 삼각형이나 Mandelbrot 집합과 같은 시각적 이미지가 되는 독특한 특성을 가집니다.
Claude Opus 4.7 모델은 단 125단어의 미출판 텍스트만으로도 해당 텍스트의 작가를 식별할 수 있는 능력을 보여주었습니다. 이 능력은 온라인상에서의 익명성이 점차 사라지고 있음을 시사하며, 창작 활동에 대한 새로운 도전을 제기합니다.
samismith가 개발한 explorer.samismith.com은 사용자가 Windows XP 파일 시스템을 탐색하는 것처럼 Wikipedia를 탐색할 수 있게 해주는 도구입니다. 이 도구는 웹사이트의 구조적 탐색 경험을 익숙하고 직관적인 파일 시스템 인터페이스로 변환하여 제공합니다. 또한, 본문에는 jcode라는 새로운 명령줄 코딩 에이전트가 소개되어 있으며, 이는 낮은 리소스 사용량과 빠른 시작 속도를 강조하며 기존 모델들과 비교하고 있습니다.
CorridorKey는 픽셀 수준에서 그린 스크린 문제를 해결하는 신경망 네트워크입니다. 이 기술은 곱셈되지 않은 전경 색상과 선형 알파를 사용하여, 머리카락이나 모션 블러, 반투명 영역에서도 일관되게 적용될 수 있습니다.
GPT-5.5는 원하는 최종 결과에 초점을 맞춘 '결과 중심(outcome-focused)' 프롬프트와 더 효과적으로 작동합니다. 즉, 모델에게 목표하는 결과를 명확하게 설명하고, 그 결과를 얻기 위한 세부적인 단계별 지침을 제공하기보다는 전체적인 방향성을 제시하는 것이 좋습니다. 과도하게 상세한 이전 지침은 오히려 모델의 탐색 공간을 제한하여 기계적이고 획일화된 응답만을 생성할 수 있습니다.