Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Atlassian과 OpenAI의 파트너십을 통해 기업 지식에 깊이 있는 조직적 맥락을 제공합니다. 이를 활용하여 고객들은 일상 업무 환경에서 강력한 에이전트적 역량을 구현할 수 있게 되었습니다.
오픈 소스 추론 테스트 도구 AA-AgentPerf-Local을 발표하여 로컬 AI 모델의 에이전트 성능 측정 기준을 제시했습니다. 이 도구는 노트북 및 워크스테이션 환경에서 실제 에이전트 궤적과 복잡한 컨텍스트를 재현하며, 다양한 하드웨어와 인기 모델 조합의 추론 속도를 테스트할 수 있게 합니다.
본 논문은 취약점 패치 검색의 효율성을 높인 2단계 시스템 'PatchHolmes'를 제안합니다. 이 시스템은 하이브리드 검색기와 에이전트 기반 검사 루프를 결합하여, 후보 목록 전체를 한 번에 보고 최적의 커밋을 선택적으로 읽어냅니다. 실험 결과, 기존 방식 대비 높은 Recall@1 성능과 효율성을 입증했습니다.
중국 규제 당국이 휴머노이드 로봇 스타트업의 IPO 상장 요건을 강화하며 시장에 냉각기를 예고했습니다. 기업들은 지속 가능한 매출, 손실 축소, 핵심 기술 보유 등 높은 기준을 충족해야 하며, 이는 극소수만이 공모 시장 진입이 가능함을 시사합니다.
Kaggle의 NVIDIA Nemotron Model Reasoning Challenge에 참가하여 동메달을 획득한 경험을 공유합니다. 이 대회는 LoRA를 활용해 LLM으로 논리 퍼즐 정답률을 높이는 것이 목표였습니다. 공개 환경에서 패배했던 베이스라인이 private 테스트에서 역전승하며 메달을 따낸 과정을 상세히 설명합니다.
개선된 H3 RefMods를 통해 이미지 생성 시 정확도를 높이고 아이덴티티 블리딩 문제를 개선했습니다. 특히, latents 데이터를 JPEG 형태로 패킹하여 VAE 없이 텍스트 인코더에 직접 공급함으로써 속도 향상과 캐싱을 구현했습니다. 또한, 프레임 샘플링 전략(stack_pictures)을 조정하여 컨디셔닝의 디테일을 높일 수 있습니다.
KeyHue는 macOS 메뉴바에 현재 선택된 입력 소스를 색 라인으로 시각화하여 보여주는 앱입니다. 이를 통해 사용자는 한/영 전환 여부나 실제 입력 상태를 직관적으로 파악할 수 있습니다. 주요 기능으로는 모든 모니터 하단 표시, Caps Lock 감지, 그리고 다양한 애플리케이션 및 창 전환에 따른 자동 처리가 포함됩니다.
DeepSeek이 중국 AI 생태계에 기여하며, 특히 Ascend 스택을 활용한 훈련 실행 가능성을 높였습니다. DeepSeek의 공개는 최전선 훈련을 재현할 수 있는 완전한 Ascend 스택에는 미치지 못하지만, 매우 근접한 수준에 도달했음을 보여줍니다.
Omarchy는 오프라인으로 작동하며 키보드만 사용하는 데스크톱 프레젠테이션 편집기 및 플레이어입니다. 이 도구는 PowerPoint/Keynote 파일을 열고 pptx 형식으로 저장할 수 있습니다. 또한, gitframe은 터미널 환경에서 diff 도구와 git 명령어를 통합하여 개발 워크플로우를 개선합니다.
본문은 시니어 백엔드 후보자에게 큐 진단 작업을 요청하는 가상 예시를 제시합니다. 기술적 정밀도 평가가 목표일 때는 채팅 환경보다 음성 워크플로우가 더 큰 가치를 제공할 수 있음을 설명합니다.
openTPU는 AI 에이전트가 하드웨어 설계에 참여하여 자체 추론 가속기를 개발할 수 있음을 보여주는 오픈 소스 프로젝트입니다. 이 시스템은 SystemVerilog, 명령어 세트, 커널 언어 등 전 과정을 포함하며, 실제 PCIe 카드에서 최신 모델들을 구동하는 성능을 입증했습니다.
AI Gateway에 신뢰도 기반의 결정 폴백(fallback) 기능이 추가되어, 기본 모델 응답이 설정된 신뢰도 조건을 위반할 경우 폴백 모델로 요청을 에스컬레이션할 수 있게 되었습니다. 이 기능은 Choice 및 Score 질문에 적용되며, 조건들을 결합하여 복잡한 의존성을 가진 에스컬레이션을 구현할 수 있습니다.
OpenGhost는 Windows, Linux, macOS 환경에서 명령 실행, 파일 수정, Git 관리 및 웹 페이지 조작이 가능한 데스크톱 에이전트입니다. 이 도구는 자체 엔진을 통해 모든 결과를 차트와 순서도로 직접 렌더링하는 것이 강점입니다.
Diffusion 모델 기반 편집은 픽셀 단위 제어에 어려움이 있었으나, 본 연구는 소프트 마스크(soft mask)를 활용하여 조절 가능한 강도로 이미지 및 비디오의 재작업을 가능하게 하는 SoftPaint를 제안합니다. 이 방법은 기존 인페인팅을 넘어 연속적인 스펙트럼의 편집을 구현하며, 기울기 계산이 필요 없는 샘플러를 통해 다양한 확산 모델에 적용 가능합니다.
본 논문은 양자 소프트웨어 설계를 자동화하기 위해 '양자 인식 하네스(QSA)'를 제안합니다. QSA는 진화 난이도 기반 코어셋, 정적/스냅샷 분석, 작업별 보상 등 세 가지 양자 특이적 안내 기능을 통합하여 기존의 한계를 극복했습니다. IBM Quantum 플랫폼에서 테스트한 결과, 다중 프로그램밍 및 오류 완화 분야에서 성능 향상을 입증하며 효율성을 높였습니다.
AI 생성 Markdown 표가 길어지면 가독성이 떨어지는 문제를 해결하기 위해 VS Code 확장 기능 'Markdown Workbench S'를 개발했습니다. 이 기능을 사용하면 미리보기 상에서 필터링, 정렬, 헤더 고정 등 Excel과 유사한 강력한 표 조작이 가능합니다.
본 논문은 대규모 평가 파이프라인에서 모든 질문을 고비용의 상위 모델에 전달할 필요 없이, 저렴한 '판별기(Judge)'를 사용하여 스스로 판단하게 하는 방식을 제안합니다. 이 판별기는 자신감 점수(`q`)를 반환하여, 자신감이 높으면 자체적으로 채택하고 낮을 때만 고성능 모델에게 에스컬레이션하는 구조입니다.
AI 생성 비디오 에셋을 활용하는 실용적인 워크플로우를 제시합니다. 단순히 결과물에 의존하기보다, '출력 계약(output contract)'을 정의하고 통제된 변형 세트를 생성하여 검토 가능한 옵션으로 접근해야 합니다. 이는 제품 데모나 랜딩 페이지 루프 제작 시 유효하며, 프롬프트와 설정을 체계적으로 관리하는 것이 중요합니다.
Gemini API의 이미지 생성 및 편집 모델인 Gemini Nano Banana 2.1이 GA되었으며, 기존 모델인 gemini-3.1-flash-image는 2026년 10월 29일 사용 중단됩니다. 사용자들은 코드 내 구형 모델 ID를 신규 모델로 마이그레이션해야 하며, 이는 품질 향상과 비용 효율성을 유지하는 후속작입니다.
Google이 오픈웨이트 멀티모달 임베딩 모델인 EmbeddingGemma 2를 공개했습니다. 이 모델은 텍스트, 이미지, 비디오 등 다양한 모달리티를 단일 벡터 공간에 매핑하며, 데이터를 외부로 전송하지 않고 디바이스 상에서 검색(On-device)할 수 있게 합니다. 이를 통해 프라이버시 보호와 에지 컴퓨팅 환경에서의 RAG 구현이 용이해집니다.