Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
MLOps 프로젝트의 체계적인 설계를 위해 ML 모델 통합 및 배포 시 고려해야 할 아키텍처 가이드라인을 제안합니다. 103개의 회색 문헌을 분석하여 5가지 범주, 25개의 주요 가이드라인을 도출했습니다.
기업용 에이전트 시스템을 위한 통제된 멀티 에이전트 아키텍처인 Queen-Bee를 제안합니다. BeeSpec을 통해 전문화된 Bee 에이전트들이 정책 준수 및 격리된 환경에서 MCP 인터페이스를 안전하게 활용하도록 설계되었습니다.
AutoPipelineAI는 자연어 설명을 기반으로 GitHub Actions나 GitLab CI/CD와 같은 CI/CD 파이프라인 스크립트를 자동 생성하는 시스템입니다. LLM을 활용해 저장소 구조를 분석하고 의도를 파악하여 복잡한 DevOps 설정 과정을 단순화합니다.
Bloomberg에서 개발한 Pomona는 에이전트 기술을 활용해 코드 품질을 지속적으로 개선하는 경량 도구입니다. 발견과 점진적 수리의 사이클을 자동화하여 작은 단위의 PR을 생성하며, 엔지니어의 개입을 통해 기술 부채를 효과적으로 관리합니다.
LLM 에이전트가 개발자 문서를 정확하게 작성하고 검토할 수 있도록 파일 간 의존성을 시각화하고 검색하는 Context-as-a-Service(CaaS)를 제안합니다. CaaS는 소스 코드와 API 참조를 인덱싱하여 에이전트가 코드베이스 전반의 의존성 체인을 효과적으로 추적하게 돕습니다.
LLM 에이전트의 효과적인 근본 원인 분석(RCA)을 위해 데이터 중심에서 객체 중심 모델링으로 전환하는 UModel 프레임워크를 제안합니다. 시맨틱 그래프와 U-SPL 쿼리 인터페이스를 통해 파편화된 데이터를 통합하고 시스템 탐색 능력을 강화합니다.
LLM 애플리케이션의 신뢰성을 확보하기 위해 수락 테스트 주도 개발(ATDD)을 적용한 새로운 평가 프로토콜을 제안합니다. 비즈니스 요구사항을 행동 계약과 릴리스 게이트로 변환하여, 모델이나 프롬프트 변경 시 안정적인 시스템 운영을 보장합니다.
SPOQ는 멀티 에이전트 시스템의 조정 오버헤드와 품질 문제를 해결하기 위한 새로운 오케스트레이션 방법론입니다. 웨이브 기반 디스패치, 이중 검증 게이트, 인간 참여형(HaaA) 구조를 통해 소프트웨어 엔지니어링 작업의 속도와 정확도를 획기적으로 높였습니다.
SBOM 생성 도구들이 소프트웨어 구성 요소를 식별하는 방식의 모호성과 한계를 분석합니다. cdxgen, syft 등 주요 도구들을 다양한 언어 환경에서 테스트한 결과, 모든 구성 요소를 완벽히 커버하지 못하는 공통적인 격차가 발견되었습니다.
MAAD는 요구사항을 다중 뷰 아키텍처 청사진으로 변환하기 위해 4개의 특화된 에이전트를 활용하는 지식 기반 프레임워크입니다. RAG와 계층적 메모리를 통합하여 아키텍처 표준을 준수하고 설계 이력을 관리하며, 자동화된 품질 평가를 제공합니다.
기존 DORA 프레임워크의 한계를 극복하기 위해 배포 리듬의 규칙성을 측정하는 '전달 일관성(DC)' 지표를 제안합니다. 120주간의 데이터를 통해 DC와 Delivery Health Matrix를 결합하여 엔지니어링 팀의 성과를 더욱 정밀하게 진단할 수 있음을 입증했습니다.
멀티 에이전트 시스템의 워크플로우가 설계된 대로 실행되는지 검증하기 위한 구조적 커버리지 테스트 접근법을 제안합니다. DSPy를 활용해 워크플로우 명세를 시나리오로 변환하고, 도구 접근 및 위임 경로의 적절성을 평가합니다.
Model Context Protocol(MCP) 환경에서 에이전트와 외부 도구 서버 간의 보안 격차를 해소하기 위한 mcp-attested 메커니즘을 제안합니다. 서버 인증, 도구 허용 목록 적용, 감사 로그 기록을 통해 안전한 도구 사용 범위를 제한하는 보안 확장 방안을 다룹니다.
SmellDoc은 Elastic Stack을 확장하여 마이크로서비스의 코드 악취를 탐지하고 시각화하는 프레임워크입니다. 정적 및 런타임 분석을 결합하여 84가지 악취 유형에 대한 지식 베이스를 제공하며, Kibana를 통해 운영자에게 실행 가능한 통찰력을 제공합니다.
FMU 기반 시뮬레이션 모델의 검증을 위해 LLM 기반 다중 에이전트 워크플로우를 활용한 메타모픽 테스팅 기법을 제안합니다. 명세로부터 메타모픽 관계(MR)를 자동으로 추출하여 테스트 케이스 생성과 출력 일관성 평가를 자동화합니다.
KYA는 자율 에이전트 시스템의 신뢰성과 거버넌스를 보장하기 위한 오픈 소스 프레임워크입니다. 서명 검증, 계층적 정책 구성, 신뢰 점수 통합 등 5가지 프리미티브를 통해 에이전트의 오작동이나 통제 이탈을 탐지하고 방지합니다.
HarnessAPI는 Python 함수를 HTTP 엔드포인트와 MCP 도구로 동시에 배포할 수 있게 해주는 스킬 우선 프레임워크입니다. 단일 소스(Pydantic 스키마)를 통해 스트리밍 API와 에이전트용 도구를 자동 생성하여 코드 중복을 제거합니다.
본 논문은 양자 수송 코드인 libNEGF를 대상으로 진행한 2년간의 연구 소프트웨어 엔지니어링(RSE) 사례를 다룹니다. CI, 자동화된 테스트, 지속적 벤치마킹 등의 품질 보증 관행을 통해 메모리 오류와 수학적 모델 오류를 발견한 과정을 설명합니다. 또한, HPC 시스템 변화에 따른 성능 퇴보를 탐지하는 방법과 과학 계산 코드에서 발생할 수 있는 결함의 위험성을 강조합니다.
본 연구는 규제가 엄격한 기업 환경에서 AI 에이전트의 지원을 받는 1인 스쿼드가 레거시 제품 개발을 성공적으로 수행한 사례를 분석합니다. 단 한 명의 스태프 엔지니어가 4인 규모의 업무를 계획된 시간의 절반 만에 완료하며 높은 코드 수용률과 비용 절감 효과를 입증했습니다. 결과적으로 AI 증강 모델의 성공은 모델의 성능보다 사양의 품질과 조직 지식에 달려 있음을 시사합니다.
본 논문은 자율적인 코드 생성이 반드시 엔지니어링 품질 향상으로 이어지지는 않는다는 점을 지적하며, 프롬프트 엔지니어링을 넘어선 '엔지니어링 프로세스 제어'의 중요성을 강조합니다. 이를 위해 대화형 의도를 구조화된 산출물과 검증 가능한 증거로 변환하는 Agentic Agile-V 프레임워크를 제안합니다. 이 프레임워크는 소프트웨어, 펌웨어, 하드웨어 개발 전반에 걸쳐 체계적인 워크플로우를 제공하는 것을 목표로 합니다.