Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
2단계 모델링(2LM)과 다단계 모델링(MLM)의 유지보수 부담을 비교하는 실증적 연구를 소개합니다. MLM의 구조적 통합이 모델 변경 시 발생하는 불일치와 수정 범위를 줄일 수 있는지 변이 기반 실험을 통해 검증합니다.
Simulink 모델 체커의 신뢰성을 검증하기 위해 블록 타입의 형식화와 비트 정밀 일치성 테스트 방법을 제안합니다. SmtMC와 SLDV를 비교 실험한 결과, SmtMC가 Simulink 시뮬레이션 및 SLDV 결과와 더 높은 일치성을 보임을 확인했습니다.
바이브 코딩의 위험성을 해결하기 위해 모델 주도 공학(MDE)과 형식 검증을 결합한 Forge 파이프라인을 제안합니다. LLM이 생성한 코드를 Dafny, CSP, Isabelle 등을 통해 검증하고, 실패 시 수정 프롬프트를 통해 자동 반복하는 폐쇄 루프 구조를 다룹니다.
LEMUR 데이터셋을 활용하여 이종 4-Expert Mixture-of-Experts(MoE4) 아키텍처를 자동으로 탐색하는 파이프라인을 제안합니다. 대규모 탐색 과정에서 발생한 커버리지 편향 문제를 식별하고, 층화 추출을 통한 개선 방안과 최적의 앙상블 조합을 도출했습니다.
이기종 LLM 코딩 에이전트 간의 대화 상태 불일치 문제를 해결하기 위해 이벤트 소싱 기반의 메모리 레이어인 ESAA-Conversational을 제안합니다. 이 아키텍처는 대화 로그를 정규화된 이벤트 스토어로 관리하여 에이전트 간의 원활한 작업 인계와 협업을 지원합니다.
VeriPilot은 LLM을 활용하여 Verilog 설계의 버그를 자동으로 식별하고 수정하는 새로운 디버깅 프레임워크입니다. 골든 레퍼런스 모델과 제어-데이터 흐름 그래프(CDFG)를 결합하여 복잡한 의존성 체인을 추적함으로써 디버깅 정확도를 높였습니다.
ESBMC-PLC+는 기존 PLCverif의 한계를 극복하기 위해 개발된 통합 IEC 61131-3 형식 검증 프레임워크입니다. ST/SCL 프런트엔드 지원과 기능 블록 상태 의미론 도입을 통해 유계가 없는 안전성 증명을 가능하게 합니다.
멀티 에이전트 환경에서 대화의 연속성을 유지하기 위한 '목표 지향적 대화 런타임(GODR)' 디자인 패턴을 제안하는 논문입니다. 목표를 일급 객체로 취급하여 복잡한 상호작용 중에도 목표의 중단, 재개, 수정이 가능하도록 설계되었습니다.
Jupyter Notebooks의 복잡성 증가에 대응하기 위해 셀 단위로 버그를 탐지하는 시스템인 JupOtter를 제안합니다. 노트북 특화 토큰화 전략과 새로운 데이터셋인 OtterDataset을 통해 기존 정적 분석기 및 LLM보다 뛰어난 성능을 입증했습니다.
오픈 소스 프로젝트에서 도메인 주도 설계(DDD)의 실행 방식과 진화, 유지보수 품질 간의 관계를 분석한 실증적 연구입니다. GitHub 저장소를 대상으로 DDD 빌딩 블록의 분포와 경계 위반이 유지보수에 미치는 영향을 조사합니다.
AutoSpec은 귀납 논리 프로그래밍(ILP)과 반례 유도 합성(CEGIS)을 결합하여 LLM 에이전트용 안전 규칙을 자동으로 생성하는 프레임워크입니다. 기존 수작업 규칙의 취약점과 신경망 분류기의 낮은 해석 가능성을 극복하여, 정밀도와 재현율이 높은 해석 가능한 규칙을 진화시킵니다.
LLM을 활용한 요구사항 도출 과정이 산출물의 품질에 미치는 영향을 비교 분석한 실증 연구입니다. 실험 결과, 인간의 협업과 AI의 합성을 결합한 방식이 전통적인 방식보다 더 명확하고 실행 가능한 요구사항을 생성함을 확인했습니다.
양자-고전 하이브리드 소프트웨어 시스템을 설계하기 위해 서비스 지향 아키텍처(SOA) 원칙을 적용하는 연구를 다룹니다. NISQ 장치의 제약 사항을 고려하여 정량적 보장을 통해 최적의 시스템 구성을 탐색하는 방법론을 제안합니다.
Agon은 프롬프트 경제를 기반으로 구축된 자율적 다학제 연구 오케스트레이터입니다. 인간의 개입을 최소화하고 기계가 연구를 확장하며 인간이 조종하는 새로운 연구 패러다임을 제시합니다.
이기종 디지털 트윈(DT) 간의 상호 운용성 문제를 해결하기 위해 '연합 노드 관리자(Federation Node Manager)'를 제안하는 연구입니다. 모듈형 통합 메커니즘을 통해 분산된 DT들이 연합 생태계 내에서 협력할 수 있는 아키텍처를 제시합니다.
Python 애플리케이션의 런타임 상태에서 직접 SBOM을 생성하는 메모리 포렌식 프레임워크 MEM-SBOM을 제안합니다. 휘발성 메모리를 활용하여 기존 도구가 놓치는 동적 의존성을 100% 정확도로 복구하고 취약점을 식별합니다.
RAVEN은 에이전트 기반 RAG와 반복 수정 프로세스를 통합하여 소프트웨어 취약점을 자동 수정하는 프레임워크입니다. 오픈 소스 LLM을 활용하며, 큐레이터 에이전트를 통해 파일 간 의존성을 파악하여 복잡한 취약점까지 해결합니다.
멀티턴 코딩 에이전트의 안전성을 확보하기 위해 기계론적 해석 가능성을 적용한 AgentLens 프레임워크를 제안합니다. 은닉 표현 수준에서 유해한 상태를 탐지하고 부분 공간 개입을 통해 위험 행동을 완화하며, 이를 검증하기 위한 MAS 벤치마크를 함께 도입했습니다.
AI 코딩 에이전트의 결과물뿐만 아니라 엔지니어링 프로세스의 규율을 측정하는 새로운 벤치마크 RigorBench를 소개합니다. 계획, 검증, 복구 등 5가지 핵심 요소를 통해 에이전트의 신뢰성을 정량적으로 평가합니다.
소프트웨어 공학 교육에서 학생들의 성찰(Reflection) 내용을 자동으로 평가하기 위한 8가지 지표 체계와 분류기를 제안합니다. 미세 조정된 RoBERTa 모델이 기존 LLM보다 정확도와 속도 면에서 우수한 성능을 보임을 입증했습니다.