Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM 애플리케이션의 신뢰성을 확보하기 위해 수락 테스트 주도 개발(ATDD)을 적용한 새로운 평가 프로토콜을 제안합니다. 비즈니스 요구사항을 행동 계약과 릴리스 게이트로 변환하여, 모델이나 프롬프트 변경 시 안정적인 시스템 운영을 보장합니다.
멀티모달 사용자 인터페이스(Multimodal UI) 툴킷을 체계적으로 비교하기 위한 새로운 벤치마킹 프레임워크를 제안합니다. 모달리티 커버리지, 개발자 워크플로우, 실험 지원이라는 세 가지 차원을 통해 기존 툴킷들의 성능과 유용성을 평가하는 구조화된 템플릿을 제공합니다.
Android 앱 개발 시 데이터 최소화 원칙을 코드 수준에서 구현하기 위한 실증 연구를 소개합니다. 1,114개의 오픈 소스 앱과 9,875개의 APK를 분석하여 31가지 코딩 가이드라인을 도출했습니다. 또한 LLM 기반 코드 생성 시 발생하는 개인정보 보호 위험을 확인하고, 가이드라인 적용을 통한 해결 방안을 제시합니다.
BlobShuffle은 클라우드 객체 스토리지를 활용하여 스트림 처리 시스템의 셔플링 비용을 획기적으로 절감하는 새로운 접근 방식을 제안합니다. Kafka Streams의 애드온 형태로 구현되어 기존 인프라 수정 없이도 높은 비용 효율성과 성능을 제공합니다.
LLM 에이전트의 기술(Skill) 사용 시 발생하는 보안 및 개인정보 보호 위험을 해결하기 위한 SkillGuard 프레임워크를 제안합니다. 이 모델은 기술의 선언된 의도와 실제 실행 동작을 연결하는 이중 평면 거버넌스를 통해 문맥 주입 공격을 효과적으로 방어합니다.
SPOQ는 멀티 에이전트 시스템의 조정 오버헤드와 품질 문제를 해결하기 위한 새로운 오케스트레이션 방법론입니다. 웨이브 기반 디스패치, 이중 검증 게이트, 인간 참여형(HaaA) 구조를 통해 소프트웨어 엔지니어링 작업의 속도와 정확도를 획기적으로 높였습니다.
AlgoTouch는 텍스트 기반 코딩 대신 데이터 변환 실행을 통해 명령형 프로그램을 점진적으로 구축하는 새로운 시스템을 제안합니다. 실행 동작으로부터 제어 구조를 결정론적으로 합성하여 Python, C, Java 등 다양한 언어에서 정확한 코드를 생성합니다.
소프트웨어 변경 사항과 그에 따른 동적 효과 사이의 관계를 학습하고 예측하는 '신경망 기반 변경 예측(Neural Change Prediction)' 기술을 제안합니다. 코드 실행 없이 의미론적 변화를 예측하는 과제를 해결하며, 코드 수정 위치 식별 및 효과 예측에 활용 가능합니다.
Embodied AI의 신뢰성 확보를 위한 AAAI'26 Bridge Program의 논의를 다룹니다. 시나리오 기반 테스트, 구성적 검증, 런타임 보증을 통합하여 복잡한 환경에서도 안전한 AI 시스템을 구축하는 워크플로우를 제안합니다.
LLM의 과잉 거부 현상을 해결하기 위한 자동화된 프레임워크 DDOR을 제안합니다. 델타 디버깅을 통해 거부를 유발하는 최소 단위의 파편을 찾아내고, 이를 바탕으로 테스트 스위트 생성 및 프롬프트 수정을 수행하여 모델의 사용성을 높입니다.
GenAI와 Agentic AI의 도입으로 소프트웨어 엔지니어링 패러다임이 코드 저작에서 시스템 지시 및 거버넌스로 변화하고 있음을 분석합니다. 연구를 통해 전통적, 생성형 AI 기반, 에이전트 기반의 세 가지 패러다임을 정의하고 미래 엔지니어에게 필요한 역량 프레임워크를 제시합니다.
본 논문은 사이버 물리 시스템(CPS) 개발 과정에서 발생하는 시스템 구현과 요구사항 간의 불일치 문제를 해결하기 위한 프레임워크를 제안합니다. 시스템 실행 데이터를 활용하여 MATLAB Simulink Requirements Tables 기반의 선언적 요구사항을 자동으로 수리함으로써 준수성을 복구합니다.
복잡한 소프트웨어 시스템의 안전한 진화를 위해 살아있는 지식 모델(living KMs)을 구축하는 TrustModel 프레임워크를 제안합니다. 이 모델은 모델링, 적합성 평가, 진화라는 세 가지 에이전트 하위 시스템을 통해 지식 모델을 지속적으로 업데이트하고 동기화합니다.
스마트폰 앱, GNSS-IMU, 승객 평가를 결합한 다중 모드 도로 거칠기 평가 프레임워크를 제안합니다. 실제 도로 데이터 분석을 통해 소비자급 센서와 인지 기반 평가의 유효성을 검증했습니다.
VDI/VDE 3682 표준에 따른 정형화된 프로세스 기술(FPD)을 위한 AutomationML(AML) 도메인 라이브러리를 제안합니다. CAEX 3.0 메타모델을 기반으로 데이터 교환을 위한 표준화된 클래스 라이브러리를 구축하여 도구 간 상호 운용성을 높였습니다.
SBOM 생성 도구들이 소프트웨어 구성 요소를 식별하는 방식의 모호성과 한계를 분석합니다. cdxgen, syft 등 주요 도구들을 다양한 언어 환경에서 테스트한 결과, 모든 구성 요소를 완벽히 커버하지 못하는 공통적인 격차가 발견되었습니다.
에이전트 기반 소프트웨어 엔지니어링(ASE)을 위한 학부 커리큘럼인 ASE-26을 제안하는 논문입니다. AI 에이전트와 협업하는 시대에 필요한 실무적 규율과 학문적 프레임워크를 구축하여 기술 격차를 해소하고자 합니다.
기존 벤치마크의 포화 문제를 해결하기 위해 솔루션 중심의 진화 프레임워크인 BenchEvolver를 제안합니다. 기존 코딩 문제를 실행 가능한 의미론을 기반으로 더 어려운 변형 문제로 자동 변환하여 고품질의 데이터셋을 구축합니다.
코딩 에이전트의 운영 안전성을 평가하기 위한 새로운 벤치마크인 SABER를 제안합니다. 기존의 프롬프트 거부 방식에서 벗어나, 일련의 행동 이후 환경 상태 변화를 통해 안전성을 측정하며 모델별 안전 프로필 분석을 지원합니다.
State-in-Context 에이전트의 토큰 효율성을 높이기 위해 코드 미니피케이션 기술을 적용한 연구입니다. 소스 코드의 의미를 보존하며 불필요한 요소를 제거한 결과, 평균 토큰 사용량을 42% 절감하면서도 성능 하락을 최소화할 수 있음을 입증했습니다.