Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
계산 과학 분야의 피어 리뷰를 원고 중심에서 실행 가능한 코드와 데이터 중심의 '코드 우선 피어 리뷰'로 전환하는 비전을 제안합니다. AI 시스템이 실험 환경 구축, 코드 감사, 주장과 증거 매핑을 수행하여 리뷰 인프라 역할을 하는 새로운 프로토콜을 다룹니다.
Random Forest 분류기에서 발생하는 잠재적 의미론적 결함을 탐지하기 위한 데이터 기반 정적 분석 기법을 제안합니다. ML 파이프라인을 DAG로 추출하여 API 계약에 따라 구조 및 데이터 결함을 식별하며, 오픈 소스 도구 dille를 통해 높은 정밀도를 입증했습니다.
Windows 드라이버의 IOCTL 제어 코드 표면을 체계적으로 지도화한 Windows IOCTL Census를 소개합니다. 심볼릭 실행 없이 중간 표현을 분석하여 27,087개 드라이버의 디스패치 표면을 복구하고 대규모 데이터셋을 구축했습니다.
MOLOT은 신뢰할 수 없는 SAST 환경을 위해 설계된 정적 악성 코드 탐지 시스템입니다. 소스 코드를 동작 시퀀스로 변환하여 의심스러운 활동을 탐지하고, 이를 소스 코드 위치로 매핑하여 설명 가능한 결과를 제공합니다.
단일 개발자가 AI를 활용해 5가지 언어와 플랫폼으로 동일한 애플리케이션을 구현한 사례 연구입니다. YAML 명세와 차등 테스트를 안전장치로 활용하여 N-버전 프로그래밍의 현대적 부활을 제안합니다.
소프트웨어 공학 교육 환경에서 LLM의 부적절한 사용이 학생들의 학문적 정직성과 정서에 미치는 영향을 조사한 연구입니다. 116명의 학부생을 대상으로 조사한 결과, 학생들은 무관심, 죄책감, 불안, 안도감 등 매우 이질적인 정서적 반응을 보였습니다.
LLM 판사가 상충하는 증거가 존재할 때 비방향성 판결(CONFLICTING) 대신 편향된 방향성 판결을 내리는 '체리피킹 오버라이드(CCO)' 현상을 분석합니다. 연구팀은 기존 수정 방법론의 한계를 지적하며, 판결 생성과 확약을 분리하는 외부 확약 제어 계층을 제안합니다.
애자일 환경에서 비자발적 기술 부채를 관리하기 위한 통합 모델을 제안합니다. 백로그, 부채, 속도, 경제적 가치 간의 역학 관계를 공식화하여 신규 개발과 부채 복구 사이의 최적 균형을 찾는 동적 정책을 제시합니다.
소프트웨어 공학 분야의 체계적 문헌 고찰(SLR) 학습과 계획 활동을 지원하는 LLM 기반 대화형 어시스턴트 SLRMentor를 소개합니다. 이 도구는 검색 문자열 구축 및 포함/제외 기준 설정 등 주요 과업을 지원하며 연구자의 진입 장벽을 낮춥니다.
Contract2Tool은 LLM 에이전트가 도구를 사용할 때 필요한 전제 조건과 효과를 자동으로 추론하는 프레임워크입니다. 메타데이터와 실행 추적을 활용해 경량 계약을 생성함으로써, 도구 호출의 정확도를 높이고 토큰 비용을 획기적으로 절감합니다.
다자간 채팅에서 얽힌 대화를 분리하는 Dialogue Disentanglement 성능을 높이기 위한 자동 프롬프트 최적화 방법론인 DD-GEPA를 제안합니다. 프롬프트를 세 가지 구성 요소로 분해하고 GEPA를 통해 최적화하여 기존 수작업 프롬프트보다 높은 정확도를 달성했습니다.
TICoder는 테스트 주도 계획과 구현 인지 재사용을 결합한 새로운 저장소 수준 코드 생성 프레임워크입니다. 테스트 케이스를 통해 계획을 정교화하고 이중 관점 유사도로 함수 재사용성을 높여 기존 SOTA 모델보다 높은 성능을 보였습니다.
MCP 환경에서 도구 오류 메시지의 암묵적 권위를 악용하는 '오류 경로 주입(Error-Path Injection)' 공격을 분석합니다. VATS 프레임워크를 통해 프런티어 모델들을 테스트한 결과, 오류 컨텍스트를 활용한 공격이 기존 간접 프롬프트 주입보다 훨씬 높은 성공률을 보임을 입증했습니다.
오픈 소스 소프트웨어(OSS) 내 개발자 중복 제거를 위한 확장 가능한 파이프라인과 모델 선택 가이드를 제안합니다. LLM 지원 매칭 프로세스로 구축한 데이터셋을 활용해 다양한 ML 모델의 정밀도, 계산 비용, 에너지 소비량을 비교 분석했습니다.
본 논문은 결정론적 파서의 제약을 극복하기 위한 범용 문맥 자유 파서(General Context-Free Parsers) 알고리즘들을 비교 분석합니다. Rust로 구현된 6가지 알고리즘을 22개의 문법으로 벤치마크한 결과, GLR 계열이 실용적인 성능 우위를 점함을 입증했습니다.
Kubernetes 장애 진단을 위해 LLM 추론과 그래프 탐색을 결합한 Graph Traversal Agent를 제안합니다. 타입화된 증거 그래프를 활용하여 결정론적인 도구 연산과 검증 단계를 거침으로써 신뢰할 수 있는 근본 원인 분석(RCA)을 수행합니다.
LLM이 생성한 단위 테스트와 인간이 작성한 테스트의 결함 탐지 능력을 Python 벤치마크를 통해 비교 연구했습니다. 연구 결과, 검색 증강 컨텍스트를 활용한 LLM이 인간보다 높은 결함 탐지율을 보였으며, 기존 커버리지 지표가 결함 탐지 능력을 충분히 반영하지 못함을 입증했습니다.
SWE 에이전트의 도구 사용 궤적을 분석하여 그들의 사고방식을 가시화하는 연구를 소개합니다. 새로운 프레임워크 Ada를 통해 에이전트의 탐색, 증거 선택, 중단 결정을 관찰 가능한 데이터로 변환하여 행동 프로필을 생성합니다.
LLM이 Rust 코드 생성 시 존재하지 않는 crate를 제안하는 패키지 환각 현상을 분석한 최초의 실증적 연구입니다. 모델 파라미터 크기와 상관없이 일관된 환각 패턴이 나타남을 확인하였으며, 이를 완화하기 위한 프롬프트 엔지니어링 전략을 제시합니다.
기업용 속성 그래프 환경에 특화된 Text-to-Cypher 벤치마크 생성 파이프라인인 PIPE-Cypher를 제안합니다. 스키마 프로파일링과 실행 검증 등을 결합하여 실제 도메인 질문을 반영한 고품질의 NL-to-Cypher 데이터셋을 자동으로 생성합니다.