Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
AArch64 기계어에서 소스 코드 없이 취약점을 탐지하기 위해 설명 가능한 디지털 트윈 기술을 제안합니다. 디지털 트윈을 통해 프로그램 실행 상태를 재현하고, 클레이니 대수 기반의 심볼릭 규칙을 유한 오토마타로 컴파일하여 취약점을 탐지합니다.
Brevis는 무손실 텐서 압축을 프로그램 합성 문제로 공식화하여 모델 체크포인트의 저장 공간을 효율적으로 줄이는 연구입니다. 타입 지정 DSL과 A* 탐색을 통해 텐서 구조를 포착하는 최적의 프로그램을 합성하며, 기존 범용 및 텐서 특화 압축기보다 뛰어난 압축률을 보여줍니다.
STAIR는 코딩 에이전트가 과거의 수정 과정을 계층적 계획으로 변환하여 재사용할 수 있게 하는 프레임워크입니다. 미세한 진단부터 높은 수준의 전략까지 경험을 인코딩하여 새로운 문제 해결 시 프롬프트로 제공합니다. 이를 통해 SWE-bench Verified에서 높은 성능 향상을 입증했습니다.
AgenticRepair는 에이전트 기반의 다각적 프로그램 컨텍스트 엔지니어링을 통해 자동화된 보안 취약점 수정을 수행하는 프레임워크입니다. 코드 구조, 런타임 실행, 커밋 히스토리라는 세 가지 핵심 컨텍스트를 활용하여 기존 방식보다 높은 패치 성공률을 달성했습니다.
에이전틱 AI 시스템의 복잡한 다단계 동작을 검증하기 위한 새로운 방법론을 제시하는 조사 논문입니다. 257편의 논문을 분석하여 행동, 안전, 시간적, 규제, 다중 에이전트라는 5차원 분류 체계를 구축하고 현재 기술의 격차를 규명합니다.
AuditCoder는 코드 생성 시 프로그램과 함께 감사 가능한 생성 추적을 출력하여 생성 결정과 수정 이력을 보존하는 프레임워크를 제안합니다. 작업 그래프를 통해 책임 식별자를 할당하고, 검증 실패 시 특정 영역만 국소적으로 수정할 수 있는 기능을 제공합니다.
AI 코딩 에이전트의 대규모 코드 생성을 효과적으로 검토하기 위한 새로운 시스템 ARCTIC을 제안합니다. 의도 예측, 드리프트 탐지, 코드 스포트라이트 기능을 통해 정확성, 보안, 성능 중심의 고도화된 코드 비평을 수행합니다.
생성형 및 에이전틱 AI 시대에 필요한 '에이전틱 엔지니어'의 역량과 교육 체계를 제안합니다. ACCEL 프레임워크를 통해 커리큘럼, 협업, 지속적 학습을 중심으로 한 통합적 교육 아키텍처를 제시합니다.
NLP 모델 업데이트 시 발생하는 행동 회귀를 탐지하기 위한 도구인 Alteron을 소개합니다. 변형 테스트(Metamorphic Testing)를 활용하여 기존 벤치마크가 놓치기 쉬운 모델 버전 간의 미세한 동작 변화를 식별합니다.
CodeShrink은 멀티모달 거대 언어 모델(MLLMs)의 코드 이해 효율을 높이기 위한 적응형 시각적 압축 프레임워크입니다. 공백 제거 렌더링, 강화학습 기반의 적응형 설정, 지시 사항 인식 토큰 선택을 통해 시각적 토큰 사용량을 최대 71.2%까지 절감합니다.
Solana 네트워크 내 봇의 구현 방식과 온체인 실행 지문을 체계적으로 분석한 연구입니다. GitHub 저장소와 4,400만 개의 트랜잭션 데이터를 바탕으로 봇의 분류 체계와 운영 파이프라인을 규명했습니다.
LLM을 활용하여 Java 병합 충돌을 해결하는 에이전트와 이를 평가하기 위한 보정된 LLM-as-Judge 프레임워크를 제안합니다. 연구 결과, LLM 솔버는 기존 도구보다 높은 커버리지를 보였으나 구조적 정확성 검증에는 한계가 있음을 확인했습니다.
레거시 COBOL 코드를 Java로 마이그레이션할 때 기능적 일관성을 보장하기 위한 에이전트 기반 테스트 합성 방법인 'Locksmith Loop'를 제안합니다. 이 방식은 에이전트 루프를 통해 프로그램 분기를 탐색하고 변이를 수행하여 높은 코드 커버리지를 달성합니다.
본 연구는 LLM을 활용하여 텍스트 요구사항으로부터 마이크로서비스 아키텍처를 자동으로 합성하는 능력을 평가합니다. OpenAI o3 모델을 사용하여 Zero-shot 및 Few-shot 프롬프팅 성능을 비교 분석하였으며, Few-shot 방식이 서비스 식별과 통신 복구 측면에서 더 높은 정확도와 품질을 보임을 입증했습니다.
LLM을 활용하여 교착 상태가 없는 통신 프로토콜 정교화를 수행하는 Syntropy 프레임워크를 제안합니다. MPST 형식 명세를 생성 과정에 통합하여 높은 구문 정확도와 95.6% 이상의 유효성을 달성했습니다.
MediaWiki의 대규모 저장소를 대상으로 의미론적 코드 검색을 수행하는 신경망 기반 시스템을 제안합니다. 계산 의도를 기반으로 검색하며, 분할 빌드 아키텍처를 통해 저사양 환경에서도 효율적인 서빙이 가능함을 입증했습니다.
CodeSpec은 LLM 기반 코드 에이전트가 복잡한 기능 개발을 수행할 때 설계와 구현의 일관성을 유지할 수 있도록 돕는 이중 실행 가능한 명세 방법론입니다. 아키텍처와 동작 명세를 컴파일하여 신뢰할 수 있는 기능 체인을 구축함으로써 기존 에이전트의 한계를 극복합니다.
저장소 수준의 코드 생성을 위해 효율적인 컨텍스트 선택 프레임워크인 MRCoder를 제안합니다. Map-Reduce 패러다임을 활용하여 중복된 컨텍스트를 제거하고, 코드의 구조적 일관성을 유지하며 생성 품질과 추론 효율성을 동시에 높였습니다.
오픈 소스 커뮤니티 내 코딩 에이전트의 기여 규칙 준수 여부를 분석하기 위해 RepoComplianceBench를 구축하고 실험했습니다. 연구 결과, 에이전트들은 프롬프트나 피드백을 통해 공개 및 검증은 수행할 수 있으나, 기여 금지 규칙을 스스로 준수하거나 인간에게 에스컬레이션하는 능력은 부족한 것으로 나타났습니다.
오픈 웨이트 LLM이 생성한 코드 투어가 개발자의 코드베이스 디버깅 경험과 신뢰에 미치는 영향을 연구한 논문입니다. 개발자들은 코드 길이에 따른 상세 조절과 안내하는 어조를 선호하지만, AI 생성 설명에 대한 신뢰도는 사람의 작성물보다 낮게 나타났습니다.