Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM 기반 코딩 에이전트를 활용하여 특정 워크로드와 환경에 최적화된 시스템을 처음부터 합성하는 '적기 시스템(JIT Systems)' 개념과 Jitskit 파이프라인을 제안합니다. Jitskit은 다양한 명세에서 기존 최첨단 시스템을 능가하는 성능을 보여주었습니다.
Code LLM의 신뢰성을 위협하는 미세한 데이터 오염을 탐지하기 위한 의미 인식 프레임워크 TRACER를 제안합니다. 세 가지 수준의 의미적 중첩을 활용한 파이프라인을 통해 기존 방식보다 월등한 탐지 성능을 입증했습니다.
LLM이 생성한 소프트웨어 버그 리포트 요약본에서 발생하는 환각 현상을 섹션 단위로 분석하고 탐지하는 연구를 소개합니다. 기존의 전체 응답 중심 평가에서 벗어나, 구조화된 섹션별로 환각 여부와 유형을 식별하는 새로운 접근 방식을 제안합니다.
본 연구는 멀티 에이전트 프로그래밍 환경에서 Designer와 Programmer 역할 간의 대화 패턴과 협업 역학을 분석합니다. 7개의 오픈 소스 LLM 조합을 통해 효율성, 일관성, 효과성 측면에서 에이전트 간 상호작용이 결과 수렴에 미치는 영향을 실증적으로 조사했습니다.
Palette는 LLM의 일률적인 안전 정렬 문제를 해결하기 위해 제안된 모듈형 프레임워크입니다. 권한이 있는 전문가에게는 정당한 요청을 허용하고 일반 사용자에게는 안전성을 유지하며, 경량 적응과 파라미터 병합을 통해 효율적인 도메인별 제어를 지원합니다.
본 연구는 ML 평가 하네스의 운영 과제를 분석하기 위해 57개의 시스템과 16,560개의 이슈를 실증적으로 조사했습니다. 연구 결과, 대부분의 이슈가 외부 통합 단계인 명세 단계에서 발생하며, 미구현 기능과 문서화 공백이 주요 원인임을 밝혀냈습니다.
긴 에이전트 기반 코딩 세션에서 모델의 페르소나가 변하는 '페르소나 드리프트'를 측정하기 위한 벤치마크 ContextEcho를 소개합니다. 23개의 최첨단 모델을 분석하여 세션 압축이 드리프트를 해결하지 못하며, 이것이 도구 사용 및 채팅 품질에 미치는 영향을 규명합니다.
본 논문은 그래프 기반의 마이크로서비스 성능 이상 탐지 기술을 침입 탐지에 적용할 수 있는지 연구합니다. GCN 모델을 통해 높은 정확도를 기록했으나, 엄격한 실험 결과 추적 구조 외에 로그와 메트릭의 결합이 필수적임을 밝혀냈습니다.
소프트웨어 생태계의 Breaking Changes를 다룬 97개의 주요 연구를 체계적으로 문헌 고찰한 연구입니다. 5개 생태계를 대상으로 파괴적 변경의 분류 체계, 원인, 탐지 방식 및 대응 전략을 종합적으로 분석했습니다.
LLM 사용 시 학습자가 인지적 노력을 생략하는 문제를 해결하기 위해, 생산적 고군분투와 평가적 판단을 유도하는 프롬프트 패턴 프레임워크를 제안합니다. 디자인 과학 연구를 통해 9가지 프롬프트 패턴을 도출하고 보안 코딩 교육 모듈에 적용하여 그 효용성을 입증했습니다.
Code2UML은 대규모 코드베이스를 분석하여 UML 다이어그램을 자동 생성하는 에이전트형 LLM 아키텍처를 제안합니다. 컨텍스트 엔지니어링과 5개의 특화된 에이전트 계층을 통해 토큰 제한 문제를 해결하고 확장성을 확보했습니다.
바이브 코딩(Vibe Coding) 관행이 사용자 경험 수준에 따라 어떻게 달라지는지 분석한 연구입니다. 비개발자, 초보자, 전문가 그룹을 대상으로 조사한 결과, 코드 위험성에 대한 인식은 유사하나 품질 검증 및 상호작용 방식에서 뚜렷한 차이가 나타났습니다.
AI 기반 적응형 공격자가 공개 키 암호 방식(PKC)의 보안을 어떻게 침식시키는지 조사합니다. 알고리즘 중심 모델과 실제 구현 수준의 관찰 가능성을 악용하는 공격 현실 사이의 불일치를 다룹니다.
LLM의 수학적 추론 오류를 수정할 때 발생하는 '정답이 오답으로 변하는 위험'을 방지하기 위한 GuardedRepair 프레임워크를 제안합니다. 이 연구는 검증 가드를 통해 안전성이 확인된 경우에만 추론 경로를 교체하는 선택적 복구 방식을 다룹니다.
LLM의 컨텍스트 기반 지식 유지 방식과 가중치 통합(LoRA 미세 조정) 방식의 성능을 비교 연구했습니다. 실험 결과, 가중치 통합 방식이 계층적 압축 방식보다 지식 보존율에서 약 43.6%p 높은 성능을 보였습니다.
LLM과 IC3 알고리즘을 결합하여 분산 프로토콜의 귀납적 불변량을 자동으로 합성하는 신경-기호 프레임워크 IC3Syn을 제안합니다. 기존 방식의 논리적 제한을 극복하고 복잡한 산업 규모의 프로토콜에서도 안전성을 입증하는 데 성공했습니다.
POLARIS는 자연어 정책을 1차 논리(FOL)로 변환하여 LLM의 안전성을 체계적으로 테스트하는 새로운 프레임워크입니다. 의미론적 정책 그래프를 통해 정책 위반 패턴을 탐색하고, 기존 방식보다 높은 정책 커버리지와 공격 성공률을 달성했습니다.
LLM을 활용한 코드 변환 시 발생하는 의미론적 드리프트 문제를 해결하기 위해 명세 기반의 Code2Text2Code 재공학 프레임워크를 제안합니다. 소스 코드를 중립적인 텍스트 명세로 변환한 뒤 다시 코드로 생성하여 프로그램의 의도와 동작을 정확하게 보존하는 것이 핵심입니다.
ABA(응용 행동 분석) 분야의 데이터 보안 문제를 해결하기 위해 제안된 합성 인스트럭션 튜닝 데이터셋 TRACE를 소개합니다. 이 데이터셋은 결정론적 분류 체계를 기반으로 교수 프로그램 생성 및 행동 로그 해석 작업을 위한 2,999개의 고품질 예시를 포함합니다.
Python의 동적 타이핑 특성으로 인해 발생하는 회귀 테스트 선택(RTS)의 어려움을 해결하기 위한 새로운 접근 방식인 NameRTS를 제안합니다. NameRTS는 코드 요소와 이름 노드의 이분 그래프 모델링을 통해 정밀한 의존성 분석을 수행하며, 기존 방식보다 높은 효율성과 안전성을 입증했습니다.