Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM 에이전트가 낮은 권한의 대안이 있음에도 높은 권한의 도구를 선택하는 '과도한 권한 도구 선택' 문제를 연구합니다. 새로운 벤치마크인 ToolPrivBench를 통해 에이전트의 위험한 도구 선택 패턴을 분석하고, 이를 완화하기 위한 권한 인식 사후 학습 방어 기법을 제안합니다.
LLM이 생성한 GPU 커널의 정확성을 검증하는 기존 벤치마크들의 한계를 지적합니다. 고정된 형태와 소규모 샘플을 사용하는 기존 방식이 실제 버그를 놓칠 수 있음을 실험적으로 증명했습니다.
소프트웨어 테스트 역량인 비판적 테스트 리터러시(CTL)를 향상시키기 위해 퍼즐 기반 학습 프레임워크인 P4TEST를 제안합니다. 다양한 워크숍을 통해 퍼즐 기반 교육이 학습자의 인지 모델과 성찰 과정에 미치는 영향을 분석했습니다.
AI 코딩 에이전트 환경에서 N-버전 프로그래밍의 효용성을 검증한 연구입니다. Knight-Leveson 실험을 재검토하여 에이전트 간 공통 모드 실패를 분석하고, 다수결 투표를 통한 오류 감소 효과를 입증했습니다.
양자 소프트웨어 공학(QSE)의 기술 부채를 해결하기 위해 LLM과 RAG를 결합하여 Qiskit 코드를 자동 마이그레이션하는 하이브리드 접근 방식을 제안합니다. 분류 체계 기반의 RAG 아키텍처를 통해 LLM의 환각을 줄이고 코드 리팩토링의 정밀도를 높이는 연구 결과를 제시합니다.
LLM의 연역적 추론 능력을 정밀하게 평가하기 위해 단항 1차 논리(QMFOL) 기반의 자동화된 벤치마크 생성 프레임워크를 제안합니다. 논리적 복잡성을 정밀하게 제어하며, 외부 증명기를 통해 논리적 일관성을 보장하는 QMFOLBench를 구축했습니다.
AutoPass는 컴파일러 내부 상태와 런타임 피드백을 분석하여 최적의 컴파일 옵션을 찾아내는 멀티 에이전트 프레임워크입니다. LLM이 컴파일러의 중간 표현을 직접 분석함으로써 기존 블랙박스 방식의 한계를 극복하고 성능을 최적화합니다.
재생 에너지 커뮤니티(REC)의 디지털 트윈 구축을 위한 MBSE 워크플로우를 제안합니다. SysML과 Modelio를 사용하여 장치 분류 및 조직 뷰를 모델링하고, SysML의 의미론적 격차를 해결하기 위해 SAREF4ENER 온톨로지를 결합하는 방안을 탐구합니다.
강화학습(RL) 에이전트의 학습을 위해 다양한 환경 변형 제품군을 효율적으로 생성하는 모델 주도 접근 방식을 제안합니다. 하이브리드 유전 알고리즘과 모델 변환 엔진을 활용하여 기존의 수동적이고 노동 집약적인 환경 개발 프로세스를 자동화합니다.
대규모 모델의 효율적인 운영을 위한 토큰 중심의 추론 최적화 기술과 4계층 아키텍처를 제안하는 논문입니다. 다중 모델 융합부터 컴퓨팅-네트워크-모델 융합까지의 기술적 경로를 체계적으로 검토합니다.
AI 에이전트의 도구 사용 및 데이터 처리 과정에서 GDPR 규정 준수를 보장하기 위한 런타임 검증 프레임워크 C-Trace를 제안합니다. 실행 트레이스를 분석하여 비준수 동작을 실시간으로 차단하고, 레드팀 공격을 통해 프레임워크의 방어 성능을 입증했습니다.
개발자의 인지적 다양성이 GitHub Copilot Chat과의 상호작용 방식에 미치는 영향을 연구한 논문입니다. 27명의 피실험자를 통해 5가지 상호작용 모드와 10가지 요구사항을 규명하여 개념 모델을 제시합니다.
자연어 프롬프트만으로 소프트웨어를 구축하는 '바이브 코딩(vibe coding)'의 실효성을 평가하는 연구입니다. Python을 활용해 LLM이 그린필드 프로그래밍 작업을 얼마나 잘 수행하는지 측정하기 위한 평가 스위트를 개발하고 분석했습니다.
ASTRA는 항공교통관제사(ATCO) 교육을 위해 자율형 심파일럿을 갖춘 차세대 시뮬레이터를 소개합니다. 현지 음성 모델과 ASR 파이프라인을 통해 단어 오류율(WER)을 획기적으로 낮추고, AI 기반의 무선 통신 성능 평가 프레임워크를 제공합니다.
딥러닝 컴파일러와 하드웨어 플랫폼 간의 상호작용에서 발생하는 버그를 탐색하기 위한 새로운 테스트 프레임워크 XCheck를 제안합니다. 풀스택 제약 조건을 활용하여 기존 방식이 놓치기 쉬운 컴파일러-플랫폼 간의 불일치를 자동으로 탐지합니다.
Mozilla의 성능 엔지니어링 시스템인 Perfherder의 이상 탐지 성능을 개선하기 위해 다양한 변화점 탐지(CPD) 방법론을 연구했습니다. 174개의 시계열 데이터셋을 통해 25가지 CPD 방법과 15가지 앙상블 접근 방식을 비교 분석하여 최적의 성능 향상 방안을 제시합니다.
LLM을 활용하여 과학적 워크플로우의 명세 생성, 자동 디버깅, 분산 실행을 통합 관리하는 새로운 접근 방식을 제안합니다. 구조화된 명세 단계를 통해 투명성을 높이고, MCP 계층을 통합하여 Pegasus WMS와의 연동 및 효율적인 제어를 지원합니다.
YouTube의 소프트웨어 엔지니어링 튜토리얼 200개를 분석하여 교육 콘텐츠 내 성별 재현 양상을 조사한 연구입니다. 분석 결과, 남성 중심적인 언어와 역할 배분이 지배적이며 여성의 주체성이 결여된 '주체성 격차'가 확인되었습니다.
L5는 퍼마컴퓨팅 원칙을 적용하여 지속 가능한 창의적 코딩을 지향하는 새로운 Lua 기반 프레임워크입니다. 본 논문은 다섯 가지 사례 연구를 통해 설계 결정과 지속 가능성, 사용성 사이의 상충 관계를 탐구합니다.
AI 시스템의 안전한 테스트를 위한 AI 샌드박스의 위협 모델, 분류 체계 및 측정 프레임워크를 제안하는 논문입니다. 디지털 AI부터 사이버-물리 시스템까지 아우르는 제어된 환경에서의 검증 및 보증 방법을 다룹니다.