Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
EGRefine은 텍스트-SQL 모델의 정확도를 저하시키는 모호하거나 약축된 스키마 문제를 해결하기 위해 개발된 실행 기반 최적화 프레임워크입니다. 이 방법론은 데이터베이스 뷰를 활용하여 쿼리 동등성을 유지하면서, 다운스트림 텍스트-SQL 실행 정확도를 최대화하는 컬럼 리네이밍 함수를 찾는 것을 목표로 합니다. EGRefine은 스크리닝, 컨텍스트 기반 후보 생성, 실행 기반 검증의 4단계 파이프라인을 통해 구조적으로 안전하고 신뢰할 수 있는 정교화된 스키마를 제공합니다.
본 기사는 금융 시나리오에서 대형 언어 모델(LLMs)의 안전성 평가를 위한 새로운 레드팀 벤치마크인 FinSafetyBench를 소개합니다. 이 벤치마크는 실제 금융 범죄 사례와 윤리 기준을 기반으로 하며, LLM이 준수 위반 요청을 얼마나 잘 거부하는지 테스트합니다. 실험 결과, 적대적 프롬프트가 기존의 안전 보호 장치를 우회할 수 있는 취약점이 발견되었으며, 특히 중국어 컨텍스트에서 더 높은 취약성이 관찰되어 정교한 방어 전략의 필요성을 강조합니다.