Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 다양한 공정성 시나리오를 체계적으로 분석하고 비교하기 위한 AR 공정성 메타모델을 제시합니다. 이 모델은 에이전트, 자원 등 핵심 요소를 고려하여 평등, 형평성, 그룹/개인 공정성 등 다양한 측정 기준의 정의와 비교가 가능하게 합니다.
연준 위원들은 올해 최소 25bp의 추가 금리 인상이 필요하다고 보고 있으며, 2026년 적정 통화 정책 수준을 평균 4.125%로 예상했습니다. 이는 연준이 긴축 사이클에 진입하고 있음을 시사하며, 시장은 목표 금리의 추세 변화에 주목해야 합니다.
Lean 4 기반의 FloatLib는 광범위한 형식 커버리지와 기계 검사 정확성을 갖춘 임의 정밀도 부동소수점 연산 라이브러리입니다. 이 라이브러리는 IEEE 이진/십진수, 포지트 등 다양한 형식을 통합하며, 모든 백엔드가 완전한 인코딩 사양과 같음을 증명합니다. FloatLib는 높은 정확성과 속도를 동시에 제공하는 검증된 소프트웨어 솔루션입니다.
운송사 검증 플랫폼 Highway가 자체 재무 상태를 사기 탐지 제품에 활용하고 있습니다. 이 시스템은 브로커의 보증 표준을 통해 운송 중 발생하는 적재물 분실 위험을 관리하며, 북미 지역 대다수 운송사를 포괄합니다. 최근 발생한 10만 달러 손실 사례는 신원 설계 결함과 사기 운송사의 재진입 시도에서 비롯된 운영상의 문제점을 보여줍니다.
본 논문은 AI 에이전트가 하드웨어 아키텍처를 설계할 때, 단순히 성능 개선을 넘어 '왜' 개선되었는지 이해하는지 탐구합니다. AutoTuring이라는 새로운 평가 방식을 도입하여, 명시적 지식(named knobs)과 익명 변수(anonymous variables)로 구성된 동일한 가속기 공간에서 에이전트를 테스트했습니다. 그 결과, 아키텍트가 모델링된 H200보다 높은 성능을 보였으나, 구조화된 비평은 오히려 대체재처럼 작동하는 경향을 발견했습니다.
Rosetta는 연구 논문 PDF를 입력받아 제1원리 분석 모델을 자동으로 생성하는 다중 에이전트 LLM 파이프라인입니다. 이 시스템은 수학적 명세, 실행 가능한 Python 코드, 그리고 영어 해석본을 인간의 개입 없이 자율적으로 산출합니다. 특히 형식화 과정 자체가 논문의 암묵적인 가정을 표면화하고 누락된 매개변수를 식별하는 데 큰 가치를 제공합니다.
OpenAI의 GPT-Live 1이 AI Gateway에서 사용 가능해졌습니다. 이 모델은 듣기와 말하기를 동시에 처리하는 풀-듀플렉스 음성 기능을 제공하며, 대화 중에도 백그라운드 작업을 독립적으로 수행할 수 있는 클라이언트 위임(client delegation)을 지원합니다.
본 논문은 LLM 에이전트가 존재하지 않는 도구를 호출하거나 스키마에 없는 인수를 전달하는 '도구 환각(Tool Hallucination)' 문제를 다룹니다. 기존의 방어책들이 이 구조적 사각지대를 해결할 수 없음을 증명하며, 폐쇄 세계 해결사 및 새로운 벤치마크를 제시합니다.
Splyce는 MLIR 기반 자동 벡터화 프레임워크로, 희소-희소 코이터레이션 루프의 병목 현상을 해결합니다. 이중 경로 실행 모델과 선택적 예측을 활용하여 데이터 의존성 브랜치를 제거하고 명령어 수준 병렬성을 극대화합니다. 테스트 결과, 다양한 희소 텐서 커널에서 높은 성능 향상(1.96X~2.86X)을 입증했습니다.
본 논문은 PaRID(PaRallel Instruction Duplication)라는 소프트웨어 지향형 프레임워크를 제안합니다. 이는 컴파일 시간 노력만으로 멀티스레딩 병렬 프로그램의 소프트 에러를 탐지하며, 직렬/병렬 혼합 환경을 지원하고 성능 오버헤드를 최소화하는 것이 특징입니다. LLM 기반 모델링과 결합하여 빠른 오류 탐지를 가능하게 했습니다.
FreedomIntelligence가 Qwen3.5-9B 기반의 의료 LLM인 HuatuoGPT-3-9B를 공개했습니다. 이 모델은 One-stage Policy Optimization (OnePO)이라는 단일 강화 학습 방식을 적용하여 별도의 도메인 특화 지도 미세 조정 없이 의학 분야에 적응시켰습니다.
중국 언론에 따르면, Google이 플래그십 모델 Gemini 4 Pro를 'gemini-3.8-flash'라는 이름으로 테스트용으로 공개한 것으로 알려졌습니다. 이 모델은 코딩, 에이전트, 추론 등 여러 분야에서 OpenAI의 Astra와 Anthropic의 Fable을 능가하며 현존 최강 수준이라는 평가를 받았습니다.
Hacktron은 libheif RCE 취약점과 OpenAI SSO 설정 오류를 결합하여 여러 OpenAI 직원의 ChatGPT 및 Codex 계정을 탈취했습니다. 공격은 포럼 이미지 업로드 경로의 취약점을 시작으로, SSO 연결성을 통해 내부 저장소 접근까지 확장되었습니다. 이 사건은 시스템 보안 설계와 인증 흐름의 중요성을 강조합니다.
구글이 플래그십 모델 Gemini 4 Pro를 'gemini-3.8-flash'로 위장하여 테스트용으로 공개했습니다. 이 모델은 코딩, 에이전트, 추론 등 여러 능력에서 OpenAI의 Astra와 Anthropic의 Fable 5.1을 능가하며 현존 최강 수준으로 평가받고 있습니다.
알리바바가 사내에서 개발한 AI 코드 리뷰 도구가 오픈소스로 공개되어 주목받고 있습니다. 기존 LLM 기반 에이전트의 한계점(변경량에 따른 누락, 위치 오류 등)을 지적하며, 결정론적 엔지니어링과 에이전트를 결합하여 신뢰성 높은 코드 검토 시스템 구축 방안을 제시합니다.
Byparr는 Cloudflare의 브라우저 검사로 인해 웹사이트 로딩이 차단되는 문제를 해결하는 자체 호스팅 도구입니다. 이 도구는 개발자들이 겪을 수 있는 기술적 장벽을 우회하여 웹 콘텐츠 접근성을 높이는 데 초점을 맞추고 있습니다.
Superstreamer라는 오픈 소스 도구를 자체 호스팅하여 비디오 파일을 부드러운 온라인 재생 스트림으로 변환할 수 있습니다. 또한, 이 도구를 활용해 필요에 따라 직접 제작한 광고나 인트로 클립을 쉽게 삽입하는 기능도 제공합니다.
Palantir Technologies는 주요 계약 관련 비판에 대응하고 영국 내 운영을 강화하기 위해 전 노동당 부대표인 Tom Watson을 고위 임원으로 영입했습니다. 이는 회사의 정치적 입지를 다지고 영국 시장에서의 영향력을 확대하려는 전략으로 해석됩니다.
본 연구는 TSMC 16 nm FinFET 공정을 기반으로 양의 피드백 부가직(PFAL)을 조사했습니다. 전력-클럭 파형 최적화를 통해, 최소 에너지 동작은 기존 사다리꼴보다 삼각형 형태에 가까워짐을 발견했습니다. 이를 활용하여 설계된 조합 회로는 정적 CMOS 대비 높은 에너지 효율과 낮은 에너지를 달성했습니다.
본 논문은 중국의 복잡한 AI 생성 콘텐츠 규정 준수 요구 사항을 다루기 위해 새로운 벤치마킹 프레임워크를 제시합니다. 이 프레임워크는 2303개의 질문으로 구성되어 20개 LLM에 대한 규정 준수 및 거부율 평가 결과를 제공하며, 중국어 환경에서의 모델 성능 분석에 기여합니다.