HERMES AGENT v0.19.0 출시: QUICKSILVER 릴리스
요약
HERMES AGENT v0.19.0 'QUICKSILVER' 릴리스를 통해 첫 토큰 도달 속도를 80% 개선했습니다. 추론 모델의 실시간 사고 과정 스트리밍, 스마트 승인 시스템, 보안 강화를 위한 비밀 소스 연동 등 에이전트 운영 효율과 안정성을 대폭 높였습니다.
핵심 포인트
- 첫 토큰 도달 속도 80% 향상 및 콜드 스타트 시간 단축
- 추론 모델의 사고 과정(Thinking) 실시간 스트리밍 지원
- LLM 리뷰어를 통한 스마트 승인 및 자동 거부 기능 도입
- Bitwarden 및 1Password 연동을 통한 API 키 보안 강화
- 서브에이전트 실시간 트랜스크립트 및 백그라운드 위임 내구성 확보
HERMES AGENT v0.19.0가 방금 출시되었습니다.
QUICKSILVER 릴리스입니다.
2,245개의 커밋 (Commits). 1,065개의 PR (Pull Requests). 450명 이상의 기여자 (Contributors).
첫 번째 토큰 (First Token) 도달 속도가 이제 80% 더 빨라졌습니다.
테마는 모든 곳에서의 속도입니다.
변경 사항: @NousResearch
속도 (핵심 내용):
콜드 스타트 (Cold start): 4.3초에서 0.9초로 단축.
80% 절감되었습니다. CLI, 게이트웨이 (Gateway), TUI, 데스크톱 (Desktop), 크론 (Cron)에 모두 적용됩니다.
에이전트 (Agent)가 응답하기 전의 그 멈춤 현상이 사라졌습니다.
추론 모델 (Reasoning models)은 이제 기본적으로 사고 과정 (Thinking)을 실시간으로 스트리밍합니다.
더 이상 30초 동안 스피너 (Spinner)를 바라보며 기다릴 필요가 없습니다.
모델이 실시간으로 생각하는 과정을 지켜볼 수 있습니다.
데스크톱 앱 (Desktop app)에는 20개 이상의 타겟 성능 개선 PR (Pull Requests)이 적용되었습니다.
마크다운 (Markdown) 렌더링 시 CPU 사용량이 14배 감소했습니다.
가상화된 디프 (Virtualized diffs). 빠릿한 세션 전환 (Session switching).
거대한 트랜스크립트 (Transcripts)가 있는 상황에서도 부하가 걸릴 때 네이티브 (Native)처럼 느껴집니다.
새로운 기능:
터미널 (Terminal)에서 /subscription 및 /topup 명령어를 사용할 수 있습니다.
Nous 플랜을 변경하고, 비용을 미리 보고, 업그레이드하거나 다운그레이드하세요. 지갑을 위해 키보드에서 손을 뗄 필요가 없습니다.
데스크톱 앱 (Desktop app)에도 이에 상응하는 결제 설정 (Billing settings) 탭이 추가되었습니다.
스마트 승인 (Smart approvals)이 이제 기본값입니다.
LLM 리뷰어 (LLM reviewer)가 매번 사용자에게 묻는 대신 플래그가 지정된 명령어를 판단합니다.
안전함 = 자동 승인. 위험함 = 자동 거부.
불확실함 = 사용자에게 에스컬레이션 (Escalates).
추가 기능: /deny [reason]을 통해 에이전트 (Agent)에게 거부한 이유를 알려줄 수 있습니다.
Bitwarden + 1Password 비밀 소스 (Secret sources).
API 키가 더 이상 평문 (Plaintext) .env 파일에 저장되지 않습니다.
로드 시점에 볼트 (Vaults)에서 비밀 정보를 가져옵니다.
여러 개의 볼트 (Vaults)를 동시에 사용할 수 있습니다.
충돌 경고 및 변수별 출처 (Provenance) 확인이 가능합니다.
실시간 서브에이전트 (Subagent) 트랜스크립트.
delegate_task는 이제 실시간 트랜스크립트 파일을 반환하며,
서브에이전트 (Subagents)가 실행되는 즉시 tail -f로 확인할 수 있습니다.
모든 도구 호출 (Tool call), 결과, 그리고 응답까지. 자식 프로세스당 하나의 로그가 생성됩니다.
내구성이 있는 백그라운드 위임 (Durable background delegation).
실행 도중 프로세스가 재시작되어도 결과가 유지됩니다.
소유권이 확인된 원장 (Ownership-checked ledger). 아무것도 사라지지 않습니다.
전달 의무 원장 (Delivery-obligation ledger).
응답 생성과 전달 확인 사이에 게이트웨이 (Gateway)가 충돌(Crash)했을 경우, 이전에는 그 답변이 유실되었습니다.
이제 응답이 state.db에 기록됩니다.
다음 부팅 시 재전달됩니다. 더 이상의 조용한 유실은 없습니다.
하나의 게이트웨이, 다양한 프로필.
단일 봇 토큰(bot token)으로 서로 다른 채널을
서로 다른 프로필로 라우팅할 수 있습니다. 업무용 Discord → 업무용 프로필.
취미용 서버 → 개인용 프로필. 하나의 봇으로 가능합니다.
세션 내보내기 (sessions export).
hermes 세션 내보내기는 Markdown, HTML,
Quarto, 프롬프트 전용 (prompt-only), 그리고 Hugging Face trace 형식을 출력합니다.
--redact 플래그는 비밀 정보를 삭제(scrub)합니다.
이제 당신의 대화 기록은 실제 데이터셋 (dataset)이 됩니다.
새로운 모델 (NEW MODELS):
GPT-5.6 (Sol, Terra, Luna + Pro 변체) 완전 연결.
Grok 4.5 GA.
Kimi K3.
Claude Sonnet 5.
Fireworks AI가 퍼스트 클래스 제공자 (picker의 #2)로 추가되었습니다.
DeepInfra 보안 강화. Upstage Solar 추가.
로컬 설정을 위한 LM Studio JIT 모델 로딩.
추론 (REASONING):
max 및 ultra 노력 수준 (effort levels) 추가.
설정(config) 내 모델별 reasoning_effort 재정의 가능.
MoA (Mixture of Agents) 프리셋 내 슬롯별 노력 수준 설정
(어드바이저(advisors)는 깊게 생각하고, 신디사이저(synthesizer)는 빠르게 유지).
보조 모델을 위한 작업별(per-task) 노력 수준 설정.
이제 사고 깊이(thinking depth)는 전역 스위치가 아닌 다이얼(dial)처럼 조절 가능합니다.
/model --once: 다시 복구되는 단발성 모델 재정의.
스택형 슬래시 스킬 (stacked slash-skills): /skill-a /skill-b 실행 시 XYZ 수행.
사용하지 않는 제공자 숨기기: 제공자별 enabled: false 설정 가능.
보안 (SECURITY):
Vertex 자격 증명(credentials)을 서브프로세스 환경(subprocess env)으로부터 격리.
미디어/비전/이미지 생성 (media/vision/image-gen)은 공유 가드(shared guard)를 통해 읽기.
모든 aiohttp 서버에 걸쳐 웹훅 바디 크기(webhook body-size) 제한.
Telegram 오류 발생 시 봇 토큰(bot-token) 삭제.
삭제기(redactor)에 Fireworks 토큰 접두사 추가.
untrusted-ref 보간(interpolation)에 대해 CI 보안 강화.
통계 (STATS):
2,245개 커밋. 1,065개 머지된 PR (merged PRs).
2,465개 파일 변경. 300,000개 삽입.
3,300개 이슈 종료. 450명 이상의 기여자.
218K GitHub 스타. 41K 포크 (forks).
Hermes 역사상 가장 큰 기여자 규모.
업그레이드:
hermes update
AI 자동 생성 콘텐츠
본 콘텐츠는 X AI 사용법/팁의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기