헤르메스 에이전트란 무엇이고 코딩 CLI와는 뭐가 다른가

타리스만에서는 유익한 AI 기술을 전달합니다
제휴 링크로 판매시 수수료를 제공받습니다

누스리서치가 공개한 오픈소스 자율 에이전트 헤르메스가 21만 개가 넘는 스타를 받으며 화제다. 클로드 코드 같은 터미널 코딩 CLI와는 무엇이 다르고, 설치하면 어떤 새로운 작업 방식이 열리는지 정리했다.

헤르메스 에이전트란 무엇인가

헤르메스 에이전트(Hermes Agent)는 AI 모델 개발사 누스리서치(Nous Research)가 만든 오픈소스 자율 에이전트다. 깃허브 저장소 설명에는 짧게 “함께 성장하는 에이전트”라고 적혀 있다. 이름이 같아 헷갈리기 쉬운데, 누스리서치가 내놓은 헤르메스라는 이름의 LLM 모델 시리즈와는 별개다. 모델은 질문에 답하는 두뇌 자체고, 에이전트는 그 두뇌를 갈아 끼우며 도구를 굴리는 몸체다.

코딩 전용 CLI(터미널에서 명령으로 실행하는 프로그램)들과 뿌리는 비슷하지만 목적이 다르다. 레포지토리 하나에 붙박여 코드를 고치는 게 아니라, 사용자 개인 서버나 컴퓨터에 상시 상주하며 여러 작업을 넘나든다.

가장 큰 차별점은 자가개선 학습 루프다. 복잡한 작업을 마치면 스스로 재사용 가능한 스킬을 만들어두고, 그 스킬을 다시 쓰면서 다듬고, 알아낸 정보를 스스로 저장하도록 자신을 유도한다. 대화 세션이 끝나도 검색 가능한 형태로 기록이 남아 다음 대화에서 다시 불러올 수 있다.

이 기억 구조는 FTS5(빠른 전문 검색 엔진)로 과거 대화를 검색하고 LLM이 그 내용을 요약해 참고하는 방식이다. 여기에 플라스틱랩스(Plastic Labs)의 혼초(Honcho)를 얹어 사용자가 누구고 어떤 맥락에서 대화하는지 계속 모델링한다. 스킬 저장 방식은 agentskills.io라는 개방 표준과도 호환된다.

216,299개의 스타가 모인 이유

2026년 7월 17일 기준 깃허브 지표는 스타 216,299개, 포크 40,481개, 열린 이슈 23,306개다. 라이선스는 MIT, 저장소는 2025년 7월 22일 생성됐고 최근까지도 코드 푸시가 이어지는 활발한 프로젝트다.

화제의 중심에는 모델을 가리지 않는다는 설계가 있다. 누스 포털(Nous Portal), 오픈라우터(OpenRouter), OpenAI, 직접 붙인 엔드포인트 등 원하는 모델로 언제든 바꿀 수 있고 hermes model 명령 한 줄이면 끝난다. 코드를 고치거나 특정 모델에 발이 묶일 일이 없다.

메시징 게이트웨이 기능도 눈에 띈다. 게이트웨이 프로세스 하나가 여러 채널을 동시에 물어, 사용자가 어디서 말을 걸든 같은 에이전트가 응답한다. 음성 메모를 보내면 전사까지 하고, 플랫폼을 옮겨도 대화 맥락이 끊기지 않는다.

  • 텔레그램
  • 디스코드
  • 슬랙
  • 왓츠앱
  • 시그널
  • 이메일과 CLI

예약 자동화도 지원한다. 내장된 크론(정해진 시간마다 작업을 자동 실행하는 스케줄러)에 자연어로 지시하면, 결과를 원하는 채널로 전달한다. 일일 리포트나 야간 백업, 주간 감사 같은 무인 작업에 쓰인다.

복잡한 작업은 격리된 서브에이전트를 띄워 병렬로 나눠 처리한다. 파이썬 스크립트가 RPC(원격 프로시저 호출, 다른 프로세스의 기능을 로컬 함수처럼 불러 쓰는 방식)로 도구를 호출해 다단계 파이프라인을 컨텍스트 비용 없이 압축하는 구조도 갖췄다.

선택 구독 상품인 누스 포털을 쓰면 300개 넘는 모델과 웹검색, 이미지 생성, 음성 합성, 클라우드 브라우저 도구를 한 구독으로 묶어 쓸 수 있다. hermes setup –portal 로 로그인만 하면 되고, 개별 API 키를 그대로 쓰는 것도 가능하다.

클로드 코드 같은 코딩 CLI와는 뭐가 다른가

결론부터 말하면 둘은 대체재가 아니라 층이 다르다. 클로드 코드 같은 터미널 코딩 에이전트는 레포지토리 안에 사는 전문가다. 코드베이스 맥락을 정확히 읽고 파일을 고치고 테스트를 돌리는 일에 최적화돼 있다. 오르카(Orca) 같은 코딩 에이전트도 이 계열에 가깝다.

헤르메스 에이전트는 반대로 서버에 산다. 세션이 끝나도 기억이 남고, 텔레그램이나 이메일 같은 여러 채널로 말을 걸 수 있고, 크론으로 무인 실행까지 한다. 코드 수정 능력보다 내 대신 계속 돌아가는 비서 쪽에 무게가 있다. 헤르메스 에이전트 안에 반드시 헤르메스 모델이 들어가야 하는 것도 아니다.

그래서 실무에서는 병행이 현실적이다. 레포 안에서 코드를 짤 때는 코딩 CLI를 쓰고, 세션을 넘나드는 잡무나 알림, 예약 작업은 헤르메스 같은 상시형 에이전트에 맡기는 식이다. 헤르메스가 코딩 CLI보다 무조건 낫다고 보기는 어렵다. 둘은 애초에 겨루는 링이 다르다.

코딩 CLI, 헤르메스, 범용 챗봇 비교
tali.kr
기능
코딩 CLI
헤르메스
범용 챗봇
활동 위치
내 PC 터미널
서버 상시 구동
브라우저 탭
세션 기억
종료 시 초기화
누적 저장, 회상
대화별 분리
무인 실행
불가
크론 예약 가능
불가
강점
코드 전문성
채널 확장, 자동화
즉문즉답 편의

설치와 첫 사용

리눅스, macOS, WSL2(윈도우 안에 리눅스 환경을 얹는 기능), 터먹스(Termux)는 아래 한 줄로 설치한다.

curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

윈도우는 WSL 없이도 파워셸에서 바로 깐다. CLI, 게이트웨이, 터미널 UI, 도구가 전부 네이티브로 동작한다.

iex (irm https://hermes-agent.nousresearch.com/install.ps1)

설치 위치는 윈도우가 %LOCALAPPDATA%\hermes, WSL2는 ~/.hermes 다. 설치 관리자가 uv(러스트로 만든 파이썬 패키지 관리자), 파이썬 3.11, Node.js, ripgrep(빠른 텍스트 검색 도구), ffmpeg, 45MB 안팎의 휴대용 깃 배시(MinGit)까지 알아서 깐다. 관리자 권한이 필요 없고 기존에 깔린 깃과도 충돌하지 않는다.

설치가 끝나면 아래처럼 실행한다.

source ~/.bashrc
hermes
헤르메스 에이전트
tali.kr
01
설치 스크립트 실행
OS에 맞는 한 줄 명령으로 uv, 파이썬, Node.js 등 필요한 도구를 자동으로 깐다
02
hermes 실행
터미널에 hermes만 치면 대화형 UI가 뜨고 바로 첫 대화를 시작할 수 있다
03
모델과 채널 연결
hermes model로 모델을 고르고 hermes gateway로 텔레그램 등 메신저를 붙인다

윈도우에서 한 가지 자주 걸리는 함정이 있다. 윈도우 디펜더나 비트디펜더 같은 백신이 %LOCALAPPDATA%\hermes\bin\uv.exe 를 악성코드로 오탐하는 사례가 공식 문서에 아예 명시돼 있을 정도다. uv 는 파이썬 패키지를 빠르게 설치하는 정상 도구이고, 오탐일 뿐이다.

해결법은 파일 하나를 예외 처리하는 게 아니라 폴더 자체를 백신 검사 대상에서 빼는 것이다. uv 가 업데이트될 때마다 파일 해시가 바뀌어서 파일 단위 예외는 금방 무력화되기 때문이다.

Add-MpPreference -ExclusionPath "$env:LOCALAPPDATA\hermes\bin"

작업을 어디서 돌릴지도 고를 수 있다. 로컬, 도커(Docker), SSH, Singularity, Modal, Daytona까지 6가지 터미널 백엔드를 지원한다.

백엔드 특징
local내 컴퓨터에서 바로 실행, 설정이 가장 간단하다
Docker컨테이너 안에서 격리 실행, 환경 오염을 막는다
SSH원격 서버에 붙어 그 서버 자원으로 작업한다
Singularity연구용 클러스터에서 흔히 쓰는 컨테이너 방식
Modal서버리스, 유휴 시 하이버네이트로 비용을 아낀다
Daytona서버리스, 요청 시에만 깨어나는 개발 환경

이 중 Daytona와 Modal은 서버리스(작업이 없을 때 서버를 계속 켜두지 않고 필요할 때만 띄우는 방식)로 영속성을 유지한다. 평소엔 하이버네이트(작업 없을 때 잠들어 자원을 거의 안 쓰는 상태)돼 있다가 요청이 오면 깨어난다. 5달러짜리 VPS(가상 사설 서버)부터 GPU 클러스터까지 규모를 자유롭게 고를 수 있다.

새로 열리는 가능성과 한계

가장 큰 변화는 내 PC를 꺼도 에이전트가 계속 돈다는 점이다. 코딩 CLI는 터미널을 닫으면 작업도 멈추지만, 헤르메스는 서버에 올려두면 잠든 사이에도 예약된 작업을 처리하고 텔레그램으로 결과를 보낸다.

서버리스 하이버네이트 덕분에 유휴 비용 부담도 줄었다. 평소엔 거의 비용이 안 나가다가 실제 요청이 들어올 때만 자원을 쓰는 구조라, 상시 서버를 띄워두는 것보다 운영 부담이 가볍다.

모델 자유도도 실질적인 이점이다. 특정 회사 모델에 락인(다른 제품으로 옮기기 어렵게 묶이는 것)되지 않고 갈아탈 수 있어서, 가격이나 성능 변화에 유연하게 대응할 수 있다.

다만 태어난 지 1년이 채 안 된 프로젝트다. 열린 이슈가 23,306개에 달하는 만큼 버그와 기능 변경이 빠르게 오간다. ▲ 서버를 직접 구동하고 관리해야 하는 부담 ▲ 범용 에이전트라 특정 코드베이스에 대한 이해도는 전용 코딩 CLI보다 떨어질 수 있다는 점은 감안해야 한다.

결국 헤르메스 에이전트는 코딩 CLI를 대체하는 도구가 아니라, 코딩 CLI가 못 채우는 영역인 세션을 넘는 기억과 여러 채널 연결, 무인 자동화를 메워주는 별개의 층에 가깝다.

자주 묻는 질문 FAQ

Q1) 헤르메스 에이전트는 무료인가

MIT 라이선스로 공개된 오픈소스라 소프트웨어 자체는 무료로 설치해 쓸 수 있다. 다만 연결하는 AI 모델의 API 비용은 별도로 든다. 여러 모델과 도구를 한 구독으로 묶은 누스 포털은 선택 사항이다.

Q2) 클로드 코드 대신 헤르메스 에이전트만 쓰면 되나

코드 수정처럼 레포지토리 맥락이 중요한 작업은 여전히 코딩 CLI가 유리하다. 헤르메스는 세션을 넘는 기억, 여러 메신저 연결, 예약 자동화처럼 코딩 CLI가 다루지 않는 영역을 보완하는 쪽에 가깝다.

Q3) 윈도우에서 WSL 없이도 설치할 수 있나

가능하다. 파워셸에서 설치 스크립트 한 줄이면 CLI와 게이트웨이, 터미널 UI가 전부 네이티브로 동작한다. 관리자 권한도 필요 없다.

댓글 남기기