🏠 메인
보고서 보기
AI Agent Intelligence · Deep Analysis

Hermes vs OpenClaw vs Codex

핵심 결론

01Hermes·OpenClaw·Codex의 역할을 분리하면 각각 자동화·채널 허브·저장소 구현에 가장 잘 맞습니다.

02핵심 비교 기준은 실행 표면·기억·샌드박스·운영 책임입니다.

03Hermes 중심+Codex 결합으로 운영하고 외부 행동은 사람이 검수하세요.

세 제품은 같은 ‘AI Agent’가 아닙니다. Hermes는 학습하는 범용 개인 에이전트, OpenClaw는 다채널·다기기 개인 비서 플랫폼, Codex는 코드 작업에 최적화된 실행 에이전트입니다.

260802 · 심층보고서모드2026.08.02 KST 기준공식 원문·GitHub API 우선사실·해석·선택 기준 분리
TWO-PAGE EXECUTIVE BRIEF

2페이지 핵심 요약

01

판단의 배경

브랜드 인지도보다 실행 표면, 메모리, 안전 경계와 운영 책임의 차이가 선택을 결정합니다. 다만 가장 넓은 채널·모바일 노드·Canvas 생태계가 중요하면 OpenClaw, 저장소 안에서 코드 변경·테스트·리뷰 품질과 기본 샌드박스가 최우선이면 Codex가 더 맞습니다. 개인 AI 운영체제 → Hermes 연결성·기기 허브 → OpenClaw 소프트웨어 제작 → Codex 메모리·스킬·세션 검색·예약 실행·서브에이전트가 하나의 장기 학습 루프로 묶입니다. 단일 Gateway가 수많은 채널, 앱, 모바일 노드, Canvas와 도구를 연결합니다.

02

핵심 비교와 근거

비교 조건과 기준이 같은 수치만 나란히 놓고 판단합니다.

03

선택 기준과 판단

한 제품으로 모든 작업을 강제하기보다 역할을 나누는 편이 현실적입니다. Telegram/Discord에서 조사·문서·예약 보고를 이어가고 장기 기억을 쌓는다면 Hermes가 중심이 됩니다. WhatsApp·iMessage·Teams·모바일 센서·Canvas 등 연결 표면 자체가 가치라면 OpenClaw가 강합니다. 산출물이 코드 변경·테스트 통과·PR 검수라면 Codex의 workspace-first 설계와 기본 샌드박스가 유리합니다. Hermes를 기억·리서치·스케줄·메신저 허브로 두고, 깊은 코드 작업을 Codex CLI/Cloud에 위임하는 조합이 Jeremy의 사용 방식에 가장 자연스럽습니다.

04

주의점과 다음 행동

공식 문서·저장소·보안 정책·라이선스·가격 문서를 1차 근거로 삼고, 저장소 인기도는 품질이 아닌 채택 신호로만 사용했습니다. 무엇을 실행하고 어디에 상주하며, 사용자가 실제로 접하는 표면은 무엇인가? 기억·스킬·예약 실행이 어떻게 유지되며, 모델 행동을 어떤 OS·승인 경계가 제한하는가? 설치·운영·모델 비용과 잠금 효과까지 포함하면 누구에게 무엇이 최적인가? 조사 체계: Terra 서브에이전트 3개가 공식 기능·보안/운영·생태계/비용을 분담했고, 부모 에이전트가 GitHub API와 공식 원문을 다시 확인했습니다.

지속형 개인 에이전트, 다채널 게이트웨이, 코딩 에이전트의 세 경로가 인간 검수자에게 모이는 AI 생성 비교 인포그래픽
AI 생성 시각 브리핑 · 공식 로고 아님좌: 지속형 개인 에이전트 · 중앙: 다채널 게이트웨이 · 우: 코딩 실행 환경 · 최종 판단은 인간
Executive Summary

결론부터: 승자 한 명이 아니라 목적별 1위입니다

브랜드 인지도보다 실행 표면, 메모리, 안전 경계와 운영 책임의 차이가 선택을 결정합니다.

Jeremy처럼 메신저에서 장기 기억·리서치·자동화·멀티에이전트를 한 시스템으로 쓰려면 Hermes가 가장 직접적입니다.

다만 가장 넓은 채널·모바일 노드·Canvas 생태계가 중요하면 OpenClaw, 저장소 안에서 코드 변경·테스트·리뷰 품질과 기본 샌드박스가 최우선이면 Codex가 더 맞습니다.

Persistent Generalist

Hermes Agent

메모리·스킬·세션 검색·예약 실행·서브에이전트가 하나의 장기 학습 루프로 묶입니다.

  • 모델·인프라 선택 폭이 넓음
  • 메신저 기반 장기 동행에 강함
  • 리서치·문서·업무 자동화에 유리
Personal Assistant Platform

OpenClaw

단일 Gateway가 수많은 채널, 앱, 모바일 노드, Canvas와 도구를 연결합니다.

  • 25개 이상 채널을 README에서 명시
  • macOS·Windows·iOS·Android 표면
  • 넓은 플러그인·ClawHub 생태계
Software Engineering Agent

OpenAI Codex

CLI·IDE·Desktop·Cloud/Web을 넘나드는 코드 중심 에이전트입니다.

  • 저장소 변경·테스트·리뷰가 핵심
  • 기본 OS 샌드박스·네트워크 차단
  • ChatGPT·OpenAI 모델과 긴밀한 통합

비교 오해 방지: Codex는 개인 비서 Gateway가 아니고, Hermes와 OpenClaw는 코드 전용 제품이 아닙니다. 따라서 ‘총점’ 하나로 순위를 매기면 제품 정체성 차이를 지우게 됩니다.

Research Method

어떻게 비교했나

공식 문서·저장소·보안 정책·라이선스·가격 문서를 1차 근거로 삼고, 저장소 인기도는 품질이 아닌 채택 신호로만 사용했습니다.

질문 1 · 제품 경계

무엇을 실행하고 어디에 상주하며, 사용자가 실제로 접하는 표면은 무엇인가?

질문 2 · 지속성과 안전

기억·스킬·예약 실행이 어떻게 유지되며, 모델 행동을 어떤 OS·승인 경계가 제한하는가?

질문 3 · 선택 비용

설치·운영·모델 비용과 잠금 효과까지 포함하면 누구에게 무엇이 최적인가?

조사 체계: Terra 서브에이전트 3개가 공식 기능·보안/운영·생태계/비용을 분담했고, 부모 에이전트가 GitHub API와 공식 원문을 다시 확인했습니다. 세 제품의 실제 모델 성능을 동일 과제로 재실행한 벤치마크는 아니므로 ‘어느 모델이 더 똑똑한가’는 결론 내리지 않습니다.

Architecture

제품의 중심축이 다릅니다

같은 도구 호출형 에이전트라도 무엇을 ‘중앙’에 두는지가 운영 경험을 바꿉니다.

Agent Loop First

Hermes: 에이전트 루프 중심

TUI 또는 메시징 Gateway에서 동일한 에이전트·도구·메모리·스킬을 사용합니다. 로컬·Docker·SSH·Singularity·Modal·Daytona·Vercel Sandbox 등 실행 백엔드를 바꿀 수 있습니다. [S1][S3]

Gateway First

OpenClaw: Gateway 중심

장기 실행 Gateway가 채널, 세션, 도구, 이벤트를 소유하고 앱·CLI·웹 UI·노드가 WebSocket으로 붙습니다. 모바일 노드는 카메라·화면·위치·Canvas 명령까지 확장합니다. [S6][S7]

Workspace First

Codex: 작업공간 중심

CLI·IDE·Desktop에서는 로컬 저장소를 OS 샌드박스로 다루고, Codex Cloud는 OpenAI 관리 컨테이너에서 비동기 작업을 수행합니다. 코드는 Git·PR·테스트 흐름이 기본 문맥입니다. [S13][S14]

운영 영향: Hermes·OpenClaw를 상시 개인 비서로 쓰면 Gateway 가동, 채널 토큰, 모델 공급자, 백업과 업데이트를 사용자가 책임집니다. Codex Cloud는 그 일부를 서비스가 대신하지만 OpenAI 계정·모델 생태계 의존도가 커집니다.

Capability Matrix

핵심 기능 비교

‘지원’은 공식 문서 기준입니다. 구현 깊이와 기본값은 별도 열로 읽어야 합니다.

비교축Hermes AgentOpenClawOpenAI Codex판단
주요 목적지속형 범용 개인 에이전트로컬 우선 개인 비서 플랫폼소프트웨어 엔지니어링 에이전트직접 대체재라기보다 인접 제품
사용 표면TUI·Telegram·Discord·Slack·WhatsApp·Signal·Email 등25개 이상 메시징 채널·WebChat·Desktop·모바일 노드CLI·IDE·Desktop·Web/Cloud·iOS채널 폭: OpenClaw
모델 선택Nous Portal·OpenRouter·OpenAI·자체 엔드포인트 등Anthropic·OpenAI·Google·xAI·OpenRouter·호환 엔드포인트 등OpenAI/ChatGPT 중심, API 키 선택개방성: Hermes·OpenClaw
장기 메모리사용자 프로필·메모리·FTS5 세션 검색·자동 스킬 개선USER/MEMORY/일별 Markdown·검색·Dreaming 통합세션·프로젝트 문맥과 로컬 메모리 기능, 개인 비서형 핵심은 아님지속형 동행: Hermes·OpenClaw
스킬·확장agentskills.io 호환 스킬·플러그인·MCP·도구셋Workspace skills·plugins·ClawHub·MCP/도구 정책Agent Skills·Plugins·MCP·repo/user/admin/system scope세 제품 모두 개방 표준으로 수렴
예약·상시 실행내장 Cron·메시징 배송·웹훅·GatewayCron·hooks·Gateway daemon·채널 액션Cloud 작업·자동화에 강하나 개인 메시징 Cron 허브는 아님개인 자동화: Hermes·OpenClaw
멀티에이전트격리 서브에이전트 병렬 위임·도구 제한채널·계정·peer별 agent routing·다중 workspace병렬 cloud tasks·subagents/agent plugins 중심동일 명칭이어도 격리 단위가 다름
코딩 워크플로터미널·파일·GitHub 스킬로 범용 처리exec·파일·브라우저·plugins로 범용 처리저장소 수정·테스트·리뷰·IDE·PR이 제품의 중심코딩: Codex
기본 샌드박스로컬 backend는 host; 별도 backend/전체 프로세스 격리 선택sandbox mode 기본 off; Docker/Podman/SSH/OpenShell 선택workspace-write OS sandbox·network off·승인 요청이 기본안전 기본값: Codex
오픈소스MITMIT 본문, GitHub SPDX 자동 식별은 NOASSERTIONApache-2.0코드는 모두 공개, 서비스 부분은 별도
Best Fit

세 가지 대표 사용자

편집 판단 점수이며 공식 벤치마크가 아닙니다.

개인 지능 증폭 시스템

Hermes 우선

메신저 대화, 장기 기억, 리서치, 문서 생성, 예약 보고, 다양한 모델과 실행 백엔드를 하나의 프로필로 묶고 싶은 사용자.

대안: 기기·채널 폭이 더 중요하면 OpenClaw

다기기·다채널 생활 비서

OpenClaw 우선

WhatsApp부터 iMessage·Teams·Matrix·모바일 노드·Canvas까지 연결하고, 개인 기기의 센서와 UI를 적극 활용하려는 사용자.

대안: 조사·멀티에이전트·학습 루프 중심이면 Hermes

개발팀과 코드베이스

Codex 우선

IDE와 터미널에서 변경하고, cloud task로 병렬 실행하며, 기본 샌드박스·승인·기업 관리 정책 아래 코드를 검수하려는 팀.

대안: 코딩 외 개인 자동화는 별도 에이전트와 조합
Memory & Learning

‘기억한다’의 의미도 다릅니다

메모리의 존재보다 무엇을 자동으로 정리하고 다음 행동에 연결하는지가 중요합니다.

Hermes가 강한 지점

  • 사용자 프로필과 일반 메모리를 분리해 장기 맥락을 관리
  • FTS5 기반 과거 세션 검색으로 ‘전에 무엇을 했나’를 복원
  • 복잡한 작업 뒤 스킬을 만들고 사용 중 개선하는 폐쇄형 학습 루프
  • Cron 결과를 메신저로 다시 전달해 기억→행동→검수 흐름을 구성

OpenClaw가 강한 지점

  • USER.md·MEMORY.md·일별 노트를 투명한 Markdown으로 저장
  • Dreaming sweep가 일별 노트에서 장기 메모리로 정리
  • Codex·Claude Code·Hermes의 Markdown 메모리 가져오기 지원
  • 채널·agent·workspace 구조와 결합해 생활 표면 전반에 적용

Codex 해석: Codex도 세션·프로젝트·skill·memory를 활용하지만, 제품의 중심은 ‘사람을 장기적으로 모델링하는 개인 비서’보다 ‘현재 저장소에서 검증 가능한 변경을 만드는 개발 에이전트’입니다. 개인 기억을 우선순위로 보면 비교축 자체가 불리합니다.

Security & Trust Boundary

가장 큰 차이는 기본 격리입니다

승인 창은 실수를 줄이는 장치일 뿐, 적대적 모델을 가두는 완전한 보안 경계가 아닙니다.

Hermes

기본: 로컬 host 실행

보안 정책은 OS 수준 격리만을 적대적 LLM에 대한 실제 경계로 봅니다. 터미널 backend 격리는 shell/file 경로를 제한하지만, code execution·MCP·plugin까지 묶으려면 전체 프로세스 Docker/OpenShell wrapping이 필요합니다.

권장: untrusted web/email/shared channel이면 whole-process sandbox + allowlist

OpenClaw

기본: sandbox off

개인 단일 운영자를 신뢰하는 모델입니다. Gateway는 host에 남고, sandbox를 켜면 도구 실행만 Docker·Podman·SSH·OpenShell로 이동합니다. 공유 Gateway는 적대적 다중 테넌트 경계가 아닙니다.

권장: 1인 1 Gateway/host, non-main 또는 all sandbox, 엄격한 tool policy

Codex

기본: workspace-write + network off

로컬 CLI/IDE는 OS 강제 샌드박스로 쓰기 범위를 작업공간에 제한하고 외부 쓰기·네트워크에 승인을 요구합니다. Cloud는 격리 컨테이너에서 setup 이후 agent 단계의 네트워크와 secret을 분리합니다.

권장: 기본 Auto 유지, repo 검수, yolo/full access는 신뢰 환경에서만

실전 결론: 공개 웹·이메일·그룹 메시지를 도구 사용 에이전트에 넣는다면 ‘모델이 지시를 잘 거부할 것’에 의존하면 안 됩니다. 계정 분리, 최소 권한, 샌드박스, 네트워크 허용목록, 외부 발신 승인, 사람의 diff/결과 검수가 필요합니다.

Ecosystem Signals

GitHub 규모는 채택 신호이지 품질 점수가 아닙니다

2026년 8월 2일 13:09 KST GitHub API 관측값입니다. 일시점 수치이며 봇·관심·역사 차이를 포함합니다.

223,898Hermes stars · forks 43,230
384,858OpenClaw stars · forks 80,876
103,169Codex stars · forks 15,557
3/32026.08.02 당일 main push 관측
OpenClaw
384,858
Hermes
223,898
Codex
103,169

OpenClaw는 Hermes의 약 1.72배, Codex의 약 3.73배 stars를 보였고 Hermes는 Codex의 약 2.17배였습니다. 프로젝트 연령·조직·마케팅·사용자층이 달라 성능 결론으로 환산하지 않았습니다.

최근 정식 release: Hermes v2026.7.30(릴리스명 v0.19.1, 2026-07-30), OpenClaw v2026.7.1(2026-07-13), Codex rust-v0.146.0(2026-07-29)을 GitHub Releases API에서 확인했습니다. 세 프로젝트 모두 매우 빠르게 변하므로 이 보고서도 버전 스냅샷입니다.

Cost & Operations

오픈소스 무료와 운영 무료는 다릅니다

코드 라이선스 비용, 모델 사용료, 상시 인프라와 사용자의 관리 시간을 분리해야 합니다.

비용 항목HermesOpenClawCodex숨은 비용
소프트웨어MIT · 자체 호스팅 가능MIT 본문 · 자체 호스팅 가능CLI Apache-2.0설치·업데이트·백업 시간
모델Nous Portal 또는 각 provider/API각 provider 구독/OAuth/APIChatGPT Free/Go/Plus/Pro/Business/Enterprise/Edu 또는 API고급 모델·긴 작업·자동 리뷰 사용량
인프라로컬, VPS, Docker, cloud sandbox상시 Gateway host·선택 sandbox·device nodes로컬 실행 또는 OpenAI cloudVPS, 컨테이너, 로그, 네트워크, 장애 대응
공식 확인 가격이 보고서에서 Portal 금액 미확정프레임워크 자체 별도 가격 없음Plus $20/월, Pro $100부터, Business $20/user/월(연간·2명 이상; 월결제 $25)가격·한도는 지역과 시점에 따라 변경

비용 판단: 자동화를 많이 할수록 토큰 단가보다 실패 재실행, 사람이 검수하는 시간, 비밀키·채널·서버를 관리하는 운영비가 커집니다. 가장 싼 모델보다 ‘검수 가능한 결과를 한 번에 내는 구성’이 총비용을 줄일 수 있습니다.

Decision Framework

선택과 조합

한 제품으로 모든 작업을 강제하기보다 역할을 나누는 편이 현실적입니다.

01 · HERMES

메신저가 작업실인가?

Telegram/Discord에서 조사·문서·예약 보고를 이어가고 장기 기억을 쌓는다면 Hermes가 중심이 됩니다.

02 · OPENCLAW

생활 채널과 기기가 핵심인가?

WhatsApp·iMessage·Teams·모바일 센서·Canvas 등 연결 표면 자체가 가치라면 OpenClaw가 강합니다.

03 · CODEX

완료 조건이 git diff와 테스트인가?

산출물이 코드 변경·테스트 통과·PR 검수라면 Codex의 workspace-first 설계와 기본 샌드박스가 유리합니다.

04 · COMBINATION

오케스트레이터와 코더를 분리할까?

Hermes를 기억·리서치·스케줄·메신저 허브로 두고, 깊은 코드 작업을 Codex CLI/Cloud에 위임하는 조합이 Jeremy의 사용 방식에 가장 자연스럽습니다.

Jeremy 권고: Hermes를 중심으로 유지하고 Codex를 전문 코딩 실행기로 결합하십시오.

현재 Jeremy의 핵심 가치는 Telegram 기반 장기 파트너, Obsidian/보고서 자동화, 메모리, 스킬, 서브에이전트와 예약 실행에 있습니다. 이 중심축은 Hermes가 가장 잘 맞습니다. OpenClaw는 채널·모바일 노드·Canvas가 실제 병목이 될 때 별도 시험판으로 검토하고, 전체 이전은 현재 가치 중복이 큽니다.

  • 지금: Hermes가 개인 AI 운영체제와 오케스트레이터 역할을 유지
  • 코드: Codex를 저장소 단위 전문 실행기로 사용하고 diff·테스트·배포를 검수
  • 시험: OpenClaw는 별도 VM/계정에서 1~2개 독점 채널 또는 모바일 노드 가치만 검증
  • 경계: 외부 발신·삭제·결제·권한 상승은 사람 승인 유지
Limitations

남은 불확실성

  • 세 제품을 동일 하드웨어·동일 모델·동일 과제에서 반복 실행한 실측 벤치마크가 아닙니다. 실제 속도·성공률·비용은 모델, 프롬프트, 도구, 프로젝트와 네트워크에 크게 좌우됩니다.
  • GitHub stars·forks는 인지도와 관심을 반영하지만 활성 사용자, 유지율, 기업 배포, 보안 품질 또는 작업 성공률을 직접 뜻하지 않습니다.
  • Hermes와 OpenClaw는 빠르게 변하는 커뮤니티 프로젝트이며, 문서와 기본값이 release마다 바뀔 수 있습니다. Codex의 서비스 기능·가격·한도도 계정과 지역에 따라 달라질 수 있습니다.
  • OpenClaw LICENSE 본문은 MIT지만 GitHub API의 SPDX 자동 식별은 기준일에 NOASSERTION이었습니다. 법적 판단이 필요한 배포는 LICENSE 원문과 제3자 고지를 직접 검토해야 합니다.
  • 보안 비교는 공개 정책과 기본 설정에 대한 분석입니다. 침투시험이나 소스 전체 감사를 수행하지 않았습니다.
  • 최종 도입, 비밀키 범위, 외부 발신과 데이터 접근 권한은 사용자가 직접 검수해야 합니다.
전체 출처클릭하여 펼치기접기
Sources & Rights

전체 출처

확인일은 모두 2026.08.02 KST입니다. 공식 원문을 우선했고, AI 이미지는 상표·제품 로고 없이 새로 생성했습니다.

ID자료명제공자원문기준상태·권리사용 범위
S1Hermes Agent READMENous Research원문 보기main공식 · MIT정체성·채널·메모리·Cron·backend·설치
S2Hermes Agent Security PolicyNous Research원문 보기main공식 정책OS 경계·credential·plugin·allowlist
S3Hermes Agent DocumentationNous Research원문 보기현재공식 문서도구·MCP·메모리·스킬·Gateway
S4Hermes LICENSENous Research원문 보기mainMIT오픈소스 라이선스
S5Hermes ReleasesGitHub / Nous Research원문 보기2026-08-02공식 저장소v2026.7.30·릴리스명 v0.19.1·발행일
S6OpenClaw READMEOpenClaw Foundation원문 보기main공식 · LICENSE 본문 MIT채널·앱·Gateway·모델·기본 보안
S7Gateway architectureOpenClaw Foundation원문 보기현재공식 문서WebSocket Gateway·clients·nodes
S8Memory overviewOpenClaw Foundation원문 보기현재공식 문서USER/MEMORY/일별 노트·Dreaming·가져오기
S9SandboxingOpenClaw Foundation원문 보기현재공식 문서기본 off·backend·scope·network
S10OpenClaw Security PolicyOpenClaw Foundation원문 보기main공식 정책1인 trust model·shared Gateway 한계
S11OpenClaw LICENSEOpenClaw Foundation원문 보기mainMIT 본문 · API NOASSERTION라이선스 및 주의
S12OpenClaw ReleasesGitHub / OpenClaw원문 보기2026-08-02공식 저장소v2026.7.1·발행일
S13Codex CLI READMEOpenAI원문 보기main공식 · Apache-2.0CLI·IDE·Desktop·Cloud·설치
S14Agent approvals & securityOpenAI원문 보기현재공식 문서OS sandbox·network·approval·Cloud 격리
S15Codex PricingOpenAI원문 보기현재공식 가격Free/Go/Plus/Pro/Business/API
S16Build skillsOpenAI원문 보기현재공식 문서Agent Skills·plugins·scope·배포
S17Model Context ProtocolOpenAI원문 보기현재공식 문서STDIO/HTTP MCP·OAuth·tool approval
S18Codex LICENSEOpenAI원문 보기mainApache-2.0오픈소스 라이선스
S19Codex ReleasesGitHub / OpenAI원문 보기2026-08-02공식 저장소rust-v0.146.0·발행일
S20Repository metadata APIGitHub API원문 보기2026-08-02공개 APIstars·forks·latest commit 관측
V1AI Agent 세 경로 인포그래픽OpenAI gpt-image-2-high / Hermes Report Mode로컬 자산: ai-agent-three-paths-16x9.png2026-08-02AI 생성 · 상표·로고 없음 · 시각 검수 완료보고서 상단 개념 비교