Claude Code vs Hermes Agent

AIエージェントのスキルシステム — アーキテクチャ、自己改善、セキュリティ、エコシステムを徹底比較

◆ Claude Code — Anthropic(GitHub 約14.0万 Stars) ◆ Hermes Agent — Nous Research(GitHub 約22.6万 Stars)

0. 設計思想の違い

両者のスキルシステムは、その出自と哲学を色濃く反映している。この違いを理解せずに機能比較しても意味がない。

Claude Code — 開発者主導のコーディング基盤

  • 同期的・対話型 — ターミナルで座ってコードを書くのが主用途
  • ユーザー主導 — 人間がドライブし、Claudeがナビゲート
  • リポジトリ中心 — CLAUDE.md はプロジェクトスコープの知識ベース
  • スキル作成はユーザー依頼ベース — ユーザーが「CLAUDE.mdに追加して」と言えば作れるが、自律的な自己改善ループはない
  • 実行制御に強い — Hooks / Permission Rules / Managed Settings / Sandbox の多層ガード
  • 幅広い実行環境 — CLI, Desktop, VS Code, JetBrains, Web, Mobile, Slack, CI

Hermes Agent — 自律型エージェント基盤

  • 非同期的・自律的 — cronジョブで留守中も動く
  • エージェント主導 — 自分で考え、行動し、スキルを自律作成する
  • ユーザー中心 — Memory / Soul / User Profile がセッションを超えて持続
  • 標準化されたスキルライフサイクル — skill_manage() による create/patch/edit/delete + アトミック書込 + セキュリティスキャン
  • 自己ホスト・常駐型運用 — 14+メッセージングチャネルに単一Gateway
  • 異種LLMプロバイダ選択 — OpenAI / Anthropic / DeepSeek / Gemini / ローカル等

1. スキル作成 — 最も誤解されやすい差

「Claude Codeはスキルを作れない」は誤り。正しくは「標準化された自律ライフサイクルの有無」の差である。

Claude Code — ユーザー依頼ベース

Claude Code自体はファイルを作成・編集できるため、ユーザーが「CLAUDE.mdに追加して」と依頼すればスキルを生成できる

  • /run-skill-generator — アプリの起動方法を学習し、.claude/skills/run-<name>/ にプロジェクトスキルを作成・コミットする公式機能
  • CLAUDE.md はユーザーの依頼に応じてClaudeが直接編集可能
  • しかし: エージェントが自律的に「これをスキル化すべき」と判断して作成する自己改善ループは組み込まれていない
正確な評価: スキル作成の可能性は両社ともにある。差は「成功・失敗・ユーザー訂正を契機に自律的にスキル化する専用の自己改善ループとライフサイクルAPIを標準装備しているか」にある。

Hermes Agent — 標準化された自己改善ループ

  • skill_manage(action='create') — アトミック書き込み+即時セキュリティスキャン+ロールバック
  • skill_manage(action='patch') / edit / delete — フルライフサイクル
  • absorbed_into — スキル削除時に転送先を明示する設計(後方互換性の考慮)
  • 自己改善ループ: 問題解決後、エージェントが「これはスキル化すべき」と自律判断し、SKILL.mdを生成して永続化する
✓ これがHermesの本当の優位点: 自己改善ループとスキル管理APIが「標準化された形で」統合されていること

2. プログレッシブ・ディスクロージャ

両者とも同じ3階層(Discovery / Activation / Execution)だが、ロードの制御方式に差がある。Hermesの「Tier 0(カテゴリのみ)」は現行の公式仕様ではないため削除。

Layer 2 — Execution

実行時サポートファイル

scripts/, references/, templates/ — エージェントが実行時に必要と判断した時のみロード。Claude Code: SKILL.md内の参照に応じて。Hermes: skill_view(name, file_path) で明示要求。

Layer 1 — Activation

SKILL.md 全文

Claude Code: LLMがdescriptionから「これが必要」と判断した時(モデルの推論に依存)。Hermes: skill_view(name) で明示的API呼び出し(エージェントの制御下)。

Layer 0 — Discovery

name + description のみ

Claude Code: 全スキルのname+descriptionを常時注入。予算はコンテキストの1%。超過分は低頻度スキルから説明文短縮。Hermes: skills_list() でオンデマンド取得。LLMの気まぐれに依存せず明示制御。

Claude Code

Discovery全スキルname+descを常時注入。予算1%。使用頻度が低いものから説明文短縮。skillListingBudgetFraction設定で調整可能。
ActivationLLM判断依存。descriptionの質がルーティング精度を直接決める。
Execution!`command` による動的コンテキスト注入が標準。SKILL.md内のファイル参照に応じてオンデマンドロード。

Hermes Agent

Layer 0skills_list() — 全スキルのname+descをオンデマンドAPIで取得。LLMの判断に依存せずエージェントが明示制御。
Layer 1skill_view(name) — SKILL.md全文を明示的に要求。呼ぶまでロードされない。
Layer 2skill_view(name, file_path) — サポートファイルを個別オンデマンド。

3. Dynamic Context Injection / Cron / 永続記憶

初版で「Claude Codeのみ」「Hermesのみ」と断定した機能の多くが、実際には両方に存在する。正しくは実装の重点とデフォルトの違いである。

Claude Code

  • Dynamic Context Injection: !`command` が標準機能。スキルロード前にCLI結果をインライン化。
  • Cron / Scheduled Tasks: /loop + AnthropicクラウドRoutines(PC停止中も動作)、Desktop scheduled tasks、GitHub Actions連携。
  • 永続記憶: Auto Memory — Claude自身がプロジェクトごとのMarkdownファイルを読み書き。ユーザーの訂正・設定・知見を保存し、必要なトピックファイルをオンデマンド読込。リポジトリ中心。
  • 実行環境: CLI, Desktop, VS Code, JetBrains, Web(オフラインでも継続), Mobile, Slack, GitHub/GitLab CI。

Hermes Agent

  • Dynamic Context Injection: SKILL.md内の !`command` をサポート。デフォルト無効で信頼スキル限定のオプトイン設計(セキュリティ考慮)。
  • Cron: 自然言語で定期cronセッションを作成。結果をTelegram/Discordに配信。自己ホストで完全制御。
  • 永続記憶: Memory / Soul / User Profile / FTS5 Session Search — セッション横断のユーザーモデリングとスキル自己改善との統合。ユーザー中心。
  • 実行環境: 14+メッセージングチャネル(Telegram/Discord/WhatsApp/Signal等)を単一Gateway。自己ホストVPS。
正確な評価: Dynamic Context Injection は両社ともサポート。Claude Codeは標準有効、Hermesはセキュリティ上の理由でオプトイン。cronも両社とも持つが、Claude CodeはクラウドRoutines主体、Hermesは自己ホストcron主体。永続記憶も両社とも持つが、Claude Codeはリポジトリ中心、Hermesはユーザーとエージェント中心という重点の違い。

4. セキュリティモデル

初版ではHermes寄りの一面的な評価になっていた。実際には両社とも多層防御を備え、得意領域が異なる。「圧倒的に安全」と断言できるものではない。

Claude Code — 実行時制御+組織ポリシー

  • Hooks: PreToolUse / PostToolUse / Stop — ライフサイクルイベントに決定論的スクリプトを挿入。exit code 2でツール実行を物理ブロック+stderrフィードバック。
  • Permission Rules: ツール単位の許可・拒否を設定可能。
  • Sandbox: 実行時サンドボックスでのコード分離。
  • Managed Settings: エンタープライズレベルでの組織ポリシー強制。
  • スキル内シェル実行の無効化、settings.json deny list。
実行時の権限制御と組織ポリシー強制に強い。しかしインストール前のスキル静的解析(サプライチェーン防御)は標準装備していない。

Hermes Agent — スキルサプライチェーン+来歴管理

  • skills_guard.py: 9カテゴリの静的解析 — コマンドインジェクション・流出パターン・Base64ペイロード・暗号通貨ウォレット等。
  • アトミック書込 → スキャン → ロールバック: 危険なスキルはインストールされない。
  • HubLockFile: SHA-256 content hash / source URL / trust level を記録。改ざん検出+検疫。
  • Trust Level: trusted vs community。出所に応じた信頼度。
スキルパッケージの来歴管理とインストール時検査に強い。ただし静的ヒューリスティック検査には限界があり、動的importや文字列組み立てによる回避が報告されている。
正確な評価 — 総合優劣は運用構成に依存する: Hermesはスキル配布のサプライチェーン管理(来歴・ハッシュ検証・事前スキャン)で優位。Claude Codeは実行時の権限制御・Hooks・組織ポリシー強制で優位。「どちらが安全か」ではなく、「いつ・どこで・何を守りたいか」で選択するべき。

5. プロバイダ/モデル

「Claude CodeはAnthropic API固定」は不正確。Claudeモデル中心だが複数のデプロイ経路がある。重要なのはモデルファミリーの多様性の差。

Claude Code — モデル特化+複数経路

  • 推論モデルはClaudeモデル中心(Sonnet / Haiku / Opus等)
  • デプロイ経路: Anthropic直接契約、Amazon Bedrock、Google Cloud Agent Platform、Microsoft Foundry、各種LLM Gateway
  • タスク別切替: Claudeファミリー内でのモデル選択(速度/品質トレードオフ)

Hermes — 異種モデル選択可能

  • OpenAI / Anthropic / DeepSeek / Gemini / xAI / Ollama / NVIDIA NIM / OpenRouter
  • タスク別に異なるモデルファミリーを切り替え可能(例: コーディング=GPT-5.5、リサーチ=DeepSeek、レビュー=Claude)
  • $20/month ChatGPT CodexバックエンドでAPI料金なし運用も可能

6. エコシステムとマーケットプレイス

Skills Hubの数値は変動値。「89,271スキル/12レジストリ」は2026-06-04時点のスナップショットであるため、現在の実数は異なる可能性がある。

Claude Code

  • Agent Skills互換のサードパーティエコシステム(skills.sh / npx skills)— Claude Code公式ではない
  • エンタープライズ管理設定
  • Pluginシステム + Bundled skills
  • Provenance/Hash追跡: 標準装備なし

Hermes Agent

  • Skills Hub: 複数レジストリを横断検索(2026-06-04スナップショットで89K件)
  • GitHubSource / WellKnownSkillSource
  • HubLockFile → Provenance / Hash / Trust Level

7. お互いにないもの — 本当の差

初版の「CCのみ」「Hermesのみ」を検証し直し、現在確認できる差のみを記載。

🪝

決定論的Hooks

Claude Code の強み

PreToolUse / PostToolUse / Stop — LLMの判断を介さない強制力。exit code 2でツール実行を物理ブロック。Hermesにこれと同等のランタイムHook機構は標準装備されていない。

🏗️

Monorepoスキル自動発見

Claude Code の強み

ネストされた.claude/skills/を自動発見+ディレクトリ修飾名(例: apps/web:deploy)。マルチパッケージリポジトリで真価を発揮。

🔄

自律スキル作成API

Hermes の強み

skill_manage() によるcreate/patch/edit/deleteのフルライフサイクル。アトミック書込+セキュリティスキャン+ロールバックまで標準化。Claude Codeのスキル作成はユーザー依頼ベース。

自己ホストcron

Hermes の強み

自然言語cron+隔離セッション。結果を14+チャネルに配信。自己ホストで完全制御可能。Claude Codeにもcron機能はあるが、クラウドRoutines主体で自己ホスト運用は想定外。

🧠

セッション横断記憶+検索

Hermes の強み

Memory/Soul/Profile/FTS5 Session Search — セッションを超えたユーザーモデリング。Claude CodeもAuto Memoryを持つが、リポジトリ中心でユーザー横断の永続性はHermesが広範。

🔌

Provider Abstraction

Hermes の強み

7+ provider / 異種モデルファミリーの切り替え。一方Claude CodeはClaudeモデル中心だがBedrock/GCP/Azure/Foundryなどの多様なデプロイ経路を持つ。

📦

スキルサプライチェーン防御

Hermes の強み

インストール前スキャン + content hash + trust level + quarantine + upstream drift検出。Claude Codeにこれと同等のスキル来歴管理機能は標準装備されていない。

👔

エンタープライズ管理

Claude Code の強み

Managed Settings、組織ポリシー強制、サンドボックス、Permission Rules。チーム導入とガバナンスの成熟度ではClaude Codeが一歩先を行く。

8. 総合比較マトリクス

13軸での比較。複数の評価軸で両者に機能がある場合は「両方◯」とし、重点の差を示す。

評価軸Claude CodeHermes Agent優位
スキル自律作成 ユーザー依頼で生成可能。/run-skill-generatorあり skill_manage()でフルライフサイクルAPI完備 Hermes
プログレッシブディスクロージャ 3層、ロード制御はLLM依存+予算1% 3層、skills_list()/skill_view()で明示制御 差は一長一短
Dynamic Context Injection 標準有効。`!command` がSKILL.md内で常時動作 サポートするがデフォルト無効(セキュリティ考慮) 標準有効ではCC
セキュリティ Hooks/Permission Rules/Sandbox/組織ポリシー 静的解析+原子性+来歴管理+検疫 得意領域が異なる
スキル来歴管理 標準装備なし HubLockFile/Trust Level/Quarantine Hermes
Cron / Scheduled Tasks /loop/クラウドRoutines/Desktop tasks/CI連携 自然言語cron/隔離セッション/自己ホスト ホスト形態の違い
決定論的Hook PreToolUse/Stop/SessionStart — 物理ブロック ランタイムHook機構の標準装備なし Claude
マルチプラットフォーム CLI/Desktop/IDE/Web/Mobile/Slack/CI 14+ messaging channels + self-host VPS チャネルと開発環境の違い
永続記憶 Auto Memory(リポジトリ中心のプロジェクト記憶) Memory/Soul/Profile/SessionSearch(ユーザー中心) 広範さではHermes
プロバイダ多様性 Claudeモデル中心。Bedrock/GCP/Azure/Foundry経路 異種モデルファミリーを選択可能 Hermes
Monorepoスキル自動発見 ネスト自動発見+ディレクトリ修飾名 カテゴリ階層のみ Claude
エンタープライズ管理 Managed Settings/組織ポリシー/サンドボックス 自己ホスト中心(エンタープライズ機能は限定的) Claude
GitHubスター数 約14.0万(2026年8月6日時点) 約22.6万(2026年8月6日時点) 現時点ではHermes
解釈: Hermes 5勝 / Claude Code 3勝 / 得意領域の違い(優劣なし) 5 — 「勝ち負け」よりも重点領域の違いで読むべき

9. レーダーチャート

Skill Lifecycle API Runtime Guards Supply Chain Security Enterprise Maturity Cross-Session Memory Channel Breadth Self-Host Cron Monorepo Discovery Claude Code Hermes Agent

10. 意思決定ツリー

「優劣」ではなく「どちらの重点領域が自分のユースケースに合うか」で選ぶ。

Question 1
スキルをエージェント自身に学習・作成させたい?
自律的な自己改善ループが必要ならHermes。スキル管理はユーザー主導で十分ならClaude Codeでも問題ない。
Question 2
「絶対に.envを読ませない」レベルが必要?
実行時の決定論的ガード(Hooks / Permission Rules)が必要ならClaude Code。インストール前のスキル静的検査が重要ならHermes。
Question 3
チーム導入/組織ガバナンスが必要?
Managed Settings / 組織ポリシー / サンドボックスが必要ならClaude Code。個人の自己ホスト常駐型として使うならHermes。
Question 4
どこからでも操作したい?留守中も動かしたい?
自己ホストcron+Telegramで外出先から操作したいならHermes。Desktop/IDE/Web/Mobile/Slackのシームレスな連携が必要ならClaude Codeも可能。
結論
ベストは「両方使う」
Claude Code 日中は机でコードを書きながらHooks+IDE統合を活用
Hermes Agent 夜間はcronジョブ+自己改善ループ、外出先からTelegram
共有GitHubリポジトリ 両方のエージェントが読める形で知識を一元管理

11. 総評

比較の目的は「どちらが優れているか」ではなく、「どこで何のために使うか」の判断材料を提供することだ。

🪟

Claude Code の真の価値

  • Hooks + Permission Rules + Sandbox — 実行時の制御と組織ポリシー強制の成熟度
  • Monorepoスキル自動発見 — マルチパッケージリポジトリの救世主
  • Dynamic Context Injection — `!`command`` が標準有効で即座に使える
  • エンタープライズ管理 — Managed Settingsでチーム導入・ガバナンスを統制
  • IDE/Desktop/Web/Mobile — 開発環境との一体性が最も高い
🧠

Hermes Agent の真の価値

  • 標準化されたスキルライフサイクルAPI — 自己改善ループが「可能」ではなく「標準」であること
  • スキルサプライチェーン防御 — 来歴管理・ハッシュ検証・静的解析・検疫
  • 自己ホスト常駐 + cron — ユーザーのリソースを完全に制御
  • 14+メッセージングチャネル — 単一Gatewayで統一的に運用
  • 異種LLMプロバイダ選択 — タスクに応じた最適なモデルを使い分け

「Hermes Agentはスキルをエージェント自身の長期的な手続き記憶として生成・改善・整理する点でClaude Codeより踏み込んだ設計を持つ。一方Claude Codeはスキルの実行制御、Hooks、権限管理、Monorepo統合、開発環境との一体性で優位にある。総合的な上下関係ではなく、自律型エージェント基盤と開発者主導型コーディング基盤という重点の違いとして評価すべきである。」