Hermes × FastMetal:月額サブスクなしでコーディングエージェントを回す
コーディングエージェントを使うのに、月額プランに入るしかないわけではありません。Nous Research の Hermes Agent は MIT ライセンスのオープンソースで、ツール自体は無料です。モデルの接続先を自由に選べるので、FastMetal に向ければ使った分だけの従量課金で運用できます。
この記事では設定手順と、Codex のサブスクリプションと比べた実際のコストを見ていきます。
1. Hermes をインストールする
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
Windows の場合は PowerShell から。
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
2. FastMetal をプロバイダーとして登録する
~/.hermes/config.yaml に、名前付きプロバイダーとして FastMetal を追加します。
providers:
fastmetal:
api: https://api.fastmetal.ai/v1
key_env: FASTMETAL_API_KEY
transport: chat_completions
default_model: anthropic-claude-sonnet-5
model:
provider: custom:fastmetal
default: anthropic-claude-sonnet-5
providers: の下では fastmetal という名前で定義しますが、model.provider で選ぶときは custom: を付けて custom:fastmetal と書きます。ここを素の fastmetal にすると、プロバイダーが選択されません。
キーは ~/.hermes/.env に置きます。
# ~/.hermes/.env
FASTMETAL_API_KEY=your-fastmetal-api-key
hermes でCLI が、hermes --tui で TUI が起動します。
3. 作業中にモデルを切り替える
名前付きプロバイダーにしておくと、セッション中に /model で切り替えられます。
/model custom:fastmetal:glm-5.2
/model custom:fastmetal:deepseek-v4-flash
/model custom:fastmetal:anthropic-claude-opus-5
ここが従量課金の効くところです。定型的な修正は安いモデルで回し、設計判断や難しいデバッグのときだけ上位モデルに上げる。サブスクリプションでは「安く済ませた分」が手元に返ってきませんが、従量課金ではそのまま請求額に反映されます。
タイトル生成や履歴の圧縮といった裏方の処理は、軽いモデルに固定しておくと無駄が減ります。
auxiliary:
title_generation:
provider: fastmetal
model: gemini-3.5-flash
compression:
provider: fastmetal
model: gemini-3.5-flash
コストを比べる考え方
Codex は ChatGPT の月額プランに含まれる形で提供されており、プランごとの月額と利用枠は OpenAI の料金ページに載っています。使っても使わなくても毎月同じ額がかかり、そのかわり利用枠の範囲では追加料金がありません。
FastMetal 側は、前払いの残高から実際に使ったトークンの分だけが引かれます。エージェントは会話の履歴を毎回送り直すため、請求の大半は入力トークンで決まり、同じ作業でもモデルの選び方で月の費用が1桁以上変わります。自分の使い方での金額は、AIコスト計算ツールに1日あたりのトークン量を入れると、モデルごとに円建てで出せます。モデル別の単価は料金ページにあります。
どちらが安いのか
正直に書くと、フロンティアモデルを毎日フルタイムで回すなら、サブスクリプションの方が安く収まることがあります。上位モデルは単価が高く、エージェントの入力量は大きいため、毎日使えば従量課金の合計が月額を超えやすくなります。
従量課金が明確に有利なのは次のようなケースです。
- 毎日は使わない — 週に 2〜3 日、あるいは案件があるときだけ使う。サブスクは使わない月も満額かかりますが、従量課金は 0 円です。
- 軽量モデルで足りる作業が多い —
deepseek-v4-flashのような軽量モデル中心なら、上位モデルの数分の1から10分の1以下の費用で収まります。 - 請求を上限で止めたい — FastMetal は前払いなので、入金した額を超える請求は構造的に発生しません。エージェントが想定外にループしても、被害は残高までです。
- 利用枠の制限を避けたい — サブスクリプション型のプランには 5 時間ごとや週単位の利用枠があり、集中して作業した日に上限へ当たることがあります。従量課金では残高が続く限り止まりません。
- モデルを固定したくない — Hermes はモデル非依存です。1 つのキーのまま Claude、GLM、DeepSeek、Qwen を切り替えられます。
逆に、毎日 8 時間フロンティアモデルを回し続ける使い方であれば、サブスクリプションの定額制の方が予算を立てやすいはずです。まずは 1〜2 週間、少額を入金して実際の消費額を測ってみるのが確実です。残高と使用額はダッシュボードからいつでも確認できます。
つまずきやすい点
- 認証エラー —
key_envに書いた名前の環境変数が~/.hermes/.envにあるか確認してください。 - モデル ID の綴り —
/modelsに載っている ID をそのまま使います。anthropic-claude-sonnet-5のようにハイフン区切りです。 - 残高切れ — 残高を使い切るとリクエストが拒否されます。エラーの内容が分かりにくい場合は、まず残高を確認してください。
次のステップ
設定の詳細は Hermes 連携ガイドにまとめています。Hermes は MCP クライアントとしても動くので、FastMetal の MCP サーバーを繋げば、メインモデルを保ったまま別モデルへの相談や画像生成をツールとして追加することもできます。