← ブログに戻る
チュートリアル

Hermes × FastMetal:月額サブスクなしでコーディングエージェントを回す

FastMetal

コーディングエージェントを使うのに、月額プランに入るしかないわけではありません。Nous Research の Hermes Agent は MIT ライセンスのオープンソースで、ツール自体は無料です。モデルの接続先を自由に選べるので、FastMetal に向ければ使った分だけの従量課金で運用できます。

この記事では設定手順と、Codex のサブスクリプションと比べた実際のコストを見ていきます。

1. Hermes をインストールする

curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

Windows の場合は PowerShell から。

iex (irm https://hermes-agent.nousresearch.com/install.ps1)

2. FastMetal をプロバイダーとして登録する

~/.hermes/config.yaml に、名前付きプロバイダーとして FastMetal を追加します。

providers:
  fastmetal:
    api: https://api.fastmetal.ai/v1
    key_env: FASTMETAL_API_KEY
    transport: chat_completions
    default_model: anthropic-claude-sonnet-5

model:
  provider: custom:fastmetal
  default: anthropic-claude-sonnet-5

providers: の下では fastmetal という名前で定義しますが、model.provider で選ぶときは custom: を付けて custom:fastmetal と書きます。ここを素の fastmetal にすると、プロバイダーが選択されません。

キーは ~/.hermes/.env に置きます。

# ~/.hermes/.env
FASTMETAL_API_KEY=your-fastmetal-api-key

hermes でCLI が、hermes --tui で TUI が起動します。

3. 作業中にモデルを切り替える

名前付きプロバイダーにしておくと、セッション中に /model で切り替えられます。

/model custom:fastmetal:glm-5.2
/model custom:fastmetal:deepseek-v4-flash
/model custom:fastmetal:anthropic-claude-opus-5

ここが従量課金の効くところです。定型的な修正は安いモデルで回し、設計判断や難しいデバッグのときだけ上位モデルに上げる。サブスクリプションでは「安く済ませた分」が手元に返ってきませんが、従量課金ではそのまま請求額に反映されます。

タイトル生成や履歴の圧縮といった裏方の処理は、軽いモデルに固定しておくと無駄が減ります。

auxiliary:
  title_generation:
    provider: fastmetal
    model: gemini-3.5-flash
  compression:
    provider: fastmetal
    model: gemini-3.5-flash

コストを比べる考え方

Codex は ChatGPT の月額プランに含まれる形で提供されており、プランごとの月額と利用枠は OpenAI の料金ページに載っています。使っても使わなくても毎月同じ額がかかり、そのかわり利用枠の範囲では追加料金がありません。

FastMetal 側は、前払いの残高から実際に使ったトークンの分だけが引かれます。エージェントは会話の履歴を毎回送り直すため、請求の大半は入力トークンで決まり、同じ作業でもモデルの選び方で月の費用が1桁以上変わります。自分の使い方での金額は、AIコスト計算ツールに1日あたりのトークン量を入れると、モデルごとに円建てで出せます。モデル別の単価は料金ページにあります。

どちらが安いのか

正直に書くと、フロンティアモデルを毎日フルタイムで回すなら、サブスクリプションの方が安く収まることがあります。上位モデルは単価が高く、エージェントの入力量は大きいため、毎日使えば従量課金の合計が月額を超えやすくなります。

従量課金が明確に有利なのは次のようなケースです。

  • 毎日は使わない — 週に 2〜3 日、あるいは案件があるときだけ使う。サブスクは使わない月も満額かかりますが、従量課金は 0 円です。
  • 軽量モデルで足りる作業が多い — deepseek-v4-flash のような軽量モデル中心なら、上位モデルの数分の1から10分の1以下の費用で収まります。
  • 請求を上限で止めたい — FastMetal は前払いなので、入金した額を超える請求は構造的に発生しません。エージェントが想定外にループしても、被害は残高までです。
  • 利用枠の制限を避けたい — サブスクリプション型のプランには 5 時間ごとや週単位の利用枠があり、集中して作業した日に上限へ当たることがあります。従量課金では残高が続く限り止まりません。
  • モデルを固定したくない — Hermes はモデル非依存です。1 つのキーのまま Claude、GLM、DeepSeek、Qwen を切り替えられます。

逆に、毎日 8 時間フロンティアモデルを回し続ける使い方であれば、サブスクリプションの定額制の方が予算を立てやすいはずです。まずは 1〜2 週間、少額を入金して実際の消費額を測ってみるのが確実です。残高と使用額はダッシュボードからいつでも確認できます。

つまずきやすい点

  • 認証エラー — key_env に書いた名前の環境変数が ~/.hermes/.env にあるか確認してください。
  • モデル ID の綴り — /models に載っている ID をそのまま使います。anthropic-claude-sonnet-5 のようにハイフン区切りです。
  • 残高切れ — 残高を使い切るとリクエストが拒否されます。エラーの内容が分かりにくい場合は、まず残高を確認してください。

次のステップ

設定の詳細は Hermes 連携ガイドにまとめています。Hermes は MCP クライアントとしても動くので、FastMetal の MCP サーバーを繋げば、メインモデルを保ったまま別モデルへの相談や画像生成をツールとして追加することもできます。

最新のAIモデルを今すぐ試す

最新のAIモデルはFastMetalのAPIキー1つで利用できます。ブラウザですぐに試す、またはOpenAI SDKからそのまま呼び出せます。