DeepSeek API:使えるモデルと円建て料金、OpenAI互換での呼び出し方

DeepSeekのV4 ProやV4.1 Flashは、日本のAIゲートウェイであるFastMetalのAPIキー1つで呼び出せます。OpenAI互換なので、既存のコードはbase URLとキーを差し替えるだけで動きます。料金は円建ての従量課金です。同じキーのまま、25のプロバイダーが提供する95以上のモデルにも切り替えられます。

FastMetalで使えるDeepSeekのモデル

2026年10月時点で、FastMetalが提供しているDeepSeekのモデルは4つです。

モデルモデルID向いている用途
DeepSeek V4 Prodeepseek-v4-proV4世代の上位モデル。難しい推論、コーディング、長いエージェント作業
DeepSeek V4 Flashdeepseek-v4-flash速度とコスト重視。分類、要約、大量の定型処理
DeepSeek V4 Flash 0731deepseek-v4-flash-07312026年7月31日に更新されたV4 Flash
DeepSeek V4.1 Flashdeepseek-v4.1-flash2026年9月10日公開。100万トークンのコンテキストと画像入力に対応

まずFlash系で試し、精度が足りない工程だけV4 Proに上げると、費用を抑えながら品質を確かめられます。ProとFlashの違いはDeepSeek V4のレビューで詳しく比べています。

モデルIDの指定

モデルIDはドットも含めて表のとおりに指定します(モデルページのURLはドットをハイフンに置き換えています)。DeepSeek公式APIの名前とは異なる場合があり、たとえば公式ではV4.1 Flashをdeepseek-flashと呼びます。使えるIDは次のコマンドで一覧できます。

curl https://api.fastmetal.ai/v1/models \
  -H "Authorization: Bearer $FASTMETAL_API_KEY"

DeepSeek APIの料金(円建て)

料金は、100万トークンあたりの入力単価と出力単価による円建ての従量課金です。下の表に現在の単価を表示しています。

並び替え:

16件のモデル

DeepSeek V4.1 Flash

deepseek-v4.1-flash

DeepSeek V4.1 Flashはディープシークの疎混合専門家モデルであり、同社のCausal Encoder-Decoder (CED)アーキテクチャ上に構築された最初のモデルです。入力時に8Bパラメータを活性化し、出力時に16Bを...

プロバイダー:deepseek logodeepseek
価格:入力 ¥33.6 · 出力 ¥100.8 / 100万トークン
コンテキスト:1.0M tokens

DeepSeek V4 Flash

deepseek-v4-flash

DeepSeek V4 Flashは、DeepSeekの効率最適化されたMixture-of-Expertsモデルで、総パラメータ数284B、アクティブ化されたパラメータ数13Bを備えており、100万トークンのコンテキストウィンドウに対応しています。高速推論用に設計されており...

プロバイダー:deepseek logodeepseek
価格:入力 ¥15.12 · 出力 ¥30.24 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#103

DeepSeek V4 Pro

deepseek-v4-pro

DeepSeek V4 Proは、DeepSeekの大規模混合専門家モデルで、総パラメータ数1.6T、アクティブ化されたパラメータ数49Bを備えており、100万トークンのコンテキストウィンドウをサポートしています。高度な推論、コーディングなどのために設計されています。

プロバイダー:deepseek logodeepseek
価格:入力 ¥218.4 · 出力 ¥436.8 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#62

DeepSeek V3.2

deepseek/deepseek-v3.2

DeepSeek-V3.2は、高い計算効率と強力な推論およびエージェント的ツール使用性能を調和させるように設計された大規模言語モデルです。DeepSeek Sparse Attention(DSA)という細粒度のスパース注意メカニズムを導入しており、長文脈シナリオにおいて品質を保ちながら訓練と推論のコストを削減します。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#122

DeepSeek V3.2 Speciale

deepseek/deepseek-v3.2-speciale

DeepSeek-V3.2-Specialeは、最大限の推論と自律型エージェント性能に最適化されたDeepSeek-V3.2の高計算量バリアントです。効率的な長文脈処理のためのDeepSeek Sparse Attention(DSA)に基づいており、その後、ポストトレーニング強化学習をスケーリングして、ベースモデルを超える能力を実現します。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens

DeepSeek V3.2 Exp

deepseek/deepseek-v3.2-exp

DeepSeek-V3.2-Expは、DeepSeekがV3.1と将来のアーキテクチャの中間段階として公開した実験的な大規模言語モデルです。DeepSeek Sparse Attention(DSA)を導入しており、これは長文脈シナリオにおけるトレーニングと推論の効率を改善しながら出力品質を維持するために設計された細粒度のスパースアテンションメカニズムです。ユーザーは`reasoning`の`enabled`ブール値を使用して推論動作を制御できます。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#127

DeepSeek V3.1 Terminus

deepseek/deepseek-v3.1-terminus

DeepSeek-V3.1 Terminusは、[DeepSeek V3.1](/deepseek/deepseek-chat-v3.1)のアップデートで、モデルの元の機能を維持しながら、言語の一貫性とエージェント機能を含むユーザーから報告された問題に対処し、コーディングおよび検索エージェントにおけるモデルのパフォーマンスをさらに最適化しています。671Bパラメータ(37Bアクティブ)の大規模ハイブリッド推論モデルで、思考モードと非思考モードの両方をサポートしています。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#138

DeepSeek V3.1 Terminus (exacto)

deepseek/deepseek-v3.1-terminus:exacto

DeepSeek-V3.1 Terminusは、[DeepSeek V3.1](/deepseek/deepseek-chat-v3.1)のアップデートで、モデルの元の機能を維持しながら、言語の一貫性とエージェント機能を含むユーザーから報告された問題に対処し、コーディングおよび検索エージェントにおけるモデルのパフォーマンスをさらに最適化しています。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens

DeepSeek V3.1

deepseek/deepseek-chat-v3.1

DeepSeek-V3.1は、プロンプトテンプレートを介して思考モードと非思考モードの両方をサポートする大規模ハイブリッド推論モデル(6710億パラメータ、370億アクティブ)です。DeepSeek-V3ベースを拡張し、2段階の長文脈トレーニングプロセスで最大128Kトークンに対応し、効率的な推論のためにFP8マイクロスケーリングを使用しています。ユーザーは`reasoning` `enabled`ブール値を使用して推論動作を制御できます。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:33K tokens
テキスト総合
#134

R1 0528

deepseek/deepseek-r1-0528

5月28日更新:[オリジナルDeepSeek R1](/deepseek/deepseek-r1)は[OpenAI o1](/openai/o1)と同等のパフォーマンスを実現していますが、オープンソース化され、推論トークンが完全に公開されています。パラメータサイズは671Bで、推論パスでは37Bがアクティブです。 完全にオープンソースのモデルです。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#128

DeepSeek V3 0324

deepseek/deepseek-chat-v3-0324

DeepSeek V3は、685Bパラメータの混合専門家モデルであり、DeepSeekチームのフラッグシップチャットモデルファミリーの最新版です。 [DeepSeek V3](/deepseek/deepseek-chat-v3)モデルの後継であり、様々なタスクで優れたパフォーマンスを発揮します。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#164

R1 Distill Qwen 32B

deepseek/deepseek-r1-distill-qwen-32b

DeepSeek R1 Distill Qwen 32Bは、[Qwen 2.5 32B](https://huggingface.co/Qwen/Qwen2.5-32B)をベースとした蒸留大規模言語モデルで、[DeepSeek R1](/deepseek/deepseek-r1)の出力を使用しています。様々なベンチマークでOpenAIのo1-miniを上回り、密集型モデルの新しい最先端の結果を達成しています。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:33K tokens

R1 Distill Llama 70B

deepseek/deepseek-r1-distill-llama-70b

DeepSeek R1 Distill Llama 70Bは、[Llama-3.3-70B-Instruct](/meta-llama/llama-3.3-70b-instruct)に基づいた蒸留大規模言語モデルで、[DeepSeek R1](/deepseek/deepseek-r1)の出力を使用しています。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:131K tokens

R1

deepseek/deepseek-r1

DeepSeek R1がここにあります:[OpenAI o1](/openai/o1)と同等のパフォーマンスですが、オープンソース化され、完全にオープンな推論トークンを備えています。パラメータサイズは671Bで、推論パスで37Bがアクティブです。 完全にオープンソースのモデル&[技術レポート](https://api-docs.deepseek.com/news/news250120)。 MITライセンス:自由に蒸留・商用化できます!

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:64K tokens
テキスト総合
#162

DeepSeek V3

deepseek/deepseek-chat

DeepSeek-V3は、DeepSeekチームの最新モデルであり、前のバージョンの指示追従能力とコーディング能力を基盤としています。約15兆トークンで事前学習されており、報告された評価によると、このモデルは他のオープンソースモデルを上回り、主要なクローズドソースモデルに匹敵します。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#205

deepseek-v4-flash-0731

deepseek-v4-flash-0731

Global: DeepSeek V4 Flash 0731 - 高速・低コストなモデル

プロバイダー:deepseek logodeepseek
価格:入力 ¥23.52 · 出力 ¥47.04 / 100万トークン
コンテキスト:- tokens

単価は改定されることがあります。全モデルの単価は料金ページで確認できます。月額料金や最低利用額はなく、使った分だけが残高から差し引かれます。月々の目安はコスト計算ツールで試算できます。

DeepSeekのV4系には、回答の前に考える「思考モード」があります。思考トークンは出力トークンとして出力単価で課金され、回答に表示されなくても課金されます。量はcompletion_tokensに含まれ、内訳はusage.completion_tokens_details.reasoning_tokensに出ます。reasoningオブジェクトのeffort、enabled: false、max_tokensで調整でき、既定値はモデルごとに異なります。詳しくは思考(推論)の制御をご覧ください。

APIキーとOpenAI互換での呼び出し方

FastMetalのAPIキーはsk-で始まり、作成時に一度だけ表示されます。OpenAIの公式SDKでもcurlでも、base URLをhttps://api.fastmetal.ai/v1、モデルをdeepseek-v4-proにすれば呼び出せます。

Python(OpenAI SDK)

import os
from openai import OpenAI

client = OpenAI(
    base_url="https://api.fastmetal.ai/v1",
    api_key=os.environ["FASTMETAL_API_KEY"],
)

res = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[{"role": "user", "content": "この関数のバグを探してください。"}],
)
print(res.choices[0].message.content)

curl

curl https://api.fastmetal.ai/v1/chat/completions \
  -H "Authorization: Bearer $FASTMETAL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [{"role": "user", "content": "こんにちは"}]
  }'

ストリーミング、ツール呼び出し、構造化出力もOpenAIの形式で使えます。modelを書き換えれば、同じコードでOpenAIのGPTやAnthropicのClaudeとも比べられます。はじめての方はAPIの始め方もご覧ください。

Claude CodeでDeepSeekを使う

FastMetalはAnthropic互換のAPIも備えているので、Claude CodeのモデルをDeepSeekに差し替えられます。環境変数を3つ設定して起動します。

export ANTHROPIC_AUTH_TOKEN="$FASTMETAL_API_KEY"
export ANTHROPIC_BASE_URL="https://api.fastmetal.ai"
export ANTHROPIC_MODEL="deepseek-v4-pro"
claude

つまずきやすいのは次の2点です。

  • キーはANTHROPIC_AUTH_TOKENに入れます。ANTHROPIC_API_KEYに入れるとx-api-keyヘッダーで送られ、FastMetalでは受け付けられません。
  • base URLの末尾に/v1は付けません。付けるとリクエスト先が/v1/v1/messagesになって404が返り、Claude Codeはモデルにアクセスできないかのようなエラーを表示します。

コーディングエージェントは1つのタスクでモデルを何度も呼び出し、そのたびに文脈を送り直します。費用の多くを入力トークンが占めるので、モデル選びでは入力単価が効きます。手順の詳細はClaude Codeの設定ガイドとClaude CodeをAPIキーで使う手順にあります。

支払い・適格請求書・データの扱い

円建てで払い、適格請求書を受け取る

支払いは円建てのプリペイドです。カード払いはすぐに残高へ反映され、銀行振込(前払い)では専用口座を記した適格請求書がその場で発行されます。どちらも¥500から購入でき、購入のたびに適格請求書が発行されます(登録番号 T5010001015990)。残高はすべてのモデルで共通なので、DeepSeekとClaudeを併用しても支払いは1本にまとまります。円建てで払う利点は円建てのLLM APIで解説しています。

予算の上限

購入した残高がそのまま利用の上限になります。APIキーごとに上限を分けられるので、チームやプロジェクト単位の予算管理にも向いています。

データの扱い

FastMetalがお客様のデータをモデルの学習に使うことはありません。リクエストは各モデルの提供元へ中継され、提供元側での扱いはその提供元のポリシーに従います。FastMetalのDeepSeekモデルは、DeepSeek社以外の推論事業者のインフラで稼働しており、リクエストがDeepSeek社のサーバーに届くことはありません(2026年10月時点)。機密性の高いデータは、事前にお問い合わせください。推論を国内で完結させたい場合は、日本国内で動くLLMから選べます。

よくある質問

DeepSeek APIの料金はいくらですか

100万トークンあたりの入力単価と出力単価による、円建ての従量課金です。モデルごとの単価はこのページの料金表と料金ページに掲載しています。月額料金はかかりません。

DeepSeek APIは無料で使えますか

アカウントの作成は無料です。DeepSeekのモデルは従量課金なので、クレジットを¥500から購入してご利用ください。

DeepSeek公式のAPIを直接使う場合と何が違いますか

1つのAPIキーで、DeepSeekを含む25のプロバイダー、95以上のモデルを呼び出せます。支払いは円建てで、銀行振込(前払い)にも対応し、購入のたびに適格請求書を発行します。

送ったデータは学習に使われますか

FastMetalがお客様のデータを学習に使うことはありません。リクエストはモデルの提供元へ中継され、提供元側ではその提供元のポリシーが適用されます。FastMetalのDeepSeekモデルはDeepSeek社以外の推論事業者のインフラで稼働しており、リクエストがDeepSeek社のサーバーに届くことはありません(2026年10月時点)。機密性の高いデータは事前にご相談ください。

残高がなくなるとどうなりますか

リクエストが受け付けられなくなります。残高が少なくなったときと尽きたときにはメールでお知らせします。購入した残高が上限なので、請求が想定を超えて膨らむことはありません。


FastMetalでDeepSeekを試す

無料でアカウントを作成してクレジットを購入すれば、すぐにDeepSeekを呼び出せます。単価は料金ページ、ほかのモデルはモデル一覧でご確認ください。

DeepSeekに関する記事

コラム

回答の長さは同じ、トークンは12倍 — DeepSeek V4.1 Flash と GLM 5.3 Flash

同じ43本のプロンプトを両モデルに流し、出力トークンと所要時間を記録しました。見える回答の量はほぼ同じなのに、支払いは4倍違います。差はすべて「考えている時間」から来ています。

新モデル

DeepSeek V4.1 Flash が利用可能に — 1Mコンテキストと画像入力、推論レベルの選択

DeepSeek V4.1 Flash が FastMetal で使えるようになりました。100万トークンのコンテキストに加え、Flash 系では初めて画像入力に対応。推論レベルを low まで下げられるのが実用上の要点です。

新モデル

DeepSeek V4 Flash とは?日本語性能・料金・使い方 — FastMetalで利用可能に

オープンウェイトの DeepSeek V4 Flash が FastMetal で使えるようになりました。高速・低コストで、エージェント/コーディング系ベンチマークではフロンティアに肉薄します。

コラム

DeepSeek V4 Pro vs Claude Opus 5:長文脈を安く回すか、最難関を確実に通すか

MITライセンスの巨大オープンモデル DeepSeek V4 Pro と、最新クローズド旗艦 Claude Opus 5 を、コスト・性能・弱点まで比較。コストを取るか、最高品質を取るか。

コラム

DeepSeek V4 vs Claude Fable 5:桁違いのコスト差、どこまで品質で埋まるか

MITライセンスの DeepSeek V4 と、Anthropic の最上位 Claude Fable 5 を比較。出力単価は桁違いに違う両者を、性能・弱点・使い分けまで正直に解説します。

レビュー

DeepSeek V4 レビュー:1.6兆パラメータの MoE を Pro と Flash で使い分ける

DeepSeek V4 Pro と V4 Flash を、アーキテクチャ・ベンチマーク・コスト・弱点まで正直にレビュー。長文脈の推論コストを大きく下げた、MIT ライセンスのオープンモデルです。