ブログに戻る
コラム

DeepSeek V4 vs Claude Fable 5:桁違いのコスト差、どこまで品質で埋まるか

FastMetal

LLM 選びで「コストか、品質か」という問いを最も極端に突きつけるのが、DeepSeek の DeepSeek V4 と Anthropic の最上位 Claude Fable 5 の対比です。出力単価は桁違いに違い、その差を品質でどこまで埋められるかが論点になります。

結論から言うと、**「大量に安く回すなら DeepSeek V4、最難関タスクを最後までやり切るなら Fable 5」**です。

スペック比較

項目DeepSeek V4Claude Fable 5
提供元DeepSeekAnthropic
モデルID(FastMetal)deepseek-v4-pro / deepseek-v4-flashanthropic-claude-fable-5
ライセンスMIT(オープン)クローズド
文脈長約100万トークン100万トークン
入力テキストのみテキスト・画像・ファイル
単価の傾向非常に安い高め

コストと性能

DeepSeek V4 は総1.6兆・アクティブ約49BのオープンなMoEで、長文脈の推論コストを大きく削っています。報道では出力単価がクローズドのフラッグシップの数十分の一とされ、大量処理での経済性が最大の武器です。上位の deepseek-v4-pro と軽量な deepseek-v4-flash を使い分けられます。

Claude Fable 5 は、公開モデルの中でも最難関のコーディングや長時間タスクで屈指の存在です。各レビューでは SWE-Bench Pro 80.3%、Terminal-Bench 2.1 88.0% などの数値が伝えられています。最大の強みは、タスクが長く曖昧で失敗が続いても進み続ける粘り強さ——大規模な移行や難しい調査に向きます。

FastMetal での円建ての実際の単価は料金ページでご確認ください。

それぞれの弱点

DeepSeek V4 の注意点: テキスト専用で画像は扱えません。よく引用される SWE-bench Verified 80.6% は最上位「Max」版の数値で、提供バリアントとは別物です。日本語特化ベンチマークも確認できませんでした。

Claude Fable 5 の注意点: 高価で低速なうえ、安全分類器が正当な作業を誤ってブロックするという報告があります。Hacker News では、医療画像・実験自動化・健康データ、さらには音楽用ファームウェアまでがリスクとして弾かれた例が共有されました。一部の研究系タスクで「本人にも見えない形で性能を落とす」挙動への批判もあり、日常的な軽作業には割高です。

使い分け

  • DeepSeek V4 が向くケース — 100万トークン級を大量に処理するバッチ、コスト最優先、ライセンスの自由が要件の商用プロジェクト。
  • Claude Fable 5 が向くケース — 大規模なコード移行、失敗を繰り返しながら進む長時間の調査、品質を最優先できる場面。

両方試す

FastMetal なら、同じ API キー・同じ円建て残高のまま model を差し替えるだけで両方を比較できます。

# DeepSeek V4 Pro
curl https://api.fastmetal.ai/v1/chat/completions \
  -H "Authorization: Bearer $FASTMETAL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "deepseek-v4-pro", "messages": [{"role": "user", "content": "こんにちは"}]}'

# Claude Fable 5(model を差し替えるだけ)
curl https://api.fastmetal.ai/v1/chat/completions \
  -H "Authorization: Bearer $FASTMETAL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "anthropic-claude-fable-5", "messages": [{"role": "user", "content": "こんにちは"}]}'

よくある質問

Q. コスト差はどれくらいですか? 報道では、DeepSeek V4 の出力単価はクローズドのフラッグシップの数十分の一とされています。実際の請求は単価×使用量です。FastMetal での円建ての単価は料金ページでご確認ください。

Q. 品質差は埋まりますか? コーディングのベンチマークでは Fable 5 が上位です。ただし用途によっては DeepSeek V4 で十分なことも多く、自分のタスクで比較するのが確実です。

Q. 日本語はどちらが得意ですか? 両モデルとも日本語特化のベンチマークは確認できませんでした。重要な用途では実プロンプトでの検証をおすすめします。

まとめ

大量に安く回すなら DeepSeek V4、最難関タスクの完遂なら Claude Fable 5 ——桁違いのコスト差は、用途次第で十分に正当化されます。FastMetal なら両方を同じキーで試せます。

詳細は DeepSeek V4 レビューClaude Fable 5 の紹介、対応モデルはモデルカタログをご覧ください。