定番モデル9本を追加:GPT-5 mini、Llama 4 Maverick、Devstral など
FastMetal のゲートウェイに、9つのモデルを追加しました。いずれも新発表のモデルではなく、すでに定番として使われているのに当サービスでは選べなかったものです。検索で実際に問い合わせのあったモデルから順に追加しました。
これで初めて Mistral のモデルがカタログに入りました。
追加したモデル
| モデル | モデルID | 向いている用途 |
|---|---|---|
| GPT-5 mini | gpt-5-mini | 現行GPTの小型版。40万トークン文脈 |
| GPT-4.1 mini | gpt-4.1-mini | 100万トークン文脈の中位モデル |
| GPT-5.4 nano | gpt-5.4-nano | 現行GPTで最安。大量の定型処理向け |
| Llama 4 Maverick | llama-4-maverick | 100万トークン文脈のオープンMoE。画像入力可 |
| Llama 3.3 70B Instruct | llama-3.3-70b-instruct | 定番の70Bオープンモデル |
| Qwen3-VL 235B-A22B | qwen3-vl-235b-a22b-instruct | 26万トークン文脈の大型ビジョンモデル |
| Gemma 4 26B-A4B | gemma-4-26b-a4b-it | 軽量マルチモーダル。日本国内実行の Gemma 4 31B の弟分 |
| gpt-oss-20B | gpt-oss-20b | 最安クラス。gpt-oss-120B の小型版 |
| Devstral 2512 | devstral-2512 | コーディング向け。当サービス初の Mistral モデル |
追加前に確認したこと
カタログに載せる前に、9モデルすべてで実際にリクエストを投げて確認しています。
- ツール呼び出し:9モデルすべてで関数呼び出しが返ることを確認しました。
- 画像入力:画像対応の6モデル(GPT-5 mini / GPT-4.1 mini / GPT-5.4 nano / Llama 4 Maverick / Qwen3-VL / Gemma 4 26B)に日本語の請求書画像を読ませ、請求書番号・合計金額・支払期限をすべて正しく抽出できることを確認しました。
- データの取り扱い:各モデルで実際に使う配信元に対して、「リクエストデータを学習や保持に使う提供元を除外する」条件でリクエストが通ることを確認しています。各モデルページのデータ方針欄に表示しています。
使い方
model の値を差し替えるだけです。エンドポイントも API キーも円建ての残高も共通です。
curl https://api.fastmetal.ai/v1/chat/completions \
-H "Authorization: Bearer $FASTMETAL_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5-mini",
"messages": [{"role": "user", "content": "この関数の計算量を説明してください。"}]
}'
注意点
Llama 4 Maverick でツールを使うときは文脈が128Kまでになります。100万トークンを扱える配信元がツール呼び出しに対応していないため、ツールを含むリクエストだけ対応する配信元へ振り分けています。長い文脈とツールを同時に使いたい場合は、Llama 4 Maverick 以外を選んでください。
よくある質問
Q. 今回追加されたモデルの料金はいくらですか? 円建ての入力・出力トークン単価をモデルカタログと料金ページに掲載しています。前払いの残高から使った分だけ引かれ、残高を超える請求は発生しません。
Q. FastMetal で Mistral のモデルは使えますか?
はい。今回追加した Devstral 2512(devstral-2512)が最初の Mistral モデルです。コーディング向けで、26万トークンの文脈に対応しています。
Q. 追加したモデルを比較できますか? GPT-5 mini、GPT-4.1 mini、GPT-5.4 nano、gpt-oss-20B、Llama 3.3 70B はモデル比較に入っているため、他のモデルと実際の回答を並べて確認できます。