モデル比較

Claude Opus 5 vs gpt-oss-20b

料金・コンテキスト長・実際の回答で比較(2026年9月時点)

Claude Opus 5(Anthropic)とgpt-oss-20b(OpenAI)を、FastMetalのゲートウェイで実際に呼び出せる条件で比較します。どちらも同じOpenAI互換エンドポイントとAPIキーから利用でき、切り替えは model の文字列を変えるだけです。

スペックと料金

anthropic logoClaude Opus 5openai logogpt-oss-20b
提供元AnthropicOpenAI
入力(100万トークンあたり)¥893.5¥5.36
出力(100万トークンあたり)¥4,467.5¥25.02
想定コスト(入力1,000・出力500トークン × 1,000回)¥3,127¥18
コンテキスト長1,000,000 トークン131,072 トークン
リリース日2026/7/242025/8/5
入力モダリティtext, image, filetext
生成速度 (p50)
アリーナ 総合#10 · ELO 1,493#252 · ELO 1,317
アリーナ 日本語#6 · ELO 1,503#179 · ELO 1,256
アリーナ コーディング#12 · ELO 1,533#232 · ELO 1,369

料金はFastMetalの円建て単価(税別)。アリーナ順位は公開リーダーボードの最新取得時点の値です。

どちらを選ぶべきか

  • 料金重視ならgpt-oss-20b。出力100万トークンあたり¥25.02で、Claude Opus 5より99%安くなります。
  • 総合の評価はアリーナ順位でClaude Opus 5が上です(10位。gpt-oss-20bは252位)。
  • 日本語の評価はアリーナ順位でClaude Opus 5が上です(6位。gpt-oss-20bは179位)。
  • コーディングの評価はアリーナ順位でClaude Opus 5が上です(12位。gpt-oss-20bは232位)。
  • 長い文書を扱うならClaude Opus 5。コンテキスト長は1,000,000トークンで、gpt-oss-20bの131,072トークンより広くとれます。
  • 迷ったら両方を同じキーで試せます。model の文字列を変えるだけで切り替わり、料金はそれぞれの単価で従量課金されます。

同じプロンプトへの実際の回答

FastMetalのゲートウェイが返した回答をそのまま並べています。ベンチマークの数字ではなく、実際の出力です。

このエラーをデバッグして

以下のエラーがPythonアプリケーションで発生しています。原因を特定して修正してください。 Traceback (most recent call last): File "app.py", line 23, in get_user_orders total = sum(order["price"] * order["quantity"] for order in orders) TypeError: unsupport…

Claude Opus 5

# エラーの原因 `order["price"]` が **文字列型 (`str`)** で返ってきています。`order["quantity"]` は `int` なので、`str * int` の演算になり `TypeError` が発生しました。 Python では `"100" * 3` は `"100100100"` という文字列の繰り返しになり、`3 * "100"` も同様です。ただし今回は `str * int` の順で、かつエラーになっているので、内部的には `price` が `Decimal` ではなく `str` として渡り、`quantity` 側が `int` 以外(あるいは逆順)…という細かい話は置いておき、要点は **DB から取得した `price` が数値型になっていない** ことです。 ## なぜ文字列になるのか(典型的な原因) | 原因 | 説明 | |---|---| | カラム型が `VARCHAR`/`TEXT` | `price` が数値カラムとして定義されていない | | DB ドライバの型変換設定 | MySQL の `DECIMAL` を文字列で返すドライバがある(例: `mysqlclient` の一部設定、`PyMySQL` の `conv` 設定) | | SQLite の型の緩さ | SQLite は宣言型と実際の格納型が一致しないことがある | | ORM/ラッパー層の仕様 | 自前の `db.query` が全カラムを `str` で返している | まずは実際の型を確認してください。 ```pytho…
応答時間 34.2秒出力 2190 トークン

gpt-oss-20b

## 1. エラーの原因 ```python TypeError: unsupported operand type(s) for *: 'str' and 'int' ``` - `order["price"]` が **文字列 (`str`)** である - `order["quantity"]` が **整数 (`int`)** である - `str * int` は演算できないため例外が発生 ### 何で `price` が文字列になるのか? | DB | 典型的な戻り値の型 | 文字列になるケース | |-----|------------------|---------------------| | PostgreSQL(psycopg2) | `Decimal` | なし(数値型は `Decimal`) | | MySQL(mysql‑connector / pymysql) | `Decimal` または `str` | `use_unicode=True` や `cursorclass=` が設定されていると文字列になる | | SQLite(sqlite3) | `int`/`float` | なし | したがって、今回使われている `db.query()` では価格列が **文字列として返されている** ことが原因です。 --- ## 2. 修正方法 ### ① 数値型へキャストして足し算 ```python def get_user_orders(user_id): # ① クエリ実行 orders = db.quer…
応答時間 10.0秒出力 1365 トークン

コードレビュー

以下のTypeScript関数をレビューして、可読性・パフォーマンス・ベストプラクティスの観点から改善点を提案してください。 async function fetchAllUsers(page: number = 1): Promise<any[]> { let allUsers: any[] = []; let hasMore = true; let currentPage = page; while (hasMo…

Claude Opus 5

# コードレビュー ## 総評 ページネーションのロジック自体は正しく動作しますが、**型安全性の欠如**と**エラーハンドリングの不在**が最も重大な問題です。特に `any[]` の使用はTypeScriptを使う意義を大きく損なっています。以下、優先度順に指摘します。 --- ## 🔴 重大な問題 ### 1. `any` 型による型安全性の喪失 `Promise<any[]>` と `data.users[i]` の型が不明なため、コンパイラの検証が一切効きません。`data.users` が `undefined` の場合はランタイムエラーになりますが、コンパイル時には検出されません。 ```typescript // APIレスポンスの型を定義 interface ApiUser { id: string; first_name: string; last_name: string; email: string; status: "active" | "suspended" | "deleted"; } interface UsersResponse { users: ApiUser[]; } // 戻り値の型も明示 interface User { id: string; name: string; email: string; } ``` 外部入力を信頼できない場合は、zod などでランタイムバリデーションを併用するのが理想です。 ```typescript const UsersResponseSch…
応答時間 40.9秒出力 3042 トークン

gpt-oss-20b

## ① ざっくりした実装概要 ```ts async function fetchAllUsers(page: number = 1): Promise<any[]> { /* … */ } ``` - 1ページにつき最大100件取得し、`status !== "deleted"` のレコードだけを `id / name / email` らしき構造体に整形。 - **ページングを手動**で止めるために while‑loop で繰り返し呼び出す → 連続で **1 つずつ直列**に `fetch` している。 - `any` をそのまま返している。 - エラー処理・型定義・可読性・パフォーマンスに関しては改善余地が多々ある。 --- ## ② 可読性(コードの見やすさ・保守性)を向上させる | 現状 | 改善案 | 具体例 | |------|--------|--------| | ① `any` を使っている | 型を定義し、返却型を `User[]` に | ```ts interface User { id: number; name: string; email: string; } ``` | | ② ループの内部でインデックスを使う | `for...of` + デストラクチャリング | ```ts for (const u of data.users) { … } ``` | | ③ `if (data.users.length < 100)` で終了判定 | `data.users.splice` で終端を判断 | –(設計…
応答時間 62.4秒出力 3181 トークン

SQLクエリの最適化

以下のSQLクエリは500万行のテーブルに対して実行すると30秒以上かかります。最適化してください。 SELECT p.product_name, c.category_name, COUNT(o.order_id) as order_count, SUM(o.amount) as total_sales, AVG(r.rating) as avg_rating FROM products p LEFT JOIN…

Claude Opus 5

## まず結論 このクエリは「遅い」だけでなく **結果が間違っている(数値が水増しされている)** 可能性が高いです。原因は同じ根っこ(結合の多重展開)なので、正しく書き直すと速度も劇的に改善します。 以下 PostgreSQL 前提(`NULLS LAST` / `true` から判断)で説明します。 --- ## 1. 問題点の整理 ### ① 致命的:`order_details` と `reviews` の多重展開(fan-out) `products` に対して `order_details`(1商品にN明細)と `reviews`(1商品にMレビュー)を**並列に**LEFT JOINしているため、中間結果が **N × M 行** に爆発します。 - ある商品に明細100件・レビュー50件 → 中間行 5,000行 - `COUNT(o.order_id)` は **レビュー件数倍**、`SUM(o.amount)` も **レビュー件数倍** に膨張 - `AVG(r.rating)` は各評価が均等に複製されるため値は偶然合いますが、無駄な行を大量に平均している 500万行テーブルでこれをやると中間結果が数億行になり、ソート/ハッシュ集約が `work_mem` を溢れてディスクスピルします。**30秒の主因はほぼこれです。** ### ② `LEFT JOIN` + `WHERE o.created_at >= ...` が矛盾 `WHERE` で外側テーブルの列を非NULL条件にすると、LEFT JOIN は実質 INNER JOIN…
応答時間 90.2秒出力 6441 トークン

gpt-oss-20b

## ① なぜ 30 秒かかるのか | 主要なボトルネック | 具体的な症状 | |------------------|--------------| | **テーブルスキャン** | `orders` と `order_details` は 500 万行を超える可能性がある。`WHERE o.status = '完了' AND o.created_at >= …` の条件が **`orders` の単一列にしかインデックスが無いので** まず全行を読み込み、次に結合のために行を再スキャン | | **結合条件が多い** | `LEFT JOIN` では結合条件を満たせない行もすべて取得しなければならない。`orders` のフィルタは `ON` ではなく `WHERE` に書かれており、`LEFT JOIN` を `INNER JOIN` に変えることで不要な行が結合に入る | | **GROUP BY のキーが冗長** | `GROUP BY p.product_name , c.category_name` はテーブルスキャン後にしばしば **テキスト列** でグループ化し、索引の恩恵が少ない | | **ORDER BY と LIMIT** | `ORDER BY total_sales DESC NULLS LAST` は集計結果全体をソートする必要がある。Top‑N を返すだけなので `HAVING COUNT(*)>0` でフィルタした後に `ROW_NUMBER()` を使えば部分ソートで済む | > 以上の理由で**全行を走査しながら集計**・**ソー…
応答時間 20.4秒出力 2648 トークン

他のプロンプトでも比較する →

よくある質問

Claude Opus 5とgpt-oss-20b、料金はどちらが安いですか?
出力100万トークンあたりClaude Opus 5は¥4,467.5、gpt-oss-20bは¥25.02で、gpt-oss-20bの方が安くなります(FastMetalの円建て単価・税別)。
Claude Opus 5とgpt-oss-20bのコンテキスト長の違いは?
Claude Opus 5は1,000,000トークン、gpt-oss-20bは131,072トークンです。
Claude Opus 5とgpt-oss-20b、評価が高いのはどちらですか?
公開アリーナの順位ではClaude Opus 5が上です(Claude Opus 5 6位、gpt-oss-20b 179位)。順位はリーダーボードの更新で変わります。
Claude Opus 5とgpt-oss-20bを同じAPIキーで使えますか?
はい。FastMetalのOpenAI互換エンドポイントで、model に "anthropic-claude-opus-5" または "gpt-oss-20b" を指定するだけで切り替えられます。料金はそれぞれの単価で、同じ前払い残高から従量課金されます。

どちらも同じAPIキーで試せます

アカウントを作成してクレジットを追加すれば、Claude Opus 5とgpt-oss-20bをブラウザのチャットとAPIの両方から呼び出せます。月額料金はありません。

Claude Opus 5の他の比較

gpt-oss-20bの他の比較