モデル比較

Claude Opus 4.8 vs gpt-oss-120b

料金・コンテキスト長・実際の回答で比較(2026年8月時点)

Claude Opus 4.8(Anthropic)とgpt-oss-120b(OpenAI)を、FastMetalのゲートウェイで実際に呼び出せる条件で比較します。どちらも同じOpenAI互換エンドポイントとAPIキーから利用でき、切り替えは model の文字列を変えるだけです。

スペックと料金

anthropic logoClaude Opus 4.8openai logogpt-oss-120b
提供元AnthropicOpenAI
入力(100万トークンあたり)¥893.5¥16
出力(100万トークンあたり)¥4,467.5¥79
想定コスト(入力1,000・出力500トークン × 1,000回)¥3,127¥56
コンテキスト長1,000,000 トークン131,072 トークン
リリース日2026/5/272025/8/5
入力モダリティtext, image, filetext
アリーナ 総合#22 · ELO 1,474#186 · ELO 1,352
アリーナ 日本語#26 · ELO 1,448#123 · ELO 1,320
アリーナ コーディング#12 · ELO 1,528#190 · ELO 1,390

料金はFastMetalの円建て単価(税別)。アリーナ順位は公開リーダーボードの最新取得時点の値です。

どちらを選ぶべきか

  • 料金重視ならgpt-oss-120b。出力100万トークンあたり¥79で、Claude Opus 4.8より98%安くなります。
  • 総合の評価はアリーナ順位でClaude Opus 4.8が上です(22位。gpt-oss-120bは186位)。
  • 日本語の評価はアリーナ順位でClaude Opus 4.8が上です(26位。gpt-oss-120bは123位)。
  • コーディングの評価はアリーナ順位でClaude Opus 4.8が上です(12位。gpt-oss-120bは190位)。
  • 長い文書を扱うならClaude Opus 4.8。コンテキスト長は1,000,000トークンで、gpt-oss-120bの131,072トークンより広くとれます。
  • 迷ったら両方を同じキーで試せます。model の文字列を変えるだけで切り替わり、料金はそれぞれの単価で従量課金されます。

同じプロンプトへの実際の回答

FastMetalのゲートウェイが返した回答をそのまま並べています。ベンチマークの数字ではなく、実際の出力です。

このエラーをデバッグして

以下のエラーがPythonアプリケーションで発生しています。原因を特定して修正してください。 Traceback (most recent call last): File "app.py", line 23, in get_user_orders total = sum(order["price"] * order["quantity"] for order in orders) TypeError: unsupport…

Claude Opus 4.8

# エラーの原因 エラーメッセージ `unsupported operand type(s) for *: 'str' and 'int'` は、**`order["price"]` が文字列(str)型**になっていることを示しています。 つまり、`price * quantity` の計算で「文字列 × 整数」という不正な演算が発生しています。 ## なぜ price が文字列なのか? 主な原因として以下が考えられます。 1. **DBのカラム型が文字列** (`VARCHAR`, `TEXT` など。特に `DECIMAL` を文字列で返すドライバもある) 2. **DBドライバが数値を文字列として返している**(例: MySQLの `DECIMAL` 型は Python では `Decimal` や `str` になることがある) 3. **データ自体に文字列が混入している** --- # 修正方法 ## 方法1: 計算時に明示的に数値変換する(推奨・即効性あり) ```python def get_user_orders(user_id): orders = db.query("SELECT price, quantity FROM orders WHERE user_id = %s", user_id) total = sum(float(order["price"]) * int(order["quantity"]) for order in orders) return {"user_id": user_id, "tot…
応答時間 16.0秒出力 1123 トークン

gpt-oss-120b

**原因** `order["price"]` が **文字列** (`str`) で返ってきているため、数値 (`int`/`float`/`Decimal`) と掛け算しようとしたときに ``` TypeError: unsupported operand type(s) for *: 'str' and 'int' ``` が発生しています。 このケースは主に次のいずれかが原因です。 | 可能性 | 内容 | |--------|------| | ① DBドライバが数値列を文字列として取得している | たとえば `psycopg2` の `cursor_factory=RealDictCursor` でも `numeric` が文字列になることがあります。 | | ② テーブル定義が文字列型 (`VARCHAR`, `CHAR`) になっている | `price` カラムが文字列型で保存されている。 | | ③ `SELECT` 文でキャストせずにそのまま取得している | DB側で数値に変換していない。 | **修正方法**は 2 つの方向があります。 --- ## 1️⃣ Python 側で安全に数値へ変換する(最も手軽) ```python from decimal import Decimal, InvalidOperation def get_user_orders(user_id): # db.query の戻り値は dict のリスト(例: [{"price": "12.34", "quantity": "2"}, ..…
応答時間 7.1秒出力 1587 トークン

コードレビュー

以下のTypeScript関数をレビューして、可読性・パフォーマンス・ベストプラクティスの観点から改善点を提案してください。 async function fetchAllUsers(page: number = 1): Promise<any[]> { let allUsers: any[] = []; let hasMore = true; let currentPage = page; while (hasMo…

Claude Opus 4.8

# コードレビュー このコードには改善できるポイントがいくつかあります。観点別に提案します。 ## 1. 型安全性 (`any` の排除) 最も重要な問題です。`any[]` を使うと TypeScript の恩恵が失われます。 ```typescript interface ApiUser { id: string; first_name: string; last_name: string; email: string; status: string; } interface ApiResponse { users: ApiUser[]; } interface User { id: string; name: string; email: string; } ``` ## 2. エラーハンドリングの欠如 `fetch` は 4xx/5xx でも reject しません。`response.ok` のチェックが必須です。 ```typescript if (!response.ok) { throw new Error(`Failed to fetch users: ${response.status} ${response.statusText}`); } ``` ## 3. 可読性 (ループ・マジックナンバー) - `for` ループ → `filter` + `map` で宣言的に - `100` などのマジックナンバーを定数化 - 文字列連結 → テンプレートリテラル ## 4. パフォーマンス -…
応答時間 23.5秒出力 1836 トークン

gpt-oss-120b

## 📋 1. 現行コードの概要と主な課題 | 項目 | 現状 | 問題点・改善余地 | |------|------|-------------------| | **型安全** | `any[]`、`any` で型を放棄 | TypeScript のメリットが失われ、実装ミスがコンパイル時に検出できない | | **可読性** | 変数名が曖昧(`data`、`i`)・文字列結合で名前を組み立てている | 何をしているかが一読で分かりにくい | | **エラーハンドリング** | `fetch` の失敗や `response.ok === false` をチェックしていない | ネットワークエラーで例外がそのままスローされ、呼び出し側が把握しにくい | | **パフォーマンス** | ページ取得を **逐次** に行っている<br>(`while` ループ中で `await`) | ページ数が多いと総待ち時間が `N × latency` になる | | **ミューテーション** | `let` で再代入が多い | 不変性を保つ方がデバッグしやすい | | **ハードコーディング** | `limit=100` がコード中に埋め込まれている | API の変更に脆弱 | | **文字列結合** | `first_name + " " + last_name` | 可読性が低く、`undefined` が入った時に `"undefined"` が出力されるリスク | | **非同期キャンセル** | `AbortController` が未使用 | 長時間待機したままキャ…
応答時間 15.6秒出力 3532 トークン

SQLクエリの最適化

以下のSQLクエリは500万行のテーブルに対して実行すると30秒以上かかります。最適化してください。 SELECT p.product_name, c.category_name, COUNT(o.order_id) as order_count, SUM(o.amount) as total_sales, AVG(r.rating) as avg_rating FROM products p LEFT JOIN…

Claude Opus 4.8

# SQLクエリの最適化 ## 主要な問題点 ### 1. LEFT JOINとWHERE句の矛盾(最重要のバグ) ```sql LEFT JOIN orders o ON ... WHERE o.created_at >= '2024-04-01' -- ここが問題 ``` `orders`を`LEFT JOIN`しているのに、`WHERE`句で`o.created_at`を条件にすると、**LEFT JOINが実質INNER JOINに変わってしまいます**(NULL行が除外されるため)。意図が不明確ですが、下記2パターンで対応します。 ### 2. 集計の重複(Fan-out問題) `reviews`と`order_details`を同時にJOINすると、**行が掛け算的に増殖**します。 - 商品Aに注文3件、レビュー4件 → 12行に膨張 - `COUNT`, `SUM`, `AVG`がすべて不正確な値になります これがパフォーマンスと正確性の両方の元凶です。 ### 3. インデックス不足 JOIN・WHERE・GROUP BYで使う列にインデストがありません。 --- ## 最適化後のクエリ 集計を**サブクエリで事前に完結**させ、Fan-outを防ぎます。 ```sql SELECT p.product_name, c.category_name, COALESCE(sales.order_count, 0) AS order_count, sales.total_sales, rv.avg_rating F…
応答時間 25.9秒出力 1723 トークン

gpt-oss-120b

## 1. 現状のボトルネック | 項目 | 理由 | |------|------| | **① LEFT JOIN → INNER JOIN に変えられるケース** | `orders` の `status = '完了'` と `created_at >= …` が必ず満たす行だけを集計したいので、`LEFT JOIN` で結合した後に `WHERE o.created_at …` を書くと、`orders` が **NULL** の行も残ってしまい、不要なレコードが大量に産まれます。| | **② フィルタが JOIN 後に適用されている** | `WHERE o.created_at >= …` が **LEFT JOIN** の後に評価されるため、まず **全行** が `orders` と結合され、その後で絞り込む → 5 M 行 × (order_details の行数) の中間結果が膨大。| | **③ インデックスが足りない** | 現在は `products(id)` と `orders(order_id)` だけ。<br>検索条件・結合キーに使っているカラムは全部 **インデックス対象外** なので、フルテーブルスキャンやハッシュジョインが走ります。| | **④ GROUP BY に文字列を直接使っている** | `p.product_name` と `c.category_name` で GROUP BY すると、文字列比較が必要になる上、同名の商品が別 ID で存在したときに正しく集計できません。`p.id` で集計した方がインデックスを活かしやす…
応答時間 13.3秒出力 2901 トークン

他のプロンプトでも比較する →

よくある質問

Claude Opus 4.8とgpt-oss-120b、料金はどちらが安いですか?
出力100万トークンあたりClaude Opus 4.8は¥4,467.5、gpt-oss-120bは¥79で、gpt-oss-120bの方が安くなります(FastMetalの円建て単価・税別)。
Claude Opus 4.8とgpt-oss-120bのコンテキスト長の違いは?
Claude Opus 4.8は1,000,000トークン、gpt-oss-120bは131,072トークンです。
Claude Opus 4.8とgpt-oss-120b、評価が高いのはどちらですか?
公開アリーナの順位ではClaude Opus 4.8が上です(Claude Opus 4.8 26位、gpt-oss-120b 123位)。順位はリーダーボードの更新で変わります。
Claude Opus 4.8とgpt-oss-120bを同じAPIキーで使えますか?
はい。FastMetalのOpenAI互換エンドポイントで、model に "anthropic-claude-opus-4-8" または "gpt-oss-120b" を指定するだけで切り替えられます。料金はそれぞれの単価で、同じ前払い残高から従量課金されます。

どちらも同じAPIキーで試せます

アカウントを作成してクレジットをチャージすれば、Claude Opus 4.8とgpt-oss-120bをブラウザのチャットとAPIの両方から呼び出せます。月額料金はありません。

Claude Opus 4.8の他の比較

gpt-oss-120bの他の比較