モデル比較

gpt-oss-20b vs Grok 4.6

料金・コンテキスト長・実際の回答で比較(2026年9月時点)

gpt-oss-20b(OpenAI)とGrok 4.6(xAI)を、FastMetalのゲートウェイで実際に呼び出せる条件で比較します。どちらも同じOpenAI互換エンドポイントとAPIキーから利用でき、切り替えは model の文字列を変えるだけです。

スペックと料金

openai logogpt-oss-20bx-ai logoGrok 4.6
提供元OpenAIxAI
入力(100万トークンあたり)¥5.36¥357.4
出力(100万トークンあたり)¥25.02¥1,072.2
想定コスト(入力1,000・出力500トークン × 1,000回)¥18¥894
コンテキスト長131,072 トークン500,000 トークン
リリース日2025/8/52026/8/12
入力モダリティtexttext, image, file
生成速度 (p50)
アリーナ 総合#252 · ELO 1,317#63 · ELO 1,456
アリーナ 日本語#179 · ELO 1,256#68 · ELO 1,412
アリーナ コーディング#232 · ELO 1,369#54 · ELO 1,506

料金はFastMetalの円建て単価(税別)。アリーナ順位は公開リーダーボードの最新取得時点の値です。

どちらを選ぶべきか

  • 料金重視ならgpt-oss-20b。出力100万トークンあたり¥25.02で、Grok 4.6より98%安くなります。
  • 総合の評価はアリーナ順位でGrok 4.6が上です(63位。gpt-oss-20bは252位)。
  • 日本語の評価はアリーナ順位でGrok 4.6が上です(68位。gpt-oss-20bは179位)。
  • コーディングの評価はアリーナ順位でGrok 4.6が上です(54位。gpt-oss-20bは232位)。
  • 長い文書を扱うならGrok 4.6。コンテキスト長は500,000トークンで、gpt-oss-20bの131,072トークンより広くとれます。
  • 迷ったら両方を同じキーで試せます。model の文字列を変えるだけで切り替わり、料金はそれぞれの単価で従量課金されます。

同じプロンプトへの実際の回答

FastMetalのゲートウェイが返した回答をそのまま並べています。ベンチマークの数字ではなく、実際の出力です。

このエラーをデバッグして

以下のエラーがPythonアプリケーションで発生しています。原因を特定して修正してください。 Traceback (most recent call last): File "app.py", line 23, in get_user_orders total = sum(order["price"] * order["quantity"] for order in orders) TypeError: unsupport…

gpt-oss-20b

## 1. エラーの原因 ```python TypeError: unsupported operand type(s) for *: 'str' and 'int' ``` - `order["price"]` が **文字列 (`str`)** である - `order["quantity"]` が **整数 (`int`)** である - `str * int` は演算できないため例外が発生 ### 何で `price` が文字列になるのか? | DB | 典型的な戻り値の型 | 文字列になるケース | |-----|------------------|---------------------| | PostgreSQL(psycopg2) | `Decimal` | なし(数値型は `Decimal`) | | MySQL(mysql‑connector / pymysql) | `Decimal` または `str` | `use_unicode=True` や `cursorclass=` が設定されていると文字列になる | | SQLite(sqlite3) | `int`/`float` | なし | したがって、今回使われている `db.query()` では価格列が **文字列として返されている** ことが原因です。 --- ## 2. 修正方法 ### ① 数値型へキャストして足し算 ```python def get_user_orders(user_id): # ① クエリ実行 orders = db.quer…
応答時間 10.0秒出力 1365 トークン

Grok 4.6

**原因:** DBから返ってきた `order["price"]` が文字列 (`str`) で、`order["quantity"]` が整数 (`int`) のため、`*` 演算ができません。価格カラムの型が VARCHAR/TEXT だったり、ドライバが数値を文字列で返す場合によく起きます。 **修正例:** ```python from decimal import Decimal def get_user_orders(user_id): orders = db.query("SELECT price, quantity FROM orders WHERE user_id = %s", user_id) total = sum(Decimal(str(order["price"])) * int(order["quantity"]) for order in orders) return {"user_id": user_id, "total": total, "orders": orders} ``` - 金額は浮動小数点誤差を避けるため `Decimal` を使うのが安全です。 - `quantity` は明示的に `int()` しています。 - カラム型を本来の NUMERIC/DECIMAL と INTEGER に直すのも根本対応になります。 空の結果や不正な値がある場合は、必要に応じてバリデーションやデフォルト値も追加してください。
応答時間 13.5秒出力 791 トークン

コードレビュー

以下のTypeScript関数をレビューして、可読性・パフォーマンス・ベストプラクティスの観点から改善点を提案してください。 async function fetchAllUsers(page: number = 1): Promise<any[]> { let allUsers: any[] = []; let hasMore = true; let currentPage = page; while (hasMo…

gpt-oss-20b

## ① ざっくりした実装概要 ```ts async function fetchAllUsers(page: number = 1): Promise<any[]> { /* … */ } ``` - 1ページにつき最大100件取得し、`status !== "deleted"` のレコードだけを `id / name / email` らしき構造体に整形。 - **ページングを手動**で止めるために while‑loop で繰り返し呼び出す → 連続で **1 つずつ直列**に `fetch` している。 - `any` をそのまま返している。 - エラー処理・型定義・可読性・パフォーマンスに関しては改善余地が多々ある。 --- ## ② 可読性(コードの見やすさ・保守性)を向上させる | 現状 | 改善案 | 具体例 | |------|--------|--------| | ① `any` を使っている | 型を定義し、返却型を `User[]` に | ```ts interface User { id: number; name: string; email: string; } ``` | | ② ループの内部でインデックスを使う | `for...of` + デストラクチャリング | ```ts for (const u of data.users) { … } ``` | | ③ `if (data.users.length < 100)` で終了判定 | `data.users.splice` で終端を判断 | –(設計…
応答時間 62.4秒出力 3181 トークン

Grok 4.6

## レビュー概要 ページネーションで全ユーザーを集めて整形する関数です。動く実装ですが、型・エラー処理・API 契約の扱い・ループの書き方に改善余地があります。無限ループや実行時例外のリスクもあります。 --- ## 重大度の高い問題 ### 1. `response.ok` 未チェック・例外未処理 `fetch` は HTTP 4xx/5xx でも throw しません。失敗時も `json()` して `data.users` にアクセスするため、例外や無限ループの原因になります。ネットワークエラーも呼び出し元に素通しです。 ```typescript if (!response.ok) { throw new Error(`Failed to fetch users: ${response.status} ${response.statusText}`); } ``` ページ単位で try/catch し、失敗したページ番号をメッセージに含めるとデバッグしやすいです。 ### 2. レスポンス形状の前提が脆い `data.users` が無い・`null`・配列でない場合に落ちます。API の契約を型で表し、最低限ガードしてください。 ```typescript const users = Array.isArray(data?.users) ? data.users : []; ``` 可能なら API 側の `has_more` / `total_pages` を使い、`length < 100` という推測に依存しない方が安全です。常に…
応答時間 50.0秒出力 2543 トークン

SQLクエリの最適化

以下のSQLクエリは500万行のテーブルに対して実行すると30秒以上かかります。最適化してください。 SELECT p.product_name, c.category_name, COUNT(o.order_id) as order_count, SUM(o.amount) as total_sales, AVG(r.rating) as avg_rating FROM products p LEFT JOIN…

gpt-oss-20b

## ① なぜ 30 秒かかるのか | 主要なボトルネック | 具体的な症状 | |------------------|--------------| | **テーブルスキャン** | `orders` と `order_details` は 500 万行を超える可能性がある。`WHERE o.status = '完了' AND o.created_at >= …` の条件が **`orders` の単一列にしかインデックスが無いので** まず全行を読み込み、次に結合のために行を再スキャン | | **結合条件が多い** | `LEFT JOIN` では結合条件を満たせない行もすべて取得しなければならない。`orders` のフィルタは `ON` ではなく `WHERE` に書かれており、`LEFT JOIN` を `INNER JOIN` に変えることで不要な行が結合に入る | | **GROUP BY のキーが冗長** | `GROUP BY p.product_name , c.category_name` はテーブルスキャン後にしばしば **テキスト列** でグループ化し、索引の恩恵が少ない | | **ORDER BY と LIMIT** | `ORDER BY total_sales DESC NULLS LAST` は集計結果全体をソートする必要がある。Top‑N を返すだけなので `HAVING COUNT(*)>0` でフィルタした後に `ROW_NUMBER()` を使えば部分ソートで済む | > 以上の理由で**全行を走査しながら集計**・**ソー…
応答時間 20.4秒出力 2648 トークン

Grok 4.6

元クエリは **行の爆発(ファンアウト)** と **結合条件の誤り** で、件数・売上・平均評価が壊れやすく、5百万行規模では全表スキャン+巨大中間結果になりやすいです。`NULLS LAST` から PostgreSQL 前提で直します。 ## 主な問題 1. **レビュー×注文明細の直積** `order_details` と `reviews` をどちらも `product_id` でつなぐと、注文100件×レビュー50件で 5,000 行になります。その後 `COUNT`/`SUM`/`AVG` すると売上がレビュー数倍、平均評価が注文数で重み付けされます。集計は **別々に先に集約** してください。 2. **`LEFT JOIN` が実質 `INNER JOIN`** `WHERE o.created_at >= ...` は右側が NULL の行を落とします。期間外・未完了を残したいなら条件は `ON` へ。トップ売上50件なら最初から完了注文だけ `INNER JOIN` する方が速いです。 3. **`GROUP BY product_name, category_name`** 同名商品が混ざり、プランナも PK 結合を使いづらいです。集約キーは **`p.id`(と必要なら category)** にしてください。 4. **`amount` の位置** `o.amount` が注文合計なら、1注文に複数明細があるとき商品別に二重計上されます。商品売上なら通常は `od.amount`(または単価×数量…
応答時間 55.1秒出力 3207 トークン

他のプロンプトでも比較する →

よくある質問

gpt-oss-20bとGrok 4.6、料金はどちらが安いですか?
出力100万トークンあたりgpt-oss-20bは¥25.02、Grok 4.6は¥1,072.2で、gpt-oss-20bの方が安くなります(FastMetalの円建て単価・税別)。
gpt-oss-20bとGrok 4.6のコンテキスト長の違いは?
gpt-oss-20bは131,072トークン、Grok 4.6は500,000トークンです。
gpt-oss-20bとGrok 4.6、評価が高いのはどちらですか?
公開アリーナの順位ではGrok 4.6が上です(gpt-oss-20b 179位、Grok 4.6 68位)。順位はリーダーボードの更新で変わります。
gpt-oss-20bとGrok 4.6を同じAPIキーで使えますか?
はい。FastMetalのOpenAI互換エンドポイントで、model に "gpt-oss-20b" または "grok-4.6" を指定するだけで切り替えられます。料金はそれぞれの単価で、同じ前払い残高から従量課金されます。

どちらも同じAPIキーで試せます

アカウントを作成してクレジットを追加すれば、gpt-oss-20bとGrok 4.6をブラウザのチャットとAPIの両方から呼び出せます。月額料金はありません。

gpt-oss-20bの他の比較

Grok 4.6の他の比較