モデル比較

GLM 5.1 vs Grok 4.5

料金・コンテキスト長・実際の回答で比較(2026年8月時点)

GLM 5.1(Z.ai)とGrok 4.5(xAI)を、FastMetalのゲートウェイで実際に呼び出せる条件で比較します。どちらも同じOpenAI互換エンドポイントとAPIキーから利用でき、切り替えは model の文字列を変えるだけです。

スペックと料金

z-ai logoGLM 5.1x-ai logoGrok 4.5
提供元Z.aixAI
入力(100万トークンあたり)¥250.18¥357.4
出力(100万トークンあたり)¥786.28¥1,072.2
想定コスト(入力1,000・出力500トークン × 1,000回)¥643¥894
コンテキスト長204,800 トークン500,000 トークン
リリース日2026/4/72026/7/8
入力モダリティtexttext, image, file
アリーナ 総合#41 · ELO 1,466#36 · ELO 1,470
アリーナ 日本語#49 · ELO 1,430#39 · ELO 1,441
アリーナ コーディング#36 · ELO 1,514#21 · ELO 1,523

料金はFastMetalの円建て単価(税別)。アリーナ順位は公開リーダーボードの最新取得時点の値です。

どちらを選ぶべきか

  • 料金重視ならGLM 5.1。出力100万トークンあたり¥786.28で、Grok 4.5より27%安くなります。
  • 総合の評価はアリーナ順位でGrok 4.5が上です(36位。GLM 5.1は41位)。
  • 日本語の評価はアリーナ順位でGrok 4.5が上です(39位。GLM 5.1は49位)。
  • コーディングの評価はアリーナ順位でGrok 4.5が上です(21位。GLM 5.1は36位)。
  • 長い文書を扱うならGrok 4.5。コンテキスト長は500,000トークンで、GLM 5.1の204,800トークンより広くとれます。
  • 迷ったら両方を同じキーで試せます。model の文字列を変えるだけで切り替わり、料金はそれぞれの単価で従量課金されます。

同じプロンプトへの実際の回答

FastMetalのゲートウェイが返した回答をそのまま並べています。ベンチマークの数字ではなく、実際の出力です。

このエラーをデバッグして

以下のエラーがPythonアプリケーションで発生しています。原因を特定して修正してください。 Traceback (most recent call last): File "app.py", line 23, in get_user_orders total = sum(order["price"] * order["quantity"] for order in orders) TypeError: unsupport…

GLM 5.1

## 原因 エラーメッセージ `TypeError: unsupported operand type(s) for *: 'str' and 'int'` は、「文字列型と整数型は掛け算(`*`)できない」というエラーです。 該当コードの以下の部分で、`order["price"]` または `order["quantity"]` のいずれか(または両方)が文字列型として渡されていることが原因です。 ```python total = sum(order["price"] * order["quantity"] for order in orders) ``` データベースからデータを取得する際、カラムの型が数値(INTやDECIMALなど)であっても、使用しているDBドライバ(MySQLdbやpsycopg2など)の設定や、DB側のカラムの定義によっては、Python側で文字列として取得されることがよくあります。 ## 修正方法 計算を行う前に、`order["price"]` と `order["quantity"]` を適切な数値型(`float` や `int`)に変換(キャスト)してから計算するように修正します。 ### 修正後のコード ```python def get_user_orders(user_id): orders = db.query("SELECT price, quantity FROM orders WHERE user_id = %s", user_id) # priceは小数の可能性があるためflo…
応答時間 14.6秒出力 1620 トークン

Grok 4.5

## 原因 エラーメッセージ: ```text TypeError: unsupported operand type(s) for *: 'str' and 'int' ``` は、`order["price"] * order["quantity"]` のときに **一方が `str`、もう一方が `int`** になっていることを示しています。 `db.query(...)` の結果では、ドライバやカーソルの設定によって数値カラムが文字列で返ることがよくあります。その状態で `*` するとこの TypeError になります。 ## 修正方法 乗算の前に数値型へ変換します。金額は小数の可能性があるので `float`(または `Decimal`)、数量は `int` が一般的です。 ```python def get_user_orders(user_id): orders = db.query("SELECT price, quantity FROM orders WHERE user_id = %s", user_id) total = sum(float(order["price"]) * int(order["quantity"]) for order in orders) return {"user_id": user_id, "total": total, "orders": orders} ``` 金額の精度を重視するなら `decimal.Decimal` の方が安全です。 ```python from decim…
応答時間 12.9秒出力 691 トークン

コードレビュー

以下のTypeScript関数をレビューして、可読性・パフォーマンス・ベストプラクティスの観点から改善点を提案してください。 async function fetchAllUsers(page: number = 1): Promise<any[]> { let allUsers: any[] = []; let hasMore = true; let currentPage = page; while (hasMo…

GLM 5.1

ご提示いただいた `fetchAllUsers` 関数を、可読性・パフォーマンス・ベストプラクティスの観点からレビューいたします。 全体的なロジックはシンプルで理解しやすいですが、TypeScriptの型安全性やエラーハンドリング、メモリ効率などの面でいくつか改善の余地があります。 --- ### 1. 型安全性(ベストプラクティス) **問題点:** `any[]` や暗黙の `any` 型が使われており、TypeScriptの利点(型による安全性やエディタの補完)が活かされていません。 **改善案:** APIのレスポンスと、関数の返り値に対して明示的な `interface` または `type` を定義します。 ### 2. エラーハンドリング(ベストプラクティス) **問題点:** `fetch` や `response.json()` が失敗した場合の考慮がありません。ネットワークエラーやAPI側のエラー(4xx, 5xx)が発生した際、意図しない挙動や謎のエラーに繋がります。 **改善案:** `response.ok` をチェックし、エラーの場合は適切に例外をスローするか、ハンドリングを行います。 ### 3. 可読性の向上(可読性) **問題点:** * `for (let i = 0; i < data.users.length; i++)` という古典的なル3項演算子のループは、インデックスアクセスが多く可読性が低いです。 * `let user` と宣言していますが、再代入されていないため `const` を使うべきです。 * `first_n…
応答時間 104.3秒出力 3444 トークン

Grok 4.5

## レビュー概要 可読性・型安全性・エラーハンドリング・パフォーマンスの面で改善余地があります。特に `any` の多用、HTTPエラー未処理、命令的なループが目立ちます。 --- ## 指摘点と改善案 ### 1. 型が弱い(`any`) `Promise<any[]>` と `data` の型がないため、補完もコンパイル時チェックも効きません。 ```typescript interface UserResponse { id: string; first_name: string; last_name: string; email: string; status: string; } interface UsersApiResponse { users: UserResponse[]; } interface User { id: string; name: string; email: string; } ``` ### 2. エラーハンドリングがない `response.ok` を見ておらず、ネットワークエラーや 4xx/5xx でも `response.json()` してしまいます。 ```typescript if (!response.ok) { throw new Error(`Failed to fetch users: ${response.status} ${response.statusText}`); } ``` ### 3. マジックナンバー `limit=100` が重複してい…
応答時間 28.3秒出力 1720 トークン

SQLクエリの最適化

以下のSQLクエリは500万行のテーブルに対して実行すると30秒以上かかります。最適化してください。 SELECT p.product_name, c.category_name, COUNT(o.order_id) as order_count, SUM(o.amount) as total_sales, AVG(r.rating) as avg_rating FROM products p LEFT JOIN…

GLM 5.1

500万行のテーブルに対するクエリが30秒以上かかる原因は、単にインデックスが不足しているだけでなく、**SQLの書き方自体に深刻な論理的バグ(ファンアウトによる集計値の歪み)とパフォーマンス問題**が含まれています。 最適化されたクエリと、改善点の詳細な解説を以下に示します。 ### 最適化されたクエリ ```sql WITH order_summary AS ( -- 1. 注文関連は先に商品単位で集計しておく SELECT od.product_id, COUNT(o.order_id) AS order_count, SUM(o.amount) AS total_sales FROM orders o JOIN order_details od ON od.order_id = o.order_id WHERE o.status = '完了' AND o.created_at >= '2024-04-01' GROUP BY od.product_id ), review_summary AS ( -- 2. レビューも先に商品単位で集計しておく SELECT r.product_id, AVG(r.rating) AS avg_rating FROM reviews r GROUP BY r.product_id ) SELECT p.product_name, c.category_name, COALESCE(os.order_count, 0) AS ord…
応答時間 94.1秒出力 4545 トークン

Grok 4.5

## 問題点 1. **行の爆発(結果が間違っている)** `order_details` と `reviews` を同じ `products` に直接 JOIN しているため、注文×レビューの直積になります。 例: 注文10件 × レビュー5件 = 50行 → `COUNT` / `SUM` が過大、`AVG(rating)` も歪みます。 2. **`LEFT JOIN` + 右側への `WHERE`** `o.created_at >= ...` が `WHERE` にあるため、実質 `INNER JOIN` です。意図が「完了注文がある商品だけ」なら明示的に `INNER JOIN` にした方がよいです。 3. **インデックス不足** `products(id)` と `orders(order_id)` だけでは、絞り込み・JOIN・ソートに足りません。 4. **`GROUP BY` が名前単位** 同名商品がまとまる可能性があります。集計キーは `p.id` が安全です。 --- ## 最適化後のクエリ 注文系とレビュー系を**先に商品単位で集計してから**結合します。 ```sql SELECT p.product_name, c.category_name, COALESCE(os.order_count, 0) AS order_count, COALESCE(os.total_sales, 0) AS total_sales, rs.avg_rating FROM pr…
応答時間 35.8秒出力 1867 トークン

他のプロンプトでも比較する →

よくある質問

GLM 5.1とGrok 4.5、料金はどちらが安いですか?
出力100万トークンあたりGLM 5.1は¥786.28、Grok 4.5は¥1,072.2で、GLM 5.1の方が安くなります(FastMetalの円建て単価・税別)。
GLM 5.1とGrok 4.5のコンテキスト長の違いは?
GLM 5.1は204,800トークン、Grok 4.5は500,000トークンです。
GLM 5.1とGrok 4.5、評価が高いのはどちらですか?
公開アリーナの順位ではGrok 4.5が上です(GLM 5.1 49位、Grok 4.5 39位)。順位はリーダーボードの更新で変わります。
GLM 5.1とGrok 4.5を同じAPIキーで使えますか?
はい。FastMetalのOpenAI互換エンドポイントで、model に "glm-5.1" または "grok-4.5" を指定するだけで切り替えられます。料金はそれぞれの単価で、同じ前払い残高から従量課金されます。

どちらも同じAPIキーで試せます

アカウントを作成してクレジットをチャージすれば、GLM 5.1とGrok 4.5をブラウザのチャットとAPIの両方から呼び出せます。月額料金はありません。

GLM 5.1の他の比較

Grok 4.5の他の比較