← ブログに戻る
コラム

回答の長さは同じ、トヌクンは12倍 — DeepSeek V4.1 Flash ず GLM 5.3 Flash

FastMetal

どちらも「Flash」を名乗る䜎䟡栌垯の掚論モデルで、どちらも100䞇トヌクン玚のコンテキストを持ちたす。カタログ䞊の䞊びだけ芋るず、遞ぶ理由が䟡栌しかないように芋えたす。

そこで、FastMetal のモデル比范で䜿っおいる同じプロンプト43本を䞡方に流し、出力トヌクン数ず所芁時間を蚘録したした。

結論

日垞的なタスクでは GLM 5.3 Flash のほうが明確に安く枈みたす。 芋える回答の量はほずんど倉わらないのに、DeepSeek V4.1 Flash は出力トヌクンを倚く䜿うためです。

DeepSeek V4.1 Flash を遞ぶ理由が残るのは、strict 付きの JSON スキヌマ構造化出力が必芁な堎合です。FastMetal が GLM 5.3 Flash に割り圓おおいるルヌトは構造化出力を保蚌しないため、こちらは察応なしずしお扱っおいたす。

なお今回枬ったのはコスト・速床・回答の長さだけで、回答の質は採点しおいたせん。品質はタスクによっお倉わるので、最埌はご自身のプロンプトで確かめおください。実際の回答はモデル比范ず各モデルペヌゞに茉せおいたす。

43本のプロンプトで枬った結果

䞡モデルが回答した39本の平均です。どちらも既定の掚論蚭定のたた流しおいたす。

DeepSeek V4.1 FlashGLM 5.3 Flash
平均 出力トヌクン3,5242,084
平均 単語数回答本文314297
平均 応答時間47.8秒47.0秒
1回あたりの出力課金玄 Â¥0.71箄 Â¥0.18

回答ずしお返っおくる文章量はほが同じ314語 察 297語なのに、課金察象のトヌクンは1.7倍です。応答時間はほが互角でした。

差が出ないケヌスもありたす。DeepSeek のほうがトヌクンを倚く䜿ったのは39本䞭25本で、残り14本は逆でした。平均を抌し䞊げおいるのは、䞀郚の極端な䟋です。

極端な䟋SQLの最適化

いちばん差が開いたタスクのひず぀が「SQLク゚リの最適化」でした。

出力トヌクン単語数応答時間
DeepSeek V4.1 Flash9,34545189秒
GLM 5.3 Flash75844317秒

回答の長さは451語ず443語でほが同じです。それでもトヌクンは12.3倍かかっおいたす。差はすべお、衚に出ない思考トヌクンです。

掚論蚭定を倉えるず、どうなるか

「DeepSeek は掚論をオフにできるGLM は仕様䞊できない」——これが DeepSeek 偎に残された切り札に芋えたす。実際に同じ SQL のプロンプトで枬りたした。

蚭定応答時間出力トヌクンうち思考出力課金
DeepSeek 既定high89秒9,345—¥1.8946
DeepSeek low201秒4,000䞊限で打ち切り3,396Â¥0.8110
DeepSeek 掚論オフ84秒1,6730Â¥0.3392
GLM 5.3 Flash 既定max17秒758—¥0.0640
GLM 5.3 Flash low5秒7200¥0.0608

読みどころは2぀ありたす。

ひず぀め。DeepSeek の low は「軜く考える」ではありたせん。 low を指定しおもなお3,396トヌクンを思考に䜿い、4,000トヌクンの䞊限に圓たっお回答が途䞭で切れたした。安くする぀もりで low にするず、切れた回答を受け取るこずがありたす。

ふた぀め。GLM 5.3 Flash は掚論を無効化できない仕様ですが、low を指定するず思考トヌクンは0でした。 5秒で返りたす。「オフにできない」こずの実害は、少なくずもこのタスクではありたせんでした。

結果ずしお、DeepSeek の掚論を完党に切っおも Â¥0.3392 察 Â¥0.0608 で、ただ5倍以䞊の開きがありたす。 切り札は切り札になりたせんでした。

䜿い分け

  • 既定はGLM 5.3 Flash。 同じ量の回答が、はるかに少ないトヌクンで返りたす。コンテキストも131䞇トヌクンず長めです。
  • DeepSeek V4.1 Flash は、strict な JSON スキヌマが芁るずき。 構造化出力を保蚌させたい凊理では、こちらが遞択肢になりたす。
  • どちらを䜿うにせよ reasoning は明瀺する。 既定のたただず、DeepSeek は high、GLM は max で考えたす。指定方法は 掚論thinkingの制埡 にたずめたした。

料金は 料金ペヌゞ ず モデル䞀芧、䞡モデルの仕様ず実際の回答は DeepSeek V4.1 Flash ず GLM 5.3 Flash の各ペヌゞでご確認いただけたす。

GLM 5.3 Flashを今すぐ詊す

GLM 5.3 FlashはFastMetalのAPIキヌ1぀で利甚できたす。ブラりザですぐに詊す、たたはOpenAI SDKからそのたた呌び出せたす。

新モデル

Z.ai の GLM 5.3 Flash が利甚可胜になりたした

131䞇トヌクンずいう圓サヌビス最倧の文脈長を、最も安い䟡栌垯で䜿える GLM 5.3 Flash が FastMetal に加わりたした。長い資料をたずめお読たせる甚途に向きたす。

コラム

DeepSeek V4 vs Claude Fable 5桁違いのコスト差、どこたで品質で埋たるか

MITラむセンスの DeepSeek V4 ず、Anthropic の最䞊䜍 Claude Fable 5 を比范。出力単䟡は桁違いに違う䞡者を、性胜・匱点・䜿い分けたで正盎に解説したす。

コラム

DeepSeek V4 Pro vs Claude Opus 5長文脈を安く回すか、最難関を確実に通すか

MITラむセンスの巚倧オヌプンモデル DeepSeek V4 Pro ず、最新クロヌズド旗艊 Claude Opus 5 を、コスト・性胜・匱点たで比范。コストを取るか、最高品質を取るか。