ブログ
Claude Opus 5 レビュー:エージェント的コーディングに全振りしたフラッグシップ
Anthropic の最新フラッグシップ Claude Opus 5 を、位置づけ・強み・コスト・弱点まで正直にレビュー。難しい長時間タスクで品質を最優先したい場面の第一候補です。
GLM-5.2 レビュー:文脈100万トークンに伸びたオープンウェイトの最上位
Z.ai の GLM-5.2 を、GLM-5 からの変化・ベンチマーク・コスト・弱点まで正直にレビュー。長時間のコーディングタスクでクローズド勢に肉薄する、MIT ライセンスのオープンモデルです。
MiniMax M3 レビュー:エージェント性能とマルチモーダルを一つにしたオープンモデル
MiniMax M3 を、アーキテクチャ・ベンチマーク・コスト・弱点まで正直にレビュー。画像と動画をネイティブに扱いながら、コーディング系でもクローズド勢に並ぶ珍しいオープンモデルです。
Qwen3.7-Max レビュー:35時間走り続けるエージェント特化のフラッグシップ
Alibaba の Qwen3.7-Max を、ベンチマーク・エージェント性能・コスト・弱点まで正直にレビュー。長時間の自律実行に振り切った、クローズドのフラッグシップモデルです。
DeepSeek V4 レビュー:1.6兆パラメータの MoE を Pro と Flash で使い分ける
DeepSeek V4 Pro と V4 Flash を、アーキテクチャ・ベンチマーク・コスト・弱点まで正直にレビュー。長文脈の推論コストを大きく下げた、MIT ライセンスのオープンモデルです。
Seedream 4.5 vs Z-Image Turbo:画像生成の品質と速度を徹底比較
ByteDance の Seedream 4.5 と Alibaba の Z-Image Turbo を比較。品質・速度・テキスト描画・用途別の選び方まで、FastMetal で使える2つの画像生成モデルを解説します。
llm-jp-3.1 レビュー:NII製国産MoEモデルの日本語実力
国立情報学研究所(NII)が開発したMoE国産オープンLLM。日本語MT-Benchでgpt-4-0613超えを達成した実力と、向き・不向きをFastMetalの視点で徹底解説。
MiniMax M2.7 完全レビュー:自己進化するオープンモデルで変わるエージェント開発
2026年3月リリースの MiniMax M2.7 は、MoE アーキテクチャを採用した自己進化型オープンウェイトモデルです。SWE-bench Verified 78% を達成し、エージェント・コーディング系でコストを大幅に抑えつつフロンティアモデルに迫る性能を発揮します。
GLM-5 レビュー:MITライセンスのオープン大規模MoEは「コーディング特化」で選ぶ
Zhipu AI(Z.ai)のオープンモデル GLM-5 を、アーキテクチャ・ベンチマーク・コスト・弱点まで正直にレビュー。コーディングとエージェント用途で光る一方、得意・不得意がはっきり分かれます。
Claude Opus 4.6 レビュー:フラッグシップの使いどころと、Sonnet との境目
Anthropic フラッグシップ Claude Opus 4.6 を、ベンチマーク・コスト・日本語・Sonnet 4.6 との使い分けの観点から正直にレビューします。
12件中 1-10件を表示