ブログ

レビュー

MiniMax M3 レビュー:エージェント性能とマルチモーダルを一つにしたオープンモデル

MiniMax M3 を、アーキテクチャ・ベンチマーク・コスト・弱点まで正直にレビュー。画像と動画をネイティブに扱いながら、コーディング系でもクローズド勢に並ぶ珍しいオープンモデルです。

チュートリアル

Pythonでストリーミング応答を実装する(OpenAI SDK)

FastMetal で LLM のストリーミング応答を Python で実装する手順を、OpenAI SDK の stream=True、中断時のエラー処理、Web チャット UI への SSE 連携まで具体例つきで解説します。

新モデル

Claude Opus 4.8 が利用可能になりました

Anthropic の Claude Opus 4.8 が FastMetal で利用可能になりました。一般提供されている Opus 系で最も高性能なモデルで、100万トークンの文脈に対応します。

コラム

日本語はトークンを食う:API料金を日本語で最適化する

日本語は英語よりトークンを多く消費しがちです。その理由(言語税)と、モデル選びからプロンプト設計まで、日本語でLLM API料金を抑える実践的な工夫を解説します。

コラム

Qwen3.7-Max vs Claude Opus 4.7:長時間エージェント対決

Alibaba のフラッグシップ Qwen3.7-Max と Anthropic の Claude Opus 4.7 を比較。長時間の自律実行に振り切った両者を、ベンチマーク・弱点まで踏まえて解説します。

レビュー

Qwen3.7-Max レビュー:35時間走り続けるエージェント特化のフラッグシップ

Alibaba の Qwen3.7-Max を、ベンチマーク・エージェント性能・コスト・弱点まで正直にレビュー。長時間の自律実行に振り切った、クローズドのフラッグシップモデルです。

コラム

無料 LLM API まとめ|2026年の無料枠・制限・注意点を整理

無料 LLM API の選択肢を2026年版で整理。クラウド無料枠・ローカル実行・無料モデルの違い、レート制限やデータ学習の注意点、有料への移行手順まで解説します。

コラム

Gemini 3.5 Flash vs Claude Haiku 4.5:高速・低コスト枠の二強を比較

大量のリクエストを速く安く捌く定番モデル、Google の Gemini 3.5 Flash と Anthropic の Claude Haiku 4.5 を、速度・コスト・コーディングの実力まで比較します。

新モデル

Gemini 3.5 Flash が利用可能になりました

Google の Gemini 3.5 Flash が FastMetal で利用可能になりました。Flash クラスのコストと速度のまま、Pro に近いコーディング性能をうたう高効率モデルです。

チュートリアル

OpenAI SDKをFastMetalに向ける — base_urlとapi_keyの2点だけ

既存の OpenAI SDK のコードを、base_url と api_key を変えるだけで FastMetal に向ける手順を、Python と Node.js の動くサンプル、環境変数での運用、つまずきポイントまで丁寧に解説します。

63件中 31-40件を表示