モデル

ここに載っているモデルはすべて、同じOpenAI互換エンドポイントとAPIキー1つで呼び出せます。料金は100万トークンあたりの円建てで、前払いクレジットから消費されます。「FastMetal未提供」のモデルは参考として掲載しており、呼び出すことはできません。

並び替え:

303件のモデル

DeepSeek V4.1 Flash

deepseek/deepseek-v4.1-flash

DeepSeek V4.1 Flashはディープシークの疎混合専門家モデルであり、同社のCausal Encoder-Decoder (CED)アーキテクチャ上に構築された最初のモデルです。入力時に8Bパラメータを活性化し、出力時に16Bを...

プロバイダー:deepseek logodeepseek
価格:入力 ¥50.686 · 出力 ¥202.7441 / 100万トークン
コンテキスト:1.0M tokens

Mercury 2.5

inception/mercury-2.5

Mercury 2.5は最速の推論LLMであり、Inceptionからの最新の拡散LLM(dLLM)です。トークンを順序立てて生成する代わりに、Mercury 2.5は複数のトークンを並列で生成および洗練し、以下を実現します...

プロバイダー:inception
価格:入力 ¥6.768 · 出力 ¥25.3799 / 100万トークン
コンテキスト:260K tokens

GPT-6 Astra

openai/gpt-6-astra

GPT-6 AstraはOpenAIの要求の厳しいエンドツーエンドの作業向けフラッグシップモデルです。高度な分析、ソフトウェアエンジニアリング、深い研究、科学的作業、ドキュメント作成に適しており、長期的な...

プロバイダー:openai logoopenai
価格:入力 ¥1,717.723 · 出力 ¥8,588.615 / 100万トークン
コンテキスト:1.1M tokens

GPT-6 Astra Pro

openai/gpt-6-astra-pro

GPT-6 Astra Proは[GPT-6 Astra](https://openrouter.ai/openai/gpt-6-astra)と同じ基盤モデルですが、複雑なタスクに対してより高品質な応答を提供するために`reasoning.mode`を`pro`に設定して提供されています。 詳細はOpenAIのドキュメントをご覧ください:https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

プロバイダー:openai logoopenai
価格:入力 ¥1,717.723 · 出力 ¥8,588.615 / 100万トークン
コンテキスト:1.1M tokens

Qwen3.8 Max (0902)

qwen/qwen3.8-max-0902

Qwen3.8 Max 0902はアリババのQwenチームによるQwen3.8 Maxの更新スナップショットです。2.4兆パラメータのミクスチャー・オブ・エキスパーツモデルで、テキスト、画像、ビデオ入力を受け入れ、テキストを返します...

プロバイダー:qwen logoqwen
価格:入力 ¥357.4 · 出力 ¥1,072.2 / 100万トークン
コンテキスト:1.0M tokens

Gemini 3.8 Flash

google/gemini-3.8-flash

Gemini 3.8 Flashは、ソフトウェアエンジニアリング、エージェンティックタスク、および多段階推論において3.7 Flashから大幅な改善を遂げた、Googleの最も知能の高いFlashモデルです。

プロバイダー:google logogoogle
価格:入力 ¥128.8292 · 出力 ¥644.1461 / 100万トークン
コンテキスト:1.0M tokens

Muse Spark 1.3

meta/muse-spark-1.3

Muse Spark 1.3はMetaの多模態推論モデルで、長時間実行されるエージェント、マルチエージェント、およびコーディングワークフロー向けに設計されています。拡張タスク全体にわたって情報を追跡し、...

プロバイダー:meta logometa
価格:入力 ¥219.8968 · 出力 ¥747.6489 / 100万トークン
コンテキスト:1.0M tokens

Muse Spark 1.3 Contributor

meta/muse-spark-1.3-contributor

Muse Spark 1.3 Contributorは、Meta のマルチモーダル推論モデルのコスト効率的なコントリビューター層であり、実験、学習、初期段階のエージェント、マルチエージェント、およびコーディングワークフロー向けに設計されています。情報を追跡するように設計されています...

プロバイダー:meta logometa
価格:FastMetal未提供
コンテキスト:1.0M tokens

Claude Fable 5.1

anthropic/claude-fable-5.1

Claude Fable 5.1は、Claude Fable 5から全体的に改善されており、エージェント型コーディング、長時間実行されるエージェント型ワークフロー、知識作業(長いコードリファクタリング、フロントエンドとビジュアル...)において最大の向上が見られます。

プロバイダー:anthropic logoanthropic
価格:入力 ¥1,787 · 出力 ¥8,935 / 100万トークン
コンテキスト:1.0M tokens

Hy4 preview

tencent/hy4-preview

テンセント:Hy4プレビューはテンセントの混合専門家モデルで、総770B個のパラメータのうち49B個がアクティブです。コーディングエージェント、複雑なツール使用ワークフロー、および生産性タスク向けに設計されています...

プロバイダー:tencent logotencent
価格:FastMetal未提供
コンテキスト:1.0M tokens

GLM 5.3 Flash

z-ai/glm-5.3-flash

GLM-5.3-Flashは、Z.aiのネイティブマルチモーダルモデルです。効率的なコーディングと長期的なエージェントタスクに適しています。ハイブリッドスパースおよび線形注意アーキテクチャにより、正確な長文脈動作を維持しながら...

プロバイダー:z-ai logoz-ai
価格:入力 ¥25.343 · 出力 ¥84.4767 / 100万トークン
コンテキスト:1.3M tokens
テキスト総合
#29

Qwen3.8 Flash

qwen/qwen3.8-flash

Qwen3.8 Flashはアリババのマルチモーダル推論モデルです。コーディング支援、エージェントワークフロー、ビジュアル理解、ドキュメントおよびコードベース分析、デスクトップインタラクション、チャート分析、長時間ビデオ分析に適しています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:1.0M tokens

Muse Spark 1.2 Contributor

meta/muse-spark-1.2-contributor

Muse Spark 1.2 コントリビューター層は、さらに低いコストで構築を開始したい開発者向けに設計されたMetaの推論モデルです。Muse Sparkよりも大幅に安価です...

プロバイダー:meta logometa
価格:FastMetal未提供
コンテキスト:1.0M tokens

GLM 5.3

z-ai/glm-5.3

GLM-5.3はZ.aiの大規模推論モデルで、複雑なソフトウェアエンジニアリングと長期的なエージェントタスク向けに構築されています。テキスト入力と出力をサポートし、100万トークンのコンテキストウィンドウを備えており、改善されています...

プロバイダー:z-ai logoz-ai
価格:入力 ¥250.18 · 出力 ¥786.28 / 100万トークン
コンテキスト:1.0M tokens

Qwen3.8 27B

qwen/qwen3.8-27b

Qwen3.8 27Bは、Qwenからのオープンウェイト密集型ビジョン言語モデルです。コーディング、プロフェッショナルワークフロー、研究、マルチモーダルインタラクション、長時間実行されるエージェントタスクに適しており、柔軟な思考が可能です...

プロバイダー:qwen logoqwen
価格:入力 ¥80.415 · 出力 ¥571.84 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#89

Gemini 3.7 Flash

google/gemini-3.7-flash

Gemini 3.7 Flashは、高速なエージェントワークフロー、コーディング、複雑なマルチステップ推論向けのGoogleのマルチモーダルモデルです。レスポンシブなパフォーマンスと信頼性の高いマルチステップが必要なタスク向けに設計されています...

プロバイダー:google logogoogle
価格:入力 ¥134.025 · 出力 ¥670.125 / 100万トークン
コンテキスト:1.0M tokens

Grok 4.6

x-ai/grok-4.6

Grok 4.6はSpaceXAIの最も高度なモデルで、コーディング、知識作業、STEMにおいて最先端のパフォーマンスを発揮します。

プロバイダー:x-ai logox-ai
価格:入力 ¥357.4 · 出力 ¥1,072.2 / 100万トークン
コンテキスト:500K tokens

Qwen3.8 2.4T A95B

qwen/qwen3.8-2.4t-a95b

Qwen3.8 2.4T A95Bは、Qwenからのオープンウェイト疎混合専門家モデルであり、[Qwen3.8 Max](/qwen/qwen3.8-max)のオープンウェイト変種で、2.4兆個の総パラメータのうち950億個のアクティブパラメータを持っています。これは...

プロバイダー:qwen logoqwen
価格:入力 ¥351.8348 · 出力 ¥1,055.5044 / 100万トークン
コンテキスト:1.0M tokens

Muse Glimmer 30B

meta/muse-glimmer-30b

Meta Superintelligence Labs のオープンウェイト・マルチモーダルモデル。Muse Spark から蒸留された 30B の高密度モデルで、コンシューマ向けハードウェア上の長期エージェントタスクに最適化されています。常時推論(reasoning)と 131k トークンのコンテキスト、画像入力に対応します。

プロバイダー:meta logometa
価格:入力 ¥62.545 · 出力 ¥268.05 / 100万トークン
コンテキスト:131K tokens

Solar Pro 4

upstage/solar-pro4

Solar Pro 4はUpstageの費用効率的な大規模言語モデルで、524Kのコンテキストウィンドウを備えています。長期的なタスクとエージェントワークフロー向けに構築されており、オフィス生産性、ドキュメント集約的な...

プロバイダー:upstage
価格:入力 ¥15.2222 · 出力 ¥60.8888 / 100万トークン
コンテキスト:524K tokens
テキスト総合
#175

Muse Spark 1.2

meta/muse-spark-1.2

Muse Spark 1.2はMetaの推論モデルで、複雑なエージェントタスク向けに設計されています。テキスト、画像、ビデオ、オーディオ、PDFドキュメントを受け入れ、テキストを返し、100万トークンのコンテキストを提供します...

プロバイダー:meta logometa
価格:入力 ¥219.8968 · 出力 ¥747.6489 / 100万トークン
コンテキスト:1.0M tokens

Qwen3.8 Max

qwen/qwen3.8-max

Alibaba の Qwen3.8 シリーズ最上位モデル。2.4兆パラメータの MoE(アクティブ 95B)で、100万トークンのコンテキストと画像入力に対応した推論モデルです。

プロバイダー:qwen logoqwen
価格:入力 ¥357.4 · 出力 ¥1,072.2 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#22

Claude Opus 5

anthropic/claude-opus-5

Claude Opus 5 is Anthropic’s flagship model for demanding reasoning, coding, and long-horizon agentic work. It is particularly strong at end-to-end software tasks, code review and bug finding, visual analysis...

プロバイダー:anthropic logoanthropic
価格:入力 ¥893.5 · 出力 ¥4,467.5 / 100万トークン
コンテキスト:1.0M tokens

Gemini 3.5 Flash Lite

google/gemini-3.5-flash-lite

Gemini 3.5 Flash Liteは、Googleの高効率モデルで、エージェント機能が強化されています。複雑なマルチエージェントワークフロー内で焦点を絞ったタスクを実行するサブエージェントに適しています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#57

Gemini 3.6 Flash

google/gemini-3.6-flash

Gemini 3.6 Flashは、コーディング、エージェントワークフロー、ウェブおよびアプリ開発向けのGoogleの高効率モデルです。不要な編集を減らしながら、洗練された出力を生成するように設計されており、...

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens

Inkling

thinkingmachines/inkling

Inklingは、Thinking Machines Labからのオープンウェイト・マルチモーダル・ミクスチャー・オブ・エキスパーツモデルで、975B総パラメータのうち41Bアクティブパラメータを備えています。汎用推論、コーディング、エージェンティック、ツール使用システム向けに設計されています。

プロバイダー:thinkingmachines
価格:入力 ¥178.7 · 出力 ¥723.735 / 100万トークン
コンテキスト:524K tokens
テキスト総合
#83

Kimi K3

moonshotai/kimi-k3

Kimi K3は、Moonshot AIの2.8Tパラメータのオープンウェイト マルチモーダル推論モデルです。複雑なコーディング、知識作業、長期的なエージェント ワークフローに適しており、特に...

プロバイダー:moonshotai logomoonshotai
価格:入力 ¥536.1 · 出力 ¥2,680.5 / 100万トークン
コンテキスト:1.0M tokens

Muse Spark 1.1

meta/muse-spark-1.1

Muse Spark 1.1はMetaのマルチモーダル推論モデルで、エージェントタスク向けに構築されています。テキスト、画像、ビデオ、オーディオ、PDFドキュメントを受け入れ、テキストを返し、100万トークンのコンテキストを備えています...

プロバイダー:meta logometa
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#10

GPT-5.6 Luna

openai/gpt-5.6-luna

GPT-5.6 Lunaは、OpenAIのGPT-5.6シリーズの高速で費用効率の良いモデルです。チャット、分類、軽量のエージェントワークフローなど、高ボリューム、低レイテンシーのタスクに適しており、有能な推論を提供します...

プロバイダー:openai logoopenai
価格:入力 ¥35.74 · 出力 ¥214.44 / 100万トークン
コンテキスト:1.1M tokens

GPT-5.6 Sol

openai/gpt-5.6-sol

GPT-5.6 Solは、OpenAIのGPT-5.6シリーズのフラッグシップモデルです。複雑な推論、コーディング、エージェントワークフローに適しており、コマンドラインと複数ステップのコーディングタスクに特に優れています...

プロバイダー:openai logoopenai
価格:入力 ¥893.5 · 出力 ¥5,361 / 100万トークン
コンテキスト:1.1M tokens

GPT-5.6 Terra

openai/gpt-5.6-terra

GPT-5.6 Terraは、OpenAIのGPT-5.6シリーズにおけるバランスの取れたモデルで、フラッグシップのSolティアとコスト効率的なLunaティアの間に位置しています。日常的なコーディング、推論、エージェント...

プロバイダー:openai logoopenai
価格:入力 ¥357.4 · 出力 ¥2,144.4 / 100万トークン
コンテキスト:1.1M tokens

Grok 4.5

x-ai/grok-4.5

Grok 4.5はSpaceXAIの最も高度なモデルで、コーディング、知識作業、STEMにおいて最先端のパフォーマンスを発揮します。

プロバイダー:x-ai logox-ai
価格:入力 ¥357.4 · 出力 ¥1,072.2 / 100万トークン
コンテキスト:500K tokens
テキスト総合
#38

Hy3

tencent/hy3

Hy3は、Tencent社による295Bパラメータの混合専門家モデル(21B活性、192人の専門家とトップ8ルーティング)で、推論、エージェントワークフロー、実世界の本番運用向けに構築されています。設定可能な推論努力をサポートしています:...

プロバイダー:tencent logotencent
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#60

Laguna XS 2.1

poolside/laguna-xs-2.1

Laguna XS 2.1は、[Poolside](https://poolside.ai/)の33B-A3Bカテゴリーにおける最新のコーディングエージェントモデルであり、2026年4月にリリースされたLaguna XS.2モデルからの進歩です。これは...

プロバイダー:poolside logopoolside
価格:FastMetal未提供
コンテキスト:262K tokens

Laguna XS 2.1 (free)

poolside/laguna-xs-2.1:free

Laguna XS 2.1は、[Poolside](https://poolside.ai/)の33B-A3Bカテゴリーにおける最新のコーディングエージェントモデルであり、2026年4月にリリースされたLaguna XS.2モデルからの進歩です。これは...

プロバイダー:poolside logopoolside
価格:FastMetal未提供
コンテキスト:262K tokens

Claude Sonnet 5

anthropic/claude-sonnet-5

Sonnet 5はAnthropicの最も高性能なSonnetクラスモデルであり、コーディング、エージェント、プロフェッショナルワークにおいて最先端のパフォーマンスを発揮します。適応的思考をサポートし、選択可能な推論努力レベル(低、中、高、最大など)に対応しています。

プロバイダー:anthropic logoanthropic
価格:入力 ¥357.4 · 出力 ¥1,787 / 100万トークン
コンテキスト:1.0M tokens

Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)

google/gemini-3.1-flash-lite-image

Nano Banana 2 Lite(Gemini 3.1 Flash Lite Image)はGoogleの最速で最もコスト効率の良いGeminiイメージモデルであり、高速開発者パイプラインと迅速なビジュアル探索向けに構築されています。テキストから画像への生成を提供します...

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:66K tokens

Nano Banana 2 (Gemini 3.1 Flash Image)

google/gemini-3.1-flash-image

Google の高速・高品質な画像生成モデル。テキストから画像を生成します。

プロバイダー:google logogoogle
価格:¥12.23 / 画像1枚
コンテキスト:131K tokens

Nano Banana Pro (Gemini 3 Pro Image)

google/gemini-3-pro-image

Nano Banana Proは、Gemini 3 Proをベースに構築されたGoogleの最も高度な画像生成・編集モデルです。元のNano Bananaを拡張し、大幅に改善されたマルチモーダル推論、現実世界への接地、および...

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:131K tokens

GLM 5.2

z-ai/glm-5.2

GLM 5.2はZ.aiの大規模推論モデルです。テキスト入力・出力に対応し、100万トークンのコンテキストウィンドウを備えており、長期的なエージェントワークフロー、プロジェクトレベルのソフトウェアエンジニアリングなどに適しています。

プロバイダー:z-ai logoz-ai
価格:入力 ¥250.18 · 出力 ¥786.28 / 100万トークン
コンテキスト:1.0M tokens

Fusion

openrouter/fusion

Fusionはあなたのプロンプトを小規模なマルチモデル審議に変えます。エキスパートモデルのパネル(以下参照)がウェブ検索とウェブフェッチ機能を有効にして並行してあなたのプロンプトを分析し、その後...

プロバイダー:openrouter logoopenrouter
価格:FastMetal未提供
コンテキスト:1.0M tokens

Kimi K2.7 Code

moonshotai/kimi-k2.7-code

MoonshotAI: Kimi K2.7 Codeは、Moonshot AIのKimi K2ファミリーに属するコーディング専門モデルで、長いコンテキストにわたってエンドツーエンドのプログラミングタスクを確実に完了するために構築されています。ネイティブマルチモーダルミクスチャーオブエキスパート...

プロバイダー:moonshotai logomoonshotai
価格:入力 ¥55 · 出力 ¥530 / 100万トークン
コンテキスト:262K tokens

Claude Fable 5

anthropic/claude-fable-5

Claude Fable 5はAnthropicのMythos級モデルで、自律的な知識作業とコーディング向けに構築されています。テキスト、画像、ファイル入力とテキスト出力をサポートし、推論機能を備えており...

プロバイダー:anthropic logoanthropic
価格:入力 ¥1,787 · 出力 ¥8,935 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#1

Nemotron 3 Ultra

nvidia/nemotron-3-ultra-550b-a55b

NVIDIA Nemotron 3 Ultraは、NVIDIAの最先端のフロンティア推論・オーケストレーションモデルで、550B個の総パラメータのうち55B個のアクティブパラメータを持つ(MoE)。ハイブリッドTransformer-Mambaの混合専門家アーキテクチャ上に構築されており、...

プロバイダー:nvidia logonvidia
価格:FastMetal未提供
コンテキスト:512K tokens

Qwen3.7 Plus

qwen/qwen3.7-plus

Qwen3.7-Plusはアリババの Qwen3.7シリーズにおけるコスト効率的なモデルです。テキストと画像の入力、テキスト出力をサポートしており、シリーズのテキスト機能を基盤としながら、その...

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#61

MiniMax M3

minimax/minimax-m3

MiniMax-M3はMiniMaxのマルチモーダル基盤モデルです。テキスト、画像、ビデオ入力とテキスト出力をサポートし、100万トークンのコンテキストウィンドウを備えており、長期的なエージェント作業、コーディングなどに適しています。

プロバイダー:minimax logominimax
価格:入力 ¥53.61 · 出力 ¥214.44 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#80

Step 3.7 Flash

stepfun/step-3.7-flash

ステップ3.7 Flashは、StepFunの最新の高効率マルチモーダルMixture-of-Expertsモデルです。196Bパラメータの言語バックボーンとビジョンエンコーダを組み合わせており、画像とビデオのネイティブ理解を実現し、約11Bのパラメータをアクティベートします...

プロバイダー:stepfun logostepfun
価格:FastMetal未提供
コンテキスト:262K tokens

Claude Opus 4.8

anthropic/claude-opus-4.8

Claude Opus 4.8はAnthropicのOpusファミリーで最も高性能な一般利用可能なモデルです。テキスト、画像、ファイル入力とテキスト出力をサポートし、推論機能と100万トークンの...

プロバイダー:anthropic logoanthropic
価格:入力 ¥893.5 · 出力 ¥4,467.5 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#33

Claude Opus 4.8 (Fast)

anthropic/claude-opus-4.8-fast

[Opus 4.8](/anthropic/claude-opus-4.8)のファストモード変種 - 通常のOpus 4.8と同じ機能で、通常のOpus 4.8に比べて2倍の価格で高速出力を実現します。 Anthropicのドキュメントで詳しく学ぶ: https://platform.claude.com/docs/en/build-with-claude/fast-mode

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:1.0M tokens

Qwen3.7 Max

qwen/qwen3.7-max

Qwen3.7-Maxはアリババの Qwen3.7シリーズのフラッグシップモデルです。テキスト入力と出力をサポートしており、エージェント中心のワークロード向けに設計されており、コーディング、オフィス、生産性タスクに特に優れています...

プロバイダー:qwen logoqwen
価格:入力 ¥263.5825 · 出力 ¥790.7475 / 100万トークン
コンテキスト:1.0M tokens

Gemini 3.5 Flash

google/gemini-3.5-flash

Gemini 3.5 Flashは、Googleの高効率マルチモーダルモデルであり、Flash層のコストとスピードでPro並みのコーディングと推論を実現します。コーディング能力と並列エージェント実行に最適化されています...

プロバイダー:google logogoogle
価格:入力 ¥268.05 · 出力 ¥1,608.3 / 100万トークン
コンテキスト:1.0M tokens

Claude Opus 4.7 (Fast)

anthropic/claude-opus-4.7-fast

[Opus 4.7](/anthropic/claude-opus-4.7)の高速モード版 - 同じ機能で、プレミアム価格6倍でより高速な出力を実現します。 Anthropicのドキュメントで詳しく学ぶ: https://platform.claude.com/docs/en/build-with-claude/fast-mode

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:1.0M tokens

Gemini 3.1 Flash Lite

google/gemini-3.1-flash-lite

Gemini 3.1 Flash Liteは、低レイテンシーで大量のワークロードに最適化されたGoogleのGA高効率マルチモーダルモデルです。テキスト、画像、ビデオ、オーディオ、PDF入力をサポートし、軽量のエージェント向けに設計されています...

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens

Granite 4.1 8B

ibm-granite/granite-4.1-8b

Granite 4.1 8Bは、IBMの Granite 4.1ファミリーの一部である、密集型のデコーダーのみの80億パラメータ言語モデルです。131Kトークンのコンテキストウィンドウをサポートし、エンタープライズタスク向けに設計されています...

プロバイダー:ibm-granite
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#265

Grok 4.3

x-ai/grok-4.3

Grok 4.3はxAIの推論モデルです。テキストと画像の入力を受け付け、テキスト出力を生成し、エージェントワークフロー、指示に従うタスク、および高い事実性を必要とするアプリケーションに適しています...

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#79

Mistral Medium 3.5

mistralai/mistral-medium-3-5

Mistral Medium 3.5は、Mistral AIの密集型128B命令追従モデルです。テキストと画像入力をサポートし、テキスト出力に対応しており、エージェントワークフロー、コーディング、複雑な...

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#103

Laguna M.1

poolside/laguna-m.1

Laguna M.1は[Poolside](https://poolside.ai/)のフラッグシップコーディングエージェントモデルであり、複雑なソフトウェアエンジニアリングタスク向けに最適化されています。エージェント型コーディングワークフロー用に設計されており、ツール呼び出しと推論をサポートし、256K...

プロバイダー:poolside logopoolside
価格:FastMetal未提供
コンテキスト:262K tokens

Laguna M.1 (free)

poolside/laguna-m.1:free

Laguna M.1は[Poolside](https://poolside.ai/)のフラッグシップコーディングエージェントモデルであり、複雑なソフトウェアエンジニアリングタスク向けに最適化されています。エージェント型コーディングワークフロー向けに設計されており、ツール呼び出しと推論をサポートし、256Kの...

プロバイダー:poolside logopoolside
価格:FastMetal未提供
コンテキスト:262K tokens

Google Gemini Pro Latest

~google/gemini-pro-latest

このモデルは常にGoogle Gemini Proファミリーの最新モデルにリダイレクトされます。

プロバイダー:~google
価格:FastMetal未提供
コンテキスト:1.0M tokens

Qwen3.6 Max Preview

qwen/qwen3.6-max-preview

Qwen3.6-Max-Previewはアリババクラウドの独自の最先端モデルで、スパース混合エキスパート(MoE)アーキテクチャに基づいており、約1兆個の総パラメータを備えています。エージェント型コーディング、ツール使用などに最適化されています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#51

DeepSeek V4 Flash

deepseek/deepseek-v4-flash

DeepSeek V4 Flashは、DeepSeekの効率最適化されたMixture-of-Expertsモデルで、総パラメータ数284B、アクティブ化されたパラメータ数13Bを備えており、100万トークンのコンテキストウィンドウに対応しています。高速推論用に設計されており...

プロバイダー:deepseek logodeepseek
価格:入力 ¥22.8496 · 出力 ¥49.2146 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#91

DeepSeek V4 Pro

deepseek/deepseek-v4-pro

DeepSeek V4 Proは、DeepSeekの大規模混合専門家モデルで、総パラメータ数1.6T、アクティブ化されたパラメータ数49Bを備えており、100万トークンのコンテキストウィンドウをサポートしています。高度な推論、コーディングなどのために設計されています。

プロバイダー:deepseek logodeepseek
価格:入力 ¥341.317 · 出力 ¥684.421 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#55

GPT-5.5

openai/gpt-5.5

GPT-5.5はOpenAIのフロンティアモデルで、複雑な専門的ワークロード向けに設計されており、GPT-5.4をベースに、より強力な推論能力、高い信頼性、難しいタスクでの改善されたトークン効率を備えています。1M以上のトークン...

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:1.1M tokens
テキスト総合
#24

GPT-5.5 Pro

openai/gpt-5.5-pro

GPT-5.5 Proは、複雑で高リスクのワークロードに対する深い推論と精度に最適化されたOpenAIの高性能モデルです。1M以上のトークンコンテキストウィンドウ(922K入力、128K出力)を備えており、以下をサポートしています...

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:1.1M tokens

Hy3 preview

tencent/hy3-preview

Hy3 previewはTencentが開発した高効率なMixture-of-Expertsモデルで、エージェントワークフローと本番環境での使用を想定して設計されています。無効化、低、高の各モードで構成可能な推論レベルをサポートしており、...

プロバイダー:tencent logotencent
価格:FastMetal未提供
コンテキスト:262K tokens

MiMo-V2.5

xiaomi/mimo-v2.5

MiMo-V2.5はシャオミによるネイティブなオムニモーダルモデルです。推論コストを約半分に削減しながらProレベルのエージェント性能を提供し、画像とビデオ理解にわたるマルチモーダル認識においてMiMo-V2-Omniを上回っています。

プロバイダー:xiaomi
価格:入力 ¥25.018 · 出力 ¥50.036 / 100万トークン
コンテキスト:1.1M tokens
テキスト総合
#94

MiMo-V2.5-Pro

xiaomi/mimo-v2.5-pro

MiMo-V2.5-Proはシャオミのフラッグシップモデルであり、一般的なエージェント機能、複雑なソフトウェアエンジニアリング、長期的なタスクにおいて強力なパフォーマンスを提供し、ClawEval、GDPVal、SWE-bench Proなどのベンチマークで上位にランクされています。

プロバイダー:xiaomi
価格:入力 ¥77.7345 · 出力 ¥155.469 / 100万トークン
コンテキスト:1.1M tokens
テキスト総合
#41

GPT-5.4 Image 2

openai/gpt-5.4-image-2

[GPT-5.4](https://openrouter.ai/openai/gpt-5.4) Image 2は、OpenAIのGPT-5.4モデルと最先端の画像生成機能をGPT Image 2から組み合わせたものです。推論、コーディング、...の間をシームレスに移動できる豊富なマルチモーダルワークフローを実現します。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:272K tokens

Kimi K2.6

moonshotai/kimi-k2.6

Kimi K2.6はMoonshot AIの次世代マルチモーダルモデルで、長期的なコーディング、コーディング駆動型UI/UX生成、マルチエージェントオーケストレーション向けに設計されています。Python、Rust、Goにわたる複雑なエンドツーエンドのコーディングタスクを処理し、...

プロバイダー:moonshotai logomoonshotai
価格:入力 ¥169.765 · 出力 ¥714.8 / 100万トークン
コンテキスト:262K tokens
テキスト総合
#50

Claude Opus 4.7

anthropic/claude-opus-4.7

Opus 4.7は、長時間実行される非同期エージェント向けに構築されたAnthropicのOpusファミリーの次世代です。Opus 4.6のコーディングとエージェント機能の強みに基づいて構築され、以下の点でより強力なパフォーマンスを提供します...

プロバイダー:anthropic logoanthropic
価格:入力 ¥840 · 出力 ¥4,200 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#7

GLM 5.1

z-ai/glm-5.1

GLM-5.1は、コーディング能力において大きな飛躍をもたらし、特に長期的なタスク処理において顕著な改善を実現しています。分単位のインタラクションを中心に構築された従来のモデルとは異なり、GLM-5.1は独立して継続的に作業することができます...

プロバイダー:z-ai logoz-ai
価格:入力 ¥250.18 · 出力 ¥786.28 / 100万トークン
コンテキスト:205K tokens
テキスト総合
#44

Gemma 4 26B A4B

google/gemma-4-26b-a4b-it

Gemma 4 26B A4B ITはGoogle DeepMindの命令チューニング済みMixture-of-Experts(MoE)モデルです。総パラメータ数は25.2Bですが、推論中はトークンあたり3.8Bのみがアクティベートされ、31B近い品質を提供します...

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:262K tokens

Gemma 4 26B A4B (free)

google/gemma-4-26b-a4b-it:free

Gemma 4 26B A4B ITはGoogle DeepMindのインストラクション調整型混合専門家(MoE)モデルです。合計25.2Bのパラメータにもかかわらず、推論中はトークンあたり3.8Bのみがアクティブ化され、31B近い品質を提供します...

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:262K tokens

Gemma 4 31B

google/gemma-4-31b-it

Gemma 4 31B Instructは、GoogleのDeepMindが開発した30.7Bのデンスマルチモーダルモデルで、テキストと画像の入力、テキスト出力に対応しています。256Kトークンのコンテキストウィンドウ、設定可能な思考/推論モード、ネイティブ関数...

プロバイダー:google logogoogle
価格:入力 ¥26 · 出力 ¥101 / 100万トークン
コンテキスト:262K tokens
テキスト総合
#66

Gemma 4 31B (free)

google/gemma-4-31b-it:free

Gemma 4 31B Instructは、Google DeepMindの30.7B密集型マルチモーダルモデルで、テキストと画像入力をサポートし、テキスト出力に対応しています。256Kトークンのコンテキストウィンドウ、設定可能な思考/推論モード、ネイティブ関数...

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:262K tokens

Qwen3.6 Plus

qwen/qwen3.6-plus

Qwen 3.6 Plusは、効率的な線形注意とスパース混合専門家ルーティングを組み合わせたハイブリッドアーキテクチャに基づいており、強力なスケーラビリティと高性能な推論を実現しています。3.5シリーズと比較して、以下の性能を提供します...

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#77

GLM 5V Turbo

z-ai/glm-5v-turbo

GLM-5V-Turboは、Z.aiの最初のネイティブマルチモーダルエージェント基盤モデルであり、ビジョンベースのコーディングとエージェント駆動タスク向けに構築されています。画像、ビデオ、テキスト入力をネイティブに処理し、長期的な計画立案や複雑なコーディングに優れています。

プロバイダー:z-ai logoz-ai
価格:FastMetal未提供
コンテキスト:203K tokens
テキスト総合
#95

Trinity Large Thinking

arcee-ai/trinity-large-thinking

Trinity Large Thinkingは、Arcee AIチームによる強力なオープンソース推論モデルです。PinchBench、エージェント型ワークロード、推論タスクで優れたパフォーマンスを発揮します。ローンチビデオ:https://youtu.be/Gc82AXLa0Rg?si=4RLn6WBz33qT--B7...

プロバイダー:arcee-ai
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#182

Grok 4.20

x-ai/grok-4.20

Grok 4.20はxAIの推論モデルで、業界トップクラスのスピードとエージェント型ツール呼び出し機能を備えています。市場で最も低い幻覚率と厳密なプロンプト遵守を組み合わせ、以下を実現します...

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:2.0M tokens

Grok 4.20 Multi-Agent

x-ai/grok-4.20-multi-agent

Grok 4.20 Multi-Agentは、xAIのGrok 4.20の変種で、協調的なエージェントベースのワークフロー向けに設計されています。複数のエージェントが並行して動作し、深い調査を実施し、ツール使用を調整し、情報を統合します...

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:2.0M tokens

LLM-jp-3.1 8x13B instruct4

llm-jp/llm-jp-3.1-8x13b-instruct4

国立情報学研究所(NII)が公開した、日本語に特化したオープンな Mixture-of-Experts モデルです。総パラメータ73B・アクティブ22B。日本語タスク、とりわけ人文系(humanities)で高いスコアを示し、日本語評価では GPT-4-0613 を上回るとされます。一方で、コーディングや数学ではフロンティアモデルに一歩譲ります。オープンモデルで、重みが公開されています。

プロバイダー:llm-jp
価格:入力 ¥16 · 出力 ¥79 / 100万トークン
コンテキスト:4K tokens

MiMo-V2-Pro

xiaomi/mimo-v2-pro

MiMo-V2-Proはシャオミのフラッグシップ基盤モデルであり、1T以上の総パラメータと100万のコンテキスト長を備えており、エージェントシナリオに深く最適化されています。OpenClawなどの一般的なエージェントフレームワークに高度に適応可能です。標準的なPinchBenchおよびClawBenchベンチマークでグローバルトップティアにランクされており、認識されたパフォーマンスはOpus 4.6に近づいています。

プロバイダー:xiaomi
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#71

MiniMax M2.7

minimax/minimax-m2.7

MiniMax-M2.7は、自律的で現実世界の生産性と継続的な改善のために設計された次世代大規模言語モデルです。自らの進化に積極的に参加するために構築されたM2.7は、マルチエージェント協働を通じた高度なエージェント機能を統合し、動的環境全体で複雑なタスクを計画、実行、改善することを可能にします。

プロバイダー:minimax logominimax
価格:入力 ¥53.61 · 出力 ¥214.44 / 100万トークン
コンテキスト:205K tokens
テキスト総合
#124

GPT-5.4 Mini

openai/gpt-5.4-mini

GPT-5.4 miniは、GPT-5.4のコア機能をより高速で効率的なモデルに統合し、高スループットのワークロードに最適化されています。テキストと画像の入力に対応し、推論、コーディング、ツール使用全般で強力なパフォーマンスを発揮しながら、大規模デプロイメントのレイテンシーとコストを削減します。 このモデルは、機能と効率のバランスを必要とする本番環境向けに設計されており、チャットアプリケーション、コーディングアシスタント、大規模に運用されるエージェントワークフローに最適です。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

GPT-5.4 Nano

openai/gpt-5.4-nano

GPT-5.4 nanoはGPT-5.4ファミリーの中で最も軽量でコスト効率に優れたバリアントであり、速度が重要で大量のタスクに最適化されています。テキストと画像の入力に対応し、分類、データ抽出、ランキング、サブエージェント実行などの低レイテンシーユースケース向けに設計されています。 このモデルは深い推論よりも応答性と効率を優先するため、スケールで高速で信頼性の高い出力を必要とするパイプラインに理想的です。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

GLM 5 Turbo

z-ai/glm-5-turbo

GLM-5 Turboは、Z.aiが開発した新しいモデルで、高速推論とOpenClawシナリオなどのエージェント駆動環境での強力なパフォーマンスのために設計されています。長い実行チェーンを含む実世界のエージェントワークフローに深く最適化されており、複雑な命令分解の改善、ツール使用、スケジュール設定と永続的な実行、および拡張タスク全体での全体的な安定性を備えています。

プロバイダー:z-ai logoz-ai
価格:FastMetal未提供
コンテキスト:203K tokens

Grok 4.20 Beta

x-ai/grok-4.20-beta

Grok 4.20 BetaはxAIの最新フラッグシップモデルで、業界トップクラスの速度とエージェント型ツール呼び出し機能を備えています。市場で最も低いハルシネーション率と厳密なプロンプト準拠を組み合わせ、一貫して正確で真実性の高い応答を提供します。 推論はAPIの`reasoning` `enabled`パラメータを使用して有効/無効にできます。

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:2.0M tokens

Nemotron 3 Super

nvidia/nemotron-3-super-120b-a12b

NVIDIA Nemotron 3 Superは、120BパラメータのオープンハイブリッドMoEモデルで、最大計算効率と複雑なマルチエージェントアプリケーションにおける精度のために、わずか12Bパラメータをアクティベートします。ハイブリッドMamba-TransformerMixture-of-Experts アーキテクチャとマルチトークン予測(MTP)に基づいており、主要なオープンモデルと比較して50%以上高いトークン生成を実現します。

プロバイダー:nvidia logonvidia
価格:FastMetal未提供
コンテキスト:262K tokens

GPT-5.4

openai/gpt-5.4

GPT-5.4はOpenAIの最新フロンティアモデルであり、CodexとGPTラインを単一システムに統合しています。100万トークン以上のコンテキストウィンドウ(入力922K、出力128K)を備え、テキストと画像入力をサポートしており、同じワークフロー内で高コンテキスト推論、コーディング、マルチモーダル分析を実現します。 このモデルは、コーディング、ドキュメント理解、ツール使用、および指示追従のパフォーマンスが向上しています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:1.1M tokens
テキスト総合
#46

GPT-5.4 Pro

openai/gpt-5.4-pro

GPT-5.4 ProはOpenAIの最も高度なモデルであり、GPT-5.4の統一されたアーキテクチャに基づいて構築され、複雑で重大なタスク向けに推論能力を強化しています。100万トークン以上のコンテキストウィンドウ(入力922K、出力128K)を備え、テキストと画像入力に対応しています。段階的な推論、指示の遵守、および精度に最適化されており、GPT-5.4 Proはエージェント型コーディング、長文脈ワークフロー、および複数ステップの問題解決に優れています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:1.1M tokens

Mercury 2

inception/mercury-2

Mercury 2は非常に高速な推論LLMであり、最初の推論拡散LLM(dLLM)です。 トークンを順序立てて生成する代わりに、Mercury 2は複数のトークンを並列で生成・改善し、標準GPUで1秒あたり1,000トークン以上を実現します。Mercury 2は、Claude 4.5 HaikuやGPT 5 Miniなどの速度最適化LLMより5倍以上高速で、コストは大幅に削減されます。

プロバイダー:inception
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#209

Gemini 3.1 Flash Lite Preview

google/gemini-3.1-flash-lite-preview

Gemini 3.1 Flash Lite Previewは、大量使用ケースに最適化されたGoogleの高効率モデルです。全体的な品質ではGemini 2.5 Flash Liteを上回り、主要な機能ではGemini 2.5 Flashのパフォーマンスに近づいています。音声入力/ASR、RAGスニペットランキング、翻訳、データ抽出、コード補完にわたる改善が含まれています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#96

GPT-5.3 Chat

openai/gpt-5.3-chat

GPT-5.3 Chatは、ChatGPTの最も使用されているモデルのアップデートで、日常会話をより滑らかに、より有用に、より直接的に役立つものにします。より正確な回答をより良い文脈化で提供し、会話の流れを妨げる不要な拒否、注釈、過度に慎重な表現を大幅に削減します。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens

Nano Banana 2 (Gemini 3.1 Flash Image Preview)

google/gemini-3.1-flash-image-preview

Gemini 3.1 Flash Image Preview(別名「Nano Banana 2」)は、Googleの最新の最先端画像生成・編集モデルで、Flashスピードでプロレベルの視覚品質を提供します。高度なコンテキスト理解と高速で費用効率の良い推論を組み合わせており、複雑な画像生成と反復的な編集をより簡単にアクセスできるようにします。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:66K tokens

Gemini 3.1 Pro Preview Custom Tools

google/gemini-3.1-pro-preview-customtools

Gemini 3.1 Pro Preview Custom Toolsは、Gemini 3.1 Proの変種で、より効率的なサードパーティ製またはユーザー定義の関数が利用可能な場合に、汎用bashツールの過度な使用を防ぐことで、ツール選択の動作を改善します。この特殊なプレビューエンドポイントは、関数呼び出しの信頼性を大幅に向上させ、コーディングエージェントと複雑なマルチツールワークフローで最も適切なツールを選択することを保証します。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens

Qwen3.5-122B-A10B

qwen/qwen3.5-122b-a10b

Qwen3.5 122B-A10Bネイティブビジョン言語モデルは、線形注意メカニズムとスパース混合専門家モデルを統合したハイブリッドアーキテクチャ上に構築されており、より高い推論効率を実現しています。全体的なパフォーマンスの観点から、このモデルはQwen3.5-397B-A17Bに次ぐものです。そのテキスト機能はQwen3-235B-2507のそれを大幅に上回り、その視覚機能はQwen3-VL-235Bのそれを上回っています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#122

Qwen3.5-27B

qwen/qwen3.5-27b

Qwen3.5 27B ネイティブビジョン言語Denseモデルは線形注意メカニズムを組み込んでおり、高速な応答時間を実現しながら推論速度とパフォーマンスのバランスを取っています。その全体的な能力はQwen3.5-122B-A10Bのそれと同等です。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#138

Qwen3.5-35B-A3B

qwen/qwen3.5-35b-a3b

Qwen3.5 Series 35B-A3Bは、線形注意メカニズムとスパース混合専門家モデルを統合したハイブリッドアーキテクチャで設計されたネイティブビジョン言語モデルであり、より高い推論効率を実現しています。その全体的なパフォーマンスはQwen3.5-27Bのそれに匹敵します。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#153

Qwen3.5-Flash

qwen/qwen3.5-flash-02-23

Qwen3.5ネイティブビジョン言語Flashモデルは、線形注意メカニズムとスパース混合専門家モデルを統合したハイブリッドアーキテクチャ上に構築されており、より高い推論効率を実現しています。3シリーズと比較して、これらのモデルはテキストのみのタスクとマルチモーダルタスクの両方において性能の大きな飛躍をもたらし、推論速度と全体的なパフォーマンスのバランスを取りながら、高速な応答時間を提供します。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#150

GPT-5.3-Codex

openai/gpt-5.3-codex

GPT-5.3-Codexは、OpenAIの最も高度なエージェント型コーディングモデルであり、GPT-5.2-Codexの最先端のソフトウェアエンジニアリング性能とGPT-5.2のより広い推論および専門知識能力を組み合わせています。SWE-Bench Proで最先端の結果を達成し、Terminal-Bench 2.0およびOSWorld-Verifiedで強力なパフォーマンスを発揮しており、マルチ言語コーディング、ターミナル習熟度、および実世界のコンピュータ使用スキルの向上を…

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

Gemini 3.1 Pro Preview

google/gemini-3.1-pro-preview

Gemini 3.1 Pro Previewは、Google の最先端推論モデルであり、ソフトウェアエンジニアリングのパフォーマンス向上、エージェント信頼性の改善、複雑なワークフロー全体でのより効率的なトークン使用を実現します。Gemini 3シリーズのマルチモーダル基盤に基づいており、テキスト、画像、ビデオ、オーディオ、コード全体での高精度推論と100万トークンのコンテキストウィンドウを組み合わせています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#15

Claude Sonnet 4.6

anthropic/claude-sonnet-4.6

Sonnet 4.6はAnthropicの最新かつ最も高性能なSonnetクラスモデルであり、コーディング、エージェント、プロフェッショナルワークにおいて最先端のパフォーマンスを発揮します。反復的な開発、複雑なコードベースのナビゲーション、メモリを備えたエンドツーエンドのプロジェクト管理、洗練されたドキュメント作成、およびウェブQAとワークフロー自動化のための自信を持ったコンピュータ使用に優れています。

プロバイダー:anthropic logoanthropic
価格:入力 ¥554.4 · 出力 ¥2,772 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#35

Qwen3.5 397B A17B

qwen/qwen3.5-397b-a17b

Qwen3.5シリーズ397B-A17Bネイティブビジョン言語モデルは、線形注意メカニズムとスパース混合専門家モデルを統合したハイブリッドアーキテクチャ上に構築されており、より高い推論効率を実現しています。言語理解、論理推論、コード生成、エージェントベースのタスク、画像理解、ビデオ理解、グラフィカルユーザーインターフェース(GUI)インタラクションを含む幅広いタスクにおいて、最先端のパフォーマンスを提供し、最先端モデルに匹敵します。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#82

MiniMax M2.5

minimax/minimax-m2.5

MiniMax-M2.5は、実世界の生産性のために設計された最先端の大規模言語モデルです。複雑な実世界のデジタル作業環境の多様な範囲で訓練されたM2.5は、M2.1のコーディング専門知識を基盤として、一般的なオフィス業務へと拡張し、Word、Excel、PowerPointファイルの生成と操作における流暢性、多様なソフトウェア環境間でのコンテキスト切り替え、および異なるエージェントと人間チーム間での作業に達しています。

プロバイダー:minimax logominimax
価格:FastMetal未提供
コンテキスト:197K tokens
テキスト総合
#159

MiniMax M2.5 (free)

minimax/minimax-m2.5:free

MiniMax-M2.5は、実世界の生産性のために設計された最先端の大規模言語モデルです。複雑な実世界のデジタル作業環境の多様な範囲で訓練されたM2.5は、M2.1のコーディング専門知識を基盤として、一般的なオフィス作業に拡張され、Word、Excel、PowerPointファイルの生成と操作における流暢性、多様なソフトウェア環境間のコンテキスト切り替え、および異なるエージェントと人間のチーム間での作業に達しています。

プロバイダー:minimax logominimax
価格:FastMetal未提供
コンテキスト:197K tokens

GLM 5

z-ai/glm-5

GLM-5はZ.aiのフラッグシップオープンソース基盤モデルであり、複雑なシステム設計と長期的なエージェントワークフロー向けに設計されています。エキスパート開発者向けに構築されており、大規模プログラミングタスクで本番環境レベルのパフォーマンスを提供し、主要なクローズドソースモデルに匹敵します。高度なエージェント計画、深いバックエンド推論、反復的な自己修正により、GLM-5はコード生成を超えて、完全なシステム構築と自律実行へと進化します。

プロバイダー:z-ai logoz-ai
価格:入力 ¥178.7 · 出力 ¥571.84 / 100万トークン
コンテキスト:205K tokens
テキスト総合
#56

Claude Opus 4.6

anthropic/claude-opus-4.6

Opus 4.6はAnthropicの最強のコーディングモデルであり、長時間実行される専門的なタスク向けに設計されています。単一のプロンプトではなく、ワークフロー全体を操作するエージェント向けに構築されており、大規模なコードベース、複雑なリファクタリング、時間をかけて展開する複数ステップのデバッグに特に効果的です。このモデルは、前世代よりも深いコンテキスト理解、より強力な問題分解、困難なエンジニアリングタスクにおけるより高い信頼性を示しています。

プロバイダー:anthropic logoanthropic
価格:入力 ¥850 · 出力 ¥4,200 / 100万トークン
コンテキスト:1.0M tokens
テキスト総合
#6

Step 3.5 Flash

stepfun/step-3.5-flash

Step 3.5 Flashは、StepFunの最も高性能なオープンソース基盤モデルです。スパースMixture of Experts(MoE)アーキテクチャに基づいており、トークンごとに196Bパラメータのうち11Bのみを選択的に活性化します。これは非常に高速で効率的な推論モデルであり、長いコンテキストでも優れたパフォーマンスを発揮します。

プロバイダー:stepfun logostepfun
価格:FastMetal未提供
コンテキスト:256K tokens
テキスト総合
#156

Step 3.5 Flash (free)

stepfun/step-3.5-flash:free

Step 3.5 Flashは、StepFunの最も高性能なオープンソース基盤モデルです。スパースな混合専門家(MoE)アーキテクチャに基づいており、トークンごとに196Bパラメータのうち11Bのみを選択的に活性化します。長いコンテキストでも非常に速度効率的な推論モデルです。

プロバイダー:stepfun logostepfun
価格:FastMetal未提供
コンテキスト:256K tokens

Kimi K2.5

moonshotai/kimi-k2.5

Kimi K2.5は、Moonshot AIのネイティブマルチモーダルモデルであり、最先端のビジュアルコーディング機能と自己指向型エージェントスウォームパラダイムを提供します。Kimi K2をベースに、約15Tの混合ビジュアルおよびテキストトークンを用いた継続的な事前学習により構築されており、一般的な推論、ビジュアルコーディング、およびエージェンティックツール呼び出しにおいて強力なパフォーマンスを発揮します。

プロバイダー:moonshotai logomoonshotai
価格:FastMetal未提供
コンテキスト:262K tokens

Trinity Large Preview (free)

arcee-ai/trinity-large-preview:free

Trinity-Large-Previewは、Arceeのフロンティアスケール・オープンウェイト言語モデルで、4-of-256エキスパートルーティングを使用して、トークンあたり13Bのアクティブパラメータを持つ400Bパラメータのスパース混合エキスパート(MoE)として構築されています。 創作、ストーリーテリング、ロールプレイ、チャットシナリオ、リアルタイム音声アシスタンスに優れており、通常の推論モデルよりも優れたパフォーマンスを発揮します。

プロバイダー:arcee-ai
価格:FastMetal未提供
コンテキスト:131K tokens

MiniMax M2-her

minimax/minimax-m2-her

MiniMax M2-herは、没入型ロールプレイ、キャラクター駆動型チャット、表現力豊かなマルチターン会話のために構築された対話優先の大規模言語モデルです。トーン和人格の一貫性を保つように設計されており、豊富なメッセージロール(user_system、group、sample_message_user、sample_message_ai)をサポートし、サンプル対話から学習してシナリオのスタイルとペーシングをより適切に一致させることができます。

プロバイダー:minimax logominimax
価格:FastMetal未提供
コンテキスト:66K tokens

GLM 4.7 Flash

z-ai/glm-4.7-flash

30Bクラスの最先端モデルとして、GLM-4.7-Flashはパフォーマンスと効率のバランスを取った新しい選択肢を提供します。エージェント型コーディングのユースケースに向けてさらに最適化され、コーディング機能、長期的なタスク計画、ツール連携を強化しており、現在の複数の公開ベンチマークリーダーボードで同規模のオープンソースモデルの中で最高水準のパフォーマンスを達成しています。

プロバイダー:z-ai logoz-ai
価格:入力 ¥10.722 · 出力 ¥71.48 / 100万トークン
コンテキスト:203K tokens
テキスト総合
#184

GPT-5.2-Codex

openai/gpt-5.2-codex

GPT-5.2-Codexは、ソフトウェアエンジニアリングとコーディングワークフロー向けに最適化されたGPT-5.1-Codexのアップグレード版です。インタラクティブな開発セッションと複雑なエンジニアリングタスクの長時間にわたる独立実行の両方に対応するよう設計されています。このモデルは、プロジェクトのゼロからの構築、機能開発、デバッグ、大規模なリファクタリング、およびコードレビューをサポートしています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

Molmo2 8B

allenai/molmo-2-8b

Molmo2-8Bは、Allen Institute for AI(Ai2)によって開発されたオープンなビジョン言語モデルで、Molmo2ファミリーの一部です。画像、ビデオ、および複数画像の理解とグラウンディングをサポートしています。Qwen3-8Bをベースとしており、ビジョンバックボーンとしてSigLIP 2を使用しています。

プロバイダー:allenai
価格:FastMetal未提供
コンテキスト:37K tokens
テキスト総合
#233

Olmo 3.1 32B Instruct

allenai/olmo-3.1-32b-instruct

Olmo 3.1 32B Instructは、高性能な会話型AI、マルチターン対話、および実用的な指示追従のために設計された大規模な320億パラメータの指示チューニング言語モデルです。Olmo 3.1ファミリーの一部として、このバリアントは複雑なユーザー指示への応答性と堅牢なチャット相互作用を強調しながら、推論およびコーディングベンチマークの強力な能力を保持しています。

プロバイダー:allenai
価格:FastMetal未提供
コンテキスト:66K tokens
テキスト総合
#230

MiniMax M2.1

minimax/minimax-m2.1

MiniMax-M2.1は、コーディング、エージェントワークフロー、および最新のアプリケーション開発に最適化された軽量で最先端の大規模言語モデルです。わずか100億のアクティブ化されたパラメータで、例外的なレイテンシ、スケーラビリティ、およびコスト効率を維持しながら、実世界の機能において大きな飛躍をもたらします。 前身と比較して、M2.1はより洗練された簡潔な出力と高速な知覚応答時間を提供します。

プロバイダー:minimax logominimax
価格:FastMetal未提供
コンテキスト:197K tokens

GLM 4.7

z-ai/glm-4.7

GLM-4.7はZ.aiの最新フラッグシップモデルであり、2つの主要分野でのアップグレードを特徴としています:プログラミング機能の強化と、より安定した多段階推論・実行です。複雑なエージェントタスクの実行において大幅な改善を示しており、より自然な会話体験と優れたフロントエンド美学を提供します。

プロバイダー:z-ai logoz-ai
価格:入力 ¥107.22 · 出力 ¥393.14 / 100万トークン
コンテキスト:203K tokens
テキスト総合
#81

Gemini 3 Flash Preview

google/gemini-3-flash-preview

Gemini 3 Flash Previewは、エージェンティックワークフロー、マルチターンチャット、コーディング支援向けに設計された高速で高い価値を提供する思考モデルです。大規模なGeminiバリアントよりも大幅に低いレイテンシーでProレベルに近い推論とツール使用パフォーマンスを提供し、インタラクティブな開発、長時間実行されるエージェントループ、協調的なコーディングタスクに最適です。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens

Olmo 3.1 32B Think

allenai/olmo-3.1-32b-think

Olmo 3.1 32Bシンクは、深い推論、複雑な多段階ロジック、および高度な指示追従を目的とした320億パラメータの大規模モデルです。Olmo 3シリーズに基づいて、バージョン3.1は洗練された推論動作と要求の厳しい評価および微妙な会話タスク全体にわたるより強いパフォーマンスを提供します。

プロバイダー:allenai
価格:FastMetal未提供
コンテキスト:66K tokens
テキスト総合
#284

MiMo-V2-Flash

xiaomi/mimo-v2-flash

MiMo-V2-Flashはシャオミが開発したオープンソースの基盤言語モデルです。309B個の総パラメータと15B個のアクティブパラメータを持つMixture-of-Expertsモデルで、ハイブリッド注意メカニズムを採用しています。MiMo-V2-Flashはハイブリッド思考トグルと256Kのコンテキストウィンドウをサポートしており、推論、コーディング、エージェントシナリオに優れています。

プロバイダー:xiaomi
価格:FastMetal未提供
コンテキスト:262K tokens

Nemotron 3 Nano 30B A3B

nvidia/nemotron-3-nano-30b-a3b

NVIDIA Nemotron 3 Nano 30B A3Bは、開発者が特化したエージェンティックAIシステムを構築するための、最高の計算効率と精度を備えた小規模言語MoEモデルです。 このモデルは完全にオープンであり、オープンウェイト、データセット、レシピを備えているため、開発者は最大限のプライバシーとセキュリティのために、モデルを簡単にカスタマイズ、最適化、および自社インフラストラクチャにデプロイできます。

プロバイダー:nvidia logonvidia
価格:FastMetal未提供
コンテキスト:262K tokens

GPT-5.2

openai/gpt-5.2

GPT-5.2は、GPT-5シリーズの最新フロンティアグレードモデルであり、GPT-5.1と比較して、より強力なエージェント機能と長いコンテキスト性能を提供します。適応的推論を使用して計算を動的に配分し、単純なクエリには迅速に応答しながら、複雑なタスクにはより深い処理を費やします。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens
テキスト総合
#88

GPT-5.2 Chat

openai/gpt-5.2-chat

GPT-5.2 Chat(別名「Instant」)は5.2ファミリーの高速で軽量なメンバーで、低レイテンシーのチャットに最適化されながら、強力な汎用知能を保持しています。適応的推論を使用して、より難しいクエリに対して選択的に「思考」し、数学、コーディング、および多段階タスクの精度を向上させます。通常の会話を遅くすることはありません。このモデルはデフォルトではより温かみがあり、会話的で、指示に従う能力が向上し、短形式の推論がより安定しています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens

GPT-5.2 Pro

openai/gpt-5.2-pro

GPT-5.2 ProはOpenAIの最も高度なモデルであり、GPT-5 Proと比べてエージェントコーディングと長いコンテキストのパフォーマンスに大幅な改善をもたらします。段階的な推論、指示の遵守、および高リスクのユースケースにおける精度を必要とする複雑なタスクに最適化されています。テスト時ルーティング機能と高度なプロンプト理解をサポートしており、「これについて深く考えて」のようなユーザー指定の意図を含みます。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

Devstral 2 2512

mistralai/devstral-2512

Devstral 2はMistral AIによる最先端のオープンソースモデルで、エージェント型コーディングに特化しています。123Bパラメータの密集型トランスフォーマーモデルで、256Kのコンテキストウィンドウをサポートしています。 Devstral 2は、コードベースの探索と複数ファイル間での変更の調整をサポートしており、アーキテクチャレベルのコンテキストを維持します。フレームワークの依存関係を追跡し、障害を検出し、修正を加えて再試行します。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:262K tokens

DeepSeek V3.1 Nex N1

nex-agi/deepseek-v3.1-nex-n1

DeepSeek V3.1 Nex-N1は、Nex-N1シリーズのフラッグシップリリースであり、エージェント自律性、ツール使用、および実世界の生産性を強調するために設計されたポスト学習モデルです。 Nex-N1は、すべての評価シナリオにおいて競争力のあるパフォーマンスを示し、特に実践的なコーディングとHTML生成タスクで強力な結果を示しています。

プロバイダー:nex-agi
価格:FastMetal未提供
コンテキスト:131K tokens

GLM 4.6V

z-ai/glm-4.6v

GLM-4.6Vは、画像、ドキュメント、混合メディア全体にわたって高忠実度の視覚理解と長文脈推論のために設計された大規模マルチモーダルモデルです。最大128Kトークンをサポートし、複雑なページレイアウトとチャートを視覚入力として直接処理し、知覚とダウンストリームツール実行を接続するネイティブマルチモーダル関数呼び出しを統合しています。

プロバイダー:z-ai logoz-ai
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#174

GPT-5.1-Codex-Max

openai/gpt-5.1-codex-max

GPT-5.1-Codex-Maxは、長時間実行される高コンテキストのソフトウェア開発タスク向けに設計されたOpenAIの最新エージェント型コーディングモデルです。更新された5.1推論スタックのバージョンに基づいており、ソフトウェアエンジニアリング、数学、研究にまたがるエージェント型ワークフローで訓練されています。 GPT-5.1-Codex-Maxは、開発ライフサイクル全体において、より高速なパフォーマンス、改善された推論、およびより高いトークン効率を提供します。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

Nova 2 Lite

amazon/nova-2-lite-v1

Nova 2 Liteは、テキスト、画像、動画を処理してテキストを生成できる、日常的なワークロード向けの高速で費用対効果の高い推論モデルです。 Nova 2 Liteは、ドキュメント処理、動画からの情報抽出、コード生成、正確な根拠に基づいた回答の提供、および多段階のエージェントワークフローの自動化において、優れた機能を実証しています。

プロバイダー:amazon logoamazon
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#222

DeepSeek V3.2

deepseek/deepseek-v3.2

DeepSeek-V3.2は、高い計算効率と強力な推論およびエージェント的ツール使用性能を調和させるように設計された大規模言語モデルです。DeepSeek Sparse Attention(DSA)という細粒度のスパース注意メカニズムを導入しており、長文脈シナリオにおいて品質を保ちながら訓練と推論のコストを削減します。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#108

DeepSeek V3.2 Speciale

deepseek/deepseek-v3.2-speciale

DeepSeek-V3.2-Specialeは、最大限の推論と自律型エージェント性能に最適化されたDeepSeek-V3.2の高計算量バリアントです。効率的な長文脈処理のためのDeepSeek Sparse Attention(DSA)に基づいており、その後、ポストトレーニング強化学習をスケーリングして、ベースモデルを超える能力を実現します。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens

Mistral Large 3 2512

mistralai/mistral-large-2512

Mistral Large 3 2512はMistralの最も高性能なモデルであり、41Bのアクティブパラメータ(合計675B)を備えたスパース混合専門家アーキテクチャを特徴とし、Apache 2.0ライセンスの下でリリースされています。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:262K tokens

INTELLECT-3

prime-intellect/intellect-3

INTELLECT-3は、GLM-4.5-Air-Baseから教師あり微調整(SFT)と大規模強化学習(RL)を用いてポスト学習された106Bパラメータの混合専門家モデル(12B活性)です。数学、コード、科学、一般的な推論において、そのサイズに対して最先端のパフォーマンスを提供し、多くのより大規模なフロンティアモデルを一貫して上回っています。

プロバイダー:prime-intellect
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#195

Claude Opus 4.5

anthropic/claude-opus-4.5

Claude Opus 4.5はAnthropicのフロンティア推論モデルで、複雑なソフトウェアエンジニアリング、エージェントワークフロー、長期的なコンピュータ使用に最適化されています。強力なマルチモーダル機能、実世界のコーディングと推論ベンチマークにおける競争力のあるパフォーマンス、プロンプトインジェクションに対する改善された堅牢性を提供します。

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:200K tokens
テキスト総合
#40

Olmo 3 32B Think

allenai/olmo-3-32b-think

Olmo 3 32B Thinkは、深い推論、複雑なロジックチェーン、高度な指示追従シナリオのために特別に設計された大規模な320億パラメータモデルです。その容量により、要求の厳しい評価タスクと非常にニュアンスのある会話推論で強力なパフォーマンスを実現します。

プロバイダー:allenai
価格:FastMetal未提供
コンテキスト:66K tokens
テキスト総合
#263

Nano Banana Pro (Gemini 3 Pro Image Preview)

google/gemini-3-pro-image-preview

Nano Banana Proは、Gemini 3 Proをベースに構築されたGoogleの最も高度な画像生成・編集モデルです。元のNano Bananaを大幅に改善し、マルチモーダル推論、現実世界への接地、高忠実度の視覚合成を実現しています。このモデルは、インフォグラフィックスや図表からシネマティックコンポジットまで、文脈に富んだグラフィックスを生成でき、検索グラウンディングを通じてリアルタイム情報を組み込むことができます。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:66K tokens

Grok 4.1 Fast

x-ai/grok-4.1-fast

Grok 4.1 FastはxAIの最高のエージェント型ツール呼び出しモデルで、カスタマーサポートや深い調査などの実世界のユースケースで優れています。2Mコンテキストウィンドウ。 推論はAPIの`reasoning` `enabled`パラメータを使用して有効/無効にできます。

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:2.0M tokens

Gemini 3 Pro Preview

google/gemini-3-pro-preview

Gemini 3 Proはテキスト、画像、動画、音声、コードにわたる強力なパフォーマンスと100万トークンのコンテキストウィンドウを備えたGoogleのフラッグシップフロンティアモデルで、高精度のマルチモーダル推論に対応しています。マルチターンツール呼び出しを使用する場合、推論の詳細を保持する必要があります。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens

GPT-5.1

openai/gpt-5.1

GPT-5.1はGPT-5シリーズの最新フロンティアグレードモデルであり、GPT-5と比べてより強力な汎用推論、改善された指示遵守、より自然な会話スタイルを提供します。適応的推論を使用して計算を動的に配分し、単純なクエリには迅速に対応しながら、複雑なタスクにはより深い思考を費やします。このモデルは、技術的または複数ステップの問題であっても理解しやすいように、より明確で根拠のある説明を生成し、専門用語を削減しています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens
テキスト総合
#84

GPT-5.1 Chat

openai/gpt-5.1-chat

GPT-5.1 Chat(別名Instant)は、5.1ファミリーの高速で軽量なメンバーであり、低遅延チャットに最適化されながら、強力な汎用知能を保持しています。適応的推論を使用して、より難しいクエリに対して選択的に「思考」し、数学、コーディング、および多段階タスクの精度を向上させます。通常の会話を遅くすることはありません。このモデルはデフォルトではより温かみがあり、より会話的であり、命令追従性が向上し、短形式推論がより安定しています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens

GPT-5.1-Codex

openai/gpt-5.1-codex

GPT-5.1-Codexはソフトウェアエンジニアリングとコーディングワークフロー向けに最適化されたGPT-5.1の特殊版です。インタラクティブな開発セッションと複雑なエンジニアリングタスクの長時間にわたる独立実行の両方に対応するよう設計されています。このモデルは、プロジェクトのゼロからの構築、機能開発、デバッグ、大規模なリファクタリング、およびコードレビューをサポートしています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

GPT-5.1-Codex-Mini

openai/gpt-5.1-codex-mini

GPT-5.1-Codex-Miniは、GPT-5.1-Codexのより小さく高速なバージョンです。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

KAT-Coder-Pro V1

kwaipilot/kat-coder-pro

KAT-Coder-Pro V1は、KwaiKATの最も高度なエージェント型コーディングモデルであり、KAT-Coderシリーズの一部です。エージェント型コーディングタスク専用に設計されており、SWE-Bench Verifiedベンチマークで73.4%の解決率を達成し、実世界のソフトウェアエンジニアリングシナリオで優れた性能を発揮します。

プロバイダー:kwaipilot
価格:FastMetal未提供
コンテキスト:256K tokens

Kimi K2 Thinking

moonshotai/kimi-k2-thinking

Kimi K2 Thinkingは、Moonshot AIの最も高度なオープンリーズニングモデルであり、K2シリーズをエージェント的で長期的なリーズニングへと拡張しています。Kimi K2で導入された兆規模のMixture-of-Experts(MoE)アーキテクチャに基づいており、フォワードパスごとに320億パラメータを活性化し、256kトークンのコンテキストウィンドウをサポートしています。

プロバイダー:moonshotai logomoonshotai
価格:FastMetal未提供
コンテキスト:131K tokens

MiniMax M2

minimax/minimax-m2

MiniMax-M2は、エンドツーエンドのコーディングとエージェントワークフロー向けに最適化されたコンパクトで高効率な大規模言語モデルです。100億の活性化パラメータ(総2,300億)を備えており、一般的な推論、ツール使用、マルチステップタスク実行全体で最先端に近いインテリジェンスを提供しながら、低レイテンシーと展開効率を維持しています。

プロバイダー:minimax logominimax
価格:FastMetal未提供
コンテキスト:197K tokens
テキスト総合
#212

Claude Haiku 4.5

anthropic/claude-haiku-4.5

Claude Haiku 4.5はAnthropicの最速かつ最も効率的なモデルであり、より大規模なClaudeモデルのコストとレイテンシーのほんの一部で、ほぼ最先端のインテリジェンスを提供します。Claude Sonnet 4の推論、コーディング、コンピュータ使用タスク全般のパフォーマンスに匹敵し、Haiku 4.5はリアルタイムおよび大量処理アプリケーションに最先端の機能をもたらします。

プロバイダー:anthropic logoanthropic
価格:入力 ¥184.8 · 出力 ¥924 / 100万トークン
コンテキスト:200K tokens
テキスト総合
#131

Llama 3.3 Nemotron Super 49B V1.5

nvidia/llama-3.3-nemotron-super-49b-v1.5

Llama-3.3-Nemotron-Super-49Bv1.5は、Meta のLlama-3.3-70B-Instructから派生した49Bパラメータの英語中心の推論/チャットモデルで、128Kのコンテキストウィンドウを備えています。数学、コード、科学、マルチターンチャットにわたるSFTを通じてエージェントワークフロー(RAG、ツール呼び出し)用に後学習され、その後複数のRL段階が続きます。

プロバイダー:nvidia logonvidia
価格:FastMetal未提供
コンテキスト:131K tokens

Nano Banana (Gemini 2.5 Flash Image)

google/gemini-2.5-flash-image

Gemini 2.5 Flash Image(別名「Nano Banana」)が一般公開されました。これは文脈理解を備えた最先端の画像生成モデルです。画像生成、編集、マルチターン会話に対応しています。アスペクト比は[image_config APIパラメータ](https://openrouter.ai/docs/features/multimodal/image-generation#image-aspect-ratio-configuration)で制御できます。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:33K tokens

GLM 4.6

z-ai/glm-4.6

GLM-4.5と比較して、今世代は以下のような重要な改善をもたらします: より長いコンテキストウィンドウ:コンテキストウィンドウが128Kから200Kトークンに拡張され、より複雑なエージェントタスクを処理できるようになりました。 優れたコーディング性能:コードベンチマークでより高いスコアを達成し、Claude Code、Cline、Roo Code、Kilo Codeなどのアプリケーションでより優れた実世界のパフォーマンスを実証しており、視覚的に洗練されたフロントエンドページ…

プロバイダー:z-ai logoz-ai
価格:FastMetal未提供
コンテキスト:203K tokens
テキスト総合
#110

GLM 4.6 (exacto)

z-ai/glm-4.6:exacto

GLM-4.5と比較して、今世代は以下のような重要な改善をもたらします: より長いコンテキストウィンドウ:コンテキストウィンドウが128Kから200Kトークンに拡張され、モデルがより複雑なエージェントタスクを処理できるようになりました。 優れたコーディング性能:コードベンチマークでより高いスコアを達成し、Claude Code、Cline、Roo Code、Kilo Codeなどのアプリケーションでより優れた実世界のパフォーマンスを実証しており、視覚的に洗練されたフロントエン…

プロバイダー:z-ai logoz-ai
価格:FastMetal未提供
コンテキスト:205K tokens

Claude Sonnet 4.5

anthropic/claude-sonnet-4.5

Claude Sonnet 4.5はAnthropicの最新かつ最も高度なSonnetモデルであり、実世界のエージェントとコーディングワークフロー向けに最適化されています。SWE-bench Verifiedなどのコーディングベンチマークで最先端のパフォーマンスを実現し、システム設計、コードセキュリティ、仕様準拠の面で改善されています。このモデルは拡張された自律操作向けに設計されており、セッション間でタスク継続性を維持し、事実ベースの進捗追跡を提供します。

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#62

DeepSeek V3.2 Exp

deepseek/deepseek-v3.2-exp

DeepSeek-V3.2-Expは、DeepSeekがV3.1と将来のアーキテクチャの中間段階として公開した実験的な大規模言語モデルです。DeepSeek Sparse Attention(DSA)を導入しており、これは長文脈シナリオにおけるトレーニングと推論の効率を改善しながら出力品質を維持するために設計された細粒度のスパースアテンションメカニズムです。ユーザーは`reasoning`の`enabled`ブール値を使用して推論動作を制御できます。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#114

Gemini 2.5 Flash Lite Preview 09-2025

google/gemini-2.5-flash-lite-preview-09-2025

Gemini 2.5 Flash-Liteは、Gemini 2.5ファミリーの軽量推論モデルで、超低レイテンシーとコスト効率に最適化されています。以前のFlashモデルと比較して、スループットの向上、トークン生成の高速化、一般的なベンチマーク全体でのパフォーマンス向上を実現しています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens

Qwen3 Max

qwen/qwen3-max

Qwen3-Maxは、Qwen3シリーズに基づいて構築された更新版リリースで、2025年1月版と比較して、推論、指示の遵守、多言語サポート、および長尾知識カバレッジにおいて大幅な改善を提供しています。数学、コーディング、論理、および科学タスクにおいてより高い精度を実現し、中国語と英語の複雑な指示をより確実に遵守し、幻覚を減らし、オープンエンドのQ&A、執筆、および会話に対してより高品質の応答を生成します。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens

Qwen3 VL 235B A22B Instruct

qwen/qwen3-vl-235b-a22b-instruct

Qwen3-VL-235B-A22B Instructは、画像とビデオ全体にわたって強力なテキスト生成と視覚理解を統合するオープンウェイトのマルチモーダルモデルです。Instructモデルは、一般的なビジョン言語用途(VQA、ドキュメント解析、チャート/テーブル抽出、多言語OCR)を対象としています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#128

Qwen3 VL 235B A22B Thinking

qwen/qwen3-vl-235b-a22b-thinking

Qwen3-VL-235B-A22Bシンキングは、テキスト生成と画像およびビデオ全体にわたる視覚理解を統合したマルチモーダルモデルです。シンキングモデルはSTEMと数学におけるマルチモーダル推論に最適化されています。このシリーズは、堅牢な知覚(多様な実世界および合成カテゴリーの認識)、空間理解(2D/3D接地)、および長形式の視覚的理解を強調しており、知覚と推論の両方に関する公開マルチモーダルベンチマークで競争力のある結果を達成しています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#154

DeepSeek V3.1 Terminus

deepseek/deepseek-v3.1-terminus

DeepSeek-V3.1 Terminusは、[DeepSeek V3.1](/deepseek/deepseek-chat-v3.1)のアップデートで、モデルの元の機能を維持しながら、言語の一貫性とエージェント機能を含むユーザーから報告された問題に対処し、コーディングおよび検索エージェントにおけるモデルのパフォーマンスをさらに最適化しています。671Bパラメータ(37Bアクティブ)の大規模ハイブリッド推論モデルで、思考モードと非思考モードの両方をサポートしています。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#126

DeepSeek V3.1 Terminus (exacto)

deepseek/deepseek-v3.1-terminus:exacto

DeepSeek-V3.1 Terminusは、[DeepSeek V3.1](/deepseek/deepseek-chat-v3.1)のアップデートで、モデルの元の機能を維持しながら、言語の一貫性とエージェント機能を含むユーザーから報告された問題に対処し、コーディングおよび検索エージェントにおけるモデルのパフォーマンスをさらに最適化しています。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens

Grok 4 Fast

x-ai/grok-4-fast

Grok 4 FastはxAIの最新マルチモーダルモデルで、最先端のコスト効率性と200万トークンのコンテキストウィンドウを備えています。推論なしと推論ありの2つのバージョンがあります。モデルの詳細については、xAIの[ニュース記事](http://x.ai/news/grok-4-fast)をご覧ください。 推論はAPIの`reasoning` `enabled`パラメータを使用して有効/無効にできます。

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:2.0M tokens

Qwen3 Next 80B A3B Instruct

qwen/qwen3-next-80b-a3b-instruct

Qwen3-Next-80B-A3B-Instructは、Qwen3-Nextシリーズの指示チューニング済みチャットモデルで、「思考」トレースなしの高速で安定した応答に最適化されています。推論、コード生成、知識QA、多言語使用など複雑なタスクに対応しながら、アライメントとフォーマットの堅牢性を維持します。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#148

Qwen3 Next 80B A3B Instruct (free)

qwen/qwen3-next-80b-a3b-instruct:free

Qwen3-Next-80B-A3B-Instructは、Qwen3-Nextシリーズの指示調整チャットモデルで、「思考」の痕跡なく高速で安定した応答を実現するよう最適化されています。推論、コード生成、知識QA、多言語使用など複雑なタスクを対象としており、アライメントとフォーマットの堅牢性を保ちながら機能します。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens

Qwen3 Next 80B A3B Thinking

qwen/qwen3-next-80b-a3b-thinking

Qwen3-Next-80B-A3B-Thinkingは、Qwen3-Nextラインの推論優先チャットモデルであり、デフォルトで構造化された「思考」トレースを出力します。複雑な多段階問題、数学的証明、コード合成/デバッグ、論理、およびエージェント計画に設計されており、知識、推論、コーディング、アライメント、および多言語評価全体で強い結果を報告しています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#183

LongCat Flash Chat

meituan/longcat-flash-chat

LongCat-Flash-Chatは、総パラメータ数560Bの大規模Mixture-of-Experts(MoE)モデルであり、入力ごとに18.6B~31.3B(平均約27B)のパラメータが動的に活性化されます。通信オーバーヘッドを削減し、ハイパーパラメータ転送、決定論的計算、多段階最適化などの高度なスケーリング戦略を通じて訓練の安定性を維持しながら、高いスループットを実現するショートカット接続MoE設計を導入しています。

プロバイダー:meituan
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#145

Kimi K2 0905

moonshotai/kimi-k2-0905

Kimi K2 0905は[Kimi K2 0711](moonshotai/kimi-k2)の9月アップデートです。Moonshot AIが開発した大規模なMixture-of-Experts(MoE)言語モデルで、総パラメータ数1兆、フォワードパスあたりのアクティブパラメータ数320億を特徴としています。前回の128kから拡張された256kトークンまでの長文脈推論に対応しています。

プロバイダー:moonshotai logomoonshotai
価格:FastMetal未提供
コンテキスト:131K tokens

Qwen3 30B A3B Thinking 2507

qwen/qwen3-30b-a3b-thinking-2507

Qwen3-30B-A3B-Thinking-2507は、複雑なタスクに対応するために拡張された多段階思考を必要とする30Bパラメータの混合専門家推論モデルです。このモデルは「思考モード」に特化して設計されており、内部推論トレースと最終的な回答が分離されています。 以前のQwen3-30Bリリースと比較して、このバージョンは論理推論、数学、科学、コーディング、および多言語ベンチマーク全体でパフォーマンスが向上しています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:33K tokens

Grok Code Fast 1

x-ai/grok-code-fast-1

Grok Code Fast 1は、エージェント型コーディングに優れた高速で経済的な推論モデルです。レスポンスに推論トレースが表示されるため、開発者はGrok Codeを高品質なワークフローに導くことができます。

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:256K tokens

DeepSeek V3.1

deepseek/deepseek-chat-v3.1

DeepSeek-V3.1は、プロンプトテンプレートを介して思考モードと非思考モードの両方をサポートする大規模ハイブリッド推論モデル(6710億パラメータ、370億アクティブ)です。DeepSeek-V3ベースを拡張し、2段階の長文脈トレーニングプロセスで最大128Kトークンに対応し、効率的な推論のためにFP8マイクロスケーリングを使用しています。ユーザーは`reasoning` `enabled`ブール値を使用して推論動作を制御できます。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:33K tokens
テキスト総合
#121

Mistral Medium 3.1

mistralai/mistral-medium-3.1

Mistral Medium 3.1は、Mistral Medium 3の更新版であり、大幅に削減された運用コストで最先端レベルの機能を提供するように設計された高性能なエンタープライズグレードの言語モデルです。最先端の推論とマルチモーダルパフォーマンスを、従来の大規模モデルと比べて8倍低いコストでバランスさせており、プロフェッショナルおよび産業用途全体でのスケーラブルなデプロイメントに適しています。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:131K tokens

GLM 4.5V

z-ai/glm-4.5v

GLM-4.5Vは、マルチモーダルエージェントアプリケーション向けのビジョン言語基盤モデルです。106Bパラメータと12Bの活性化パラメータを備えたMixture-of-Experts(MoE)アーキテクチャに基づいており、ビデオ理解、画像Q&A、OCR、ドキュメント解析で最先端の結果を達成し、フロントエンドウェブコーディング、グラウンディング、空間推論で大幅な改善を実現しています。

プロバイダー:z-ai logoz-ai
価格:FastMetal未提供
コンテキスト:66K tokens
テキスト総合
#199

GPT-5

openai/gpt-5

GPT-5はOpenAIの最も高度なモデルであり、推論、コード品質、ユーザー体験における大幅な改善を提供しています。複雑なタスク、段階的な推論、指示の遵守、および高リスク使用例における精度が必要なタスクに最適化されています。テスト時ルーティング機能と高度なプロンプト理解をサポートしており、「これについて深く考えてほしい」といったユーザーが指定した意図を含みます。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

GPT-5 Chat

openai/gpt-5-chat

GPT-5 Chatは、エンタープライズアプリケーション向けの高度で自然、マルチモーダル、コンテキスト認識型の会話用に設計されています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#104

GPT-5 Mini

openai/gpt-5-mini

GPT-5 Miniは、GPT-5のコンパクト版で、軽量の推論タスクを処理するように設計されています。GPT-5と同じ指示追従と安全性チューニングの利点を提供しますが、レイテンシーとコストが削減されています。GPT-5 MiniはOpenAIのo4-miniモデルの後継です。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

GPT-5 Nano

openai/gpt-5-nano

GPT-5-Nanoは、GPT-5システムにおける最小かつ最速のバリアントであり、開発者ツール、迅速なインタラクション、および超低遅延環境向けに最適化されています。より大規模な同等製品と比べて推論の深さは限定的ですが、主要な指示追従機能とセーフティ機能を保持しています。GPT-4.1-nanoの後継製品であり、コスト効率的またはリアルタイムアプリケーション向けの軽量オプションを提供します。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:400K tokens

Claude Opus 4.1

anthropic/claude-opus-4.1

Claude Opus 4.1は、Anthropicのフラッグシップモデルの更新版で、コーディング、推論、エージェントタスクにおけるパフォーマンスが向上しています。SWE-bench Verifiedで74.5%を達成し、マルチファイルコードリファクタリング、デバッグ精度、詳細指向の推論において顕著な改善を示しています。このモデルは最大64Kトークンまでの拡張思考をサポートし、研究、データ分析、ツール支援推論を含むタスクに最適化されています。

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:200K tokens
テキスト総合
#73

gpt-oss-120b

openai/gpt-oss-120b

gpt-oss-120bは、OpenAIが開発した、高度な推論、エージェント機能、および汎用本番用途向けに設計された、オープンウェイト117Bパラメータの混合エキスパート(MoE)言語モデルです。フォワードパスごとに5.1Bパラメータをアクティベートし、ネイティブMXFP4量子化により単一のH100 GPUで実行するよう最適化されています。

プロバイダー:openai logoopenai
価格:入力 ¥16 · 出力 ¥79 / 100万トークン
コンテキスト:131K tokens
テキスト総合
#200

gpt-oss-120b (exacto)

openai/gpt-oss-120b:exacto

gpt-oss-120bはOpenAIの開放重み付け、117Bパラメータの混合専門家(MoE)言語モデルで、高度な推論、エージェント的、および汎用本番用途向けに設計されています。フォワードパスごとに5.1Bパラメータをアクティベートし、ネイティブMXFP4量子化を備えた単一H100 GPUで実行するよう最適化されています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:131K tokens

gpt-oss-120b (free)

openai/gpt-oss-120b:free

gpt-oss-120bはOpenAIが開発したオープンウェイト、117Bパラメータの混合専門家(MoE)言語モデルで、高度な推論、エージェント的、および汎用的な本番用途向けに設計されています。フォワードパスあたり5.1Bパラメータをアクティベートし、ネイティブMXFP4量子化を備えた単一H100 GPUで実行するように最適化されています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:131K tokens

gpt-oss-20b

openai/gpt-oss-20b

gpt-oss-20bはOpenAIがApache 2.0ライセンスの下でリリースしたオープンウェイト21Bパラメータモデルです。Mixture-of-Experts(MoE)アーキテクチャを採用しており、フォワードパスあたり3.6B個のアクティブパラメータを備えており、低レイテンシ推論とコンシューマーまたは単一GPU ハードウェアへのデプロイメント向けに最適化されています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#251

gpt-oss-20b (free)

openai/gpt-oss-20b:free

gpt-oss-20bはOpenAIがApache 2.0ライセンスの下でリリースしたオープンウェイトの21Bパラメータモデルです。Mixture-of-Experts(MoE)アーキテクチャを採用しており、フォワードパスあたり3.6B個のアクティブパラメータを持ち、低レイテンシ推論とコンシューマーまたは単一GPU ハードウェアへのデプロイメント向けに最適化されています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:131K tokens

Qwen3 Coder 30B A3B Instruct

qwen/qwen3-coder-30b-a3b-instruct

Qwen3-Coder-30B-A3B-Instructは、30.5Bパラメータの混合エキスパート(MoE)モデルで、128個のエキスパート(フォワードパスごとに8個がアクティブ)を備えており、高度なコード生成、リポジトリ規模の理解、エージェント的なツール使用のために設計されています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:160K tokens

Qwen3 30B A3B Instruct 2507

qwen/qwen3-30b-a3b-instruct-2507

Qwen3-30B-A3B-Instruct-2507は、Qwenの30.5Bパラメータの混合専門家言語モデルで、推論ごとに3.3Bのアクティブパラメータを備えています。非思考モードで動作し、高品質な指示追従、多言語理解、エージェント的ツール使用のために設計されています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#171

GLM 4.5

z-ai/glm-4.5

GLM-4.5は、エージェントベースのアプリケーション向けに特別に設計された最新のフラッグシップ基盤モデルです。Mixture-of-Experts(MoE)アーキテクチャを活用し、最大128kトークンのコンテキスト長をサポートしています。GLM-4.5は、推論、コード生成、エージェント整合性において大幅に強化された機能を提供します。

プロバイダー:z-ai logoz-ai
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#134

GLM 4.5 Air

z-ai/glm-4.5-air

GLM-4.5-Airは、最新フラグシップモデルファミリーの軽量バリアントであり、エージェント中心のアプリケーション向けに特別に設計されています。GLM-4.5と同様に、Mixture-of-Experts(MoE)アーキテクチャを採用していますが、より小さなパラメータサイズです。GLM-4.5-Airはハイブリッド推論モードもサポートしており、高度な推論とツール使用のための「思考モード」と、リアルタイム相互作用のための「非思考モード」を提供します。

プロバイダー:z-ai logoz-ai
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#180

GLM 4.5 Air (free)

z-ai/glm-4.5-air:free

GLM-4.5-Airは、最新のフラグシップモデルファミリーの軽量バリアントであり、エージェント中心のアプリケーション向けに特別に設計されています。GLM-4.5と同様に、Mixture-of-Experts(MoE)アーキテクチャを採用していますが、より小さなパラメータサイズになっています。GLM-4.5-Airは、ハイブリッド推論モードもサポートしており、高度な推論とツール使用のための「思考モード」と、リアルタイムインタラクション用の「非思考モード」を提供しています。

プロバイダー:z-ai logoz-ai
価格:FastMetal未提供
コンテキスト:131K tokens

Qwen3 235B A22B Thinking 2507

qwen/qwen3-235b-a22b-thinking-2507

Qwen3-235B-A22B-Thinking-2507は、複雑な推論タスクに最適化された高性能なオープンウェイト混合エキスパート(MoE)言語モデルです。フォワードパスごとに235Bパラメータのうち22Bをアクティベートし、最大262,144トークンのコンテキストをネイティブにサポートしています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#147

Qwen3 Coder 480B A35B

qwen/qwen3-coder

Qwen3-Coder-480B-A35B-Instructは、Qwenチームによって開発されたMixture-of-Experts(MoE)コード生成モデルです。関数呼び出し、ツール使用、リポジトリ上の長文脈推論などのエージェント的コーディングタスクに最適化されています。このモデルは総480億パラメータを備えており、フォワードパスあたり35億パラメータがアクティブです(160個のエキスパートのうち8個)。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens

Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite

Gemini 2.5 Flash-Liteは、Gemini 2.5ファミリーの軽量推論モデルで、超低レイテンシーとコスト効率に最適化されています。以前のFlashモデルと比較して、スループットの向上、トークン生成の高速化、一般的なベンチマーク全体でのパフォーマンス向上を実現しています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens

Qwen3 235B A22B Instruct 2507

qwen/qwen3-235b-a22b-2507

Qwen3-235B-A22B-Instruct-2507は、Qwen3-235Bアーキテクチャに基づいた多言語対応の命令チューニング済みMoE言語モデルで、フォワードパスあたり22Bのアクティブパラメータを備えています。汎用テキスト生成、命令追従、論理推論、数学、コード、ツール使用に最適化されています。このモデルはネイティブ262Kのコンテキスト長をサポートしており、「思考モード」(<think>ブロック)を実装していません。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens
テキスト総合
#112

Kimi K2 0711

moonshotai/kimi-k2

Kimi K2 Instruct は、Moonshot AI によって開発された大規模なMixture-of-Experts(MoE)言語モデルであり、総パラメータ数1兆個、フォワードパスあたり320億個のアクティブパラメータを備えています。エージェント機能に最適化されており、高度なツール使用、推論、コード合成を含みます。

プロバイダー:moonshotai logomoonshotai
価格:FastMetal未提供
コンテキスト:131K tokens

Devstral Medium

mistralai/devstral-medium

Devstral Mediumは、Mistral AIとAll Hands AIが共同開発した高性能なコード生成およびエージェント推論モデルです。Devstral Smallの上位版として位置付けられており、SWE-Bench Verifiedで61.6%を達成し、コード関連タスクではGemini 2.5 ProおよびGPT-4.1を上回りながら、大幅に低いコストで利用できます。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:131K tokens

Grok 4

x-ai/grok-4

Grok 4はxAIの最新の推論モデルで、256kのコンテキストウィンドウを備えています。並列ツール呼び出し、構造化出力、画像とテキスト入力の両方をサポートしています。推論は公開されておらず、推論を無効にすることはできず、推論の努力を指定することはできないことに注意してください。特定のリクエストの総トークン数が128kトークンを超えると、価格が上昇します。

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:256K tokens

DeepSeek R1T2 Chimera

tngtech/deepseek-r1t2-chimera

DeepSeek-TNG-R1T2-Chimera は TNG Tech による第2世代の Chimera モデルです。DeepSeek-AI の R1-0528、R1、V3-0324 チェックポイントから Assembly-of-Experts マージで組み立てられた 671 B パラメータの混合専門家テキスト生成モデルです。

プロバイダー:tngtech
価格:FastMetal未提供
コンテキスト:164K tokens

Mercury

inception/mercury

Mercuryは最初の拡散大規模言語モデル(dLLM)です。革新的な離散拡散アプローチを適用することで、このモデルはGPT-4.1 NanoやClaude 3.5 Haikuなどの速度最適化モデルよりも5~10倍高速に実行されながら、同等のパフォーマンスを実現します。Mercuryの速度により、開発者はボイスエージェント、検索インターフェース、チャットボットなど、レスポンシブなユーザー体験を提供できます。

プロバイダー:inception
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#261

Gemini 2.5 Flash

google/gemini-2.5-flash

Gemini 2.5 Flashは、Google最先端の汎用モデルであり、高度な推論、コーディング、数学、科学的タスク向けに特別に設計されています。組み込みの「思考」機能を備えており、より高い精度とニュアンスに富んだコンテキスト処理を備えた応答を提供することができます。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#136

Gemini 2.5 Pro

google/gemini-2.5-pro

Gemini 2.5 Proは、高度な推論、コーディング、数学、科学的タスク向けに設計されたGoogleの最先端AIモデルです。「思考」機能を採用しており、強化された精度とニュアンスに富んだコンテキスト処理で応答を推論することができます。Gemini 2.5 Proは、LMArenaリーダーボードでの第1位の位置付けを含む複数のベンチマークで最高レベルのパフォーマンスを達成し、優れた人間の好みへの適合性と複雑な問題解決能力を反映しています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#75

MiniMax M1

minimax/minimax-m1

MiniMax-M1は、拡張コンテキストと高効率推論のために設計された大規模なオープンウェイト推論モデルです。ハイブリッドMixture-of-Experts(MoE)アーキテクチャと、カスタム「ライトニングアテンション」メカニズムを組み合わせており、100万トークンまでの長いシーケンスを処理できると同時に、競争力のあるFLOP効率を維持しています。

プロバイダー:minimax logominimax
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#188

Grok 3

x-ai/grok-3

Grok 3はxAIの最新モデルです。エンタープライズユースケース(データ抽出、コーディング、テキスト要約など)に優れた旗艦モデルです。金融、医療、法律、科学における深い専門知識を備えています。

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:131K tokens

Grok 3 Mini

x-ai/grok-3-mini

軽量モデルで、応答する前に考えます。高速でスマート、深い専門知識を必要としない論理ベースのタスクに最適です。生の思考トレースにアクセスできます。

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:131K tokens

Gemini 2.5 Pro Preview 06-05

google/gemini-2.5-pro-preview

Gemini 2.5 Proは、高度な推論、コーディング、数学、科学的タスク向けに設計されたGoogleの最先端AIモデルです。「思考」機能を採用しており、強化された精度とニュアンスに富んだコンテキスト処理で応答を推論することができます。Gemini 2.5 Proは、LMArenaリーダーボードでの1位獲得を含む複数のベンチマークで最高水準のパフォーマンスを達成し、優れた人間の好みへの適合性と複雑な問題解決能力を反映しています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens

R1 0528

deepseek/deepseek-r1-0528

5月28日更新:[オリジナルDeepSeek R1](/deepseek/deepseek-r1)は[OpenAI o1](/openai/o1)と同等のパフォーマンスを実現していますが、オープンソース化され、推論トークンが完全に公開されています。パラメータサイズは671Bで、推論パスでは37Bがアクティブです。 完全にオープンソースのモデルです。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#115

Claude Opus 4

anthropic/claude-opus-4

Claude Opus 4は、リリース時点で世界最高のコーディングモデルとしてベンチマークされており、複雑で長時間実行されるタスクとエージェントワークフローにおいて持続的なパフォーマンスをもたらします。ソフトウェアエンジニアリングで新しいベンチマークを設定し、SWE-bench(72.5%)とTerminal-bench(43.2%)で最高の結果を達成しています。

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:200K tokens
テキスト総合
#129

Claude Sonnet 4

anthropic/claude-sonnet-4

Claude Sonnet 4は前身のSonnet 3.7の機能を大幅に強化し、コーディングと推論タスクの両方で改善された精度と制御性に優れています。SWE-bench(72.7%)で最先端のパフォーマンスを達成し、Sonnet 4は能力と計算効率のバランスを取り、日常的なコーディングタスクから複雑なソフトウェア開発プロジェクトまで、幅広いアプリケーションに適しています。

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#160

Gemma 3n 4B

google/gemma-3n-e4b-it

Gemma 3n E4B-itは、スマートフォン、ノートパソコン、タブレットなどのモバイルおよび低リソースデバイスでの効率的な実行に最適化されています。テキスト、視覚データ、オーディオを含むマルチモーダル入力をサポートしており、テキスト生成、音声認識、翻訳、画像分析などの多様なタスクを実現します。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:33K tokens
テキスト総合
#250

Gemma 3n 4B (free)

google/gemma-3n-e4b-it:free

Gemma 3n E4B-itは、スマートフォン、ノートパソコン、タブレットなどのモバイルおよび低リソースデバイスでの効率的な実行に最適化されています。テキスト、ビジュアルデータ、オーディオを含むマルチモーダル入力をサポートしており、テキスト生成、音声認識、翻訳、画像分析など、多様なタスクを実現します。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:8K tokens

Gemini 2.5 Pro Preview 05-06

google/gemini-2.5-pro-preview-05-06

Gemini 2.5 Proは、高度な推論、コーディング、数学、科学的タスク向けに設計されたGoogleの最先端AIモデルです。「思考」機能を採用しており、強化された精度とニュアンスに富んだコンテキスト処理で応答を推論することができます。Gemini 2.5 Proは、LMArenaリーダーボードでの1位獲得を含む複数のベンチマークで最高レベルのパフォーマンスを達成しており、優れた人間の好みへの適合性と複雑な問題解決能力を反映しています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens

Mistral Medium 3

mistralai/mistral-medium-3

Mistral Medium 3は、フロンティアレベルの機能を大幅に削減された運用コストで提供するように設計された、高性能なエンタープライズグレードの言語モデルです。最先端の推論とマルチモーダルパフォーマンスを従来の大規模モデルと比べて8倍低いコストで実現し、専門的および産業的なユースケース全体でのスケーラブルなデプロイメントに適しています。 このモデルはコーディング、STEM推論、エンタープライズ適応などの領域で優れています。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:131K tokens

Mercury Coder

inception/mercury-coder

Mercury Coderは初の拡散型大規模言語モデル(dLLM)です。革新的な離散拡散アプローチを適用することで、Claude 3.5 HaikuやGPT-4o Miniなどの速度最適化モデルと比べて5~10倍高速に動作しながら、同等のパフォーマンスを実現しています。Mercury Coderの高速性により、開発者はコーディング中に集中力を保ちながら、迅速なチャットベースの反復処理と応答性の高いコード補完提案を享受できます。

プロバイダー:inception
価格:FastMetal未提供
コンテキスト:128K tokens

Qwen3 235B A22B

qwen/qwen3-235b-a22b

Qwen3-235B-A22Bは、Qwenによって開発された235Bパラメータの混合専門家(MoE)モデルで、フォワードパスごとに22Bパラメータを活性化します。複雑な推論、数学、コードタスク向けの「思考」モードと、一般的な会話効率向けの「非思考」モードの間でシームレスに切り替えることができます。このモデルは、強力な推論能力、多言語対応(100以上の言語と方言)、高度な指示追従、エージェントツール呼び出し機能を実証しています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#176

Qwen3 30B A3B

qwen/qwen3-30b-a3b

Qwen3は、Qwen大規模言語モデルシリーズの最新世代であり、密集型とMixture-of-Experts(MoE)アーキテクチャの両方を備えており、推論、多言語サポート、および高度なエージェントタスクで優れています。複雑な推論のための思考モードと効率的な対話のための非思考モードをシームレスに切り替える独自の能力により、多目的で高品質なパフォーマンスを実現します。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:41K tokens
テキスト総合
#234

Qwen3 32B

qwen/qwen3-32b

Qwen3-32Bは、Qwen3シリーズの密集型32.8Bパラメータ因果言語モデルであり、複雑な推論と効率的な対話の両方に最適化されています。数学、コーディング、論理推論などのタスク用の「思考」モードと、より高速な汎用会話用の「非思考」モードをシームレスに切り替えることができます。このモデルは、指示追従、エージェントツール使用、創作文、および100以上の言語と方言にわたる多言語タスクで強力なパフォーマンスを発揮します。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:41K tokens
テキスト総合
#207

o3

openai/o3

o3は、複数の分野にわたってバランスの取れた強力なモデルです。数学、科学、コーディング、視覚推論タスクにおいて新しい基準を設定しています。また、技術文書作成と指示遵守においても優れています。テキスト、コード、画像にわたる分析を含む複数ステップの問題を考え抜くために使用してください。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:200K tokens

o4 Mini

openai/o4-mini

OpenAI o4-miniは、o-シリーズのコンパクトな推論モデルであり、高速で費用対効果の高いパフォーマンスに最適化されながら、強力なマルチモーダル機能とエージェント機能を保持しています。ツール使用をサポートし、AIME(Pythonで99.5%)やSWE-benchなどのベンチマークで競争力のある推論およびコーディングパフォーマンスを実証し、その前身であるo3-miniを上回り、いくつかの領域ではo3に近づいています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:200K tokens

GPT-4.1

openai/gpt-4.1

GPT-4.1は、高度な指示追従、実世界のソフトウェアエンジニアリング、長文脈推論に最適化されたフラッグシップ大規模言語モデルです。100万トークンのコンテキストウィンドウに対応し、コーディング(SWE-bench Verified 54.6%)、指示準拠(IFEval 87.4%)、マルチモーダル理解ベンチマークにおいてGPT-4oおよびGPT-4.5を上回ります。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:1.0M tokens

GPT-4.1 Mini

openai/gpt-4.1-mini

GPT-4.1 Miniは、GPT-4oと同等のパフォーマンスを大幅に低いレイテンシーとコストで実現する中規模モデルです。100万トークンのコンテキストウィンドウを保持し、難易度の高い指示評価で45.1%、MultiChallengeで35.8%、IFEvalで84.1%のスコアを獲得しています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:1.0M tokens

GPT-4.1 Nano

openai/gpt-4.1-nano

低レイテンシーが必要なタスクでは、GPT-4.1 nanoはGPT-4.1シリーズの中で最も高速で最も安価なモデルです。100万トークンのコンテキストウィンドウを備えた小規模なサイズで優れたパフォーマンスを提供し、MMLUで80.1%、GPQAで50.3%、Aiderポリグロットコーディングで9.8%のスコアを獲得しており、GPT-4o miniよりも高い結果となっています。分類や自動補完などのタスクに最適です。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:1.0M tokens

Grok 3 Mini Beta

x-ai/grok-3-mini-beta

Grok 3 Miniは軽量で小型の思考モデルです。従来のモデルが即座に回答を生成するのとは異なり、Grok 3 Miniは応答する前に考えます。推論が必要で広範なドメイン知識を必要としないタスクに最適であり、数学固有の定量的なユースケース(難しいパズルや数学問題の解決など)で優れています。 透明な「思考」トレースにアクセス可能です。デフォルトでは低い推論に設定されており、`reasoning: { effort: "high" }`設定でブーストできます。

プロバイダー:x-ai logox-ai
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#193

Llama 3.1 Nemotron Ultra 253B v1

nvidia/llama-3.1-nemotron-ultra-253b-v1

Llama-3.1-Nemotron-Ultra-253B-v1は、高度な推論、人間とのインタラクティブなチャット、検索拡張生成(RAG)、およびツール呼び出しタスクに最適化された大規模言語モデル(LLM)です。Meta のLlama-3.1-405B-Instruct から派生しており、ニューラルアーキテクチャサーチ(NAS)を使用して大幅にカスタマイズされており、効率の向上、メモリ使用量の削減、推論レイテンシの改善が実現されています。

プロバイダー:nvidia logonvidia
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#206

Llama 4 Maverick

meta-llama/llama-4-maverick

Llama 4 Maverick 17B Instruct (128E)はMetaの高容量マルチモーダル言語モデルで、128個のエキスパートと1フォワードパスあたり170億個のアクティブパラメータ(合計400B)を備えた混合エキスパート(MoE)アーキテクチャに基づいて構築されています。多言語テキストと画像入力をサポートし、12の対応言語にわたって多言語テキストとコード出力を生成します。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:1.0M tokens

Llama 4 Scout

meta-llama/llama-4-scout

Llama 4 Scout 17B Instruct (16E)はMetaによって開発されたMixture-of-Experts (MoE)言語モデルで、合計109Bのうち170億パラメータをアクティベートします。テキストと画像のネイティブマルチモーダル入力と、12の対応言語にわたるマルチリンガル出力(テキストとコード)をサポートしています。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:328K tokens

DeepSeek V3 0324

deepseek/deepseek-chat-v3-0324

DeepSeek V3は、685Bパラメータの混合専門家モデルであり、DeepSeekチームのフラッグシップチャットモデルファミリーの最新版です。 [DeepSeek V3](/deepseek/deepseek-chat-v3)モデルの後継であり、様々なタスクで優れたパフォーマンスを発揮します。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#151

Qwen2.5 VL 32B Instruct

qwen/qwen2.5-vl-32b-instruct

Qwen2.5-VL-32Bは、強化学習を通じて微調整されたマルチモーダルビジョン言語モデルであり、数学的推論の強化、構造化出力、および視覚的問題解決能力を備えています。物体認識、画像内のテキスト解釈、および拡張ビデオ内の正確なイベント位置特定を含む視覚分析タスクに優れています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:128K tokens

Mistral Small 3.1 24B

mistralai/mistral-small-3.1-24b-instruct

Mistral Small 3.1 24B Instructは、Mistral Small 3(2501)のアップグレード版で、240億のパラメータを備え、高度なマルチモーダル機能を搭載しています。テキストベースの推論とビジョンタスクにおいて最先端のパフォーマンスを提供し、画像分析、プログラミング、数学的推論、および数十の言語にわたる多言語サポートを含みます。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:128K tokens

Olmo 2 32B Instruct

allenai/olmo-2-0325-32b-instruct

OLMo-2 32B Instruct は、OLMo-2 32B 2025年3月ベースモデルの教師あり命令ファインチューン版です。GSM8K、MATH、IFEval、および一般的なNLP評価など、多様なベンチマークにおいて複雑な推論と命令追従タスクに優れています。AI2によって開発されたOLMo-2 32Bは、オープンソース言語モデルの理解と開発を進めるために、主に英語言語データセットで訓練された、オープンで研究指向のイニシアティブの一部です。

プロバイダー:allenai
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#305

Command A

cohere/command-a

Command Aは、エージェント、多言語、コーディングのユースケースにおいて優れたパフォーマンスを提供することに焦点を当てた、1110億パラメータのオープンウェイト モデルで、256kのコンテキストウィンドウを備えています。 他の主要な独自モデルおよびオープンウェイト モデルと比較して、Command Aは最小限のハードウェアコストで最大のパフォーマンスを実現し、ビジネスに不可欠なエージェントタスクと多言語タスクで優れています。

プロバイダー:cohere logocohere
価格:FastMetal未提供
コンテキスト:256K tokens

Gemma 3 12B

google/gemma-3-12b-it

Gemma 3はマルチモーダル機能を導入し、ビジョン言語入力とテキスト出力をサポートしています。最大128kトークンのコンテキストウィンドウを処理でき、140以上の言語を理解し、構造化出力と関数呼び出しを含む、改善された数学、推論、チャット機能を提供します。Gemma 3 12BはGemma 3 27B以降、Gemma 3モデルファミリーで2番目に大きいモデルです。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#218

Gemma 3 12B (free)

google/gemma-3-12b-it:free

Gemma 3はマルチモーダル機能を導入し、ビジョン言語入力とテキスト出力をサポートしています。最大128kトークンのコンテキストウィンドウを処理でき、140以上の言語を理解し、構造化出力と関数呼び出しを含む、改善された数学、推論、チャット機能を提供します。Gemma 3 12Bは、[Gemma 3 27B](google/gemma-3-27b-it)に次ぐGemma 3モデルファミリーの2番目に大きいモデルです。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:33K tokens

Gemma 3 4B

google/gemma-3-4b-it

Gemma 3は、マルチモーダル機能を導入し、ビジョン言語入力とテキスト出力をサポートしています。最大128kトークンのコンテキストウィンドウを処理でき、140以上の言語を理解し、構造化出力と関数呼び出しを含む、改善された数学、推論、チャット機能を提供します。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#268

Gemma 3 4B (free)

google/gemma-3-4b-it:free

Gemma 3は、ビジョン言語入力とテキスト出力をサポートするマルチモーダル機能を導入しています。最大128kトークンのコンテキストウィンドウを処理し、140以上の言語を理解し、構造化出力と関数呼び出しを含む、改善された数学、推論、チャット機能を提供します。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:33K tokens

Gemma 3 27B

google/gemma-3-27b-it

Gemma 3はマルチモーダル機能を導入し、ビジョン言語入力とテキスト出力をサポートしています。最大128kトークンのコンテキストウィンドウを処理でき、140以上の言語を理解し、構造化出力と関数呼び出しを含む、改善された数学、推論、チャット機能を提供します。Gemma 3 27BはGoogleの最新のオープンソースモデルで、Gemma 2の後継です。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#186

Gemma 3 27B (free)

google/gemma-3-27b-it:free

Gemma 3は、ビジョン言語入力とテキスト出力をサポートするマルチモーダル機能を導入しています。最大128kトークンのコンテキストウィンドウを処理でき、140以上の言語を理解し、構造化出力と関数呼び出しを含む、改善された数学、推論、チャット機能を提供します。Gemma 3 27BはGoogleの最新のオープンソースモデルであり、[Gemma 2](google/gemma-2-27b-it)の後継です。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:131K tokens

QwQ 32B

qwen/qwq-32b

QwQはQwenシリーズの推論モデルです。従来の指示チューニングモデルと比較して、思考と推論が可能なQwQは、特に難しい問題において、ダウンストリームタスクのパフォーマンスを大幅に向上させることができます。QwQ-32Bは中規模の推論モデルであり、DeepSeek-R1やo1-miniなどの最先端の推論モデルと競争力のあるパフォーマンスを達成することができます。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:33K tokens
テキスト総合
#223

Gemini 2.0 Flash Lite

google/gemini-2.0-flash-lite-001

Gemini 2.0 Flash Liteは、[Gemini Flash 1.5](/google/gemini-flash-1.5)と比べて最初のトークンまでの時間(TTFT)が大幅に高速化されており、[Gemini Pro 1.5](/google/gemini-pro-1.5)のような大規模モデルと同等の品質を維持しながら、極めて経済的なトークン価格を実現しています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens

Claude 3.7 Sonnet

anthropic/claude-3.7-sonnet

Claude 3.7 Sonnetは、推論、コーディング、問題解決能力が向上した高度な大規模言語モデルです。ハイブリッド推論アプローチを導入しており、ユーザーは迅速な応答と複雑なタスク向けの段階的な処理の拡張の間で選択できます。このモデルは、特にフロントエンド開発とフルスタック更新におけるコーディングの顕著な改善を示しており、複数ステップのプロセスを自律的にナビゲートできるエージェンティックワークフローで優れています。

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:200K tokens
テキスト総合
#181

o3 Mini High

openai/o3-mini-high

OpenAI o3-mini-highは、reasoning_effortを高に設定した[o3-mini](/openai/o3-mini)と同じモデルです。 o3-miniは、STEM推論タスク、特に科学、数学、コーディングに最適化されたコスト効率的な言語モデルです。このモデルは3つの調整可能な推論努力レベルを備えており、関数呼び出し、構造化出力、ストリーミングを含む主要な開発者機能をサポートしていますが、ビジョン処理機能は含まれていません。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:200K tokens
テキスト総合
#189

Gemini 2.0 Flash

google/gemini-2.0-flash-001

Gemini Flash 2.0は、[Gemini Flash 1.5](/google/gemini-flash-1.5)と比べて最初のトークンまでの時間(TTFT)が大幅に短縮されており、[Gemini Pro 1.5](/google/gemini-pro-1.5)などのより大規模なモデルと同等の品質を維持しています。マルチモーダル理解、コーディング機能、複雑な指示への対応、関数呼び出しにおいて顕著な改善が導入されています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:1.0M tokens
テキスト総合
#191

Qwen2.5 VL 72B Instruct

qwen/qwen2.5-vl-72b-instruct

Qwen2.5-VLは、花、鳥、魚、昆虫などの一般的な物体の認識に優れています。また、画像内のテキスト、チャート、アイコン、グラフィック、レイアウトの分析にも非常に高い能力を持っています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:33K tokens

Qwen-Max

qwen/qwen-max

Qwen-Max(Qwen2.5ベース)は、特に複雑なマルチステップタスクにおいて、[Qwenモデル](/qwen)の中で最高の推論性能を提供します。20兆以上のトークンで事前学習された大規模MoEモデルであり、厳選された教師あり微調整(SFT)と人間フィードバックからの強化学習(RLHF)の方法論によってさらに後学習されています。パラメータ数は非公開です。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:33K tokens

Qwen-Plus

qwen/qwen-plus

Qwen-Plusは、Qwen2.5基盤モデルに基づいており、131Kのコンテキストを備えた、パフォーマンス、速度、コストのバランスの取れたモデルです。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:1.0M tokens

Qwen VL Max

qwen/qwen-vl-max

Qwen VL Maxは7500トークンのコンテキスト長を備えた視覚理解モデルです。より広範な複雑なタスクに対して最適なパフォーマンスを提供することに優れています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:131K tokens

o3 Mini

openai/o3-mini

OpenAI o3-miniは、STEM推論タスクに最適化されたコスト効率的な言語モデルで、特に科学、数学、コーディングに優れています。 このモデルは`reasoning_effort`パラメータをサポートしており、「high」「medium」「low」に設定して、モデルの思考時間を制御できます。デフォルトは「medium」です。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:200K tokens
テキスト総合
#205

Mistral Small 3

mistralai/mistral-small-24b-instruct-2501

Mistral Small 3は、一般的なAIタスク全体で低レイテンシーパフォーマンスに最適化された24Bパラメータの言語モデルです。Apache 2.0ライセンスの下でリリースされており、効率的なローカルデプロイメント向けに設計された事前学習版と命令チューニング版の両方を備えています。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:33K tokens
テキスト総合
#292

R1 Distill Qwen 32B

deepseek/deepseek-r1-distill-qwen-32b

DeepSeek R1 Distill Qwen 32Bは、[Qwen 2.5 32B](https://huggingface.co/Qwen/Qwen2.5-32B)をベースとした蒸留大規模言語モデルで、[DeepSeek R1](/deepseek/deepseek-r1)の出力を使用しています。様々なベンチマークでOpenAIのo1-miniを上回り、密集型モデルの新しい最先端の結果を達成しています。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:33K tokens

R1 Distill Llama 70B

deepseek/deepseek-r1-distill-llama-70b

DeepSeek R1 Distill Llama 70Bは、[Llama-3.3-70B-Instruct](/meta-llama/llama-3.3-70b-instruct)に基づいた蒸留大規模言語モデルで、[DeepSeek R1](/deepseek/deepseek-r1)の出力を使用しています。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:131K tokens

R1

deepseek/deepseek-r1

DeepSeek R1がここにあります:[OpenAI o1](/openai/o1)と同等のパフォーマンスですが、オープンソース化され、完全にオープンな推論トークンを備えています。パラメータサイズは671Bで、推論パスで37Bがアクティブです。 完全にオープンソースのモデル&[技術レポート](https://api-docs.deepseek.com/news/news250120)。 MITライセンス:自由に蒸留・商用化できます!

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:64K tokens
テキスト総合
#149

Phi 4

microsoft/phi-4

[Microsoft Research](/microsoft) Phi-4は、複雑な推論タスクで高いパフォーマンスを発揮するように設計されており、メモリが限定的な状況や迅速な応答が必要な場況で効率的に動作できます。 140億のパラメータを持つPhi-4は、高品質な合成データセット、厳選されたウェブサイトのデータ、および学術資料の混合データで訓練されました。指示に正確に従い、強力なセーフティスタンダードを維持するために慎重に改善されています。英語の入力で最適に機能します。

プロバイダー:microsoft logomicrosoft
価格:FastMetal未提供
コンテキスト:16K tokens
テキスト総合
#304

DeepSeek V3

deepseek/deepseek-chat

DeepSeek-V3は、DeepSeekチームの最新モデルであり、前のバージョンの指示追従能力とコーディング能力を基盤としています。約15兆トークンで事前学習されており、報告された評価によると、このモデルは他のオープンソースモデルを上回り、主要なクローズドソースモデルに匹敵します。

プロバイダー:deepseek logodeepseek
価格:FastMetal未提供
コンテキスト:164K tokens
テキスト総合
#192

o1

openai/o1

OpenAIの最新かつ最強のモデルファミリーであるo1は、応答する前により多くの時間をかけて考えるように設計されています。o1モデルシリーズは、大規模な強化学習によって訓練され、思考の連鎖を使用して推論します。 o1モデルは、数学、科学、プログラミング、およびその他のSTEM関連のタスクに最適化されています。物理学、化学、生物学のベンチマークにおいて、博士号レベルの精度を一貫して示しています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:200K tokens

Command R7B (12-2024)

cohere/command-r7b-12-2024

Command R7B(12-2024)は、2024年12月にリリースされたCommand R+モデルの小規模で高速なアップデートです。RAG、ツール使用、エージェント、および複雑な推論と複数のステップを必要とする同様のタスクに優れています。

プロバイダー:cohere logocohere
価格:FastMetal未提供
コンテキスト:128K tokens

Llama 3.3 70B Instruct

meta-llama/llama-3.3-70b-instruct

Meta Llama 3.3マルチリンガル大規模言語モデル(LLM)は、70B(テキスト入力/テキスト出力)の事前学習および命令チューニングされた生成モデルです。Llama 3.3命令チューニングテキストのみモデルは、マルチリンガル対話ユースケースに最適化されており、一般的な業界ベンチマークで利用可能なオープンソースおよびクローズドチャットモデルの多くを上回ります。 対応言語:英語、ドイツ語、フランス語、イタリア語、ポルトガル語、ヒンディー語、スペイン語、タイ語。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#249

Llama 3.3 70B Instruct (free)

meta-llama/llama-3.3-70b-instruct:free

Meta Llama 3.3マルチリンガル大規模言語モデル(LLM)は、70B(テキスト入力/テキスト出力)の事前学習および命令チューニングされた生成モデルです。Llama 3.3命令チューニングテキストのみモデルは、マルチリンガル対話ユースケースに最適化されており、一般的な業界ベンチマークで利用可能なオープンソースおよびクローズドチャットモデルの多くを上回ります。 対応言語:英語、ドイツ語、フランス語、イタリア語、ポルトガル語、ヒンディー語、スペイン語、タイ語。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:128K tokens

Nova Lite 1.0

amazon/nova-lite-v1

Amazon Nova Lite 1.0は、Amazonが提供する非常に低コストのマルチモーダルモデルで、画像、動画、テキスト入力を高速に処理してテキスト出力を生成することに特化しています。Amazon Nova Liteは、リアルタイムの顧客対応、ドキュメント分析、視覚的質問応答タスクを高い精度で処理できます。 300Kトークンの入力コンテキストにより、単一の入力で複数の画像または最大30分の動画を分析できます。

プロバイダー:amazon logoamazon
価格:FastMetal未提供
コンテキスト:300K tokens

Nova Micro 1.0

amazon/nova-micro-v1

Amazon Nova Micro 1.0は、Amazon Novaモデルファミリーの中で最も低いレイテンシーの応答を提供するテキストのみのモデルであり、非常に低いコストで利用できます。128Kトークンのコンテキスト長を備え、速度とコストに最適化されたAmazon Nova Microは、テキスト要約、翻訳、コンテンツ分類、インタラクティブチャット、ブレーンストーミングなどのタスクに優れています。シンプルな数学的推論とコーディング能力を備えています。

プロバイダー:amazon logoamazon
価格:FastMetal未提供
コンテキスト:128K tokens

Nova Pro 1.0

amazon/nova-pro-v1

Amazon Nova Pro 1.0は、Amazonが開発した高性能なマルチモーダルモデルで、幅広いタスクに対して精度、速度、コストの組み合わせを提供することに焦点を当てています。2024年12月の時点で、視覚的質問応答(TextVQA)とビデオ理解(VATEX)を含む主要なベンチマークで最先端のパフォーマンスを達成しています。 Amazon Nova Proは、視覚情報とテキスト情報の両方を処理し、財務文書を分析する強力な能力を示しています。

プロバイダー:amazon logoamazon
価格:FastMetal未提供
コンテキスト:300K tokens

Mistral Large 2407

mistralai/mistral-large-2407

これはMistral AIのフラッグシップモデル、Mistral Large 2(バージョンmistral-large-2407)です。プロプライエタリな重みが利用可能なモデルであり、推論、コード、JSON、チャットなどに優れています。ローンチアナウンスメントは[こちら](https://mistral.ai/news/mistral-large-2407/)でお読みください。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#254

Mistral Large 2411

mistralai/mistral-large-2411

Mistral Large 2 2411は、[Pixtral Large 2411](/mistralai/pixtral-large-2411)と同時にリリースされた[Mistral Large 2](/mistralai/mistral-large)のアップデートです。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#266

Pixtral Large 2411

mistralai/pixtral-large-2411

Pixtral Largeは、[Mistral Large 2](/mistralai/mistral-large-2411)の上に構築された124Bパラメータのオープンウェイト、マルチモーダルモデルです。このモデルは、ドキュメント、チャート、自然画像を理解することができます。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:131K tokens

Qwen2.5 Coder 32B Instruct

qwen/qwen-2.5-coder-32b-instruct

Qwen2.5-Coderは、最新のコード専用Qwen大規模言語モデルシリーズ(旧称CodeQwen)です。Qwen2.5-Coderは、CodeQwen1.5に対して以下の改善をもたらします: - **コード生成**、**コード推論**、**コード修正**における大幅な改善。 - **コードエージェント**などの実世界アプリケーションのためのより包括的な基盤。コーディング能力を強化するだけでなく、数学と一般的な能力における強みも維持しています。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:33K tokens
テキスト総合
#295

Claude 3.5 Haiku

anthropic/claude-3.5-haiku

Claude 3.5 Haikuは、速度、コーディング精度、ツール使用の強化された機能を備えています。リアルタイムアプリケーションで優れるように設計されており、チャットインタラクションや即座のコーディング提案など、動的なタスクに不可欠な迅速な応答時間を提供します。 これにより、ソフトウェア開発、カスタマーサービスボット、データ管理システムなど、速度と精度の両方を要求する環境に非常に適しています。

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:200K tokens
テキスト総合
#238

Claude 3.5 Sonnet

anthropic/claude-3.5-sonnet

新しいClaude 3.5 Sonnetは、Opusを上回る性能を提供しながら、Sonnetより高速で、Sonnetと同じ価格です。Sonnetは特に以下の分野で優れています: - コーディング:SWE-Bench Verifiedで約49%のスコアを獲得し、これまでの最高スコアを上回っており、複雑なプロンプトスキャフォルディングなしで実現 - データサイエンス:人間のデータサイエンス専門知識を補強し、非構造化データを操作しながら複数のツールを使用して洞察を得る - ビジュア…

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:200K tokens
テキスト総合
#179

Llama 3.1 Nemotron 70B Instruct

nvidia/llama-3.1-nemotron-70b-instruct

NVIDIAのLlama 3.1 Nemotron 70Bは、正確で有用な応答を生成するために設計された言語モデルです。[Llama 3.1 70Bアーキテクチャ](/models/meta-llama/llama-3.1-70b-instruct)と人間フィードバックからの強化学習(RLHF)を活用し、自動アライメントベンチマークで優れた性能を発揮します。

プロバイダー:nvidia logonvidia
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#271

Llama 3.2 1B Instruct

meta-llama/llama-3.2-1b-instruct

Llama 3.2 1Bは、10億パラメータの言語モデルで、要約、対話、多言語テキスト分析などの自然言語タスクを効率的に実行することに焦点を当てています。小さいサイズにより、低リソース環境で効率的に動作しながら、強力なタスク性能を維持できます。 8つのコア言語をサポートし、さらに多くの言語に微調整可能なLlama 1.3Bは、大規模モデルの高い計算需要なしに、多様な多言語設定で動作できる軽量でありながら強力なAIソリューションを求めるビジネスや開発者に最適です。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:60K tokens
テキスト総合
#382

Llama 3.2 3B Instruct

meta-llama/llama-3.2-3b-instruct

Llama 3.2 3Bは、30億のパラメータを持つ多言語大規模言語モデルで、対話生成、推論、要約などの高度な自然言語処理タスク向けに最適化されています。最新のトランスフォーマーアーキテクチャで設計され、英語、スペイン語、ヒンディー語を含む8つの言語をサポートしており、追加言語にも対応可能です。 9兆トークンで学習されたLlama 3.2 3Bモデルは、指示への従従性、複雑な推論、ツール使用に優れています。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#353

Llama 3.2 3B Instruct (free)

meta-llama/llama-3.2-3b-instruct:free

Llama 3.2 3Bは、30億個のパラメータを持つ多言語大規模言語モデルで、対話生成、推論、要約などの高度な自然言語処理タスクに最適化されています。最新のトランスフォーマーアーキテクチャで設計されており、英語、スペイン語、ヒンディー語を含む8つの言語をサポートし、追加言語にも対応可能です。 9兆トークンで学習されたLlama 3.2 3Bモデルは、指示の遵守、複雑な推論、ツール使用に優れています。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:131K tokens

Qwen2.5 72B Instruct

qwen/qwen-2.5-72b-instruct

Qwen2.5 72Bは、Qwenの最新の大規模言語モデルシリーズです。Qwen2.5はQwen2に対して以下の改善をもたらします: - 知識が大幅に増加し、これらの領域における専門の専門家モデルのおかげで、コーディングと数学の能力が大きく向上しました。 - 指示への従順性、長いテキスト(8,000トークン以上)の生成、構造化データ(表など)の理解、特にJSONなどの構造化出力の生成において大幅な改善。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:33K tokens
テキスト総合
#270

Command R (08-2024)

cohere/command-r-08-2024

command-r-08-2024は、多言語検索拡張生成(RAG)とツール使用のパフォーマンスが向上した[Command R](/models/cohere/command-r)のアップデート版です。より広く言えば、数学、コード、推論能力が向上しており、以前のより大規模なCommand R+モデルのバージョンと競争力があります。

プロバイダー:cohere logocohere
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#306

Command R+ (08-2024)

cohere/command-r-plus-08-2024

command-r-plus-08-2024は、[Command R+](/models/cohere/command-r-plus)のアップデート版で、前のCommand R+バージョンと比べて約50%高いスループットと25%低いレイテンシーを実現しながら、ハードウェアフットプリントは同じに保たれています。 ローンチポストは[こちら](https://docs.cohere.com/changelog/command-gets-refreshed)でご覧ください。

プロバイダー:cohere logocohere
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#290

GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06

2024年8月6日版のGPT-4oは構造化出力のパフォーマンスが向上しており、レスポンス形式でJSONスキーマを提供する機能があります。詳細は[こちら](https://openai.com/index/introducing-structured-outputs-in-the-api/)をご覧ください。 GPT-4o(「o」は「omni」の意)はOpenAIの最新AIモデルで、テキストと画像の両方の入力をサポートし、テキスト出力を提供します。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#226

Llama 3.1 405B (base)

meta-llama/llama-3.1-405b

Metaの最新モデルクラス(Llama 3.1)は、様々なサイズとバリエーションで発表されました。これはベースとなる405B事前学習版です。 人間による評価において、主要なクローズドソースモデルと比較して強いパフォーマンスを示しています。 モデルリリースについて詳しく知るには、[こちらをクリック](https://ai.meta.com/blog/meta-llama-3/)してください。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:33K tokens

Llama 3.1 405B Instruct

meta-llama/llama-3.1-405b-instruct

待望の400Bクラスの Llama3 がついに登場しました!128k のコンテキストと印象的な評価スコアを備えており、Meta AI チームはオープンソース LLM の最前線を押し進め続けています。 Meta の最新モデルクラス(Llama 3.1)は、様々なサイズとバリエーションで発表されました。この 405B インストラクションチューニング版は、高品質な対話ユースケースに最適化されています。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:131K tokens

Llama 3.1 70B Instruct

meta-llama/llama-3.1-70b-instruct

Metaの最新モデルクラス(Llama 3.1)は、様々なサイズとバリエーションでリリースされました。この70Bのインストラクションチューニング版は、高品質な対話ユースケースに最適化されています。 人間による評価において、主要なクローズドソースモデルと比較して強いパフォーマンスを示しています。 モデルリリースの詳細については、[こちらをクリック](https://ai.meta.com/blog/meta-llama-3-1/)してください。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:131K tokens
テキスト総合
#274

Llama 3.1 8B Instruct

meta-llama/llama-3.1-8b-instruct

Metaの最新モデルクラス(Llama 3.1)は、様々なサイズとバリエーションでリリースされました。この8Bの指示チューニング版は、高速で効率的です。 人間による評価では、主要なクローズドソースモデルと比較して強いパフォーマンスを示しています。 モデルリリースの詳細については、[こちらをクリック](https://ai.meta.com/blog/meta-llama-3-1/)してください。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:16K tokens
テキスト総合
#327

GPT-4o-mini

openai/gpt-4o-mini

GPT-4o miniは、[GPT-4 Omni](/models/openai/gpt-4o)の後に続くOpenAIの最新モデルであり、テキストと画像の両方の入力をサポートし、テキスト出力を生成します。 最も高度な小規模モデルとして、他の最近のフロンティアモデルよりも何倍も手頃な価格であり、[GPT-3.5 Turbo](/models/openai/gpt-3.5-turbo)よりも60%以上安くなっています。最先端の知能を維持しながら、大幅にコスト効率が向上しています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens

GPT-4o-mini (2024-07-18)

openai/gpt-4o-mini-2024-07-18

GPT-4o miniは、[GPT-4 Omni](/models/openai/gpt-4o)に続くOpenAIの最新モデルであり、テキストと画像の両方の入力をサポートし、テキスト出力を提供します。 最も高度な小規模モデルとして、他の最近のフロンティアモデルよりも何倍も安価であり、[GPT-3.5 Turbo](/models/openai/gpt-3.5-turbo)よりも60%以上安くなっています。最先端の知能を維持しながら、大幅にコスト効率が向上しています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#248

Gemma 2 27B

google/gemma-2-27b-it

Google の Gemma 2 27B は、[Gemini モデル](/models?q=gemini)の作成に使用されたのと同じ研究と技術から構築されたオープンモデルです。 Gemma モデルは、質問応答、要約、推論など、さまざまなテキスト生成タスクに適しています。 詳細については、[ローンチアナウンスメント](https://blog.google/technology/developers/google-gemma-2/)を参照してください。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:8K tokens
テキスト総合
#277

Gemma 2 9B

google/gemma-2-9b-it

Google による Gemma 2 9B は、そのサイズクラスにおいて効率性とパフォーマンスの新しい基準を設定する、高度なオープンソース言語モデルです。 様々なタスク向けに設計されており、開発者と研究者が革新的なアプリケーションを構築できるようにしながら、アクセシビリティ、安全性、費用対効果を維持しています。

プロバイダー:google logogoogle
価格:FastMetal未提供
コンテキスト:8K tokens
テキスト総合
#297

Mistral 7B Instruct

mistralai/mistral-7b-instruct

高性能で業界標準の73億パラメータモデルであり、速度とコンテキスト長に最適化されています。 *Mistral 7B Instructには複数のバージョンがあり、これは最新バージョンを意図しています。*

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:33K tokens
テキスト総合
#383

Mistral 7B Instruct v0.3

mistralai/mistral-7b-instruct-v0.3

高性能で業界標準の73億パラメータモデルで、速度とコンテキスト長に最適化されています。 [Mistral 7B Instruct v0.2](/models/mistralai/mistral-7b-instruct-v0.2)の改善版で、以下の変更が加えられています: - 語彙を32768に拡張 - v3トークナイザーに対応 - 関数呼び出しに対応 注:関数呼び出しのサポートはプロバイダーに依存します。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:33K tokens

GPT-4o

openai/gpt-4o

GPT-4o(「o」は「omni」の意)はOpenAIの最新AIモデルで、テキストと画像の両方の入力をサポートし、テキスト出力を提供します。[GPT-4 Turbo](/models/openai/gpt-4-turbo)と同じレベルのインテリジェンスを維持しながら、処理速度は2倍、コスト効率は50%向上しています。GPT-4oはまた、非英語言語の処理性能の向上と視覚機能の強化も提供しています。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens

GPT-4o (2024-05-13)

openai/gpt-4o-2024-05-13

GPT-4o(「o」は「omni」の意)はOpenAIの最新AIモデルで、テキストと画像の両方の入力をサポートし、テキスト出力を提供します。[GPT-4 Turbo](/models/openai/gpt-4-turbo)と同等のインテリジェンスレベルを維持しながら、処理速度は2倍、コスト効率は50%向上しています。GPT-4oはまた、非英語言語の処理性能の向上と、視覚機能の強化を提供します。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#211

Llama 3 70B Instruct

meta-llama/llama-3-70b-instruct

Metaの最新モデルクラス(Llama 3)は、様々なサイズとバリエーションでリリースされました。この70Bのインストラクションチューニング版は、高品質な対話ユースケースに最適化されています。 人間による評価において、主要なクローズドソースモデルと比較して強いパフォーマンスを示しています。 モデルリリースの詳細については、[こちらをクリック](https://ai.meta.com/blog/meta-llama-3/)してください。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:8K tokens
テキスト総合
#289

Llama 3 8B Instruct

meta-llama/llama-3-8b-instruct

Metaの最新モデルクラス(Llama 3)は、様々なサイズとバリエーションで発表されました。この8Bの指示チューニング版は、高品質な対話ユースケースに最適化されています。 人間による評価では、主要なクローズドソースモデルと比較して強いパフォーマンスを示しています。 モデルリリースの詳細については、[こちらをクリック](https://ai.meta.com/blog/meta-llama-3/)してください。

プロバイダー:meta-llama logometa-llama
価格:FastMetal未提供
コンテキスト:8K tokens
テキスト総合
#320

Mixtral 8x22B Instruct

mistralai/mixtral-8x22b-instruct

Mistralの公式なinstruct微調整版[Mixtral 8x22B](/models/mistralai/mixtral-8x22b)です。141B個のパラメータのうち39B個のアクティブパラメータを使用しており、そのサイズに対して比類のないコスト効率を提供します。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:66K tokens

GPT-4 Turbo

openai/gpt-4-turbo

最新のGPT-4 Turboモデル(ビジョン機能付き)。ビジョンリクエストはJSONモードと関数呼び出しを使用できるようになりました。 トレーニングデータ:2023年12月まで。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens

Claude 3 Haiku

anthropic/claude-3-haiku

Claude 3 Haikuはアンスロピックの最速かつ最もコンパクトなモデルで、ほぼ瞬時の応答性を実現します。迅速で正確なターゲット性能です。 ローンチアナウンスメントとベンチマーク結果は[こちら](https://www.anthropic.com/news/claude-3-haiku)をご覧ください #マルチモーダル

プロバイダー:anthropic logoanthropic
価格:FastMetal未提供
コンテキスト:200K tokens
テキスト総合
#301

Mistral Large

mistralai/mistral-large

これはMistral AIのフラッグシップモデルであるMistral Large 2(バージョン`mistral-large-2407`)です。プロプライエタリな重みが利用可能なモデルであり、推論、コード、JSON、チャットなどに優れています。ローンチアナウンスメントは[こちら](https://mistral.ai/news/mistral-large-2407/)でご覧ください。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:128K tokens

Mixtral 8x7B Instruct

mistralai/mixtral-8x7b-instruct

Mixtral 8x7B Instruct は、Mistral AI による事前学習済みの生成型スパース混合専門家モデルで、チャットと指示用途向けです。合計470億パラメータの8つの専門家(フィードフォワードネットワーク)を組み込んでいます。 Mistral によってファインチューニングされた指示モデル。#moe

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:33K tokens

GPT-4 Turbo (older v1106)

openai/gpt-4-1106-preview

最新のGPT-4 Turboモデルはビジョン機能を備えています。ビジョンリクエストはJSONモードと関数呼び出しを使用できるようになりました。 トレーニングデータ:2023年4月までのデータ。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:128K tokens
テキスト総合
#257

Mistral 7B Instruct v0.1

mistralai/mistral-7b-instruct-v0.1

7.3Bパラメータモデルで、すべてのベンチマークでLlama 2 13Bを上回るパフォーマンスを発揮し、速度とコンテキスト長に最適化されています。

プロバイダー:mistralai logomistralai
価格:FastMetal未提供
コンテキスト:3K tokens

GPT-3.5 Turbo

openai/gpt-3.5-turbo

GPT-3.5 TurboはOpenAIの最速モデルです。自然言語またはコードを理解および生成でき、チャットと従来の完了タスク用に最適化されています。 2021年9月までのトレーニングデータ。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:16K tokens

GPT-4

openai/gpt-4

OpenAIのフラッグシップモデルであるGPT-4は、より広範な一般知識と高度な推論能力により、以前のモデルよりも高い精度で難しい問題を解くことができる大規模マルチモーダル言語モデルです。学習データ:2021年9月までのデータ。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:8K tokens

GPT-4 (older v0314)

openai/gpt-4-0314

GPT-4-0314はGPT-4の最初のバージョンで、コンテキスト長は8,192トークンであり、6月14日までサポートされていました。トレーニングデータ:2021年9月までです。

プロバイダー:openai logoopenai
価格:FastMetal未提供
コンテキスト:8K tokens
テキスト総合
#280

deepseek-v4-flash-0731

deepseek/deepseek-v4-flash-0731

Global: DeepSeek V4 Flash 0731 - 高速・低コストなモデル

プロバイダー:deepseek logodeepseek
価格:入力 ¥39.314 · 出力 ¥117.942 / 100万トークン
コンテキスト:- tokens

Gemini Flash Lite

google/gemini-flash-lite

GeminiシリーズにおけるGoogleの最速かつ最もコスト効率の高いモデル。2.5倍高速なトークン生成までの時間を備えたフロンティアクラスのパフォーマンスを提供し、大量処理と低遅延が求められるアプリケーションに最適です。

プロバイダー:google logogoogle
価格:入力 ¥0 · 出力 ¥0 / 100万トークン
コンテキスト:1.0M tokens

Lustify SDXL

venice/lustify-sdxl

Global: 漫画画像を生成する

プロバイダー:venice
価格:FastMetal未提供
コンテキスト:- tokens

Nex-N2.5-Mini

nex-agi/nex-n2.5-mini

Global: Nex AGI Nex-N2.5-Mini - エージェント型コーディングモデル(無料)

プロバイダー:nex-agi
価格:入力 ¥0 · 出力 ¥0 / 100万トークン
コンテキスト:262K tokens

qwen3.6-27b

qwen/qwen3.6-27b

Global: Qwen 3.6 27B

プロバイダー:qwen logoqwen
価格:入力 ¥80.415 · 出力 ¥482.49 / 100万トークン
コンテキスト:- tokens

Qwen3.6 35B-A3B

qwen/qwen3.6-35b-a3b

Japan: Qwen 3.6 35B-A3B - 日本国内でホスト・実行

プロバイダー:qwen logoqwen
価格:入力 ¥32 · 出力 ¥158 / 100万トークン
コンテキスト:- tokens

Qwen3 Coder 480B A35B

qwen/qwen3-coder-480b-a35b-instruct-fp8

アリババの最も高性能なオープンソースのエージェント型コーディングモデル。480B個の総パラメータ(35B個がアクティブ)を備えたMixture-of-Experts アーキテクチャで、7.5兆トークンで訓練されています。エージェント型コーディングベンチマークにおいてオープンモデルの中で最先端の結果を達成し、Claude Sonnet 4に匹敵します。

プロバイダー:qwen logoqwen
価格:FastMetal未提供
コンテキスト:262K tokens

random-free

openrouter/free

Global: 無料

プロバイダー:openrouter logoopenrouter
価格:入力 ¥0 · 出力 ¥0 / 100万トークン
コンテキスト:200K tokens

Seedream 4.5

bytedance-seed/seedream-4.5

Global: Generate images

プロバイダー:bytedance-seed logobytedance-seed
価格:¥7.15 / 画像1枚
コンテキスト:- tokens

Voxtral Mini 3B

mistralai/voxtral-mini-3b-2507

3Bパラメータの音声言語モデルで、Ministral-3Bバックボーンに音声エンコーダを搭載し、最先端の音声理解を実現します。8言語にわたって、音声文字起こし、翻訳、音声Q&A、音声からの関数呼び出しに対応しています。

プロバイダー:mistralai logomistralai
価格:入力 ¥8.4 · 出力 ¥8.4 / 100万トークン
コンテキスト:33K tokens

Z-Image Turbo

tongyi/z-image-turbo

Global: リアルな画像を生成する

プロバイダー:tongyi
価格:¥1.68 / 画像1枚
コンテキスト:- tokens