4件のモデル
Mercury 2.5
mercury-2.5Mercury 2.5は最速の推論LLMであり、Inceptionからの最新の拡散LLM(dLLM)です。トークンを順序立てて生成する代わりに、Mercury 2.5は複数のトークンを並列で生成および洗練し、以下を実現します...
Mercury 2
inception/mercury-2Mercury 2は非常に高速な推論LLMであり、最初の推論拡散LLM(dLLM)です。 トークンを順序立てて生成する代わりに、Mercury 2は複数のトークンを並列で生成・改善し、標準GPUで1秒あたり1,000トークン以上を実現します。Mercury 2は、Claude 4.5 HaikuやGPT 5 Miniなどの速度最適化LLMより5倍以上高速で、コストは大幅に削減されます。
Mercury
inception/mercuryMercuryは最初の拡散大規模言語モデル(dLLM)です。革新的な離散拡散アプローチを適用することで、このモデルはGPT-4.1 NanoやClaude 3.5 Haikuなどの速度最適化モデルよりも5~10倍高速に実行されながら、同等のパフォーマンスを実現します。Mercuryの速度により、開発者はボイスエージェント、検索インターフェース、チャットボットなど、レスポンシブなユーザー体験を提供できます。
Mercury Coder
inception/mercury-coderMercury Coderは初の拡散型大規模言語モデル(dLLM)です。革新的な離散拡散アプローチを適用することで、Claude 3.5 HaikuやGPT-4o Miniなどの速度最適化モデルと比べて5~10倍高速に動作しながら、同等のパフォーマンスを実現しています。Mercury Coderの高速性により、開発者はコーディング中に集中力を保ちながら、迅速なチャットベースの反復処理と応答性の高いコード補完提案を享受できます。