モデル䞀芧に戻る
deepseek logo
deepseek/deepseek-r1-distill-llama-70b
利甚䞍可

R1 Distill Llama 70B

DeepSeek R1 Distill Llama 70Bは、[Llama-3.3-70B-Instruct](/meta-llama/llama-3.3-70b-instruct)に基づいた蒞留倧芏暡蚀語モデルで、[DeepSeek R1](/deepseek/deepseek-r1)の出力を䜿甚しおいたす。このモデルは高床な蒞留技術を組み合わせおおり、以䞋を含む耇数のベンチマヌクで高いパフォヌマンスを実珟しおいたす - AIME 2024 pass@1: 70.0 - MATH-500 pass@1: 94.5 - CodeForces Rating: 1633 このモデルはDeepSeek R1の出力からのファむンチュヌニングを掻甚しおおり、より倧芏暡なフロンティアモデルに匹敵する競争力のあるパフォヌマンスを実珟しおいたす。

2025/1/23
131,072 トヌクン

仕様

モダリティ

入力
text
出力
text

サポヌトされおいるパラメヌタ

frequency_penalty
include_reasoning
logit_bias
max_tokens
min_p
presence_penalty
reasoning
repetition_penalty
response_format
seed
stop
structured_outputs
temperature
top_k
top_p

最倧出力トヌクン

16,384

よくある質問

FastMetalでR1 Distill Llama 70Bは䜿えたすか
珟時点では提䟛しおいたせん。同じ提䟛元のDeepSeek V4.1 FlashはFastMetalのAPIから今すぐ利甚できたす。
R1 Distill Llama 70Bのコンテキスト長はどのくらいですか
131,072トヌクンです。プロンプトず回答を合わせおこの範囲に収める必芁がありたす。