DeepSeek V3 is 1.3× cheaper per million tokens (blended). DeepSeek V3 has the larger context window (163,840 vs 8,192 tokens, 20.0×).

DeepSeek V3 vs R1 Distill Llama 70B

Live catalog fields. Best-in-row is highlighted.

DeepSeek V3open

DeepSeek · deepseek__deepseek-chat

R1 Distill Llama 70Bopen

DeepSeek · deepseek__deepseek-r1-distill-llama-70b

Identity

Fielddeepseek__deepseek-chatdeepseek__deepseek-r1-distill-llama-70b
ProviderDeepSeekDeepSeek
Slugdeepseek__deepseek-chatdeepseek__deepseek-r1-distill-llama-70b
Statuslivelive
Open weightsYesYes
License
HuggingFacedeepseek-ai/DeepSeek-V3deepseek-ai/DeepSeek-R1-Distill-Llama-70B

Quality

Fielddeepseek__deepseek-chatdeepseek__deepseek-r1-distill-llama-70b
Quality index (0–100)

Cost

Fielddeepseek__deepseek-chatdeepseek__deepseek-r1-distill-llama-70b
Input $ / 1M tokens$0.32$0.80
Cached input $ / 1M
Output $ / 1M tokens$0.89$0.80

Context

Fielddeepseek__deepseek-chatdeepseek__deepseek-r1-distill-llama-70b
Max context tokens163,8408,192
Max output tokens16,3847,372

Modalities

Fielddeepseek__deepseek-chatdeepseek__deepseek-r1-distill-llama-70b
Inputtexttext
Outputtexttext