R1 Distill Llama 70B is 2.1× cheaper per million tokens (blended). Qwen3.8 27B has the larger context window (1,000,000 vs 8,192 tokens, 122.1×).

R1 Distill Llama 70B vs Qwen3.8 27B

Live catalog fields. Best-in-row is highlighted.

R1 Distill Llama 70Bopen

DeepSeek · deepseek__deepseek-r1-distill-llama-70b

Qwen3.8 27Bopen

Qwen · qwen__qwen3.8-27b

Identity

Fielddeepseek__deepseek-r1-distill-llama-70bqwen__qwen3.8-27b
ProviderDeepSeekQwen
Slugdeepseek__deepseek-r1-distill-llama-70bqwen__qwen3.8-27b
Statuslivelive
Open weightsYesYes
License
HuggingFacedeepseek-ai/DeepSeek-R1-Distill-Llama-70BQwen/Qwen3.8-27B

Quality

Fielddeepseek__deepseek-r1-distill-llama-70bqwen__qwen3.8-27b
Quality index (0–100)89.0

Cost

Fielddeepseek__deepseek-r1-distill-llama-70bqwen__qwen3.8-27b
Input $ / 1M tokens$0.80$0.42
Cached input $ / 1M$0.09
Output $ / 1M tokens$0.80$3.00

Context

Fielddeepseek__deepseek-r1-distill-llama-70bqwen__qwen3.8-27b
Max context tokens8,1921,000,000
Max output tokens7,372131,072

Modalities

Fielddeepseek__deepseek-r1-distill-llama-70bqwen__qwen3.8-27b
Inputtexttext, image, video
Outputtexttext