Qwen3.8 27B is slightly cheaper per million tokens (blended). Qwen3.8 27B has the larger context window (1,000,000 vs 256,000 tokens, 3.9×).

Nemotron 3 Ultra vs Qwen3.8 27B

Live catalog fields. Best-in-row is highlighted.

Nemotron 3 Ultraopen

NVIDIA · nvidia__nemotron-3-ultra-550b-a55b

Qwen3.8 27Bopen

Qwen · qwen__qwen3.8-27b

Identity

Fieldnvidia__nemotron-3-ultra-550b-a55bqwen__qwen3.8-27b
ProviderNVIDIAQwen
Slugnvidia__nemotron-3-ultra-550b-a55bqwen__qwen3.8-27b
Statuslivelive
Open weightsYesYes
License
HuggingFacenvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16Qwen/Qwen3.8-27B

Quality

Fieldnvidia__nemotron-3-ultra-550b-a55bqwen__qwen3.8-27b
Quality index (0–100)89.0

Cost

Fieldnvidia__nemotron-3-ultra-550b-a55bqwen__qwen3.8-27b
Input $ / 1M tokens$0.63$0.42
Cached input $ / 1M$0.19$0.09
Output $ / 1M tokens$3.13$3.00

Context

Fieldnvidia__nemotron-3-ultra-550b-a55bqwen__qwen3.8-27b
Max context tokens256,0001,000,000
Max output tokens32,768131,072

Modalities

Fieldnvidia__nemotron-3-ultra-550b-a55bqwen__qwen3.8-27b
Inputtexttext, image, video
Outputtexttext