Back to comparator
nvidia

NVIDIA: Nemotron 3 Ultra

nvidia/nemotron-3-ultra-550b-a55b

For $1, you can send approximately:
~34.0messages

How do we get this number?

One message = ~7,000 input tokens + ~7,000 output tokens
Input cost per message7,000 x $0.60/M = $0.004200
Output cost per message7,000 x $3.60/M = $0.025200
Total cost per message$0.029400
Messages for $134.01
Context window
512k
tokens
Max response
0
tokens
Input price
$0.60
per million tokens
Output price
$3.60
per million tokens

Modalities

Input:textOutput:text

Description

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...