Back to comparator
nvidia

NVIDIA: Nemotron 3 Super

nvidia/nemotron-3-super-120b-a12b

For $1, you can send approximately:
~295messages

How do we get this number?

One message = ~7,000 input tokens + ~7,000 output tokens
Input cost per message7,000 x $0.08/M = $0.000595
Output cost per message7,000 x $0.40/M = $0.002800
Total cost per message$0.003395
Messages for $1294.55
Context window
1.0M
tokens
Max response
16k
tokens
Input price
$0.08
per million tokens
Output price
$0.40
per million tokens

Modalities

Input:textOutput:text

Description

NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer...