nvidia
NVIDIA: Nemotron 3 Super
nvidia/nemotron-3-super-120b-a12b
For $1, you can send approximately:
~295messages
How do we get this number?
One message = ~7,000 input tokens + ~7,000 output tokens
Input cost per message7,000 x $0.08/M = $0.000595
Output cost per message7,000 x $0.40/M = $0.002800
Total cost per message$0.003395
Messages for $1294.55
Context window
1.0M
tokens
Max response
16k
tokens
Input price
$0.08
per million tokens
Output price
$0.40
per million tokens
Modalities
Input:textOutput:text
Description
NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer...