Llama 3.3 Nemotron Super 49B v1.5 vs OpenAI: GPT-5 Mini
Llama 3.3 Nemotron Super 49B v1.5 is cheaper than OpenAI: GPT-5 Mini by about 100% on a blended (75% input / 25% output) basis. Llama 3.3 Nemotron Super 49B v1.5 charges $0.000000 / $0.000000 per 1M input/output tokens; OpenAI: GPT-5 Mini charges $0.250000 / $2.000000.
| Field | Llama 3.3 Nemotron Super 49B v1.5 | OpenAI: GPT-5 Mini |
|---|---|---|
| Input $/Mtok | $0.000000 | $0.250000 |
| Output $/Mtok | $0.000000 | $2.000000 |
| Cache read $/Mtok | – | $0.025000 |
| Cache write $/Mtok | – | – |
| Input $/Mchar | 0.000000 | 0.070428 |
| Output $/Mchar | 0.000000 | 0.563428 |
| Context window | 131072 | 400000 |
| Tokenizer | llama3 | o200k |
Price history
Same workload, monthly cost
Illustrative monthly cost at 10M tokens/month, split per workload preset. Not a substitute for the calculator, which uses your own volume, cache and batch assumptions.
| Workload | Llama 3.3 Nemotron Super 49B v1.5 | OpenAI: GPT-5 Mini |
|---|---|---|
| Coding agent | $0.00 | $3.38 |
| RAG chat | $0.00 | $5.13 |
| Summarisation (batch) | $0.00 | $4.25 |
| Classification | $0.00 | $2.85 |
| Chat assistant | $0.00 | $9.50 |
| Content generation | $0.00 | $16.50 |
Cite this page
Llama 3.3 Nemotron Super 49B v1.5 vs OpenAI: GPT-5 Mini: $0.000000/$0.000000 vs $0.250000/$2.000000 per 1M tokens, as of 2026-10-04 (Token Barometer, https://tokenbarometer.com/compare/nvidia_nemotron-super-49b-v1-vs-openai_gpt-5-mini).
Llama 3.3 Nemotron Super 49B v1.5 page | OpenAI: GPT-5 Mini page | Open in calculator