Llama 3.3 Nemotron Super 49B v1.5 vs OpenAI: GPT-5 Mini

Llama 3.3 Nemotron Super 49B v1.5 is cheaper than OpenAI: GPT-5 Mini by about 100% on a blended (75% input / 25% output) basis. Llama 3.3 Nemotron Super 49B v1.5 charges $0.000000 / $0.000000 per 1M input/output tokens; OpenAI: GPT-5 Mini charges $0.250000 / $2.000000.

FieldLlama 3.3 Nemotron Super 49B v1.5OpenAI: GPT-5 Mini
Input $/Mtokfree$0.250000
Output $/Mtokfree$2.000000
Cache read $/Mtok–$0.025000
Cache write $/Mtok––
Input $/Mchar0.0000000.070428
Output $/Mchar0.0000000.563428
Context window131072400000
Tokenizerllama3o200k
Confidence?aggregatorapi
Sourcemodelsdevopenrouter

Confidence: official = vendor pricing page · api = OpenRouter per-host · aggregator = community list, may lag · unreviewed = automatic extraction awaiting review. When sources disagree the most authoritative wins. Details: /methodology#confidence

Price history

Same workload, monthly cost

Illustrative monthly cost at 10M tokens/month, split per workload preset. Not a substitute for the calculator, which uses your own volume, cache and batch assumptions.

WorkloadLlama 3.3 Nemotron Super 49B v1.5OpenAI: GPT-5 Mini
Coding agent$0.00$3.38
RAG chat$0.00$5.13
Summarisation (batch)$0.00$4.25
Classification$0.00$2.85
Chat assistant$0.00$9.50
Content generation$0.00$16.50

Cite this page

Llama 3.3 Nemotron Super 49B v1.5 vs OpenAI: GPT-5 Mini: $0.000000/$0.000000 vs $0.250000/$2.000000 per 1M tokens as of 2026-10-04. Token Barometer by Dejan Strbad, https://tokenbarometer.com, data CC BY 4.0. https://tokenbarometer.com/compare/nvidia_nemotron-super-49b-v1-vs-openai_gpt-5-mini

Llama 3.3 Nemotron Super 49B v1.5 page | OpenAI: GPT-5 Mini page | Open in calculator