Llama 3.3 Nemotron Super 49B v1.5 vs OpenAI: o4 Mini

Llama 3.3 Nemotron Super 49B v1.5 is cheaper than OpenAI: o4 Mini by about 100% on a blended (75% input / 25% output) basis. Llama 3.3 Nemotron Super 49B v1.5 charges $0.000000 / $0.000000 per 1M input/output tokens; OpenAI: o4 Mini charges $1.100000 / $4.400000.

FieldLlama 3.3 Nemotron Super 49B v1.5OpenAI: o4 Mini
Input $/Mtok$0.000000$1.100000
Output $/Mtok$0.000000$4.400000
Cache read $/Mtok–$0.275000
Cache write $/Mtok––
Input $/Mchar0.0000000.309885
Output $/Mchar0.0000001.239541
Context window131072200000
Tokenizerllama3o200k

Price history

Same workload, monthly cost

Illustrative monthly cost at 10M tokens/month, split per workload preset. Not a substitute for the calculator, which uses your own volume, cache and batch assumptions.

WorkloadLlama 3.3 Nemotron Super 49B v1.5OpenAI: o4 Mini
Coding agent$0.00$12.65
RAG chat$0.00$15.95
Summarisation (batch)$0.00$14.30
Classification$0.00$11.66
Chat assistant$0.00$24.20
Content generation$0.00$37.40

Cite this page

Llama 3.3 Nemotron Super 49B v1.5 vs OpenAI: o4 Mini: $0.000000/$0.000000 vs $1.100000/$4.400000 per 1M tokens, as of 2026-10-04 (Token Barometer, https://tokenbarometer.com/compare/nvidia_nemotron-super-49b-v1-vs-openai_o4-mini).

Llama 3.3 Nemotron Super 49B v1.5 page | OpenAI: o4 Mini page | Open in calculator