Llama 3.1 8B Instruct
Offerings
| Host | Variant | Region | Status | Input $/Mtok | Output $/Mtok | Cache read | Cache write | Latency / throughput soon | Confidence | Source |
|---|---|---|---|---|---|---|---|---|---|---|
| aws-bedrock | – | – | active | $0.220000 | $0.220000 | – | – | – | medium | modelsdev |
| nvidia | – | – | active | $0.000000 | $0.000000 | – | – | – | medium | modelsdev |
| perplexity | – | – | active | $0.200000 | $0.200000 | – | – | – | medium | litellm |
Cite this page
Llama 3.1 8B Instruct costs $0.000000/$0.000000 per 1M tokens on nvidia as of 2026-10-04 (Token Barometer, https://tokenbarometer.com/model/meta/llama-3.1-8b-instruct).
Badge
Embed a pricing badge for this model:
[](https://tokenbarometer.com/model/meta/llama-3.1-8b-instruct)
Price history
Change log
| Date | Host | Kind | Change |
|---|---|---|---|
| 2026-10-04 | nvidia | Metadata changed | Metadata changed |
| 2026-10-04 | aws-bedrock | Metadata changed | Metadata changed |
| 2026-10-04 | aws-bedrock | Metadata changed | Metadata changed |
| 2026-10-04 | nvidia | New offering | New offering |
| 2026-10-04 | aws-bedrock | New offering | New offering |
| 2026-10-04 | aws-bedrock | New offering | New offering |
| 2026-10-04 | perplexity | New offering | New offering |
Compare
No comparison pages for this model yet. See all comparisons.