NVIDIAnemotron familyActive

nvidia-nemotron-nano-9b-v2

Compact Nemotron model for efficient reasoning and deployable AI agents

JSONEmbed chartCompare
Context
131,072
Max output
131,072
Input / 1M
$0.06
Output / 1M
$0.23
Providers
4
01Profile

Profile

Released
2025-08-18
Last updated
2025-08-18
Knowledge cutoff
2024-09
Weights
Open
02Capabilities

Capabilities

Input
text
Output
text
Reasoning
Yes
Tool calling
Yes
Structured output
No
Attachments
No
Cache read
Cache write
03Pricing

Pricing across 3 providers

Per 1M tokens, USD. Sorted by input price. First-party row highlighted.

ProviderProvider model idInputOutputCache readContext
nvidiafirst-partynvidia/nvidia-nemotron-nano-9b-v2org:nvidiaNot listedNot listedNot listed131,072
amazon-bedrocknvidia.nemotron-nano-9b-v2$0.06$0.23Not listed131,072
merge-gatewaynvidia/nemotron-nano-9b-v2$0.06$0.23Not listed128,000
vercelnvidia/nemotron-nano-9b-v2$0.06$0.23Not listed131,072
04History

Change history

12+ recent events since 2025-08-18

2026-09-11Contextamazon-bedrockContext window128,000→ new
2026-09-11Contextamazon-bedrockMax output4,096→ 8,192
2026-08-24Removededenaiofferingremoved→ new
2026-08-24Removededenaiofferingremoved→ new
2026-08-24Removedopenrouterofferingremoved→ new
2026-08-14Addededenaioffering→ new
2026-08-14Addededenaioffering→ new
2026-08-03Removednano-gptofferingremoved→ new
2026-08-02Removedkiloofferingremoved→ new
2026-07-29Addedmerge-gatewayoffering→ new
2026-06-11Removedopenrouterofferingremoved→ new
2026-06-07ContextopenrouterContext window131,072→ new
as of 2026-09-16
About ·Corrections ·Contact ·Privacy ·EN / 中文 / 繁體
HomeModelsLabsProvidersToolsRankingsChangesNews