# Nemotron 3 Nano 30B A3B

> Nemotron 3 Nano 30B A3B is an open-weight language model from NVIDIA, released on 15 Dec 2025. It accepts text and generates text, with a 262K-token context window and up to 262K output tokens per response. As of 4 Oct 2026, the lowest listed API price is $0.05 per million input tokens and $0.20 per million output tokens (DeepInfra), across 4 providers we track.

Source page: https://www.aimodel.directory/models/nemotron-3-nano-30b-a3b
Last verified: 4 Oct 2026

## Specifications

- **Developer:** NVIDIA
- **Release date:** 15 Dec 2025 (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/deepinfra/models/nvidia/Nemotron-3-Nano-30B-A3B.toml)
- **Status:** Generally available (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/deepinfra/models/nvidia/Nemotron-3-Nano-30B-A3B.toml)
- **Weights:** Open weights (source: Hugging Face, https://huggingface.co/nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16)
- **License:** nvidia-nemotron-open-model-license (source: Hugging Face, https://huggingface.co/nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16)
- **Parameters:** 31.6B (source: Hugging Face, https://huggingface.co/nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16)
- **Context window:** 262K (262,144 tokens) (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/deepinfra/models/nvidia/Nemotron-3-Nano-30B-A3B.toml)
- **Max output:** 262K tokens (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/deepinfra/models/nvidia/Nemotron-3-Nano-30B-A3B.toml)
- **Knowledge cutoff:** Sept 2024 (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/deepinfra/models/nvidia/Nemotron-3-Nano-30B-A3B.toml)
- **Input:** Text (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/deepinfra/models/nvidia/Nemotron-3-Nano-30B-A3B.toml)
- **Output:** Text (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/deepinfra/models/nvidia/Nemotron-3-Nano-30B-A3B.toml)
- **Reasoning mode:** Yes (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/deepinfra/models/nvidia/Nemotron-3-Nano-30B-A3B.toml)
- **Tool calling:** Yes (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/deepinfra/models/nvidia/Nemotron-3-Nano-30B-A3B.toml)
- **Hugging Face:** nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 (source: Hugging Face, https://huggingface.co/nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16)

## API pricing (USD per 1M tokens)

| Provider | Input | Output | Cached input | Context |
|---|---|---|---|---|
| DeepInfra | $0.05 | $0.20 | $0.03 | 262K |
| OpenRouter | $0.05 | $0.20 | $0.03 | 262K |
| Vercel AI Gateway | $0.05 | $0.20 | $0.03 | 262K |
| Amazon Bedrock | $0.06 | $0.24 | – | 262K |

## FAQ

### What is the context window of Nemotron 3 Nano 30B A3B?

Nemotron 3 Nano 30B A3B has a context window of 262,144 tokens (262K) and can generate up to 262,144 tokens in a single response, according to models.dev.

### How much does the Nemotron 3 Nano 30B A3B API cost?

Nemotron 3 Nano 30B A3B is listed from $0.05 per million input tokens and $0.20 per million output tokens (DeepInfra). Prices last verified 4 Oct 2026.

### Is Nemotron 3 Nano 30B A3B open source?

Nemotron 3 Nano 30B A3B is an open-weight model: its weights are published on Hugging Face as nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 under the nvidia-nemotron-open-model-license license. Check the license terms before commercial use.

### When was Nemotron 3 Nano 30B A3B released?

NVIDIA released Nemotron 3 Nano 30B A3B on 15 Dec 2025, according to models.dev.

### Which providers offer Nemotron 3 Nano 30B A3B?

We track Nemotron 3 Nano 30B A3B on 4 providers: DeepInfra, OpenRouter, Vercel AI Gateway, Amazon Bedrock.

---
Data licensed CC BY 4.0. Cite as: AI Model Directory, "Nemotron 3 Nano 30B A3B", https://www.aimodel.directory/models/nemotron-3-nano-30b-a3b