# nemotron-mini-4b-instruct

> nemotron-mini-4b-instruct is an open-weight language model from NVIDIA, released on 21 Aug 2024. It accepts text and generates text, with a 128K-token context window and up to 8K output tokens per response. NVIDIA has deprecated this model.

Source page: https://www.aimodel.directory/models/nemotron-mini-4b-instruct
Last verified: 4 Oct 2026

## Specifications

- **Developer:** NVIDIA
- **Release date:** 21 Aug 2024 (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/nvidia/models/nvidia/nemotron-mini-4b-instruct.toml)
- **Status:** Deprecated (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/nvidia/models/nvidia/nemotron-mini-4b-instruct.toml)
- **Weights:** Open weights (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/nvidia/models/nvidia/nemotron-mini-4b-instruct.toml)
- **Context window:** 128K (128,000 tokens) (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/nvidia/models/nvidia/nemotron-mini-4b-instruct.toml)
- **Max output:** 8K tokens (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/nvidia/models/nvidia/nemotron-mini-4b-instruct.toml)
- **Input:** Text (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/nvidia/models/nvidia/nemotron-mini-4b-instruct.toml)
- **Output:** Text (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/nvidia/models/nvidia/nemotron-mini-4b-instruct.toml)
- **Reasoning mode:** No (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/nvidia/models/nvidia/nemotron-mini-4b-instruct.toml)
- **Tool calling:** Yes (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/nvidia/models/nvidia/nemotron-mini-4b-instruct.toml)

## API pricing (USD per 1M tokens)

| Provider | Input | Output | Cached input | Context |
|---|---|---|---|---|

## FAQ

### What is the context window of nemotron-mini-4b-instruct?

nemotron-mini-4b-instruct has a context window of 128,000 tokens (128K) and can generate up to 8,192 tokens in a single response, according to models.dev.

### Is nemotron-mini-4b-instruct open source?

nemotron-mini-4b-instruct is an open-weight model. Check the license terms before commercial use.

### When was nemotron-mini-4b-instruct released?

NVIDIA released nemotron-mini-4b-instruct on 21 Aug 2024, according to models.dev.

---
Data licensed CC BY 4.0. Cite as: AI Model Directory, "nemotron-mini-4b-instruct", https://www.aimodel.directory/models/nemotron-mini-4b-instruct