# Llama 4 Scout 17B 16E Instruct

> Llama 4 Scout 17B 16E Instruct is an open-weight language model from Meta, released on 5 Apr 2025. It accepts text and images and generates text, with a 131K-token context window and up to 16K output tokens per response. As of 4 Oct 2026, the lowest listed API price is $0.17 per million input tokens and $0.66 per million output tokens (Amazon Bedrock), across 2 providers we track.

Source page: https://www.aimodel.directory/models/llama-4-scout-17b-instruct
Last verified: 4 Oct 2026

## Specifications

- **Developer:** Meta
- **Release date:** 5 Apr 2025 (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)
- **Status:** Generally available (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)
- **Weights:** Open weights (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)
- **Context window:** 131K (131,000 tokens) (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)
- **Max output:** 16K tokens (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)
- **Knowledge cutoff:** Aug 2024 (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)
- **Input:** Text and images (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)
- **Output:** Text (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)
- **Reasoning mode:** No (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)
- **Tool calling:** Yes (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)
- **Structured output:** No (source: models.dev, https://github.com/sst/models.dev/blob/dev/providers/cloudflare-workers-ai/models/@cf/meta/llama-4-scout-17b-16e-instruct.toml)

## API pricing (USD per 1M tokens)

| Provider | Input | Output | Cached input | Context |
|---|---|---|---|---|
| Amazon Bedrock | $0.17 | $0.66 | – | 10M |
| Amazon Bedrock | $0.17 | $0.66 | – | 10M |
| Cloudflare Workers AI | $0.27 | $0.85 | – | 131K |

## FAQ

### What is the context window of Llama 4 Scout 17B 16E Instruct?

Llama 4 Scout 17B 16E Instruct has a context window of 131,000 tokens (131K) and can generate up to 16,384 tokens in a single response, according to models.dev.

### How much does the Llama 4 Scout 17B 16E Instruct API cost?

Llama 4 Scout 17B 16E Instruct is listed from $0.17 per million input tokens and $0.66 per million output tokens (Amazon Bedrock). Prices last verified 4 Oct 2026.

### Is Llama 4 Scout 17B 16E Instruct open source?

Llama 4 Scout 17B 16E Instruct is an open-weight model. Check the license terms before commercial use.

### When was Llama 4 Scout 17B 16E Instruct released?

Meta released Llama 4 Scout 17B 16E Instruct on 5 Apr 2025, according to models.dev.

### Which providers offer Llama 4 Scout 17B 16E Instruct?

We track Llama 4 Scout 17B 16E Instruct on 2 providers: Amazon Bedrock, Cloudflare Workers AI.

---
Data licensed CC BY 4.0. Cite as: AI Model Directory, "Llama 4 Scout 17B 16E Instruct", https://www.aimodel.directory/models/llama-4-scout-17b-instruct