llama-3.2-1b-instruct
meta
The Llama 3.2 instruction-tuned text only models are optimized for multilingual dialogue use cases, including agentic retrieval and summarization tasks.
- Context window
- 60,000 tokens
- Input cost
- —
- Output cost
- —
- Latency (p50)
- 233 ms
