llama-3.3-70b-versatile
- Input / 1M
- $0.59
- Output / 1M
- $0.79
- Cached input
- —
- Context
- 128K
A 1,000-token prompt costs $0.00059 to send. Token counts for Groq models are estimated — approximated, because this family has no public tokenizer.
- Tool calling
- Max output 33K
Priced closest to this
| Model | Provider | Input | Output | |
|---|---|---|---|---|
| llama3.1-70b | Cerebras | $0.60 | $0.60 | |
| gpt-audio-mini | OpenAI | $0.60 | $2.40 | |
| kimi-k2-0711-preview | Moonshot | $0.60 | $2.50 | |
| kimi-k2-0905-preview | Moonshot | $0.60 | $2.50 | compare |
| kimi-k2-thinking | Moonshot | $0.60 | $2.50 | |
| kimi-k2.5 | Moonshot | $0.60 | $3.00 | compare |
Compare llama-3.3-70b-versatile
- vs claude-fable-5
- vs claude-opus-5
- vs claude-sonnet-5
- vs command-r
- vs command-r-plus
- vs deepseek-v3.2
- vs deepseek-v4-flash
- vs deepseek-v4-pro
- vs gemini-3.5-flash
- vs gemini-3.5-flash-lite
- vs gemini-3.6-flash
- vs gpt-5.6
- vs gpt-5.6-sol
- vs gpt-5.6-terra
- vs gpt-oss-120b
- vs grok-4-1-fast
- vs grok-4-1-fast-reasoning
- vs grok-4.20-0309-reasoning
- vs jamba-large-1.6
- vs jamba-large-1.7
- vs jamba-mini-1.7
- vs kimi-k2-0905-preview
- vs kimi-k2.5
- vs kimi-k2.6
- vs llama-3.1-70b-instruct
- vs llama-3.1-8b-instant
- vs llama-3.1-8b-instruct
- vs ministral-8b-latest
- vs mistral-large-3
- vs mistral-medium-3-5
- vs sonar-pro
- vs zai-glm-4.6
- vs zai-glm-4.7