Models/llama-3.1-8b-instant

llama-3.1-8b-instantActive · Inference

Groq AI · Released · Llama Community License

Groq chat model.

Context
128K
Max output
8K
Input
$0.05
Output
$0.08
Cached in
-
Latency
-

Capabilities

Core
Streaming
Function calling
JSON mode
Structured outputs
Multimodal
Vision
Image input
Audio
Image generation
Video
Advanced
Reasoning
Tool calling
MCP
Prompt caching
Batch API
Embeddings

Details

ProviderGroq AI
Released
LicenseLlama Community License
InputText
OutputText
Throughput-
Availability-

Related models