Models/Ling-3.0-flash

Ling-3.0-flashActive · Cloud

DeepInfra · Released Jul 2026 · MIT

*Ling-3.0-flash* is a *124B-parameter Mixture-of-Experts (MoE) model*, with approximately *5.1B parameters activated per token*. The model is designed with *token efficiency and production-scale agentic inference* as key priorities, enabling developers...

Context
131K
Max output
0
Input
$0.06
Output
$0.18
Cached in
$0.01
Latency
-

Capabilities

Core
Streaming
Function calling
JSON mode
Structured outputs
Multimodal
Vision
Image input
Audio
Image generation
Video
Advanced
Reasoning
Tool calling
MCP
Prompt caching
Batch API
Embeddings

Details

ProviderDeepInfra
ReleasedJul 2026
LicenseMIT
InputText
OutputText
Throughput-
Availability100%

Related models