Models/mercury-2

mercury-2Active · Cloud

Inception · Released Mar 2026 · Proprietary

Mercury 2 is an extremely fast reasoning LLM, and the first reasoning diffusion LLM (dLLM). Instead of generating tokens sequentially, Mercury 2 produces and refines multiple tokens in parallel, achieving...

Context
128K
Max output
50K
Input
$0.25
Output
$0.75
Cached in
$0.02
Latency
-

Capabilities

Core
Streaming
Function calling
JSON mode
Structured outputs
Multimodal
Vision
Image input
Audio
Image generation
Video
Advanced
Reasoning
Tool calling
MCP
Prompt caching
Batch API
Embeddings

Details

ProviderInception
ReleasedMar 2026
LicenseProprietary
InputText
OutputText
Throughput-
Availability100%

Related models