Models/gemini-2.5-flash-lite

gemini-2.5-flash-liteActive · Cloud

Google - Vertex AI · Released Jul 2025 · Proprietary

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...

Context
1.0M
Max output
66K
Input
$0.10
Output
$0.40
Cached in
$0.01
Latency
-

Capabilities

Core
Streaming
Function calling
JSON mode
Structured outputs
Multimodal
Vision
Image input
Audio
Image generation
Video
Advanced
Reasoning
Tool calling
MCP
Prompt caching
Batch API
Embeddings

Details

ReleasedJul 2025
LicenseProprietary
InputAudio, Image, Text, Video
OutputText
Throughput-
Availability99.4%

Related models