Model profile
Gemini 2.5 Flash Lite
MaintenanceUltra-lightweight model for high-volume, cost-sensitive workloads.
Everything you need to evaluate this model before wiring it into production.
This model remains in the public catalog, but Token101 has paused live routing while upstream availability is being restored.
gemini-2.5-flash-liteProvider
Google Gemini
Launch status
Maintenance
Context window
1.0M
Prompt caching
Not supported
API routing is pausedView Pricing
Capabilities
Check context size, supported modalities, and output limits before you integrate.
Context window
1.0M
Max output
65.5K
Input modalities
Text, Image
Output modalities
Text
Prompt caching
Not supported