Gemini 2.5 Flash-Lite
Lean Gemini 2.5 lane for cheap multimodal traffic and quick agents
Model facts
- Context window
- 1.05M tokens
- Maximum output
- 66K tokens
- Cheapest paid input
- $0.1 per 1M tokens
- Cheapest paid output
- $0.1 per 1M tokens
- Open weights
- no
- Providers
- 26
Capabilities and modalities
reasoning, tool calling, structured output, attachments, temperature control, text, image, audio, video, pdf.
Artificial Analysis benchmarks
Compare this model on the full LLM benchmark leaderboard.
| Configuration | AAI | Coding | Math | Output tokens/s |
|---|---|---|---|---|
| Reasoning | 11.4 | not measured | 53.3 | not measured |
| Non-reasoning | 6.7 | not measured | 35.3 | not measured |
Observed price history
- 2026-08-24: $0.1 input / $0.1 output per 1M tokens
API providers
- Kenari — model id gemini-2-5-flash-lite; free input / free output per 1M tokens; provider documentation
- LLMTR — model id google/gemini-2.5-flash-lite; $0.1 input / $0.1 output per 1M tokens; provider documentation
- OpenRouter — model id google/gemini-2.5-flash-lite:batch; $0.05 input / $0.2 output per 1M tokens; provider documentation
- Poe — model id google/gemini-2.5-flash-lite; $0.07 input / $0.28 output per 1M tokens; provider documentation
- Jiekou.AI — model id gemini-2.5-flash-lite; $0.09 input / $0.36 output per 1M tokens; provider documentation
- Helicone — model id gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- OpenRouter — model id google/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- CrossModel — model id gemini/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- DevPass (LLM Gateway) — model id gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- Google — model id gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- Impossibl — model id google/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- Kilo Gateway — model id google/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- LLM Gateway — model id google-ai-studio/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- LLM Gateway — model id google-vertex/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- Merge Gateway — model id google/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- NEAR AI Cloud — model id google/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- NanoGPT — model id gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- Ofox — model id google/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- OrcaRouter — model id google/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- Requesty (EU) — model id gemini-2.5-flash-lite@eu; $0.1 input / $0.4 output per 1M tokens; provider documentation
- SAP AI Core — model id gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- Vercel AI Gateway — model id google/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- Vertex — model id gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- ZenMux — model id google/gemini-2.5-flash-lite; $0.1 input / $0.4 output per 1M tokens; provider documentation
- AnyAPI — model id google/gemini-2.5-flash-lite; not published input / not published output per 1M tokens; provider documentation
- Qiniu — model id gemini-2.5-flash-lite; not published input / not published output per 1M tokens; provider documentation