Fast Gemini workhorse for multimodal apps where latency and price matter
Benchmarks
| Benchmark | Category | Score | Variant | Provenance | Source | Observed |
|---|---|---|---|---|---|---|
| AA Intelligence Index | intelligence | 13.1 | thinking | independent | aa | Sep 9, 2026 |
| Design Arena — 3d | preference | 1100 | — | mirror | openrouter | Sep 18, 2026 |
| Design Arena — codecategories | preference | 1118 | — | mirror | openrouter | Sep 21, 2026 |
| Design Arena — dataviz | preference | 1149 | — | mirror | openrouter | Sep 20, 2026 |
| Design Arena — gamedev | preference | 1089 | — | mirror | openrouter | Sep 18, 2026 |
| Design Arena — svg | preference | 1043 | — | mirror | openrouter | Sep 18, 2026 |
| Design Arena — uicomponent | preference | 1109 | — | mirror | openrouter | Sep 20, 2026 |
| Design Arena — website | preference | 1127 | — | mirror | openrouter | Sep 11, 2026 |
| LMArena Text | preference | 1417 | — | crowd | lmarena | Sep 13, 2026 |
| LMArena Vision | preference | 1236 | — | crowd | lmarena | Sep 13, 2026 |
| Median output speed | speed | 230 tok/s | thinking | independent | aa | Sep 21, 2026 |
| Median time to first token | speed | 13.98s | thinking | independent | aa | Sep 21, 2026 |
Includes index data from Artificial Analysis.
Providers
Live operational stats per hosting endpoint, via OpenRouter.
| Provider | Quant | Context | $/1M in · out | Uptime 24h | Latency | Throughput |
|---|---|---|---|---|---|---|
| Google AI Studio | — | 1.0M | $0.3 · $2.5 | 99.87% | — | — |
| Google AI Studio | — | 1.0M | $0.15 · $1.25 | 99.98% | — | — |
| Google AI Studio | — | 1.0M | $0.54 · $4.5 | 94.64% | — | — |
| — | 1.0M | $0.3 · $2.5 | 80.58% | — | — | |
| — | 1.0M | $0.3 · $2.5 | 99.49% | — | — | |
| — | 1.0M | $0.3 · $2.5 | 99.56% | — | — | |
| — | 1.0M | $0.54 · $4.5 | 99.80% | — | — |