Largest Gemma 4 instruction model for open, self-hosted chat and reasoning
Benchmarks
| Benchmark | Category | Score | Variant | Provenance | Source | Observed |
|---|---|---|---|---|---|---|
| AA Agentic Index | agentic | 14.4 | — | mirror | openrouter | Jul 23, 2026 |
| AA Coding Index | coding | 43.4 | — | mirror | openrouter | Jul 23, 2026 |
| AA Intelligence Index | intelligence | 29.4 | — | mirror | openrouter | Jul 23, 2026 |
Includes index data from Artificial Analysis.
Providers
Live operational stats per hosting endpoint, via OpenRouter.
| Provider | Quant | Context | $/1M in · out | Uptime 24h | Latency | Throughput |
|---|---|---|---|---|---|---|
| Cerebras | fp16 | 131K | $0.99 · $1.49 | 99.97% | — | — |
| Chutes | fp4 | 131K | $0.12 · $0.37 | 87.77% | — | — |
| CoreWeave | bf16 | 262K | $0.12 · $0.35 | 99.48% | — | — |
| Crusoe | — | 262K | $0.14 · $0.4 | 99.55% | — | — |
| DeepInfra | fp8 | 262K | $0.13 · $0.38 | 97.02% | — | — |
| DeepInfra | fp4 | 262K | $0.12 · $0.37 | 94.16% | — | — |
| Friendli | — | 262K | $0.14 · $0.4 | 98.87% | — | — |
| ModelRun | fp4 | 262K | $0.22 · $0.55 | 99.40% | — | — |
| Morph | fp4 | 175K | $0.14 · $0.4 | 97.74% | — | — |
| Novita | bf16 | 262K | $0.14 · $0.4 | 90.44% | — | — |
| OpenInference | bf16 | 262K | $0.1 · $0.35 | 99.35% | — | — |
| Parasail | fp8 | 262K | $0.15 · $0.4 | 95.44% | — | — |
| Phala | — | 262K | $0.15 · $0.46 | 76.27% | — | — |
| SambaNova | — | 131K | $0.38 · $1.15 | 99.53% | — | — |
| SiliconFlow | fp8 | 262K | $0.13 · $0.4 | 84.62% | — | — |
| Together | — | 262K | $0.39 · $0.97 | 96.08% | — | — |
| Venice | bf16 | 256K | $0.12 · $0.36 | 99.36% | — | — |