◈ Multi-Provider · tokens/sec
Models Speed Benchmark
Same prompt · Streaming · Ranked by tokens / second
6 gateways · 30 models · One sentence answer
⏱ Auto-run Schedule
Loading…
Saved to
schedule.json + BENCHMARK_INTERVAL. Use disabled to stop autoruns. Next run shown above when enabled.
⚙ Providers & Models
ID
Provider
Base URL
API Key Env
Tier
★
Actions
Edits save to the server (D1 on Cloudflare,
models.json locally). Drag ⋮⋮ to reorder — top runs first; disabled models are skipped in runs.
Benchmark Output
Running…
—
Models Tested
—
Fastest (tok/s)
—
Winner
Tokens per Second ↑ (higher is better)
Loading results.json …
tokens / second →
Historical Performance — Tokens per Second up to 12 models · errors = gaps · x-axis shows run time + location
Run the benchmark multiple times to see historical trends