Requesty
All model families

gpt-4o-mini

Median total latency per provider over the last 24 hours, from live production traffic. This is the signal Requesty's latency router samples when it picks a provider for gpt-4o-mini.

Provider latency, last 24 hours

30 minute buckets · UTC
fastest provider, last 24h9 lead changes
200ms500ms1.0s2.0s5.0s10s20s50s16:0020:0000:0004:0008:0012:00azure @swedencentralopenai

Current routing standings

gpt-4o-mini

1azure @swedencentral73.6%1.01s2.08s1%$0.162openai26.4%1.29s2.07s$0.21
fastest provider, last 24h9 lead changes

Win share is simulated with the production router's Thompson Sampling over the last hour of gpt-4o-mini traffic.