Requesty
All model families

gpt-4.1

Median total latency per provider over the last 24 hours, from live production traffic. This is the signal Requesty's latency router samples when it picks a provider for gpt-4.1.

Provider latency, last 24 hours

30 minute buckets · UTC
fastest provider, last 24h9 lead changes
200ms500ms1.0s2.0s5.0s10s20s16:0020:0000:0004:0008:0012:00azureopenaiazure @swedencentralazure @francecentral

Current routing standings

gpt-4.1

1azure @francecentral59.4%1.05s1.75s64%$1.112azure @swedencentral25.8%1.46s5.38s45%$1.523openai14.8%1.43s3.62s15%$2.294azure0.0%11.2s33.2s12%$3.30
fastest provider, last 24h9 lead changes

Win share is simulated with the production router's Thompson Sampling over the last hour of gpt-4.1 traffic.