The Known Good Updated 8 Oct 2026 Subscribe

API providers

Who actually serves the models, what they charge for them, and how fast they answer. Prices and endpoint telemetry are ingested from OpenRouter — we do not run our own provider benchmarks.

84 hosts serving tracked models
All 84 of 84 providers
Provider Models served Mean output t/s Mean TTFT Lowest blended $/M
OpenAI · first party 113 82 5.6s $0.069
DeepInfra 92 44 1.7s $0.025
Novita 89 58 1.8s $0.000
Google · first party 62 99 4.0s $0.087
Alibaba · first party 61 69 1.1s $0.055
Azure · first party 60 79 3.3s $0.14
Parasail 46 69 0.9s $0.030
SiliconFlow 43 43 1.6s $0.075
Together 43 84 0.8s $0.075
Amazon Bedrock · first party 40 83 2.6s $0.061
Venice 39 50 2.2s $0.11
AtlasCloud 36 54 1.7s $0.000
Anthropic · first party 33 92 2.6s $0.10
Phala 30 59 2.3s $0.068
CoreWeave 29 99 0.5s $0.055
GMICloud 29 49 2.9s $0.000
StreamLake 29 61 1.5s $0.066
Google AI Studio 27 80 5.5s $0.000
Mistral · first party 27 98 1.8s $0.075
Fireworks 25 101 2.0s $0.12
DigitalOcean 23 37 1.0s $0.12
Nebius 20 67 1.8s $0.10
NextBit 20 48 1.6s $0.060
Cloudflare 19 57 1.3s $0.041
Io Net 16 50 1.4s $0.025
Reka · first party 16 66 1.0s $0.095
BaseTen 14 120 0.9s $0.16
Morph 14 371 2.1s $0.17
Z.AI · first party 14 43 4.8s $0.24
PrimeIntellect 14 73 1.1s $0.13
Baidu · first party 13 69 0.9s $0.023
Crusoe 12 103 0.6s $0.087
Darkbloom 12 32 2.5s $0.000
Relace 12 75 1.0s $0.15
Claude Platform on AWS 12 60 2.2s $0.20
AkashML 11 46 1.0s $0.040
Chutes 11 23 2.7s $0.18
Wafer 11 72 1.1s $0.084
DekaLLM 11 58 0.9s $0.021
Groq 9 292 0.3s $0.058
Ionstream 9 37 6.7s $0.17
Mancer 2 9 42 0.8s $0.10
Sail Research 9 50 1.1s $0.11
Makora 9 92 1.2s $0.12
InferenceNet 9 102 1.0s $0.060
Decart 8 66 2.2s $0.000
Friendli 8 101 0.8s $0.20
Minimax · first party 8 67 1.0s $0.42
Nvidia · first party 8 53 1.2s $0.000
xAI · first party 8 114 2.3s $1.25
Cohere · first party 7 89 0.3s $0.000
Inceptron 7 58 0.8s $0.20
ModelRun 7 112 0.6s $0.000
SambaNova 7 120 1.3s $0.34
AionLabs 6 49 1.4s $0.88
DeepSeek · first party 6 86 0.9s $0.26
Mara 6 126 1.5s $0.30
Nex AGI 6 72 2.3s $0.000
OpenInference 6 25 2.0s $0.000
Poolside 6 65 1.3s $0.000
Seed · first party 6 63 0.9s $0.13
Meta · first party 5 125 3.3s $0.12
Perplexity · first party 5 46 13.4s $1.00
Tencent · first party 5 68 1.9s $0.077
Xiaomi · first party 5 47 3.4s $0.17
Modal 5 107 0.7s $0.24
Ambient 4 25 2.6s $0.10
Cerebras 4 479 0.3s $0.45
Moonshot AI · first party 4 37 2.5s $1.20
Sakana AI 4 66 6.4s $1.71
Inception 3 324 1.2s $0.068
Upstage · first party 3 88 1.1s $0.087
Stealth 3 37 5.7s $0.000
Inflection 2 — — $4.38
Perceptron 2 54 0.6s $0.49
StepFun 2 105 3.3s $0.44
Thinking Machines · first party 2 75 1.4s $0.000
Unbiased 2 46 3.2s $1.40
Tenstorrent 2 70 0.5s $0.20
AI21 · first party 1 — — $3.50
Arcee AI 1 193 0.6s $0.39
Liquid 1 226 0.4s $0.000
Near AI 1 18 2.1s $0.17
Krea 1 99 1.9s $0.39
How to read this. A host appears here once we have seen it serve at least one tracked model. Mean output t/s and mean TTFT average that host's measurements across every model it serves, so a host that only serves small models will look faster than one carrying frontier models — compare hosts on a single model page for a like-for-like reading. Lowest blended $/M is the cheapest blended rate that host publishes for any model, at a 3:1 input:output blend. Figures are ingested from OpenRouter endpoint listings and telemetry, with metadata enriched from models.dev. See methodology and attribution.