Measured performance

Provider & model performance

Measured time-to-first-token, time-to-first-byte, throughput, and uptime for every LLM provider and model TrustedRouter routes to — continuously sampled, not vendor-claimed.

Last updated 2026-07-25T07:19:48Z
Continuously sampled from TrustedRouter's monitor regions over the 5,000-sample benchmark set — time-to-first-token (TTFT), time-to-first-byte (TTFB), throughput, and success rate measured on real streaming requests, not vendor-claimed. Unsupported route and probe-configuration rows are reported separately and do not count as provider downtime. No prompt or output content is ever stored.

Providers

Ranked by measured p50 time-to-first-token across all of a provider's models in the 5,000-sample benchmark set (35 providers · 814 samples).

#ProviderModels p50 TTFTThroughputUptimeErrorsConfig excludedSamples
1 google-vertex 8 1646 ms 1 tok/s 100.00% 68
2 baseten 8 1940 ms 100.00% 19
3 friendli 7 2066 ms 100.00% 21
4 cerebras 6 2230 ms 100.00% 22
5 openai 17 2256 ms 100.00% 27
6 tinfoil 5 2365 ms 49 tok/s 92.59% ReadTimeout 7% 54
7 together 7 2532 ms 100.00% 9
8 deepseek 2 2704 ms 100.00% 15
9 siliconflow 9 2839 ms 100.00% 11
10 wafer 5 3030 ms 100.00% 23
11 zai 10 3080 ms 100.00% 16
12 anthropic 6 3142 ms 100.00% 22
13 grok 4 3227 ms 100.00% 14
14 digitalocean 14 3439 ms 100.00% 27
15 kimi 10 3603 ms 100.00% 19
16 inceptron 3 3895 ms 100.00% 12
17 gmi 4 4021 ms 100.00% 20
18 thinkingmachines 1 4411 ms 100.00% 19
19 novita 22 4418 ms 91.67% ReadTimeout 8% 24
20 xiaomi 3 4624 ms 100.00% 21
21 parasail 10 4719 ms 100.00% 15
22 chutes 9 4781 ms 95.24% provider_error 5% 21
23 minimax 5 5086 ms 100.00% 17
24 atlas-cloud 22 5163 ms 100.00% 25
25 lightning 8 5314 ms 91.67% http_503 8% 12
26 nebius 16 5409 ms 100.00% 20
27 deepinfra 17 6219 ms 95.65% ReadTimeout 4% 23
28 venice 10 6606 ms 100.00% 22
29 makora 5 7244 ms 100.00% 11
30 google-ai-studio 11 7421 ms 4 tok/s 40.24% provider_error 60% 82
31 crusoe 13 8169 ms 100.00% 22
32 mistral 8 8200 ms 100.00% 20
33 fireworks 5 8560 ms 100.00% 17
34 morph 8 8663 ms 100.00% 25
35 phala 1 8964 ms 89.47% ReadTimeout 11% 19

Models

Models sampled in the 5,000-sample benchmark set, fastest measured TTFT first. Rows with few samples are marked — more data sharpens the numbers.

#ModelProvider p50 TTFTp95 TTFTp50 TTFB ThroughputUptimeConfig excludedSamples
1 qwen/qwen3-235b-a22b-thinking-2507 limited data deepinfra 695 ms 19289 ms 695 ms 66.67% 3
2 openai/gpt-5.4-mini limited data openai 717 ms 717 ms 716 ms 100.00% 1
3 nvidia/nemotron-3-nano-omni-reasoning-30b-a3b limited data crusoe 786 ms 786 ms 786 ms 100.00% 1
4 moonshotai/kimi-k2.7-code limited data baseten 846 ms 9923 ms 846 ms 100.00% 2
5 z-ai/glm-5.2 limited data friendli 856 ms 9636 ms 856 ms 100.00% 2
6 qwen/qwen3-next-80b-a3b-instruct limited data deepinfra 960 ms 960 ms 960 ms 100.00% 1
7 z-ai/glm-4.7 limited data cerebras 987 ms 6738 ms 987 ms 100.00% 2
8 z-ai/glm-4.7 limited data baseten 1017 ms 1025 ms 1017 ms 100.00% 2
9 openai/gpt-5.6-luna limited data openai 1021 ms 1943 ms 1021 ms 100.00% 3
10 minimax/minimax-m2.5 limited data digitalocean 1029 ms 1029 ms 1028 ms 100.00% 1
11 qwen/qwen3-next-80b-a3b-instruct limited data parasail 1051 ms 1051 ms 1051 ms 100.00% 1
12 qwen/qwen3-235b-a22b-2507 limited data friendli 1066 ms 18836 ms 1066 ms 100.00% 4
13 NousResearch/Hermes-4-70B limited data nebius 1129 ms 1129 ms 1129 ms 100.00% 1
14 moonshotai/moonshot-v1-8k limited data kimi 1138 ms 13466 ms 1138 ms 100.00% 2
15 deepseek/deepseek-v4-flash limited data deepinfra 1224 ms 8966 ms 1223 ms 100.00% 2
16 qwen/qwen3.5-397b-a17b limited data digitalocean 1367 ms 2189 ms 1367 ms 100.00% 2
17 google/gemma-3-27b-it limited data nebius 1381 ms 1381 ms 1381 ms 100.00% 1
18 z-ai/glm-5.2-fast limited data baseten 1413 ms 8996 ms 1413 ms 100.00% 4
19 google/gemini-2.5-flash limited data atlas-cloud 1456 ms 1456 ms 1456 ms 100.00% 1
20 nvidia/Llama-3_1-Nemotron-Ultra-253B-v1 limited data nebius 1474 ms 1535 ms 1473 ms 100.00% 3
21 openai/o3-mini limited data openai 1516 ms 1516 ms 1516 ms 100.00% 1
22 mistralai/mistral-medium-3-5 limited data mistral 1555 ms 4164 ms 1555 ms 100.00% 2
23 z-ai/glm-5v-turbo limited data atlas-cloud 1603 ms 1603 ms 1603 ms 100.00% 1
24 nvidia/nemotron-3-ultra-550b-a55b limited data together 1607 ms 5461 ms 1607 ms 100.00% 2
25 x-ai/grok-build-0.1 limited data grok 1628 ms 4765 ms 1627 ms 100.00% 2
26 minimax/minimax-m2.5 limited data friendli 1640 ms 2209 ms 1640 ms 100.00% 2
27 morph/morph-v3-fast limited data morph 1644 ms 5868 ms 1644 ms 100.00% 3
28 google/gemini-2.5-flash-lite google-vertex 1646 ms 10906 ms 1645 ms 1 tok/s 100.00% 47
29 openai/gpt-oss-120b limited data parasail 1667 ms 3626 ms 1667 ms 100.00% 2
30 qwen/qwen3-235b-a22b-instruct-2507 limited data novita 1669 ms 1669 ms 1669 ms 100.00% 1
31 minimax/minimax-m3 limited data morph 1679 ms 6192 ms 1678 ms 100.00% 2
32 nvidia/Cosmos3-Super-Reasoner limited data nebius 1738 ms 1738 ms 1738 ms 100.00% 1
33 Qwen/Qwen3-30B-A3B-Instruct-2507 limited data nebius 1749 ms 10379 ms 1749 ms 100.00% 2
34 qwen/qwen2.5-vl-72b-instruct limited data parasail 1771 ms 1771 ms 1771 ms 100.00% 1
35 google/gemini-3.5-flash limited data google-vertex 1783 ms 1783 ms 1783 ms 100.00% 1
36 mistralai/ministral-14b-2512 limited data mistral 1796 ms 1796 ms 1796 ms 100.00% 1
37 z-ai/glm-5.2 limited data makora 1827 ms 4973 ms 1827 ms 100.00% 2
38 moonshotai/kimi-k2.7-code limited data kimi 1829 ms 13835 ms 1829 ms 100.00% 2
39 google/gemma-3n-e4b-it limited data together 1836 ms 1836 ms 1835 ms 100.00% 1
40 mistralai/mistral-nemo limited data novita 1857 ms 18417 ms 1857 ms 100.00% 2
41 morph/morph-v3-large limited data morph 1859 ms 8870 ms 1858 ms 100.00% 3
42 google/gemini-3-flash-preview limited data google-vertex 1860 ms 2171 ms 1860 ms 100.00% 3
43 x-ai/grok-4.3 limited data atlas-cloud 1915 ms 1915 ms 1915 ms 100.00% 1
44 openai/gpt-5.6-sol limited data openai 1934 ms 6176 ms 1934 ms 100.00% 2
45 openai/gpt-4o-mini limited data openai 1935 ms 5026 ms 1935 ms 100.00% 4
46 openai/gpt-oss-120b limited data baseten 1940 ms 17491 ms 1940 ms 100.00% 4
47 thinkingmachines/inkling-1m limited data baseten 1940 ms 1940 ms 1940 ms 100.00% 1
48 cerebras/gpt-oss-120b limited data cerebras 1942 ms 9072 ms 1942 ms 100.00% 4
49 moonshotai/moonshot-v1-128k-vision-preview limited data kimi 1952 ms 1952 ms 1951 ms 100.00% 1
50 moonshotai/kimi-k2.7-code limited data siliconflow 2004 ms 2779 ms 2004 ms 100.00% 2
51 openai/o4-mini limited data openai 2006 ms 2006 ms 2006 ms 100.00% 1
52 bytedance/ui-tars-1.5-7b limited data parasail 2041 ms 18031 ms 2041 ms 100.00% 3
53 openai/gpt-oss-120b limited data novita 2045 ms 2045 ms 2044 ms 100.00% 1
54 z-ai/glm-5 limited data atlas-cloud 2057 ms 2057 ms 2057 ms 100.00% 1
55 lgai-exaone/k-exaone-236b-a23b limited data friendli 2066 ms 10264 ms 2065 ms 100.00% 6
56 xiaomi/mimo-v2.5 limited data digitalocean 2072 ms 7291 ms 2072 ms 100.00% 2
57 moonshotai/kimi-k2.7-code limited data together 2104 ms 2104 ms 2104 ms 100.00% 1
58 anthropic/claude-haiku-4.5 limited data anthropic 2117 ms 10432 ms 2117 ms 100.00% 4
59 deepseek/deepseek-v4-pro limited data digitalocean 2133 ms 13168 ms 2132 ms 100.00% 2
60 qwen/qwen3.5-9b limited data siliconflow 2181 ms 2181 ms 2181 ms 100.00% 1
61 nvidia/nemotron-3-nano-omni limited data digitalocean 2196 ms 2196 ms 2196 ms 100.00% 1
62 google/gemini-3-flash-preview limited data google-ai-studio 2219 ms 4294 ms 2218 ms 100.00% 2
63 google/gemini-2.5-flash limited data google-vertex 2220 ms 9131 ms 2220 ms 165 tok/s 100.00% 10
64 google/gemma-4-31b-it limited data cerebras 2230 ms 14085 ms 2229 ms 100.00% 8
65 z-ai/glm-5.2 limited data fireworks 2250 ms 23186 ms 2250 ms 100.00% 4
66 openai/gpt-4-turbo limited data openai 2256 ms 2256 ms 2256 ms 100.00% 1
67 moonshotai/kimi-k2.7-code-highspeed limited data kimi 2257 ms 10977 ms 2257 ms 100.00% 4
68 z-ai/glm-4.5v limited data zai 2287 ms 8041 ms 2287 ms 100.00% 4
69 x-ai/grok-4.5 limited data grok 2288 ms 11323 ms 2288 ms 100.00% 3
70 anthropic/claude-sonnet-5 limited data anthropic 2317 ms 13959 ms 2316 ms 100.00% 5
71 meta-llama/llama-4-maverick limited data digitalocean 2317 ms 6198 ms 2317 ms 100.00% 4
72 qwen/qwen3-vl-235b-a22b-instruct limited data deepinfra 2322 ms 2322 ms 2321 ms 100.00% 1
73 google/gemini-2.5-flash-lite limited data atlas-cloud 2352 ms 10654 ms 2352 ms 100.00% 2
74 moonshotai/kimi-k2-0905 limited data novita 2362 ms 2362 ms 2362 ms 100.00% 1
75 openai/gpt-oss-120b tinfoil 2365 ms 15360 ms 2364 ms 49 tok/s 100.00% 30
76 deepseek/deepseek-v4-pro limited data deepseek 2365 ms 12139 ms 2365 ms 100.00% 4
77 z-ai/glm-5.1 limited data chutes 2380 ms 2380 ms 2380 ms 100.00% 1
78 openai/gpt-4o limited data lightning 2405 ms 2405 ms 2405 ms 100.00% 1
79 google/gemma-4-31b-it limited data friendli 2411 ms 4427 ms 2411 ms 100.00% 2
80 inclusionai/ling-2.6-1t limited data novita 2421 ms 2421 ms 2420 ms 100.00% 1
81 xiaomi/mimo-v2.5-pro limited data xiaomi 2468 ms 9561 ms 2468 ms 100.00% 6
82 z-ai/glm-4.5-air limited data zai 2486 ms 13743 ms 2486 ms 100.00% 2
83 z-ai/glm-5v-turbo limited data siliconflow 2506 ms 2506 ms 2506 ms 100.00% 1
84 moonshotai/kimi-k2.6 limited data together 2532 ms 12096 ms 2532 ms 100.00% 2
85 google/gemma-4-31b-it limited data novita 2608 ms 2608 ms 2608 ms 100.00% 1
86 tencent/hy3 limited data siliconflow 2620 ms 2620 ms 2620 ms 100.00% 1
87 moonshotai/kimi-k2.6 limited data novita 2637 ms 2637 ms 2637 ms 100.00% 1
88 deepseek/deepseek-v4-flash limited data deepseek 2704 ms 16724 ms 2703 ms 100.00% 11
89 google/gemma-4-31b-it limited data crusoe 2708 ms 6300 ms 2708 ms 100.00% 2
90 openai/o1 limited data openai 2712 ms 4738 ms 2712 ms 100.00% 2
91 z-ai/glm-5.1 limited data zai 2729 ms 2729 ms 2729 ms 100.00% 1
92 z-ai/glm-5 limited data gmi 2779 ms 9394 ms 2779 ms 100.00% 6
93 google/gemma-4-31b-turbo limited data chutes 2781 ms 4122 ms 2781 ms 100.00% 2
94 deepseek/deepseek-v3.2 limited data friendli 2820 ms 16728 ms 2820 ms 100.00% 2
95 deepseek/deepseek-v4-pro limited data makora 2820 ms 5177 ms 2819 ms 100.00% 2
96 qwen/qwen3.5-397b-a17b limited data novita 2838 ms 2838 ms 2838 ms 100.00% 1
97 google/gemma-4-26b-a4b-it limited data siliconflow 2839 ms 12728 ms 2839 ms 100.00% 2
98 nvidia/nemotron-3-nano-30b-a3b limited data crusoe 2845 ms 8408 ms 2844 ms 100.00% 2
99 minimax/minimax-m3 limited data wafer 2896 ms 13453 ms 2895 ms 100.00% 6
100 google/gemini-3.6-flash limited data google-ai-studio 3007 ms 3007 ms 3007 ms 100.00% 1
101 z-ai/glm-5.2-fast limited data wafer 3030 ms 9496 ms 3030 ms 100.00% 6
102 google/gemini-3-flash-preview limited data lightning 3046 ms 3137 ms 3046 ms 100.00% 2
103 z-ai/glm-5 limited data zai 3080 ms 7761 ms 3080 ms 100.00% 2
104 z-ai/glm-5-turbo limited data zai 3094 ms 3094 ms 3094 ms 100.00% 1
105 gryphe/mythomax-l2-13b limited data deepinfra 3104 ms 3104 ms 3104 ms 100.00% 1
106 anthropic/claude-opus-4.5 limited data anthropic 3142 ms 11027 ms 3141 ms 100.00% 4
107 x-ai/grok-4.3 limited data grok 3227 ms 17686 ms 3227 ms 100.00% 3
108 z-ai/glm-5 limited data digitalocean 3248 ms 3248 ms 3248 ms 100.00% 1
109 qwen/qwen3-235b-a22b-thinking-2507 limited data venice 3264 ms 3757 ms 3263 ms 100.00% 3
110 openai/gpt-3.5-turbo limited data openai 3268 ms 7448 ms 3267 ms 100.00% 2
111 minimax/minimax-m2.5-highspeed limited data minimax 3275 ms 14065 ms 3275 ms 100.00% 5
112 google/gemini-2.5-pro limited data atlas-cloud 3365 ms 3365 ms 3365 ms 100.00% 1
113 minimax/minimax-m2.5 limited data chutes 3369 ms 15618 ms 3369 ms 66.67% 3
114 deepseek/deepseek-v4-flash limited data siliconflow 3371 ms 3371 ms 3371 ms 100.00% 1
115 deepseek/deepseek-v3-0324 limited data crusoe 3378 ms 16807 ms 3378 ms 100.00% 2
116 Qwen/Qwen3-Next-80B-A3B-Thinking limited data nebius 3436 ms 3436 ms 3436 ms 100.00% 1
117 meta-llama/llama-3.3-70b-instruct limited data digitalocean 3439 ms 4081 ms 3439 ms 100.00% 3
118 mistralai/mistral-small-3.2-24b-instruct limited data mistral 3539 ms 15105 ms 3539 ms 100.00% 3
119 deepseek/deepseek-v4-flash limited data makora 3600 ms 3600 ms 3600 ms 100.00% 1
120 moonshotai/kimi-k2.5 limited data kimi 3603 ms 4851 ms 3603 ms 100.00% 2
121 minimax/minimax-m2 limited data minimax 3604 ms 3604 ms 3604 ms 100.00% 1
122 qwen/qwen3.5-397b-a17b limited data chutes 3640 ms 3640 ms 3640 ms 100.00% 1
123 moonshotai/kimi-k2.6 limited data atlas-cloud 3657 ms 3657 ms 3657 ms 100.00% 1
124 z-ai/glm-5.1 limited data friendli 3691 ms 14272 ms 3691 ms 100.00% 3
125 z-ai/glm-4.6v limited data zai 3795 ms 3795 ms 3795 ms 100.00% 1
126 mistralai/mistral-small-2603 limited data mistral 3805 ms 4089 ms 3804 ms 100.00% 2
127 z-ai/glm-5.1 limited data wafer 3824 ms 8116 ms 3824 ms 100.00% 3
128 moonshotai/kimi-k2.6 limited data inceptron 3895 ms 17904 ms 3895 ms 100.00% 7
129 qwen/qwen3-vl-30b-a3b-instruct limited data novita 3980 ms 3980 ms 3980 ms 100.00% 1
130 google/gemini-3.6-flash limited data google-vertex 4010 ms 6644 ms 4009 ms 100.00% 2
131 z-ai/glm-5.1 limited data gmi 4021 ms 6785 ms 4021 ms 100.00% 4
132 z-ai/glm-4.7-flash limited data venice 4096 ms 4096 ms 4096 ms 100.00% 1
133 tencent/hy3 limited data atlas-cloud 4185 ms 4185 ms 4185 ms 100.00% 1
134 minimax/minimax-m2.7 limited data morph 4317 ms 4319 ms 4317 ms 100.00% 3
135 openai/gpt-5.6-terra limited data openai 4334 ms 4334 ms 4333 ms 100.00% 1
136 x-ai/grok-4.20 limited data grok 4367 ms 8833 ms 4367 ms 100.00% 6
137 thinkingmachines/inkling limited data thinkingmachines 4411 ms 19659 ms 4411 ms 100.00% 19
138 x-ai/grok-4.5 limited data atlas-cloud 4416 ms 4416 ms 4416 ms 100.00% 1
139 kwaipilot/kat-coder-pro limited data novita 4418 ms 4418 ms 4418 ms 100.00% 1
140 google/gemma-4-26b-a4b-it limited data deepinfra 4419 ms 4419 ms 4419 ms 100.00% 1
141 openai/gpt-4 limited data lightning 4468 ms 8225 ms 4468 ms 100.00% 2
142 google/gemini-3.1-pro-preview limited data google-vertex 4535 ms 8047 ms 4535 ms 100.00% 3
143 z-ai/glm-5.1 limited data digitalocean 4545 ms 12575 ms 4545 ms 100.00% 2
144 xiaomi/mimo-v2.5 limited data xiaomi 4624 ms 16036 ms 4624 ms 100.00% 10
145 moonshotai/moonshot-v1-32k limited data kimi 4650 ms 9053 ms 4650 ms 100.00% 2
146 meta-llama/llama-4-maverick limited data parasail 4719 ms 8723 ms 4719 ms 100.00% 2
147 thinkingmachines/inkling limited data together 4725 ms 4725 ms 4725 ms 100.00% 1
148 google/gemini-3.5-flash-lite limited data google-vertex 4744 ms 4744 ms 4744 ms 100.00% 1
149 mistralai/mistral-nemo limited data chutes 4781 ms 8744 ms 4780 ms 100.00% 4
150 qwen/qwen3-coder-next limited data parasail 4887 ms 4887 ms 4887 ms 100.00% 1
151 openai/gpt-oss-120b limited data deepinfra 4892 ms 11487 ms 4892 ms 100.00% 2
152 z-ai/glm-5v-turbo limited data zai 4899 ms 4899 ms 4898 ms 100.00% 1
153 moonshotai/kimi-k2.6 limited data fireworks 4916 ms 9303 ms 4916 ms 100.00% 3
154 nvidia/nemotron-3-ultra-550b-a55b limited data baseten 4938 ms 11696 ms 4938 ms 100.00% 2
155 qwen/qwen3-omni-30b-a3b-instruct limited data novita 4984 ms 4984 ms 4984 ms 100.00% 1
156 deepseek/deepseek-v3.1-terminus limited data atlas-cloud 5075 ms 5075 ms 5075 ms 100.00% 1
157 moonshotai/kimi-k2.7-code limited data inceptron 5082 ms 7441 ms 5081 ms 100.00% 3
158 minimax/minimax-m2.1-highspeed limited data minimax 5086 ms 11367 ms 5086 ms 100.00% 5
159 openai/gpt-5.4-mini limited data atlas-cloud 5163 ms 8512 ms 5163 ms 100.00% 3
160 z-ai/glm-5.2 limited data chutes 5228 ms 21455 ms 5228 ms 100.00% 3
161 openai/gpt-4.1 limited data lightning 5314 ms 5314 ms 5314 ms 100.00% 1
162 moonshotai/kimi-k2.6 limited data tinfoil 5344 ms 12016 ms 5344 ms 100.00% 8
163 deepseek/deepseek-v4-pro limited data gmi 5384 ms 12889 ms 5384 ms 100.00% 5
164 moonshotai/Kimi-K2.7-Code limited data nebius 5409 ms 5409 ms 5409 ms 100.00% 1
165 z-ai/glm-4.5 limited data zai 5440 ms 6951 ms 5439 ms 100.00% 2
166 mistralai/mistral-nemo limited data mistral 5461 ms 5461 ms 5461 ms 100.00% 1
167 qwen/qwen3.5-397b-a17b limited data venice 5545 ms 20582 ms 5545 ms 100.00% 3
168 x-ai/grok-build-0.1 limited data atlas-cloud 5648 ms 5648 ms 5648 ms 100.00% 1
169 z-ai/glm-5.1 limited data crusoe 5663 ms 7911 ms 5662 ms 100.00% 2
170 meta-llama/llama-3.3-70b-instruct limited data parasail 5664 ms 5664 ms 5663 ms 100.00% 1
171 deepseek/deepseek-v3.2 limited data chutes 5677 ms 8659 ms 5676 ms 100.00% 4
172 openai/gpt-oss-120b limited data cerebras 5807 ms 8165 ms 5807 ms 100.00% 3
173 z-ai/glm-5.2 limited data gmi 5917 ms 22283 ms 5917 ms 100.00% 5
174 moonshotai/kimi-k2.6 limited data deepinfra 6219 ms 6219 ms 6219 ms 100.00% 1
175 google/gemini-2.5-flash limited data google-ai-studio 6255 ms 12681 ms 6255 ms 7 tok/s 100.00% 8
176 moonshotai/kimi-k2.7-code limited data novita 6263 ms 11929 ms 6263 ms 100.00% 2
177 anthropic/claude-opus-4.6 limited data anthropic 6389 ms 13776 ms 6389 ms 100.00% 2
178 z-ai/glm-4.7 limited data venice 6392 ms 15958 ms 6392 ms 100.00% 2
179 meta-llama/llama-3.3-70b-instruct limited data together 6406 ms 6406 ms 6405 ms 100.00% 1
180 xiaomi/mimo-v2.5-pro-ultraspeed limited data xiaomi 6409 ms 13352 ms 6409 ms 100.00% 5
181 qwen/qwen3.5-35b-a3b limited data deepinfra 6441 ms 6441 ms 6440 ms 100.00% 1
182 openai/gpt-5.1 limited data openai 6557 ms 6557 ms 6557 ms 100.00% 1
183 z-ai/glm-5 limited data venice 6606 ms 18102 ms 6606 ms 100.00% 4
184 google/gemini-2.5-flash limited data lightning 6897 ms 15293 ms 6897 ms 100.00% 3
185 qwen/qwen3.7-max limited data atlas-cloud 6930 ms 6930 ms 6930 ms 100.00% 1
186 meta-llama/llama-3.3-70b-instruct limited data makora 7244 ms 16435 ms 7244 ms 100.00% 4
187 google/gemini-2.5-flash-lite google-ai-studio 7421 ms 9545 ms 7420 ms 4 tok/s 35.71% 56
188 arcee-ai/trinity-large-thinking limited data parasail 7460 ms 7460 ms 7460 ms 100.00% 1
189 moonshotai/moonshot-v1-32k-vision-preview limited data kimi 7505 ms 7505 ms 7505 ms 100.00% 1
190 anthropic/claude-opus-5 limited data anthropic 7527 ms 17256 ms 7526 ms 100.00% 4
191 google/gemini-3.5-flash limited data google-ai-studio 7914 ms 7914 ms 7914 ms 100.00% 1
192 deepseek/deepseek-v3.2 limited data digitalocean 8073 ms 8073 ms 8072 ms 100.00% 1
193 moonshotai/kimi-k2.5 limited data novita 8091 ms 8091 ms 8090 ms 100.00% 1
194 z-ai/glm-5.2 limited data inceptron 8151 ms 11621 ms 8151 ms 100.00% 2
195 zai-org/autoglm-phone-9b-multilingual limited data novita 8159 ms 8159 ms 8158 ms 100.00% 1
196 qwen/qwen3-235b-a22b-2507 limited data crusoe 8169 ms 13670 ms 8169 ms 100.00% 3
197 mistralai/codestral-2508 limited data mistral 8200 ms 9917 ms 8199 ms 100.00% 5
198 google/gemma-4-31b-it limited data tinfoil 8548 ms 12397 ms 8548 ms 83.33% 6
199 deepseek/deepseek-v4-pro limited data fireworks 8560 ms 20540 ms 8560 ms 100.00% 4
200 moonshotai/kimi-k3 limited data siliconflow 8651 ms 8651 ms 8650 ms 100.00% 1
201 deepseek/deepseek-v4-flash limited data morph 8663 ms 11399 ms 8663 ms 100.00% 4
202 moonshotai/kimi-k2.6 limited data kimi 8668 ms 8668 ms 8668 ms 100.00% 1
203 google/gemini-3.5-flash-lite limited data google-ai-studio 8705 ms 8705 ms 8704 ms 100.00% 1
204 minimax/minimax-m3 limited data siliconflow 8722 ms 8722 ms 8722 ms 100.00% 1
205 z-ai/glm-5.2 limited data crusoe 8792 ms 8792 ms 8792 ms 100.00% 1
206 deepseek/deepseek-v4-pro limited data baseten 8810 ms 8810 ms 8810 ms 100.00% 1
207 openai/gpt-oss-120b limited data fireworks 8814 ms 16745 ms 8814 ms 100.00% 3
208 google/gemini-3.1-flash-lite limited data deepinfra 8888 ms 8888 ms 8888 ms 100.00% 1
209 moonshotai/kimi-k2-instruct limited data novita 8892 ms 8892 ms 8891 ms 100.00% 1
210 z-ai/glm-5.2 limited data phala 8964 ms 20432 ms 8963 ms 89.47% 19
211 deepseek/deepseek-v4-flash limited data atlas-cloud 9047 ms 9047 ms 9047 ms 100.00% 1
212 openai/gpt-5.2 limited data openai 9061 ms 9061 ms 9061 ms 100.00% 1
213 qwen/qwen3.5-9b limited data deepinfra 9126 ms 10558 ms 9126 ms 100.00% 2
214 nvidia/nemotron-3-super-120b-a12b limited data nebius 9265 ms 10610 ms 9264 ms 100.00% 2
215 mistralai/ministral-8b-2512 limited data mistral 9468 ms 20212 ms 9468 ms 100.00% 5
216 minimax/minimax-m2.7 limited data minimax 9479 ms 10445 ms 9478 ms 100.00% 3
217 nvidia/nemotron-3-nano-30b-a3b limited data novita 9584 ms 9584 ms 9584 ms 100.00% 1
218 yutori/n1.5 limited data crusoe 9627 ms 9627 ms 9627 ms 100.00% 1
219 nvidia/nemotron-3-super-120b-a12b limited data crusoe 9837 ms 13857 ms 9836 ms 100.00% 4
220 openai/gpt-4.1-nano limited data openai 9922 ms 9922 ms 9922 ms 100.00% 1
221 minimax/minimax-m3 limited data deepinfra 10040 ms 10462 ms 10039 ms 100.00% 2
222 cerebras/zai-glm-4.7 limited data cerebras 10131 ms 20590 ms 10131 ms 100.00% 3
223 qwen/qwen3-vl-235b-a22b-thinking limited data atlas-cloud 10175 ms 10175 ms 10175 ms 100.00% 1
224 moonshotai/kimi-k3 limited data kimi 10333 ms 10333 ms 10333 ms 100.00% 1
225 z-ai/glm-5.2 limited data morph 10437 ms 12382 ms 10437 ms 100.00% 3
226 qwen/qwen3.6-27b limited data morph 10495 ms 15054 ms 10494 ms 100.00% 6
227 cerebras/gemma-4-31b limited data cerebras 10679 ms 12327 ms 10679 ms 100.00% 2
228 meta-llama/llama-3.3-70b-instruct limited data tinfoil 10728 ms 18201 ms 10727 ms 100.00% 6
229 anthropic/claude-fable-5 limited data anthropic 10766 ms 11303 ms 10766 ms 100.00% 3
230 moonshotai/moonshot-v1-128k limited data kimi 10785 ms 11291 ms 10785 ms 100.00% 3
231 qwen/qwen3.5-397b-a17b limited data morph 10909 ms 10909 ms 10909 ms 100.00% 1
232 microsoft/phi-4 limited data deepinfra 10968 ms 10968 ms 10968 ms 100.00% 1
233 google/gemma-4-26b-a4b-it limited data parasail 10972 ms 11743 ms 10972 ms 100.00% 2
234 z-ai/glm-5.1 limited data fireworks 11149 ms 17681 ms 11149 ms 100.00% 3
235 openai/o3 limited data openai 11388 ms 11388 ms 11388 ms 100.00% 1
236 nvidia/nemotron-3-nano-30b-a3b limited data deepinfra 11435 ms 11435 ms 11435 ms 100.00% 1
237 z-ai/glm-5.2-nvfp4 limited data makora 11443 ms 22366 ms 11443 ms 100.00% 2
238 google/gemini-3.1-flash-lite limited data google-vertex 11637 ms 11637 ms 11637 ms 100.00% 1
239 kwaipilot/kat-coder-air-v2.5 limited data atlas-cloud 11641 ms 11641 ms 11641 ms 100.00% 1
240 moonshotai/kimi-k2.5 limited data chutes 11654 ms 14602 ms 11654 ms 100.00% 2
241 z-ai/glm-4.6 limited data venice 11718 ms 13535 ms 11718 ms 100.00% 2
242 mistralai/mistral-large limited data mistral 11752 ms 11752 ms 11751 ms 100.00% 1
243 zai-org/glm-4.6v limited data novita 12186 ms 12186 ms 12185 ms 100.00% 1
244 deepseek/deepseek-v4-pro limited data crusoe 12186 ms 12186 ms 12186 ms 100.00% 1
245 z-ai/glm-5v-turbo limited data venice 12242 ms 12816 ms 12242 ms 100.00% 2
246 MiniMaxAI/MiniMax-M3 limited data nebius 12323 ms 12323 ms 12323 ms 100.00% 1
247 Qwen/Qwen2.5-VL-72B-Instruct limited data nebius 12433 ms 12433 ms 12432 ms 100.00% 1
248 nvidia/nemotron-nano-12b-v2-vl limited data digitalocean 12466 ms 12605 ms 12466 ms 100.00% 3
249 openai/gpt-3.5-turbo limited data lightning 12476 ms 12476 ms 12476 ms 100.00% 1
250 qwen/qwen3.5-397b-a17b limited data deepinfra 12847 ms 12847 ms 12847 ms 100.00% 1
251 google/gemini-3.5-flash limited data lightning 12853 ms 12853 ms 12853 ms 100.00% 1
252 xiaomi/mimo-v2.5-pro limited data digitalocean 12905 ms 18425 ms 12905 ms 100.00% 2
253 z-ai/glm-5.2 limited data wafer 13050 ms 14496 ms 13050 ms 100.00% 5
254 z-ai/glm-5 limited data deepinfra 13071 ms 13071 ms 13071 ms 100.00% 1
255 z-ai/glm-5.2 limited data zai 13071 ms 13071 ms 13071 ms 100.00% 1
256 qwen/qwen3.7-plus limited data atlas-cloud 13121 ms 13121 ms 13121 ms 100.00% 1
257 google/gemini-3.1-flash-lite limited data atlas-cloud 13183 ms 13183 ms 13183 ms 100.00% 1
258 google/gemma-4-31b-it limited data siliconflow 13396 ms 13396 ms 13396 ms 100.00% 1
259 moonshotai/kimi-k2.6 limited data wafer 13657 ms 21339 ms 13657 ms 100.00% 3
260 Qwen/Qwen3-235B-A22B-Instruct-2507 limited data nebius 13665 ms 13665 ms 13665 ms 100.00% 1
261 z-ai/glm-5-turbo limited data venice 13667 ms 13960 ms 13667 ms 100.00% 3
262 z-ai/glm-5.1 limited data venice 13675 ms 13675 ms 13675 ms 100.00% 1
263 minimaxai/minimax-m1-80k limited data novita 13691 ms 13691 ms 13691 ms 100.00% 1
264 openai/gpt-oss-120b limited data nebius 13713 ms 13713 ms 13713 ms 100.00% 1
265 minimax/minimax-m2.7-highspeed limited data minimax 13775 ms 14562 ms 13774 ms 100.00% 3
266 openai/gpt-4o limited data openai 13866 ms 13866 ms 13866 ms 100.00% 1
267 qwen/qwen3.5-9b limited data venice 14279 ms 14279 ms 14279 ms 100.00% 1
268 google/gemma-4-31b-it limited data digitalocean 14295 ms 15212 ms 14294 ms 100.00% 2
269 qwen/qwen3.6-plus limited data atlas-cloud 14300 ms 14300 ms 14300 ms 100.00% 1
270 openai/gpt-4 limited data openai 14643 ms 15057 ms 14643 ms 100.00% 2
271 z-ai/glm-5.2 limited data baseten 14704 ms 15870 ms 14704 ms 100.00% 3
272 sao10k/l31-70b-euryale-v2.2 limited data novita 14722 ms 14722 ms 14722 ms 100.00% 1
273 stepfun/step-3.7-flash limited data novita 14850 ms 14850 ms 14850 ms 100.00% 1
274 bytedance/doubao-seed-1.6-251015 limited data atlas-cloud 15335 ms 15335 ms 15335 ms 100.00% 1
275 nvidia/nemotron-3-ultra-550b limited data crusoe 15495 ms 15495 ms 15495 ms 100.00% 1
276 meta-llama/llama-3.3-70b-instruct limited data crusoe 16009 ms 16009 ms 16009 ms 100.00% 1
277 moonshotai/kimi-k2.6 limited data parasail 16092 ms 16092 ms 16092 ms 100.00% 1
278 nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B limited data nebius 16182 ms 16182 ms 16182 ms 100.00% 1
279 qwen/qwen3.6-27b limited data chutes 16724 ms 16724 ms 16723 ms 100.00% 1
280 zai-org/GLM-5.1 limited data nebius 16864 ms 16864 ms 16864 ms 100.00% 1
281 qwen/qwen3.6-35b-a3b limited data deepinfra 18201 ms 18201 ms 18201 ms 100.00% 1
282 bytedance/doubao-seed-1.8-251228 limited data atlas-cloud 18226 ms 18226 ms 18226 ms 100.00% 1
283 openai/gpt-oss-120b limited data crusoe 18843 ms 18843 ms 18843 ms 100.00% 1
284 z-ai/glm-4.7 limited data zai 19273 ms 19273 ms 19273 ms 100.00% 1
285 kwaipilot/kat-coder-pro-v2 limited data atlas-cloud 20553 ms 20553 ms 20552 ms 100.00% 1
286 NousResearch/Hermes-4-405B limited data nebius 20613 ms 20613 ms 20613 ms 100.00% 1
287 deepseek-ai/DeepSeek-V4-Pro limited data nebius 20813 ms 20813 ms 20813 ms 100.00% 1
288 z-ai/glm-5.2 limited data digitalocean 23432 ms 23432 ms 23432 ms 100.00% 1
289 z-ai/glm-5.2 limited data together 26013 ms 26013 ms 26013 ms 100.00% 1
290 z-ai/glm-5.2 limited data tinfoil 31693 ms 31693 ms 31692 ms 25.00% 4
291 google/gemini-3.1-pro-preview limited data google-ai-studio 0.00% 6
292 google/gemma-3-12b-it limited data novita 0.00% 1
293 google/gemini-3.1-flash-image-preview limited data google-ai-studio 0.00% 1
294 google/gemma-3-27b-it limited data novita 0.00% 1
295 google/gemini-2.0-flash-001 limited data google-ai-studio 0.00% 1
296 google/gemini-2.5-pro limited data google-ai-studio 0.00% 1
297 google/gemini-2.0-flash-lite-001 limited data google-ai-studio 0.00% 4
298 openai/gpt-4-turbo limited data lightning 0.00% 1
299 openai/text-embedding-3-large limited data openai 100.00% 2
Workspace access

Sign in

Choose a sign in method. New email and OAuth accounts include $0.10 in starter credit; wallet-only accounts start at $0.

By signing in you agree to the terms of service and privacy policy.