OpenAI compatible API · Attested · Public status
Baseten performance
Review measured TTFT, TTFB, effective throughput, uptime, and sampled model routes for Baseten on TrustedRouter using metadata-only production probes.
Onebase URL to migrate
100sof models and routes
0prompt or output logs. Always.
Basetenbaseten
53 samplesContinuously sampled provider performance. TrustedRouter reports unsupported route and probe-configuration rows separately from provider downtime. Prompt and output content is not stored.
| p50 TTFT | 1929 ms |
|---|---|
| p95 TTFT | 4484 ms |
| p50 TTFB | 1982 ms |
| Effective throughput | 62 tok/s n=12 |
| Uptime | 100.00% |
Measured model routes
| Model | p50 TTFT | p50 TTFB | Effective throughput | Uptime | Config excluded | Availability samples |
|---|---|---|---|---|---|---|
| deepseek/deepseek-v4-pro | 833 ms | 832 ms | — | 100.00% | — | 3 |
| openai/gpt-oss-120b | 977 ms | 976 ms | — | 100.00% | — | 4 |
| thinkingmachines/inkling-1m | 997 ms | 996 ms | 144 tok/s n=1 | 100.00% | — | 3 |
| moonshotai/kimi-k2.6 | 1122 ms | 1121 ms | 59 tok/s n=1 | 100.00% | — | 4 |
| nvidia/nemotron-3-ultra-550b-a55b | 1339 ms | 1338 ms | 40 tok/s n=1 | 100.00% | — | 2 |
| deepseek/deepseek-v4-flash-0731 | 1879 ms | 1879 ms | 73 tok/s n=1 | 100.00% | — | 2 |
| deepseek/deepseek-v4-pro-0813 | 1929 ms | 1929 ms | 62 tok/s n=2 | 100.00% | — | 9 |
| moonshotai/kimi-k3 | 1979 ms | 1979 ms | 66 tok/s n=2 | 100.00% | — | 3 |
| z-ai/glm-5.2 | 2268 ms | 2268 ms | 46 tok/s n=1 | 100.00% | — | 5 |
| thinkingmachines/inkling-small | 2350 ms | 2350 ms | 52 tok/s n=1 | 100.00% | — | 4 |
| moonshotai/kimi-k2.7-code | 2448 ms | 2448 ms | 58 tok/s n=1 | 100.00% | — | 4 |
| z-ai/glm-4.7 | 3913 ms | 3913 ms | — | 100.00% | — | 5 |
| z-ai/glm-5.2-fast | 4185 ms | 4185 ms | 157 tok/s n=1 | 100.00% | — | 5 |