OpenAI compatible API · Attested · Public status
Lightning AI performance
Measured TTFT, TTFB, effective throughput, uptime, and sampled model routes for Lightning AI.
Onebase URL to migrate
100sof models and routes
0prompt or output logs. Always.
Lightning AIlightning
47 samples
Continuously sampled provider performance. TrustedRouter reports unsupported route and probe-configuration rows separately from provider downtime. Prompt and output content is not stored.
| p50 TTFT | 2169 ms |
|---|---|
| p95 TTFT | 4885 ms |
| p50 TTFB | 2474 ms |
| Effective throughput | 48 tok/s n=4 |
| Uptime | 100.00% |
Measured model routes
| Model | p50 TTFT | p50 TTFB | Effective throughput | Uptime | Config excluded | Availability samples |
|---|---|---|---|---|---|---|
| google/gemma-4-31b-it | 583 ms | 583 ms | 128 tok/s n=1 | 100.00% | — | 3 |
| openai/gpt-4o | 1442 ms | 1442 ms | — | 100.00% | — | 5 |
| google/gemini-2.5-flash | 1751 ms | 1751 ms | — | 100.00% | — | 7 |
| openai/gpt-4.1 | 1815 ms | 1815 ms | — | 100.00% | — | 1 |
| openai/gpt-4 | 1867 ms | 1867 ms | — | 100.00% | — | 3 |
| openai/gpt-3.5-turbo | 1892 ms | 1892 ms | — | 100.00% | — | 4 |
| google/gemini-3.5-flash | 2169 ms | 2168 ms | 45 tok/s n=2 | 100.00% | — | 7 |
| google/gemini-3-flash-preview | 2602 ms | 2602 ms | — | 100.00% | — | 3 |
| openai/gpt-4-turbo | 2674 ms | 2673 ms | — | 100.00% | — | 2 |
| google/gemini-3.1-pro-preview | 2774 ms | 2774 ms | 51 tok/s n=1 | 100.00% | — | 2 |
| google/gemini-3.1-flash-lite-preview | 3756 ms | 3755 ms | — | 100.00% | — | 4 |
| google/gemini-2.5-pro | 3797 ms | 3797 ms | — | 100.00% | — | 6 |