SiliconFlow
Explore SiliconFlow models on TrustedRouter with current routes, token pricing, policy sources, privacy posture, regional availability, and API support.
SiliconFlowsiliconflow
No provider claim| Provider | SiliconFlow |
|---|---|
| Routing status | Active |
| Provider website | https://www.siliconflow.com/ |
| Models | 31 public models |
| Credits routes | 31 |
| Zero data retention | not claimed |
| Confidential compute | not claimed |
| Provider E2EE | not claimed |
| Policy note | No provider-ZDR claim is tracked here. SiliconFlow's privacy policy source is linked for retention and interaction-data terms. Policy source |
Measured performance
48 samplesContinuously sampled across SiliconFlow's routed models: p50 TTFT, effective throughput, and success rate. Effective throughput uses provider-reported output tokens over complete request time. Unsupported route and probe-configuration rows are separated from provider downtime. No prompt or output content stored.
| p50 TTFT | 1980 ms |
|---|---|
| Effective throughput | 54 tok/s n=12 |
| Uptime | 95.83% |
| Model | p50 TTFT | Effective throughput | Uptime | Config excluded | Availability samples |
|---|---|---|---|---|---|
| deepseek/deepseek-v4-flash | 1098 ms | — | 100.00% | — | 2 |
| deepseek/deepseek-v4-flash-vision-exp | 1127 ms | — | 100.00% | — | 1 |
| moonshotai/kimi-k2.7-code | 1326 ms | 78 tok/s n=1 | 100.00% | — | 5 |
| moonshotai/kimi-k2.6 | 1622 ms | — | 100.00% | — | 1 |
| google/gemma-4-26b-a4b-it | 1646 ms | — | 100.00% | — | 1 |
| minimax/minimax-m2.5 | 1650 ms | — | 100.00% | — | 2 |
| qwen/qwen3.6-35b-a3b | 1683 ms | — | 66.67% | — | 3 |
| openai/gpt-oss-120b | 1764 ms | — | 100.00% | — | 1 |
| google/gemma-4-31b-it | 1863 ms | 34 tok/s n=1 | 66.67% | — | 3 |
| tencent/hunyuan-a13b-instruct | 1883 ms | — | 100.00% | — | 1 |
| qwen/qwen3.5-9b | 1957 ms | — | 100.00% | — | 3 |
| z-ai/glm-5.2 | 1980 ms | 129 tok/s n=2 | 100.00% | — | 3 |
| z-ai/glm-5v-turbo | 2066 ms | — | 100.00% | — | 3 |
| moonshotai/kimi-k2.5 | 2275 ms | — | 100.00% | — | 1 |
| tencent/hy3 | 2361 ms | — | 100.00% | — | 3 |
| deepseek/deepseek-v4-flash-0731 | 2663 ms | 86 tok/s n=1 | 100.00% | — | 1 |
| z-ai/glm-5 | 2766 ms | — | 100.00% | — | 2 |
| openai/gpt-oss-20b | 3156 ms | — | 100.00% | — | 1 |
| qwen/qwen3.5-122b-a10b | 3223 ms | — | 100.00% | — | 1 |
| z-ai/glm-5.1 | 3308 ms | — | 100.00% | — | 1 |
| z-ai/glm-4.5-air | 3317 ms | — | 100.00% | — | 2 |
| deepseek/deepseek-v3.2-exp | 3518 ms | — | 100.00% | — | 1 |
| deepseek/deepseek-v4-pro | 4102 ms | 30 tok/s n=1 | 100.00% | — | 1 |
| deepseek/deepseek-v4-pro-0423 | 5888 ms | 34 tok/s n=2 | 100.00% | — | 1 |
| moonshotai/kimi-k3 | 6106 ms | 33 tok/s n=2 | 100.00% | — | 3 |
| qwen/qwen3.6-27b | 18266 ms | — | 100.00% | — | 1 |
| minimax/minimax-m3 | — | 73 tok/s n=2 | — | — | 0 |
SiliconFlow performance history · Full provider & model leaderboard.
Models served by SiliconFlow.
Each row links to pricing, provider, benchmark, and API pages for the model.
| Model | AI IQ | Context | Input | Cached input | Output |
|---|---|---|---|---|---|
deepseek/deepseek-v3.1-terminusDeepSeek: DeepSeek V3.1 Terminus |
— | 131,072 | $0.28485/1M | Not published | $1.055/1M |
deepseek/deepseek-v3.2DeepSeek: DeepSeek V3.2 |
IQ 103#73 | 163,840 | $0.28485/1M | $0.142425/1M | $0.4431/1M |
deepseek/deepseek-v3.2-expDeepSeek: DeepSeek V3.2 Exp |
— | 163,840 | $0.28485/1M | Not published | $0.43255/1M |
deepseek/deepseek-v4-flashDeepSeek: DeepSeek V4 Flash 0423 |
IQ 113#46 | 1,024,000 | $0.13715/1M | $0.02954/1M | $0.2954/1M |
deepseek/deepseek-v4-flash-0731DeepSeek: DeepSeek V4 Flash 0731 |
— | 1,048,576 | $0.13715/1M | $0.02954/1M | $0.2954/1M |
deepseek/deepseek-v4-flash-vision-expDeepSeek: DeepSeek V4 Flash Vision Exp |
IQ 113#47 | 1,048,576 | $0.13715/1M | $0.02954/1M | $0.2954/1M |
deepseek/deepseek-v4-proDeepSeek: DeepSeek V4 Pro 0423 |
IQ 117#36 | 1,024,000 | $1.58421/1M | $0.142425/1M | $3.307425/1M |
deepseek/deepseek-v4-pro-0423DeepSeek V4 Pro 0423 |
— | 1,024,000 | $1.58421/1M | $0.142425/1M | $3.307425/1M |
google/gemma-4-12b-itgoogle/gemma-4-12B-it |
IQ 98#91 | 0 | $0.1055/1M | Not published | $0.3165/1M |
google/gemma-4-26b-a4b-itGoogle: Gemma 4 26B A4B |
IQ 96#98 | 262,144 | $0.1266/1M | Not published | $0.422/1M |
google/gemma-4-31b-itGoogle: Gemma 4 31B |
IQ 101#80 | 262,144 | $0.13715/1M | Not published | $0.422/1M |
minimax/minimax-m2.5MiniMax: MiniMax M2.5 |
IQ 105#71 | 200,000 | $0.3165/1M | $0.03165/1M | $1.266/1M |
minimax/minimax-m3MiniMax: MiniMax M3 |
IQ 114#44 | 524,288 | $0.3165/1M | $0.0633/1M | $1.266/1M |
moonshotai/kimi-k2.5MoonshotAI: Kimi K2.5 |
IQ 111#55 | 262,144 | $0.47475/1M | $0.07385/1M | $2.37375/1M |
moonshotai/kimi-k2.6MoonshotAI: Kimi K2.6 |
IQ 119#30 | 262,144 | $0.81235/1M | $0.1477/1M | $3.587/1M |
moonshotai/kimi-k2.7-codeMoonshotAI: Kimi K2.7 Code |
IQ 118#33 | 262,144 | $0.906414/1M | $0.189827/1M | $4.009/1M |
moonshotai/kimi-k3MoonshotAI: Kimi K3 |
IQ 123#21 | 1,048,576 | $3.165/1M | $0.3165/1M | $15.825/1M |
openai/gpt-oss-120bOpenAI: gpt-oss-120b |
IQ 105#69 | 131,072 | $0.05275/1M | Not published | $0.47475/1M |
openai/gpt-oss-20bOpenAI: gpt-oss-20b |
IQ 100#86 | 131,072 | $0.0422/1M | Not published | $0.1899/1M |
qwen/qwen3.5-122b-a10bQwen: Qwen3.5-122B-A10B |
— | 262,144 | $0.2743/1M | Not published | $2.1944/1M |
qwen/qwen3.5-27bQwen: Qwen3.5-27B |
— | 262,144 | $0.26375/1M | Not published | $2.11/1M |
qwen/qwen3.5-9bQwen: Qwen3.5-9B |
IQ 90#113 | 262,144 | $0.1055/1M | Not published | $0.15825/1M |
qwen/qwen3.6-27bQwen: Qwen3.6 27B |
IQ 111#56 | 262,144 | $0.3165/1M | Not published | $3.376/1M |
qwen/qwen3.6-35b-a3bQwen: Qwen3.6 35B A3B |
IQ 100#89 | 262,144 | $0.211/1M | Not published | $1.688/1M |
tencent/hunyuan-a13b-instructTencent: Hunyuan A13B Instruct |
— | 131,072 | $0.1477/1M | Not published | $0.60135/1M |
tencent/hy3Tencent: Hy3 |
IQ 103#76 | 262,144 | $0.13926/1M | $0.034815/1M | $0.55704/1M |
z-ai/glm-4.5-airZ.ai: GLM 4.5 Air |
— | 131,072 | $0.1477/1M | Not published | $0.9073/1M |
z-ai/glm-5Z.ai: GLM 5 |
IQ 106#66 | 198,000 | $1.00225/1M | $0.211/1M | $2.69025/1M |
z-ai/glm-5.1Z.ai: GLM 5.1 |
IQ 114#43 | 200,000 | $1.25545/1M | $0.633/1M | $3.9457/1M |
z-ai/glm-5.2Z.ai: GLM 5.2 |
IQ 120#27 | 1,048,576 | $1.37361/1M | $0.2743/1M | $4.31706/1M |
z-ai/glm-5v-turboZ.ai: GLM 5V Turbo |
— | 202,752 | $1.266/1M | $0.2532/1M | $4.22/1M |
Questions
Does SiliconFlow have zero data retention?
TrustedRouter does not currently mark SiliconFlow as provider-level zero data retention. Use trustedrouter/zdr or provider.min_privacy=zdr to select a different eligible route, and review the linked policy source for changes.
Is SiliconFlow end-to-end encrypted?
TrustedRouter does not currently mark SiliconFlow as end-to-end encrypted at the provider boundary. The TrustedRouter gateway is still attested, but the selected provider normally receives the request in order to run the model. Use trustedrouter/e2e for the stronger route requirement.
Which SiliconFlow models are available through TrustedRouter?
This page currently lists 31 public SiliconFlow models, with live pricing, route count, context length, measured performance when available, and links to each model's provider and benchmark pages.