全部/科技/性能 · 延迟

OpenRouter · 性能 · 延迟

HISTORY近 30 天历史柱高表示当天去重热搜数量
08/2209/20 有历史数据
  • 01
    OpenAI: gpt-oss-20b
    P50 吞吐 263.5 tok/s · P50 延迟 131 ms · 最佳服务商 CoreWeave · 754.8万 次请求openai
  • 02
    Meta: Llama 3.1 8B Instruct
    P50 吞吐 250 tok/s · P50 延迟 133 ms · 最佳服务商 Groq · 227.9万 次请求meta-llama
  • 03
    Sao10K: Llama 3 8B Lunaris
    P50 吞吐 88 tok/s · P50 延迟 137 ms · 最佳服务商 DeepInfra · 28.5万 次请求sao10k
  • 04
    Google: Gemma 4 31B
    P50 吞吐 132 tok/s · P50 延迟 145 ms · 最佳服务商 ModelRun · 897.5万 次请求google
  • 05
    OpenAI: gpt-oss-120b
    P50 吞吐 657 tok/s · P50 延迟 189 ms · 最佳服务商 Groq · 1365.0万 次请求openai
  • 06
    OpenAI: gpt-oss-safeguard-20b
    P50 吞吐 475 tok/s · P50 延迟 194 ms · 最佳服务商 Groq · 35.4万 次请求openai
  • 07
    IBM: Granite 4.2 8B
    P50 吞吐 93 tok/s · P50 延迟 216 ms · 最佳服务商 CoreWeave · 15.0万 次请求ibm-granite
  • 08
    NVIDIA: Nemotron 3.5 Lightning
    P50 吞吐 129 tok/s · P50 延迟 220 ms · 最佳服务商 CoreWeave · 122.0万 次请求nvidia
  • 09
    Meta: Llama 3.3 70B Instruct
    P50 吞吐 178 tok/s · P50 延迟 233 ms · 最佳服务商 Groq · 268.3万 次请求meta-llama
  • 10
    Mistral: Ministral 3 8B 2512
    P50 吞吐 43 tok/s · P50 延迟 239 ms · 最佳服务商 Mistral · 62.6万 次请求mistralai
  • 11
    Z.ai: GLM 5.3 Flash
    P50 吞吐 93 tok/s · P50 延迟 264 ms · 最佳服务商 Modal · 5919.5万 次请求z-ai
  • 12
    DeepSeek: DeepSeek V4.1 Flash
    P50 吞吐 134 tok/s · P50 延迟 269 ms · 最佳服务商 Makora · 4062.2万 次请求deepseek
  • 13
    Tencent: Hy3
    P50 吞吐 106 tok/s · P50 延迟 269 ms · 最佳服务商 DeepInfra · 1549.8万 次请求tencent
  • 14
    NVIDIA: Nemotron 3 Ultra
    P50 吞吐 137 tok/s · P50 延迟 270 ms · 最佳服务商 BaseTen · 554.8万 次请求nvidia
  • 15
    MoonshotAI: Kimi K2.7 Code
    P50 吞吐 162 tok/s · P50 延迟 271 ms · 最佳服务商 ModelRun · 16.8万 次请求moonshotai
  • 16
    Qwen: Qwen2.5 7B Instruct
    P50 吞吐 71 tok/s · P50 延迟 273.5 ms · 最佳服务商 Phala · 66.4万 次请求qwen
  • 17
    Poolside: Laguna XS 2.1
    P50 吞吐 101 tok/s · P50 延迟 282 ms · 最佳服务商 Poolside · 28.6万 次请求poolside
  • 18
    MiniMax: MiniMax M2.7
    P50 吞吐 255 tok/s · P50 延迟 286 ms · 最佳服务商 Groq · 41.2万 次请求minimax
  • 19
    Thinking Machines: Inkling Small
    P50 吞吐 176 tok/s · P50 延迟 292 ms · 最佳服务商 BaseTen · 48.9万 次请求thinkingmachines
  • 20
    Z.ai: GLM 5.1
    P50 吞吐 101 tok/s · P50 延迟 296 ms · 最佳服务商 Friendli · 76.4万 次请求z-ai
  • 21
    Amazon: Nova Micro 1.0
    P50 吞吐 125 tok/s · P50 延迟 296 ms · 最佳服务商 Amazon Bedrock · 115.9万 次请求amazon
  • 22
    Thinking Machines: Inkling
    P50 吞吐 166 tok/s · P50 延迟 301.5 ms · 最佳服务商 BaseTen · 74.7万 次请求thinkingmachines
  • 23
    Meta: Llama 4 Scout
    P50 吞吐 91 tok/s · P50 延迟 310 ms · 最佳服务商 Google · 65.4万 次请求meta-llama
  • 24
    Mistral: Mistral Small 3
    P50 吞吐 44 tok/s · P50 延迟 311 ms · 最佳服务商 DeepInfra · 52.1万 次请求mistralai
  • 25
    Mistral: Ministral 3 3B 2512
    P50 吞吐 42.5 tok/s · P50 延迟 316 ms · 最佳服务商 Mistral · 27.7万 次请求mistralai
  • 26
    Z.ai: GLM 4.7 Flash
    P50 吞吐 33 tok/s · P50 延迟 318 ms · 最佳服务商 Cloudflare · 56.4万 次请求z-ai
  • 27
    Mistral: Ministral 3 14B 2512
    P50 吞吐 100.5 tok/s · P50 延迟 321 ms · 最佳服务商 Mistral · 14.8万 次请求mistralai
  • 28
    Qwen: Qwen3 30B A3B Instruct 2507
    P50 吞吐 58 tok/s · P50 延迟 326 ms · 最佳服务商 Alibaba · 160.3万 次请求qwen
  • 29
    Meta: Llama 4 Maverick
    P50 吞吐 41 tok/s · P50 延迟 329 ms · 最佳服务商 DeepInfra · 136.9万 次请求meta-llama
  • 30
    Meta: Muse Glimmer 30B
    P50 吞吐 128 tok/s · P50 延迟 332 ms · 最佳服务商 Together · 20.3万 次请求meta
  • 31
    MiniMax: MiniMax M2.5
    P50 吞吐 124 tok/s · P50 延迟 335 ms · 最佳服务商 Friendli · 12.2万 次请求minimax
  • 32
    Google: Gemini 3.1 Flash Lite Preview
    P50 吞吐 101 tok/s · P50 延迟 337 ms · 最佳服务商 Google AI Studio · 297.5万 次请求google
  • 33
    Z.ai: GLM 5.2
    P50 吞吐 199 tok/s · P50 延迟 341 ms · 最佳服务商 Friendli · 808.8万 次请求z-ai
  • 34
    Meta: Llama Guard 4 12B
    P50 吞吐 8 tok/s · P50 延迟 345 ms · 最佳服务商 DeepInfra · 29.0万 次请求meta-llama
  • 35
    NVIDIA: Nemotron 3 Super
    P50 吞吐 66 tok/s · P50 延迟 347 ms · 最佳服务商 DeepInfra · 165.2万 次请求nvidia
  • 36
    Qwen: Qwen3 235B A22B Instruct 2507
    P50 吞吐 53 tok/s · P50 延迟 353 ms · 最佳服务商 Nebius · 284.7万 次请求qwen
  • 37
    MoonshotAI: Kimi K2.6
    P50 吞吐 123 tok/s · P50 延迟 354 ms · 最佳服务商 Crusoe · 144.8万 次请求moonshotai
  • 38
    Qwen: Qwen3 VL 8B Instruct
    P50 吞吐 47 tok/s · P50 延迟 362 ms · 最佳服务商 Alibaba · 123.4万 次请求qwen
  • 39
    Z.ai: GLM 5.3
    P50 吞吐 134 tok/s · P50 延迟 366 ms · 最佳服务商 Together · 353.9万 次请求z-ai
  • 40
    Mistral: Mistral Small 4
    P50 吞吐 84 tok/s · P50 延迟 366 ms · 最佳服务商 Mistral · 16.2万 次请求mistralai
  • 41
    Qwen: Qwen3 32B
    P50 吞吐 24 tok/s · P50 延迟 370 ms · 最佳服务商 DeepInfra · 107.8万 次请求qwen
  • 42
    Mistral: Mistral Nemo
    P50 吞吐 64 tok/s · P50 延迟 379 ms · 最佳服务商 Io Net · 1843.0万 次请求mistralai
  • 43
    DeepSeek: DeepSeek V4 Flash 0731
    P50 吞吐 180 tok/s · P50 延迟 380 ms · 最佳服务商 CoreWeave · 9266.1万 次请求deepseek
  • 44
    Qwen: Qwen3.8 27B
    P50 吞吐 83 tok/s · P50 延迟 384.5 ms · 最佳服务商 CoreWeave · 129.1万 次请求qwen
  • 45
    Qwen: Qwen3.5-35B-A3B
    P50 吞吐 110 tok/s · P50 延迟 385 ms · 最佳服务商 DeepInfra · 29.1万 次请求qwen
  • 46
    StepFun: Step 3.7 Flash
    P50 吞吐 106 tok/s · P50 延迟 390.5 ms · 最佳服务商 DeepInfra · 19.9万 次请求stepfun
  • 47
    DeepSeek: DeepSeek V3.1
    P50 吞吐 94 tok/s · P50 延迟 391 ms · 最佳服务商 CoreWeave · 99.9万 次请求deepseek
  • 48
    Qwen2.5 72B Instruct
    P50 吞吐 15 tok/s · P50 延迟 410 ms · 最佳服务商 DeepInfra · 28.9万 次请求qwen
  • 49
    Qwen: Qwen3.5-122B-A10B
    P50 吞吐 69 tok/s · P50 延迟 411 ms · 最佳服务商 DeepInfra · 14.9万 次请求qwen
  • 50
    Google: Gemma 4 26B A4B
    P50 吞吐 70 tok/s · P50 延迟 414 ms · 最佳服务商 Google · 1148.8万 次请求google
  • 51
    SpaceXAI: Grok 4.20
    P50 吞吐 89 tok/s · P50 延迟 426 ms · 最佳服务商 xAI · 53.3万 次请求x-ai
  • 52
    Qwen: Qwen3.6 Flash
    P50 吞吐 60 tok/s · P50 延迟 427 ms · 最佳服务商 Alibaba · 19.0万 次请求qwen
  • 53
    Qwen: Qwen3.6 35B A3B
    P50 吞吐 107 tok/s · P50 延迟 427 ms · 最佳服务商 CoreWeave · 257.0万 次请求qwen
  • 54
    Google: Gemini 2.5 Flash
    P50 吞吐 89 tok/s · P50 延迟 427.5 ms · 最佳服务商 Google AI Studio · 1406.6万 次请求google
  • 55
    Inception: Mercury 2
    P50 吞吐 190 tok/s · P50 延迟 442 ms · 最佳服务商 Inception · 12.5万 次请求inception
  • 56
    Amazon: Nova Lite 1.0
    P50 吞吐 90 tok/s · P50 延迟 445 ms · 最佳服务商 Amazon Bedrock · 13.5万 次请求amazon
  • 57
    ByteDance Seed: Seed-2.0-Mini
    P50 吞吐 57 tok/s · P50 延迟 446 ms · 最佳服务商 Seed · 29.5万 次请求bytedance-seed
  • 58
    Qwen: Qwen3.5-9B
    P50 吞吐 36 tok/s · P50 延迟 449 ms · 最佳服务商 Parasail · 121.2万 次请求qwen
  • 59
    Meta: Llama 3.1 70B Instruct
    P50 吞吐 27 tok/s · P50 延迟 451 ms · 最佳服务商 DeepInfra · 26.4万 次请求meta-llama
  • 60
    Qwen: Qwen3.8 2.4T A95B
    P50 吞吐 157 tok/s · P50 延迟 453 ms · 最佳服务商 Modal · 10.9万 次请求qwen
  • 61
    Qwen: Qwen3 Next 80B A3B Instruct
    P50 吞吐 86 tok/s · P50 延迟 468 ms · 最佳服务商 Google · 20.2万 次请求qwen
  • 62
    Google: Gemini 2.5 Flash Lite
    P50 吞吐 217 tok/s · P50 延迟 473 ms · 最佳服务商 Google AI Studio · 3276.2万 次请求google
  • 63
    Google: Gemini 3.5 Flash Lite
    P50 吞吐 92 tok/s · P50 延迟 477 ms · 最佳服务商 Google · 480.1万 次请求google
  • 64
    Qwen: Qwen2.5 VL 72B Instruct
    P50 吞吐 20 tok/s · P50 延迟 477 ms · 最佳服务商 Parasail · 19.4万 次请求qwen
  • 65
    Google: Gemini 3.1 Flash Lite
    P50 吞吐 111 tok/s · P50 延迟 478 ms · 最佳服务商 Google AI Studio · 1196.0万 次请求google
  • 66
    DeepSeek: DeepSeek V4 Pro 0423
    P50 吞吐 103 tok/s · P50 延迟 494 ms · 最佳服务商 BaseTen · 466.0万 次请求deepseek
  • 67
    IBM: Granite 4.0 Micro
    P50 吞吐 36 tok/s · P50 延迟 497 ms · 最佳服务商 Cloudflare · 10.0万 次请求ibm-granite
  • 68
    OpenAI: GPT-4o-mini
    P50 吞吐 92 tok/s · P50 延迟 499 ms · 最佳服务商 OpenAI · 992.9万 次请求openai
  • 69
    NVIDIA: Nemotron 3 Nano Omni
    P50 吞吐 40 tok/s · P50 延迟 508.5 ms · 最佳服务商 Nvidia · 18.8万 次请求nvidia
  • 70
    OpenAI: GPT-4o-mini (2024-07-18)
    P50 吞吐 56 tok/s · P50 延迟 511 ms · 最佳服务商 OpenAI · 42.5万 次请求openai
  • 71
    DeepSeek: DeepSeek V4 Pro 0813
    P50 吞吐 98 tok/s · P50 延迟 521 ms · 最佳服务商 Parasail · 354.3万 次请求deepseek
  • 72
    DeepSeek: DeepSeek V3.2
    P50 吞吐 58.5 tok/s · P50 延迟 531 ms · 最佳服务商 Friendli · 722.8万 次请求deepseek
  • 73
    Mistral: Mistral Small 3.2 24B
    P50 吞吐 44 tok/s · P50 延迟 538 ms · 最佳服务商 Parasail · 81.5万 次请求mistralai
  • 74
    OpenAI: GPT-5.6 Luna
    P50 吞吐 138 tok/s · P50 延迟 542 ms · 最佳服务商 Amazon Bedrock · 3962.3万 次请求openai
  • 75
    Cohere: North Mini Code
    P50 吞吐 83 tok/s · P50 延迟 549.5 ms · 最佳服务商 Cohere · 50.3万 次请求cohere
  • 76
    Z.ai: GLM 4.5 Air
    P50 吞吐 72 tok/s · P50 延迟 550 ms · 最佳服务商 Novita · 37.3万 次请求z-ai
  • 77
    Z.ai: GLM 4.7
    P50 吞吐 76 tok/s · P50 延迟 553 ms · 最佳服务商 Google · 44.6万 次请求z-ai
  • 78
    Qwen: Qwen3 VL 30B A3B Instruct
    P50 吞吐 31 tok/s · P50 延迟 559 ms · 最佳服务商 Alibaba · 57.5万 次请求qwen
  • 79
    Inception: Mercury 2.5
    P50 吞吐 54 tok/s · P50 延迟 560 ms · 最佳服务商 Inception · 155.3万 次请求inception
  • 80
    Anthropic: Claude Sonnet 5
    P50 吞吐 97 tok/s · P50 延迟 564 ms · 最佳服务商 Azure · 258.6万 次请求anthropic
  • 81
    Poolside: Laguna S 2.1
    P50 吞吐 76 tok/s · P50 延迟 573 ms · 最佳服务商 Poolside · 199.2万 次请求poolside
  • 82
    Anthropic: Claude Haiku 4.5
    P50 吞吐 115 tok/s · P50 延迟 573 ms · 最佳服务商 Amazon Bedrock · 384.4万 次请求anthropic
  • 83
    Qwen: Qwen3 VL 235B A22B Instruct
    P50 吞吐 30 tok/s · P50 延迟 574 ms · 最佳服务商 Alibaba · 60.2万 次请求qwen
  • 84
    OpenAI: GPT-4o
    P50 吞吐 46 tok/s · P50 延迟 579 ms · 最佳服务商 OpenAI · 51.6万 次请求openai
  • 85
    SpaceXAI: Grok 4.3
    P50 吞吐 92 tok/s · P50 延迟 583 ms · 最佳服务商 xAI · 90.3万 次请求x-ai
  • 86
    Qwen: Qwen3 VL 32B Instruct
    P50 吞吐 51 tok/s · P50 延迟 585 ms · 最佳服务商 Alibaba · 94.3万 次请求qwen
  • 87
    Qwen: Qwen3 Coder 480B A35B
    P50 吞吐 73 tok/s · P50 延迟 590.5 ms · 最佳服务商 DeepInfra · 10.8万 次请求qwen
  • 88
    Tencent: Hy-MT2-1.8B
    P50 吞吐 3 tok/s · P50 延迟 594 ms · 最佳服务商 Tencent · 1632.8万 次请求tencent
  • 89
    Qwen: Qwen3.5-Flash
    P50 吞吐 46 tok/s · P50 延迟 611 ms · 最佳服务商 Alibaba · 327.9万 次请求qwen
  • 90
    MoonshotAI: Kimi K2 0905
    P50 吞吐 5 tok/s · P50 延迟 615 ms · 最佳服务商 Novita · 27.9万 次请求moonshotai
  • 91
    inclusionAI: Ling 3.0 Flash Fin
    P50 吞吐 150 tok/s · P50 延迟 633 ms · 最佳服务商 DeepInfra · 224.5万 次请求inclusionai
  • 92
    Qwen: Qwen3.6 27B
    P50 吞吐 70 tok/s · P50 延迟 636 ms · 最佳服务商 Venice · 10.8万 次请求qwen
  • 93
    LiquidAI: LFM2.5-2.6B
    P50 吞吐 166 tok/s · P50 延迟 637 ms · 最佳服务商 Liquid · 18.2万 次请求liquid
  • 94
    Tencent: Hy-MT2-7B
    P50 吞吐 3 tok/s · P50 延迟 638 ms · 最佳服务商 Tencent · 1607.0万 次请求tencent
  • 95
    DeepSeek: DeepSeek V3
    P50 吞吐 25 tok/s · P50 延迟 638 ms · 最佳服务商 DeepInfra · 105.8万 次请求deepseek
  • 96
    Z.ai: GLM 4.6
    P50 吞吐 62 tok/s · P50 延迟 641 ms · 最佳服务商 DeepInfra · 13.3万 次请求z-ai
  • 97
    Qwen: Qwen3 8B
    P50 吞吐 51 tok/s · P50 延迟 649 ms · 最佳服务商 Alibaba · 10.1万 次请求qwen
  • 98
    Tencent: Hy-MT2-30B-A3B
    P50 吞吐 5 tok/s · P50 延迟 650 ms · 最佳服务商 Tencent · 1460.3万 次请求tencent
  • 99
    MoonshotAI: Kimi K3
    P50 吞吐 61 tok/s · P50 延迟 650 ms · 最佳服务商 Wafer · 306.6万 次请求moonshotai
  • 100
    OpenAI: GPT-5.1
    P50 吞吐 68.5 tok/s · P50 延迟 655 ms · 最佳服务商 Azure · 52.3万 次请求openai