全部/科技/性能 · 延迟

OpenRouter · 性能 · 延迟

HISTORY近 30 天历史柱高表示当天去重热搜数量
10706
07/0808/06 有历史数据
  • 01
    IBM: Granite 4.1 8B
    P50 吞吐 106 tok/s · P50 延迟 111 ms · 最佳服务商 CoreWeave · 45.8万 次请求ibm-granite
  • 02
    Cohere: Command R7B (12-2024)
    P50 吞吐 54 tok/s · P50 延迟 167 ms · 最佳服务商 Cohere · 12.8万 次请求cohere
  • 03
    Poolside: Laguna XS 2.1
    P50 吞吐 102 tok/s · P50 延迟 171 ms · 最佳服务商 Poolside · 43.8万 次请求poolside
  • 04
    Meta: Llama Guard 4 12B
    P50 吞吐 12 tok/s · P50 延迟 171 ms · 最佳服务商 Together · 70.2万 次请求meta-llama
  • 05
    Meta: Llama 3.3 70B Instruct
    P50 吞吐 70 tok/s · P50 延迟 174 ms · 最佳服务商 CoreWeave · 290.7万 次请求meta-llama
  • 06
    Sao10K: Llama 3 8B Lunaris
    P50 吞吐 69 tok/s · P50 延迟 179 ms · 最佳服务商 DeepInfra · 36.4万 次请求sao10k
  • 07
    Meta: Llama 3.2 3B Instruct
    P50 吞吐 54 tok/s · P50 延迟 203 ms · 最佳服务商 Cloudflare · 17.8万 次请求meta-llama
  • 08
    Microsoft: Phi 4
    P50 吞吐 55 tok/s · P50 延迟 205 ms · 最佳服务商 DeepInfra · 16.3万 次请求microsoft
  • 09
    Meta: Llama 3.2 1B Instruct
    P50 吞吐 25 tok/s · P50 延迟 205 ms · 最佳服务商 Cloudflare · 16.0万 次请求meta-llama
  • 10
    OpenAI: gpt-oss-120b
    P50 吞吐 616 tok/s · P50 延迟 206 ms · 最佳服务商 Groq · 1488.5万 次请求openai
  • 11
    OpenAI: gpt-oss-safeguard-20b
    P50 吞吐 426.5 tok/s · P50 延迟 230 ms · 最佳服务商 Groq · 41.3万 次请求openai
  • 12
    Meta: Llama 3.1 70B Instruct
    P50 吞吐 28 tok/s · P50 延迟 235 ms · 最佳服务商 CoreWeave · 73.8万 次请求meta-llama
  • 13
    Meta: Llama 3.1 8B Instruct
    P50 吞吐 96 tok/s · P50 延迟 235 ms · 最佳服务商 CoreWeave · 625.6万 次请求meta-llama
  • 14
    Mistral: Mistral Small 3
    P50 吞吐 36 tok/s · P50 延迟 251 ms · 最佳服务商 DeepInfra · 44.0万 次请求mistralai
  • 15
    StepFun: Step 3.7 Flash
    P50 吞吐 157 tok/s · P50 延迟 255 ms · 最佳服务商 DeepInfra · 251.3万 次请求stepfun
  • 16
    Nous: Hermes 4 70B
    P50 吞吐 69 tok/s · P50 延迟 256 ms · 最佳服务商 Nebius · 14.1万 次请求nousresearch
  • 17
    Qwen: Qwen3 32B
    P50 吞吐 291 tok/s · P50 延迟 262 ms · 最佳服务商 Groq · 126.7万 次请求qwen
  • 18
    Google: Gemma 4 31B
    P50 吞吐 106 tok/s · P50 延迟 263 ms · 最佳服务商 Together · 997.6万 次请求google
  • 19
    OpenAI: gpt-oss-20b
    P50 吞吐 240 tok/s · P50 延迟 263.5 ms · 最佳服务商 Together · 559.9万 次请求openai
  • 20
    Z.ai: GLM 5.1
    P50 吞吐 75 tok/s · P50 延迟 265 ms · 最佳服务商 Friendli · 56.6万 次请求z-ai
  • 21
    Qwen: Qwen3 30B A3B
    P50 吞吐 94 tok/s · P50 延迟 270 ms · 最佳服务商 DeepInfra · 11.2万 次请求qwen
  • 22
    MiniMax: MiniMax M2.7
    P50 吞吐 288 tok/s · P50 延迟 299 ms · 最佳服务商 Groq · 88.8万 次请求minimax
  • 23
    Qwen: Qwen3 14B
    P50 吞吐 51 tok/s · P50 延迟 304 ms · 最佳服务商 Alibaba · 25.2万 次请求qwen
  • 24
    Qwen: Qwen2.5 7B Instruct
    P50 吞吐 54 tok/s · P50 延迟 312 ms · 最佳服务商 Phala · 54.2万 次请求qwen
  • 25
    Meta: Llama 4 Scout
    P50 吞吐 154 tok/s · P50 延迟 315 ms · 最佳服务商 Groq · 281.3万 次请求meta-llama
  • 26
    Qwen: Qwen3.6 35B A3B
    P50 吞吐 154 tok/s · P50 延迟 318 ms · 最佳服务商 CoreWeave · 137.8万 次请求qwen
  • 27
    Qwen: Qwen3 235B A22B Instruct 2507
    P50 吞吐 47 tok/s · P50 延迟 318 ms · 最佳服务商 Crusoe · 280.2万 次请求qwen
  • 28
    Mistral: Ministral 3 8B 2512
    P50 吞吐 45 tok/s · P50 延迟 320 ms · 最佳服务商 Mistral · 56.7万 次请求mistralai
  • 29
    Mistral: Ministral 3 3B 2512
    P50 吞吐 52 tok/s · P50 延迟 322 ms · 最佳服务商 Mistral · 26.0万 次请求mistralai
  • 30
    Qwen: Qwen3.5-35B-A3B
    P50 吞吐 205 tok/s · P50 延迟 324 ms · 最佳服务商 CoreWeave · 31.4万 次请求qwen
  • 31
    Google: Gemma 3n 4B
    P50 吞吐 28 tok/s · P50 延迟 326 ms · 最佳服务商 Together · 48.6万 次请求google
  • 32
    NVIDIA: Nemotron 3 Nano 30B A3B
    P50 吞吐 132 tok/s · P50 延迟 328 ms · 最佳服务商 Crusoe · 39.4万 次请求nvidia
  • 33
    Qwen: Qwen3.5-27B
    P50 吞吐 39 tok/s · P50 延迟 329 ms · 最佳服务商 DeepInfra · 30.0万 次请求qwen
  • 34
    Qwen: Qwen3 30B A3B Instruct 2507
    P50 吞吐 55 tok/s · P50 延迟 330 ms · 最佳服务商 Alibaba · 176.5万 次请求qwen
  • 35
    Ling-3.0-flash
    P50 吞吐 129 tok/s · P50 延迟 339 ms · 最佳服务商 DeepInfra · 241.9万 次请求inclusionai
  • 36
    Qwen: Qwen3 Coder Next
    P50 吞吐 76 tok/s · P50 延迟 355 ms · 最佳服务商 Ionstream · 14.3万 次请求qwen
  • 37
    Meta: Llama 4 Maverick
    P50 吞吐 58 tok/s · P50 延迟 358 ms · 最佳服务商 DeepInfra · 118.4万 次请求meta-llama
  • 38
    ByteDance Seed: Seed-2.0-Mini
    P50 吞吐 60 tok/s · P50 延迟 359 ms · 最佳服务商 Seed · 26.0万 次请求bytedance-seed
  • 39
    DeepSeek: DeepSeek V4 Flash 0423
    P50 吞吐 80 tok/s · P50 延迟 364 ms · 最佳服务商 CoreWeave · 8685.1万 次请求deepseek
  • 40
    Z.ai: GLM 4.7 Flash
    P50 吞吐 36 tok/s · P50 延迟 367 ms · 最佳服务商 Cloudflare · 74.7万 次请求z-ai
  • 41
    Z.ai: GLM 4.7
    P50 吞吐 305 tok/s · P50 延迟 371 ms · 最佳服务商 Cerebras · 67.5万 次请求z-ai
  • 42
    DeepSeek: DeepSeek V3 0324
    P50 吞吐 34 tok/s · P50 延迟 371 ms · 最佳服务商 Crusoe · 110.7万 次请求deepseek
  • 43
    Mistral: Ministral 3 14B 2512
    P50 吞吐 48 tok/s · P50 延迟 379 ms · 最佳服务商 Mistral · 13.6万 次请求mistralai
  • 44
    Qwen: Qwen3.6 27B
    P50 吞吐 59 tok/s · P50 延迟 388 ms · 最佳服务商 CoreWeave · 39.5万 次请求qwen
  • 45
    Mistral: Mistral Small 3.2 24B
    P50 吞吐 26 tok/s · P50 延迟 393 ms · 最佳服务商 DeepInfra · 112.0万 次请求mistralai
  • 46
    Google: Gemma 4 26B A4B
    P50 吞吐 56 tok/s · P50 延迟 394 ms · 最佳服务商 DeepInfra · 1089.7万 次请求google
  • 47
    Qwen: Qwen3 VL 8B Instruct
    P50 吞吐 47 tok/s · P50 延迟 402 ms · 最佳服务商 Alibaba · 209.2万 次请求qwen
  • 48
    Amazon: Nova Lite 1.0
    P50 吞吐 109 tok/s · P50 延迟 412 ms · 最佳服务商 Amazon Bedrock · 15.8万 次请求amazon
  • 49
    DeepSeek: DeepSeek V4 Flash 0731
    P50 吞吐 128 tok/s · P50 延迟 415 ms · 最佳服务商 BaseTen · 3408.4万 次请求deepseek
  • 50
    MoonshotAI: Kimi K2.7 Code
    P50 吞吐 139 tok/s · P50 延迟 436 ms · 最佳服务商 ModelRun · 32.5万 次请求moonshotai
  • 51
    SpaceXAI: Grok 4.20
    P50 吞吐 96 tok/s · P50 延迟 437 ms · 最佳服务商 xAI · 52.0万 次请求x-ai
  • 52
    Qwen: Qwen3 Next 80B A3B Instruct
    P50 吞吐 55 tok/s · P50 延迟 440 ms · 最佳服务商 Alibaba · 32.8万 次请求qwen
  • 53
    Anthropic: Claude 3 Haiku
    P50 吞吐 67 tok/s · P50 延迟 442 ms · 最佳服务商 Amazon Bedrock · 19.2万 次请求anthropic
  • 54
    NVIDIA: Nemotron 3 Nano Omni
    P50 吞吐 75 tok/s · P50 延迟 454 ms · 最佳服务商 Nvidia · 21.7万 次请求nvidia
  • 55
    Qwen: Qwen3 VL 30B A3B Instruct
    P50 吞吐 27 tok/s · P50 延迟 459 ms · 最佳服务商 DeepInfra · 63.7万 次请求qwen
  • 56
    Google: Gemini 2.5 Flash Lite
    P50 吞吐 110 tok/s · P50 延迟 463 ms · 最佳服务商 Google · 3164.9万 次请求google
  • 57
    Google: Gemma 3 12B
    P50 吞吐 32 tok/s · P50 延迟 466 ms · 最佳服务商 DeepInfra · 185.4万 次请求google
  • 58
    Qwen: Qwen3.5-Flash
    P50 吞吐 44 tok/s · P50 延迟 468 ms · 最佳服务商 Alibaba · 358.2万 次请求qwen
  • 59
    Qwen: Qwen3.5-9B
    P50 吞吐 40 tok/s · P50 延迟 475 ms · 最佳服务商 Together · 90.3万 次请求qwen
  • 60
    Xiaomi: MiMo-V2.5-Pro
    P50 吞吐 74 tok/s · P50 延迟 478 ms · 最佳服务商 DeepInfra · 122.5万 次请求xiaomi
  • 61
    Anthropic: Claude Haiku 4.5
    P50 吞吐 88 tok/s · P50 延迟 490 ms · 最佳服务商 Google · 534.0万 次请求anthropic
  • 62
    DeepSeek: DeepSeek V4 Pro
    P50 吞吐 81 tok/s · P50 延迟 493 ms · 最佳服务商 BaseTen · 1276.2万 次请求deepseek
  • 63
    DeepSeek: DeepSeek V3
    P50 吞吐 27 tok/s · P50 延迟 493 ms · 最佳服务商 DeepInfra · 192.8万 次请求deepseek
  • 64
    Thinking Machines: Inkling
    P50 吞吐 107 tok/s · P50 延迟 494 ms · 最佳服务商 BaseTen · 13.1万 次请求thinkingmachines
  • 65
    Google: Gemma 3 27B
    P50 吞吐 43 tok/s · P50 延迟 511 ms · 最佳服务商 Parasail · 253.9万 次请求google
  • 66
    OpenAI: GPT-4o-mini (2024-07-18)
    P50 吞吐 54 tok/s · P50 延迟 512 ms · 最佳服务商 OpenAI · 174.7万 次请求openai
  • 67
    Tencent: Hy3
    P50 吞吐 54 tok/s · P50 延迟 516 ms · 最佳服务商 DeepInfra · 1093.6万 次请求tencent
  • 68
    Poolside: Laguna S 2.1
    P50 吞吐 65 tok/s · P50 延迟 519 ms · 最佳服务商 Poolside · 288.0万 次请求poolside
  • 69
    MiniMax: MiniMax M2.5
    P50 吞吐 83 tok/s · P50 延迟 519.5 ms · 最佳服务商 Inceptron · 23.9万 次请求minimax
  • 70
    Anthropic: Claude Sonnet 4
    P50 吞吐 47 tok/s · P50 延迟 536 ms · 最佳服务商 Google · 38.3万 次请求anthropic
  • 71
    Amazon: Nova Micro 1.0
    P50 吞吐 125 tok/s · P50 延迟 536 ms · 最佳服务商 Amazon Bedrock · 356.2万 次请求amazon
  • 72
    Z.ai: GLM 4.6
    P50 吞吐 36 tok/s · P50 延迟 537 ms · 最佳服务商 DeepInfra · 10.8万 次请求z-ai
  • 73
    Mistral: Mistral Nemo
    P50 吞吐 28 tok/s · P50 延迟 537 ms · 最佳服务商 Parasail · 683.1万 次请求mistralai
  • 74
    Qwen: Qwen3.5 397B A17B
    P50 吞吐 66 tok/s · P50 延迟 538 ms · 最佳服务商 DeepInfra · 30.8万 次请求qwen
  • 75
    OpenAI: GPT-4o-mini
    P50 吞吐 68 tok/s · P50 延迟 539 ms · 最佳服务商 OpenAI · 1620.3万 次请求openai
  • 76
    Google: Gemma 3 4B
    P50 吞吐 22 tok/s · P50 延迟 542 ms · 最佳服务商 DeepInfra · 34.9万 次请求google
  • 77
    Google: Gemini 3.5 Flash Lite
    P50 吞吐 54 tok/s · P50 延迟 545 ms · 最佳服务商 Google AI Studio · 410.6万 次请求google
  • 78
    Qwen: Qwen3.6 Flash
    P50 吞吐 90 tok/s · P50 延迟 547 ms · 最佳服务商 Alibaba · 32.4万 次请求qwen
  • 79
    Google: Gemini 2.5 Flash
    P50 吞吐 85 tok/s · P50 延迟 547 ms · 最佳服务商 Google AI Studio · 2169.5万 次请求google
  • 80
    SpaceXAI: Grok 4.3
    P50 吞吐 106 tok/s · P50 延迟 567 ms · 最佳服务商 xAI · 195.4万 次请求x-ai
  • 81
    NVIDIA: Nemotron 3 Ultra
    P50 吞吐 87 tok/s · P50 延迟 576 ms · 最佳服务商 BaseTen · 437.1万 次请求nvidia
  • 82
    Mistral: Mistral Small 4
    P50 吞吐 83 tok/s · P50 延迟 577 ms · 最佳服务商 Mistral · 66.5万 次请求mistralai
  • 83
    DeepSeek: DeepSeek V3.2
    P50 吞吐 42 tok/s · P50 延迟 578.5 ms · 最佳服务商 Friendli · 716.9万 次请求deepseek
  • 84
    Google: Gemini 3.1 Flash Lite
    P50 吞吐 96 tok/s · P50 延迟 606 ms · 最佳服务商 Google AI Studio · 1564.2万 次请求google
  • 85
    Inception: Mercury 2
    P50 吞吐 267 tok/s · P50 延迟 609 ms · 最佳服务商 Inception · 15.6万 次请求inception
  • 86
    OpenAI: GPT-4o
    P50 吞吐 41 tok/s · P50 延迟 615 ms · 最佳服务商 OpenAI · 91.9万 次请求openai
  • 87
    Qwen: Qwen3 8B
    P50 吞吐 56 tok/s · P50 延迟 623 ms · 最佳服务商 Alibaba · 25.1万 次请求qwen
  • 88
    MoonshotAI: Kimi K2.6
    P50 吞吐 108 tok/s · P50 延迟 630 ms · 最佳服务商 Fireworks · 177.5万 次请求moonshotai
  • 89
    Google: Gemini 3.1 Flash Lite Preview
    P50 吞吐 103 tok/s · P50 延迟 631 ms · 最佳服务商 Google AI Studio · 314.0万 次请求google
  • 90
    Qwen2.5 72B Instruct
    P50 吞吐 22 tok/s · P50 延迟 632 ms · 最佳服务商 DeepInfra · 20.4万 次请求qwen
  • 91
    inclusionAI: Ling-2.6-flash
    P50 吞吐 67 tok/s · P50 延迟 634 ms · 最佳服务商 Novita · 1132.1万 次请求inclusionai
  • 92
    Qwen: Qwen2.5 VL 72B Instruct
    P50 吞吐 25 tok/s · P50 延迟 660.5 ms · 最佳服务商 Parasail · 16.6万 次请求qwen
  • 93
    Z.ai: GLM 5.2
    P50 吞吐 142 tok/s · P50 延迟 673 ms · 最佳服务商 Friendli · 1263.7万 次请求z-ai
  • 94
    OpenAI: GPT-4.1 Nano
    P50 吞吐 51 tok/s · P50 延迟 679 ms · 最佳服务商 OpenAI · 155.6万 次请求openai
  • 95
    OpenAI: GPT-4.1 Mini
    P50 吞吐 53 tok/s · P50 延迟 683.5 ms · 最佳服务商 Azure · 452.4万 次请求openai
  • 96
    Qwen: Qwen3 Coder 30B A3B Instruct
    P50 吞吐 67 tok/s · P50 延迟 700 ms · 最佳服务商 DigitalOcean · 17.1万 次请求qwen
  • 97
    Z.ai: GLM 4.5 Air
    P50 吞吐 33 tok/s · P50 延迟 700.5 ms · 最佳服务商 Novita · 11.3万 次请求z-ai
  • 98
    DeepSeek: DeepSeek V3.1
    P50 吞吐 48 tok/s · P50 延迟 702 ms · 最佳服务商 Google · 227.1万 次请求deepseek
  • 99
    Mistral: Mistral Large 3 2512
    P50 吞吐 38 tok/s · P50 延迟 704 ms · 最佳服务商 Mistral · 24.6万 次请求mistralai
  • 100
    Qwen: Qwen3.5-122B-A10B
    P50 吞吐 58 tok/s · P50 延迟 706 ms · 最佳服务商 DeepInfra · 14.7万 次请求qwen