全部/科技/性能 · 吞吐量

OpenRouter · 性能 · 吞吐量

HISTORY近 30 天历史柱高表示当天去重热搜数量
10806
07/0808/06 有历史数据
  • 01616
    OpenAI: gpt-oss-120b
    P50 吞吐 616 tok/s · P50 延迟 206 ms · 最佳服务商 Cerebras · 1488.5万 次请求openai
  • 02426
    OpenAI: gpt-oss-safeguard-20b
    P50 吞吐 426.5 tok/s · P50 延迟 230 ms · 最佳服务商 Groq · 41.3万 次请求openai
  • 03309
    Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)
    P50 吞吐 309 tok/s · P50 延迟 2,218 ms · 最佳服务商 Google AI Studio · 11.9万 次请求google
  • 04305
    Z.ai: GLM 4.7
    P50 吞吐 305 tok/s · P50 延迟 371 ms · 最佳服务商 Cerebras · 67.5万 次请求z-ai
  • 05291
    Qwen: Qwen3 32B
    P50 吞吐 291 tok/s · P50 延迟 262 ms · 最佳服务商 Groq · 126.7万 次请求qwen
  • 06288
    MiniMax: MiniMax M2.7
    P50 吞吐 288 tok/s · P50 延迟 299 ms · 最佳服务商 Groq · 88.8万 次请求minimax
  • 07267
    Inception: Mercury 2
    P50 吞吐 267 tok/s · P50 延迟 609 ms · 最佳服务商 Inception · 15.6万 次请求inception
  • 08240
    OpenAI: gpt-oss-20b
    P50 吞吐 240 tok/s · P50 延迟 263.5 ms · 最佳服务商 Amazon Bedrock · 559.9万 次请求openai
  • 09205
    Qwen: Qwen3.5-35B-A3B
    P50 吞吐 205 tok/s · P50 延迟 324 ms · 最佳服务商 CoreWeave · 31.4万 次请求qwen
  • 10178
    Google: Nano Banana (Gemini 2.5 Flash Image)
    P50 吞吐 178 tok/s · P50 延迟 4,774 ms · 最佳服务商 Google AI Studio · 30.8万 次请求google
  • 11162
    Google: Nano Banana 2 (Gemini 3.1 Flash Image)
    P50 吞吐 162 tok/s · P50 延迟 7,666 ms · 最佳服务商 Google AI Studio · 14.3万 次请求google
  • 12157
    StepFun: Step 3.7 Flash
    P50 吞吐 157 tok/s · P50 延迟 255 ms · 最佳服务商 DeepInfra · 251.3万 次请求stepfun
  • 13155
    Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)
    P50 吞吐 155 tok/s · P50 延迟 8,335 ms · 最佳服务商 Google AI Studio · 11.1万 次请求google
  • 14154
    Qwen: Qwen3.6 35B A3B
    P50 吞吐 154 tok/s · P50 延迟 318 ms · 最佳服务商 CoreWeave · 137.8万 次请求qwen
  • 15154
    Meta: Llama 4 Scout
    P50 吞吐 154 tok/s · P50 延迟 315 ms · 最佳服务商 Groq · 281.3万 次请求meta-llama
  • 16142
    Z.ai: GLM 5.2
    P50 吞吐 142 tok/s · P50 延迟 673 ms · 最佳服务商 BaseTen · 1263.7万 次请求z-ai
  • 17139
    MoonshotAI: Kimi K2.7 Code
    P50 吞吐 139 tok/s · P50 延迟 436 ms · 最佳服务商 Together · 32.5万 次请求moonshotai
  • 18132
    NVIDIA: Nemotron 3 Nano 30B A3B
    P50 吞吐 132 tok/s · P50 延迟 328 ms · 最佳服务商 Crusoe · 39.4万 次请求nvidia
  • 19129
    Ling-3.0-flash
    P50 吞吐 129 tok/s · P50 延迟 339 ms · 最佳服务商 DeepInfra · 241.9万 次请求inclusionai
  • 20128
    DeepSeek: DeepSeek V4 Flash 0731
    P50 吞吐 128 tok/s · P50 延迟 415 ms · 最佳服务商 CoreWeave · 3408.4万 次请求deepseek
  • 21125
    Amazon: Nova Micro 1.0
    P50 吞吐 125 tok/s · P50 延迟 536 ms · 最佳服务商 Amazon Bedrock · 356.2万 次请求amazon
  • 22124
    NVIDIA: Nemotron 3 Super
    P50 吞吐 124 tok/s · P50 延迟 977 ms · 最佳服务商 Nebius · 133.8万 次请求nvidia
  • 23110
    Google: Gemini 2.5 Flash Lite
    P50 吞吐 110 tok/s · P50 延迟 463 ms · 最佳服务商 Google AI Studio · 3164.9万 次请求google
  • 24109
    Amazon: Nova Lite 1.0
    P50 吞吐 109 tok/s · P50 延迟 412 ms · 最佳服务商 Amazon Bedrock · 15.8万 次请求amazon
  • 25108
    MoonshotAI: Kimi K2.6
    P50 吞吐 108 tok/s · P50 延迟 630 ms · 最佳服务商 BaseTen · 177.5万 次请求moonshotai
  • 26107
    Thinking Machines: Inkling
    P50 吞吐 107 tok/s · P50 延迟 494 ms · 最佳服务商 BaseTen · 13.1万 次请求thinkingmachines
  • 27107
    OpenAI: GPT-5.6 Luna Pro
    P50 吞吐 107 tok/s · P50 延迟 2,061 ms · 最佳服务商 Azure · 72.4万 次请求openai
  • 28106
    SpaceXAI: Grok 4.3
    P50 吞吐 106 tok/s · P50 延迟 567 ms · 最佳服务商 xAI · 195.4万 次请求x-ai
  • 29106
    IBM: Granite 4.1 8B
    P50 吞吐 106 tok/s · P50 延迟 111 ms · 最佳服务商 CoreWeave · 45.8万 次请求ibm-granite
  • 30106
    Google: Gemma 4 31B
    P50 吞吐 106 tok/s · P50 延迟 263 ms · 最佳服务商 SambaNova · 997.6万 次请求google
  • 31103
    Google: Gemini 3.1 Flash Lite Preview
    P50 吞吐 103 tok/s · P50 延迟 631 ms · 最佳服务商 Google AI Studio · 314.0万 次请求google
  • 32102
    Poolside: Laguna XS 2.1
    P50 吞吐 102 tok/s · P50 延迟 171 ms · 最佳服务商 Poolside · 43.8万 次请求poolside
  • 33101
    OpenAI: GPT-5.1
    P50 吞吐 101 tok/s · P50 延迟 1,018 ms · 最佳服务商 Azure · 37.1万 次请求openai
  • 3498
    Google: Gemini 3.1 Pro Preview
    P50 吞吐 98 tok/s · P50 延迟 2,893 ms · 最佳服务商 Google AI Studio · 211.9万 次请求google
  • 3596
    Google: Gemini 3.1 Flash Lite
    P50 吞吐 96 tok/s · P50 延迟 606 ms · 最佳服务商 Google AI Studio · 1564.2万 次请求google
  • 3696
    SpaceXAI: Grok 4.20
    P50 吞吐 96 tok/s · P50 延迟 437 ms · 最佳服务商 xAI · 52.0万 次请求x-ai
  • 3796
    Meta: Llama 3.1 8B Instruct
    P50 吞吐 96 tok/s · P50 延迟 235 ms · 最佳服务商 Groq · 625.6万 次请求meta-llama
  • 3894
    Meta: Muse Spark 1.1
    P50 吞吐 94 tok/s · P50 延迟 13,061 ms · 最佳服务商 Meta · 24.4万 次请求meta
  • 3994
    Qwen: Qwen3 30B A3B
    P50 吞吐 94 tok/s · P50 延迟 270 ms · 最佳服务商 Alibaba · 11.2万 次请求qwen
  • 4092
    MiniMax: MiniMax M3
    P50 吞吐 92 tok/s · P50 延迟 839 ms · 最佳服务商 Venice · 482.1万 次请求minimax
  • 4190
    Qwen: Qwen3.6 Flash
    P50 吞吐 90 tok/s · P50 延迟 547 ms · 最佳服务商 Alibaba · 32.4万 次请求qwen
  • 4289
    Google: Gemini 2.5 Pro
    P50 吞吐 89 tok/s · P50 延迟 2,024 ms · 最佳服务商 Google AI Studio · 77.7万 次请求google
  • 4388
    Anthropic: Claude Haiku 4.5
    P50 吞吐 88 tok/s · P50 延迟 490 ms · 最佳服务商 Google · 534.0万 次请求anthropic
  • 4487
    NVIDIA: Nemotron 3 Ultra
    P50 吞吐 87 tok/s · P50 延迟 576 ms · 最佳服务商 Together · 437.1万 次请求nvidia
  • 4586
    Anthropic: Claude Sonnet 5
    P50 吞吐 86 tok/s · P50 延迟 1,890.5 ms · 最佳服务商 Google · 345.8万 次请求anthropic
  • 4686
    OpenAI: GPT-5 Nano
    P50 吞吐 86 tok/s · P50 延迟 2,493 ms · 最佳服务商 OpenAI · 171.2万 次请求openai
  • 4785
    Google: Gemini 2.5 Flash
    P50 吞吐 85 tok/s · P50 延迟 547 ms · 最佳服务商 Google · 2169.5万 次请求google
  • 4883
    Mistral: Mistral Small 4
    P50 吞吐 83 tok/s · P50 延迟 577 ms · 最佳服务商 Mistral · 66.5万 次请求mistralai
  • 4983
    MiniMax: MiniMax M2.5
    P50 吞吐 83 tok/s · P50 延迟 519.5 ms · 最佳服务商 Friendli · 23.9万 次请求minimax
  • 5081
    DeepSeek: DeepSeek V4 Pro
    P50 吞吐 81 tok/s · P50 延迟 493 ms · 最佳服务商 BaseTen · 1276.2万 次请求deepseek
  • 5180
    DeepSeek: DeepSeek V4 Flash 0423
    P50 吞吐 80 tok/s · P50 延迟 364 ms · 最佳服务商 DeepSeek · 8685.1万 次请求deepseek
  • 5278
    OpenAI: GPT-5 Mini
    P50 吞吐 78 tok/s · P50 延迟 2,706 ms · 最佳服务商 Azure · 335.6万 次请求openai
  • 5378
    Perplexity: Sonar
    P50 吞吐 78 tok/s · P50 延迟 1,816 ms · 最佳服务商 Perplexity · 29.9万 次请求perplexity
  • 5477
    Google: Gemini 3.6 Flash
    P50 吞吐 77 tok/s · P50 延迟 1,991 ms · 最佳服务商 Google AI Studio · 770.1万 次请求google
  • 5576
    Anthropic: Claude Opus 4.7
    P50 吞吐 76 tok/s · P50 延迟 954 ms · 最佳服务商 Google · 131.7万 次请求anthropic
  • 5676
    Qwen: Qwen3 Coder Next
    P50 吞吐 76 tok/s · P50 延迟 355 ms · 最佳服务商 Ionstream · 14.3万 次请求qwen
  • 5775
    NVIDIA: Nemotron 3 Nano Omni
    P50 吞吐 75 tok/s · P50 延迟 454 ms · 最佳服务商 Nvidia · 21.7万 次请求nvidia
  • 5875
    Z.ai: GLM 5.1
    P50 吞吐 75 tok/s · P50 延迟 265 ms · 最佳服务商 Friendli · 56.6万 次请求z-ai
  • 5975
    Qwen: Qwen3.5 Plus 2026-02-15
    P50 吞吐 75 tok/s · P50 延迟 852 ms · 最佳服务商 Alibaba · 16.1万 次请求qwen
  • 6075
    OpenAI: GPT-5
    P50 吞吐 75 tok/s · P50 延迟 4,461 ms · 最佳服务商 Azure · 38.4万 次请求openai
  • 6174
    Nex AGI: Nex-N2-Mini
    P50 吞吐 74.5 tok/s · P50 延迟 1,086.5 ms · 最佳服务商 Nex AGI · 22.9万 次请求nex-agi
  • 6274
    Anthropic: Claude Opus 4.8
    P50 吞吐 74 tok/s · P50 延迟 1,083.5 ms · 最佳服务商 Google · 167.6万 次请求anthropic
  • 6374
    Xiaomi: MiMo-V2.5-Pro
    P50 吞吐 74 tok/s · P50 延迟 478 ms · 最佳服务商 DeepInfra · 122.5万 次请求xiaomi
  • 6474
    OpenAI: GPT-5.4 Mini
    P50 吞吐 74 tok/s · P50 延迟 928 ms · 最佳服务商 Azure · 402.2万 次请求openai
  • 6571
    Google: Gemini 3.5 Flash
    P50 吞吐 71 tok/s · P50 延迟 1,532 ms · 最佳服务商 Google AI Studio · 301.9万 次请求google
  • 6670
    Meta: Llama 3.3 70B Instruct
    P50 吞吐 70 tok/s · P50 延迟 174 ms · 最佳服务商 SambaNova · 290.7万 次请求meta-llama
  • 6769
    Upstage: Solar Pro 3
    P50 吞吐 69 tok/s · P50 延迟 889 ms · 最佳服务商 Upstage · 13.3万 次请求upstage
  • 6869
    Nous: Hermes 4 70B
    P50 吞吐 69 tok/s · P50 延迟 256 ms · 最佳服务商 Nebius · 14.1万 次请求nousresearch
  • 6969
    Sao10K: Llama 3 8B Lunaris
    P50 吞吐 69 tok/s · P50 延迟 179 ms · 最佳服务商 DeepInfra · 36.4万 次请求sao10k
  • 7068
    OpenAI: GPT-4.1
    P50 吞吐 68 tok/s · P50 延迟 726.5 ms · 最佳服务商 Azure · 186.6万 次请求openai
  • 7168
    OpenAI: GPT-4o-mini
    P50 吞吐 68 tok/s · P50 延迟 539 ms · 最佳服务商 Azure · 1620.3万 次请求openai
  • 7267
    Claude Opus 5
    P50 吞吐 67 tok/s · P50 延迟 1,434 ms · 最佳服务商 Amazon Bedrock · 246.8万 次请求anthropic
  • 7367
    OpenAI: GPT-5.6 Luna
    P50 吞吐 67 tok/s · P50 延迟 1,127 ms · 最佳服务商 Azure · 2004.9万 次请求openai
  • 7467
    inclusionAI: Ling-2.6-flash
    P50 吞吐 67 tok/s · P50 延迟 634 ms · 最佳服务商 Novita · 1132.1万 次请求inclusionai
  • 7567
    Qwen: Qwen3 Coder 30B A3B Instruct
    P50 吞吐 67 tok/s · P50 延迟 700 ms · 最佳服务商 Alibaba · 17.1万 次请求qwen
  • 7667
    Anthropic: Claude 3 Haiku
    P50 吞吐 67 tok/s · P50 延迟 442 ms · 最佳服务商 Amazon Bedrock · 19.2万 次请求anthropic
  • 7766
    Qwen: Qwen3.5 397B A17B
    P50 吞吐 66 tok/s · P50 延迟 538 ms · 最佳服务商 Novita · 30.8万 次请求qwen
  • 7865
    Poolside: Laguna S 2.1
    P50 吞吐 65 tok/s · P50 延迟 519 ms · 最佳服务商 Poolside · 288.0万 次请求poolside
  • 7965
    MoonshotAI: Kimi K3
    P50 吞吐 65 tok/s · P50 延迟 978 ms · 最佳服务商 Fireworks · 272.5万 次请求moonshotai
  • 8064
    OpenAI: GPT-5.6 Terra
    P50 吞吐 64 tok/s · P50 延迟 2,391 ms · 最佳服务商 Azure · 371.2万 次请求openai
  • 8162
    Anthropic: Claude Fable 5
    P50 吞吐 62.5 tok/s · P50 延迟 3,817.5 ms · 最佳服务商 Google · 59.3万 次请求anthropic
  • 8262
    OpenAI: GPT-5.3-Codex
    P50 吞吐 61.5 tok/s · P50 延迟 2,579.5 ms · 最佳服务商 OpenAI · 10.2万 次请求openai
  • 8361
    OpenAI: GPT-5.4
    P50 吞吐 61 tok/s · P50 延迟 1,129 ms · 最佳服务商 Azure · 137.6万 次请求openai
  • 8461
    Google: Gemini 3 Flash Preview
    P50 吞吐 61 tok/s · P50 延迟 1,207 ms · 最佳服务商 Google AI Studio · 1576.4万 次请求google
  • 8560
    Xiaomi: MiMo-V2.5
    P50 吞吐 60 tok/s · P50 延迟 792 ms · 最佳服务商 Venice · 1115.9万 次请求xiaomi
  • 8660
    ByteDance Seed: Seed-2.0-Mini
    P50 吞吐 60 tok/s · P50 延迟 359 ms · 最佳服务商 Seed · 26.0万 次请求bytedance-seed
  • 8760
    Z.ai: GLM 5
    P50 吞吐 60 tok/s · P50 延迟 926 ms · 最佳服务商 GMICloud · 108.5万 次请求z-ai
  • 8859
    Qwen: Qwen3.6 27B
    P50 吞吐 59 tok/s · P50 延迟 388 ms · 最佳服务商 CoreWeave · 39.5万 次请求qwen
  • 8958
    Qwen: Qwen3.5-122B-A10B
    P50 吞吐 58 tok/s · P50 延迟 706 ms · 最佳服务商 DeepInfra · 14.7万 次请求qwen
  • 9058
    Meta: Llama 4 Maverick
    P50 吞吐 58 tok/s · P50 延迟 358 ms · 最佳服务商 Parasail · 118.4万 次请求meta-llama
  • 9158
    Perplexity: Sonar Pro
    P50 吞吐 58 tok/s · P50 延迟 1,853 ms · 最佳服务商 Perplexity · 21.9万 次请求perplexity
  • 9257
    MoonshotAI: Kimi K2.5
    P50 吞吐 57 tok/s · P50 延迟 840.5 ms · 最佳服务商 Amazon Bedrock · 147.6万 次请求moonshotai
  • 9357
    ByteDance Seed: Seed 1.6 Flash
    P50 吞吐 57 tok/s · P50 延迟 849 ms · 最佳服务商 Seed · 20.6万 次请求bytedance-seed
  • 9456
    Google: Gemma 4 26B A4B
    P50 吞吐 56 tok/s · P50 延迟 394 ms · 最佳服务商 Cloudflare · 1089.7万 次请求google
  • 9556
    Qwen: Qwen3 8B
    P50 吞吐 56 tok/s · P50 延迟 623 ms · 最佳服务商 Alibaba · 25.1万 次请求qwen
  • 9655
    Qwen: Qwen3 Next 80B A3B Instruct
    P50 吞吐 55 tok/s · P50 延迟 440 ms · 最佳服务商 Alibaba · 32.8万 次请求qwen
  • 9755
    Qwen: Qwen3 30B A3B Instruct 2507
    P50 吞吐 55 tok/s · P50 延迟 330 ms · 最佳服务商 CoreWeave · 176.5万 次请求qwen
  • 9855
    Microsoft: Phi 4
    P50 吞吐 55 tok/s · P50 延迟 205 ms · 最佳服务商 DeepInfra · 16.3万 次请求microsoft
  • 9954
    Google: Gemini 3.5 Flash Lite
    P50 吞吐 54 tok/s · P50 延迟 545 ms · 最佳服务商 Google AI Studio · 410.6万 次请求google
  • 10054
    Tencent: Hy3
    P50 吞吐 54 tok/s · P50 延迟 516 ms · 最佳服务商 DeepInfra · 1093.6万 次请求tencent