按处理的总 Token 消耗量排名
openai
openai
过去 7 天网关上的 Token 消耗量
网关上首字节延迟 (TTFT) 最低的模型
按 Token 消耗量比较 DeepToken 上最热门的模型
| 排名 | 模型 ID | Token 消耗量 (7天)▼ | 平均延迟 | 7天变化 |
|---|---|---|---|---|
| 1 | O gpt-4o-mini openai | 1.15T | 550ms | ↑ +15% |
| 2 | O gpt-4o openai | 950B | 850ms | ↑ +10% |
| 3 | G gemini-2.5-flash google | 620B | 450ms | ↑ +23% |
| 4 | A claude-sonnet-4-20250514 anthropic | 620B | 850ms | NEW |
| 5 | G gemini-2.5-pro google | 410B | 1100ms | ↑ +11% |
| 6 | A claude-opus-4-20250514 anthropic | 150B | 2400ms | NEW |
| 7 | G gemini-3.1-flash-image-2k-9x16 google | 10B | 800ms | ↓ - |
| 8 | G gemini-3.1-flash-image-4k google | 10B | 800ms | ↓ - |
| 9 | A claude-opus-4-6 anthropic | 10B | 800ms | ↓ - |
| 10 | A claude-opus-4-6-thinking anthropic | 10B | 800ms | ↓ - |
排行榜数据每分钟更新一次,基于最近 7 天的滚动请求窗口。Token 数量为输入与输出的合计总量。
延迟表示完整请求的响应时间,TTFT 则表示首个 Token 的响应时间。默认种子值会与实时路由指标混合计算,以引导新节点的数据展示。
更新于 2026年7月10日 15:37
查看目录