跳到内容
DeepToken推理与计费网关
首页控制台模型提示词排行榜文档定价企业版博客

    热门路由模型

    按处理的总 Token 消耗量排名

    2
    亚军
    O

    gpt-4o

    openai

    Token 消耗量 (7天)950B
    请求量 (7天)420M
    平均延迟850ms
    平均首字节延迟120ms
    OpenAI
    ↑ +10%
    1
    冠军模型
    O

    gpt-4o-mini

    openai

    Token 消耗量 (7天)1.15T
    请求量 (7天)890M
    平均延迟550ms
    平均首字节延迟90ms
    OpenAI
    ↑ +15%
    3
    季军
    G

    gemini-2.5-flash

    google

    Token 消耗量 (7天)620B
    请求量 (7天)290M
    平均延迟450ms
    平均首字节延迟80ms
    Google
    ↑ +23%

    Token 消耗量排行

    过去 7 天网关上的 Token 消耗量

    1
    Ogpt-4o-mini
    1.15T
    2
    Ogpt-4o
    950B
    3
    Ggemini-2.5-flash
    620B
    4
    Aclaude-sonnet-4-20250514
    620B
    5
    Ggemini-2.5-pro
    410B
    6
    Aclaude-opus-4-20250514
    150B
    7
    Ggemini-3.1-flash-image-2k-9x16
    10B
    8
    Ggemini-3.1-flash-image-4k
    10B
    9
    Aclaude-opus-4-6
    10B
    10
    Aclaude-opus-4-6-thinking
    10B
    11
    Aclaude-opus-4-7
    10B
    12
    Aclaude-opus-4-8
    10B
    13
    Aclaude-haiku-4-5-20251001
    10B
    14
    Aclaude-sonnet-4-5-20250929
    10B
    15
    Aclaude-sonnet-4-5-20250929-thinking
    10B

    最快模型

    网关上首字节延迟 (TTFT) 最低的模型

    1G
    gemini-2.5-flashGoogle
    google
    平均延迟450ms
    吞吐量4751 tok/s
    TTFT80ms
    2O
    gpt-4o-miniOpenAI
    openai
    平均延迟550ms
    吞吐量2349 tok/s
    TTFT90ms
    3O
    gpt-4oOpenAI
    openai
    平均延迟850ms
    吞吐量2661 tok/s
    TTFT120ms
    4G
    gemini-3.1-flash-image-2k-9x16Google
    google
    平均延迟800ms
    吞吐量2500 tok/s
    TTFT120ms
    5G
    gemini-3.1-flash-image-4kGoogle
    google
    平均延迟800ms
    吞吐量2500 tok/s
    TTFT120ms
    6A
    claude-opus-4-6Anthropic
    anthropic
    平均延迟800ms
    吞吐量2500 tok/s
    TTFT120ms
    7A
    claude-opus-4-6-thinkingAnthropic
    anthropic
    平均延迟800ms
    吞吐量2500 tok/s
    TTFT120ms
    8A
    claude-opus-4-7Anthropic
    anthropic
    平均延迟800ms
    吞吐量2500 tok/s
    TTFT120ms
    9A
    claude-opus-4-8Anthropic
    anthropic
    平均延迟800ms
    吞吐量2500 tok/s
    TTFT120ms
    10A
    claude-haiku-4-5-20251001Anthropic
    anthropic
    平均延迟800ms
    吞吐量2500 tok/s
    TTFT120ms

    LLM 排行榜

    按 Token 消耗量比较 DeepToken 上最热门的模型

    显示 10 / 101 个模型

    排名模型 ID家族Token 消耗量 (7天)▼请求量 (7天)平均延迟平均首字节延迟7天变化
    1
    O
    gpt-4o-mini
    openai
    OpenAI1.15T890M550ms90ms↑ +15%
    2
    O
    gpt-4o
    openai
    OpenAI950B420M850ms120ms↑ +10%
    3
    G
    gemini-2.5-flash
    google
    Google620B290M450ms80ms↑ +23%
    4
    A
    claude-sonnet-4-20250514
    anthropic
    Anthropic620B240M850ms140msNEW
    5
    G
    gemini-2.5-pro
    google
    Google410B140M1100ms160ms↑ +11%
    6
    A
    claude-opus-4-20250514
    anthropic
    Anthropic150B60M2400ms350msNEW
    7
    G
    gemini-3.1-flash-image-2k-9x16
    google
    Google10B5M800ms120ms↓ -
    8
    G
    gemini-3.1-flash-image-4k
    google
    Google10B5M800ms120ms↓ -
    9
    A
    claude-opus-4-6
    anthropic
    Anthropic10B5M800ms120ms↓ -
    10
    A
    claude-opus-4-6-thinking
    anthropic
    Anthropic10B5M800ms120ms↓ -

    市场份额 (按 Token 消耗)

    OpenAI: 48% (2.33T tokens)Google: 32% (1.55T tokens)Anthropic: 19% (920B tokens)DeepSeek: 0.8% (40B tokens)Other: 0.2% (10B tokens)4.85T总 Token
    OpenAI
    2.33T48%
    Google
    1.55T32%
    Anthropic
    920B19%
    DeepSeek
    40B0.8%
    Other
    10B0.2%
    OpenAI: 48% (2.33T tokens)Google: 32% (1.55T tokens)Anthropic: 19% (920B tokens)DeepSeek: 0.8% (40B tokens)Other: 0.2% (10B tokens)
    排行榜说明

    排行榜数据每分钟更新一次,基于最近 7 天的滚动请求窗口。Token 数量为输入与输出的合计总量。

    延迟表示完整请求的响应时间,TTFT 则表示首个 Token 的响应时间。默认种子值会与实时路由指标混合计算,以引导新节点的数据展示。

    更新于 2026年7月10日 15:37

    查看目录