Zum Inhalt springen
DeepTokenKI-Kreativsuite
StartseiteDashboardModellePromptsBestenlisteDokuPreiseUnternehmenBlog

    Top-Modelle

    Volumen-Spitzenreiter nach verarbeiteten Tokens

    2
    Platz 2
    O

    gpt-4o

    openai

    Tokens (7T)950B
    Anfragen (7T)420M
    Ø Latenz850ms
    Ø TTFT120ms
    OpenAI
    ↑ +10%
    1
    Platz 1
    O

    gpt-4o-mini

    openai

    Tokens (7T)1.15T
    Anfragen (7T)890M
    Ø Latenz550ms
    Ø TTFT90ms
    OpenAI
    ↑ +15%
    3
    Platz 3
    G

    gemini-2.5-flash

    google

    Tokens (7T)620B
    Anfragen (7T)290M
    Ø Latenz450ms
    Ø TTFT80ms
    Google
    ↑ +23%

    Top-Modelle nach Token-Volumen

    Token-Verbrauch über das Gateway in den letzten 7 Tagen

    1
    Ogpt-4o-mini
    1.15T
    2
    Ogpt-4o
    950B
    3
    Ggemini-2.5-flash
    620B
    4
    Aclaude-sonnet-4-20250514
    620B
    5
    Ggemini-2.5-pro
    410B
    6
    Aclaude-opus-4-20250514
    150B
    7
    Ggemini-3.1-flash-image-2k-9x16
    10B
    8
    Ggemini-3.1-flash-image-4k
    10B
    9
    Aclaude-opus-4-6
    10B
    10
    Aclaude-opus-4-6-thinking
    10B
    11
    Aclaude-opus-4-7
    10B
    12
    Aclaude-opus-4-8
    10B
    13
    Aclaude-haiku-4-5-20251001
    10B
    14
    Aclaude-sonnet-4-5-20250929
    10B
    15
    Aclaude-sonnet-4-5-20250929-thinking
    10B

    Schnellste Modelle

    Modelle mit der niedrigsten Time to First Token (TTFT) auf dem Gateway

    1G
    gemini-2.5-flashGoogle
    google
    Ø Latenz450ms
    Durchsatz4751 tok/s
    TTFT80ms
    2O
    gpt-4o-miniOpenAI
    openai
    Ø Latenz550ms
    Durchsatz2349 tok/s
    TTFT90ms
    3O
    gpt-4oOpenAI
    openai
    Ø Latenz850ms
    Durchsatz2661 tok/s
    TTFT120ms
    4G
    gemini-3.1-flash-image-2k-9x16Google
    google
    Ø Latenz800ms
    Durchsatz2500 tok/s
    TTFT120ms
    5G
    gemini-3.1-flash-image-4kGoogle
    google
    Ø Latenz800ms
    Durchsatz2500 tok/s
    TTFT120ms
    6A
    claude-opus-4-6Anthropic
    anthropic
    Ø Latenz800ms
    Durchsatz2500 tok/s
    TTFT120ms
    7A
    claude-opus-4-6-thinkingAnthropic
    anthropic
    Ø Latenz800ms
    Durchsatz2500 tok/s
    TTFT120ms
    8A
    claude-opus-4-7Anthropic
    anthropic
    Ø Latenz800ms
    Durchsatz2500 tok/s
    TTFT120ms
    9A
    claude-opus-4-8Anthropic
    anthropic
    Ø Latenz800ms
    Durchsatz2500 tok/s
    TTFT120ms
    10A
    claude-haiku-4-5-20251001Anthropic
    anthropic
    Ø Latenz800ms
    Durchsatz2500 tok/s
    TTFT120ms

    LLM-Rangliste

    Vergleichen Sie die beliebtesten Modelle auf DeepToken nach Token-Volumen

    10 von 101 Modellen

    RangModell-IDFamilieTokens (7T)▼Anfragen (7T)Ø LatenzØ TTFT7T Veränderung
    1
    O
    gpt-4o-mini
    openai
    OpenAI1.15T890M550ms90ms↑ +15%
    2
    O
    gpt-4o
    openai
    OpenAI950B420M850ms120ms↑ +10%
    3
    G
    gemini-2.5-flash
    google
    Google620B290M450ms80ms↑ +23%
    4
    A
    claude-sonnet-4-20250514
    anthropic
    Anthropic620B240M850ms140msNEW
    5
    G
    gemini-2.5-pro
    google
    Google410B140M1100ms160ms↑ +11%
    6
    A
    claude-opus-4-20250514
    anthropic
    Anthropic150B60M2400ms350msNEW
    7
    G
    gemini-3.1-flash-image-2k-9x16
    google
    Google10B5M800ms120ms↓ -
    8
    G
    gemini-3.1-flash-image-4k
    google
    Google10B5M800ms120ms↓ -
    9
    A
    claude-opus-4-6
    anthropic
    Anthropic10B5M800ms120ms↓ -
    10
    A
    claude-opus-4-6-thinking
    anthropic
    Anthropic10B5M800ms120ms↓ -

    Marktanteil (Tokens)

    OpenAI: 48% (2.33T tokens)Google: 32% (1.55T tokens)Anthropic: 19% (920B tokens)DeepSeek: 0.8% (40B tokens)Other: 0.2% (10B tokens)4.85TGesamt-Tokens
    OpenAI
    2.33T48%
    Google
    1.55T32%
    Anthropic
    920B19%
    DeepSeek
    40B0.8%
    Other
    10B0.2%
    OpenAI: 48% (2.33T tokens)Google: 32% (1.55T tokens)Anthropic: 19% (920B tokens)DeepSeek: 0.8% (40B tokens)Other: 0.2% (10B tokens)
    So funktioniert die Bestenliste

    Die Bestenliste wird minütlich aktualisiert und nutzt ein rollendes 7-Tage-Fenster. Tokens werden als Gesamtmenge (Eingabe + Ausgabe) gezählt.

    Latenz misst die Zeit bis zur Fertigstellung, TTFT die Zeit bis zum ersten Token.

    Aktualisiert 10.07.2026, 15:37

    Katalog ansehen