Passer au contenu
DeepTokenSuite créative IA
AccueilTableau de bordModèlesInvitesTableau de classementDocumentationTarifsEntreprisesBlog

    Modèles les plus routés

    Leaders par volume total de tokens traités

    2
    2ème place
    O

    gpt-4o

    openai

    Tokens (7j)950B
    Requêtes (7j)420M
    Latence moy.850ms
    TTFT moy.120ms
    OpenAI
    ↑ +10%
    1
    1ère place
    O

    gpt-4o-mini

    openai

    Tokens (7j)1.15T
    Requêtes (7j)890M
    Latence moy.550ms
    TTFT moy.90ms
    OpenAI
    ↑ +15%
    3
    3ème place
    G

    gemini-2.5-flash

    google

    Tokens (7j)620B
    Requêtes (7j)290M
    Latence moy.450ms
    TTFT moy.80ms
    Google
    ↑ +23%

    Principaux modèles par volume de tokens

    Consommation de tokens sur la passerelle au cours des 7 derniers jours

    1
    Ogpt-4o-mini
    1.15T
    2
    Ogpt-4o
    950B
    3
    Ggemini-2.5-flash
    620B
    4
    Aclaude-sonnet-4-20250514
    620B
    5
    Ggemini-2.5-pro
    410B
    6
    Aclaude-opus-4-20250514
    150B
    7
    Ggemini-3.1-flash-image-2k-9x16
    10B
    8
    Ggemini-3.1-flash-image-4k
    10B
    9
    Aclaude-opus-4-6
    10B
    10
    Aclaude-opus-4-6-thinking
    10B
    11
    Aclaude-opus-4-7
    10B
    12
    Aclaude-opus-4-8
    10B
    13
    Aclaude-haiku-4-5-20251001
    10B
    14
    Aclaude-sonnet-4-5-20250929
    10B
    15
    Aclaude-sonnet-4-5-20250929-thinking
    10B

    Modèles les plus rapides

    Modèles avec le temps jusqu'au premier token (TTFT) le plus bas sur la passerelle

    1G
    gemini-2.5-flashGoogle
    google
    Latence moy.450ms
    Débit4751 tok/s
    TTFT80ms
    2O
    gpt-4o-miniOpenAI
    openai
    Latence moy.550ms
    Débit2349 tok/s
    TTFT90ms
    3O
    gpt-4oOpenAI
    openai
    Latence moy.850ms
    Débit2661 tok/s
    TTFT120ms
    4G
    gemini-3.1-flash-image-2k-9x16Google
    google
    Latence moy.800ms
    Débit2500 tok/s
    TTFT120ms
    5G
    gemini-3.1-flash-image-4kGoogle
    google
    Latence moy.800ms
    Débit2500 tok/s
    TTFT120ms
    6A
    claude-opus-4-6Anthropic
    anthropic
    Latence moy.800ms
    Débit2500 tok/s
    TTFT120ms
    7A
    claude-opus-4-6-thinkingAnthropic
    anthropic
    Latence moy.800ms
    Débit2500 tok/s
    TTFT120ms
    8A
    claude-opus-4-7Anthropic
    anthropic
    Latence moy.800ms
    Débit2500 tok/s
    TTFT120ms
    9A
    claude-opus-4-8Anthropic
    anthropic
    Latence moy.800ms
    Débit2500 tok/s
    TTFT120ms
    10A
    claude-haiku-4-5-20251001Anthropic
    anthropic
    Latence moy.800ms
    Débit2500 tok/s
    TTFT120ms

    Classement LLM

    Comparez les modèles les plus populaires sur DeepToken par volume de tokens

    10 sur 101 modèles

    RangID du modèleFamilleTokens (7j)▼Requêtes (7j)Latence moy.TTFT moy.Variation 7j
    1
    O
    gpt-4o-mini
    openai
    OpenAI1.15T890M550ms90ms↑ +15%
    2
    O
    gpt-4o
    openai
    OpenAI950B420M850ms120ms↑ +10%
    3
    G
    gemini-2.5-flash
    google
    Google620B290M450ms80ms↑ +23%
    4
    A
    claude-sonnet-4-20250514
    anthropic
    Anthropic620B240M850ms140msNEW
    5
    G
    gemini-2.5-pro
    google
    Google410B140M1100ms160ms↑ +11%
    6
    A
    claude-opus-4-20250514
    anthropic
    Anthropic150B60M2400ms350msNEW
    7
    G
    gemini-3.1-flash-image-2k-9x16
    google
    Google10B5M800ms120ms↓ -
    8
    G
    gemini-3.1-flash-image-4k
    google
    Google10B5M800ms120ms↓ -
    9
    A
    claude-opus-4-6
    anthropic
    Anthropic10B5M800ms120ms↓ -
    10
    A
    claude-opus-4-6-thinking
    anthropic
    Anthropic10B5M800ms120ms↓ -

    Parts de marché (Tokens)

    OpenAI: 48% (2.33T tokens)Google: 32% (1.55T tokens)Anthropic: 19% (920B tokens)DeepSeek: 0.8% (40B tokens)Other: 0.2% (10B tokens)4.85Ttokens totaux
    OpenAI
    2.33T48%
    Google
    1.55T32%
    Anthropic
    920B19%
    DeepSeek
    40B0.8%
    Other
    10B0.2%
    OpenAI: 48% (2.33T tokens)Google: 32% (1.55T tokens)Anthropic: 19% (920B tokens)DeepSeek: 0.8% (40B tokens)Other: 0.2% (10B tokens)
    Fonctionnement du classement

    Le classement est mis à jour chaque minute sur une fenêtre glissante de 7 jours. Les tokens comptent l'entrée + la sortie.

    La latence mesure le temps total, le TTFT le temps jusqu'au premier token.

    Mis à jour 10 juil. 2026, 15:37

    Voir le catalogue