Volumen-Spitzenreiter nach verarbeiteten Tokens
openai
openai
Token-Verbrauch über das Gateway in den letzten 7 Tagen
Modelle mit der niedrigsten Time to First Token (TTFT) auf dem Gateway
Vergleichen Sie die beliebtesten Modelle auf DeepToken nach Token-Volumen
| Rang | Modell-ID | Tokens (7T)▼ | Ø Latenz | 7T Veränderung |
|---|---|---|---|---|
| 1 | O gpt-4o-mini openai | 1.15T | 550ms | ↑ +15% |
| 2 | O gpt-4o openai | 950B | 850ms | ↑ +10% |
| 3 | G gemini-2.5-flash google | 620B | 450ms | ↑ +23% |
| 4 | A claude-sonnet-4-20250514 anthropic | 620B | 850ms | NEW |
| 5 | G gemini-2.5-pro google | 410B | 1100ms | ↑ +11% |
| 6 | A claude-opus-4-20250514 anthropic | 150B | 2400ms | NEW |
| 7 | G gemini-3.1-flash-image-2k-9x16 google | 10B | 800ms | ↓ - |
| 8 | G gemini-3.1-flash-image-4k google | 10B | 800ms | ↓ - |
| 9 | A claude-opus-4-6 anthropic | 10B | 800ms | ↓ - |
| 10 | A claude-opus-4-6-thinking anthropic | 10B | 800ms | ↓ - |
Die Bestenliste wird minütlich aktualisiert und nutzt ein rollendes 7-Tage-Fenster. Tokens werden als Gesamtmenge (Eingabe + Ausgabe) gezählt.
Latenz misst die Zeit bis zur Fertigstellung, TTFT die Zeit bis zum ersten Token.
Aktualisiert 10.07.2026, 15:37
Katalog ansehen