API de collecte injoignable — dernières données valides affichées
21 sources Mis à jour Variations 0 / 24h Échecs de validation 0

Diagnose

Find out where the bill leaked.

We compare what token pricing implies against what you were actually charged, then break the gap down by cause. Nothing you type is sent to our servers.

Ces termes sont nouveaux ? Aide-mémoire de 30 secondes
Jeton
La plus petite unité qu'un modèle lit et écrit. Environ 1 à 2 jetons par mot en français. La facturation repose sur ce décompte.
Entrée / sortie
L'entrée est ce que vous envoyez, la sortie ce que le modèle rédige. La sortie coûte généralement plusieurs fois plus cher.
Jetons de raisonnement
Ce que le modèle réfléchit avant de répondre. Vous ne le voyez jamais, mais c'est facturé comme de la sortie. C'est pourquoi les factures dépassent les prévisions.
Contexte
La longueur maximale de texte envoyable en un appel.
Cache
La remise obtenue lorsque le même début de prompt est renvoyé.

Bill higher than expected?

Enter your actual usage and we point at where it leaked · calculated in your browser only

Copy the numbers straight from your invoice or usage dashboard.

Cost implied by token pricing
Gap
Enter your numbers to see the diagnosis
Would self-hosting be cheaper? — break-even
Enter an hourly GPU cost to calculate

Utilisation is almost always overestimated. If you only serve peak hours, real utilisation is often 20-40% — and the GPU bill runs while it sits idle.

Emplacement publicitaire · 728×90