How billing works
Consultez les coûts en crédits et l’unité de facturation appliqués par l’API.
- Les montants affichés sont les tarifs API publiés. Une opération facturée qui échoue est remboursée.
- Tarif API publié
- unité de facturation
Rate card
ServicePriceHow it is applied
Gemini 3.1 Pro Preview500 in · 3,000 outTarif API publié
Gemini 3.8 / 3.7 / 3.6 Flash375 in · 1,875 outTarif API publié
Gemini 3.5 Flash375 in · 2,250 outTarif API publié
Gemini 3.5 Flash Lite75 in · 625 outTarif API publié
Gemini 2.5 Pro313 in · 2,500 outTarif API publié
Gemini 2.5 Flash75 in · 625 outTarif API publié
Gemini 2.5 Flash Lite25 in · 100 outTarif API publié
Kimi K3750 in · 3,750 outTarif API publié
Kimi K2.6 / K2.7 Code238 in · 1,000 outTarif API publié
NVIDIA models25–140 in · 70–420 outTarif API publié
Questions
How is a token call charged?
Input, cached input, output, and reasoning tokens are measured by the provider. A successful request is charged from actual usage; failed model calls are refunded.
Why can the final cost differ from the estimate?
The estimate reserves enough credit to start safely. The final amount uses the provider's measured usage and returns any unused reservation.