← Pricing
PricingModelos

Texto e raciocínio

Veja os custos em créditos e a unidade de cobrança aplicada pela API.

How billing works

Veja os custos em créditos e a unidade de cobrança aplicada pela API.

  • Os valores exibidos são as tarifas publicadas da API. Uma operação cobrada que falha é reembolsada.
  • Tarifa publicada da API
  • unidade de cobrança

Rate card

ServicePriceHow it is applied
Gemini 3.1 Pro Preview500 in · 3,000 outTarifa publicada da API
Gemini 3.8 / 3.7 / 3.6 Flash375 in · 1,875 outTarifa publicada da API
Gemini 3.5 Flash375 in · 2,250 outTarifa publicada da API
Gemini 3.5 Flash Lite75 in · 625 outTarifa publicada da API
Gemini 2.5 Pro313 in · 2,500 outTarifa publicada da API
Gemini 2.5 Flash75 in · 625 outTarifa publicada da API
Gemini 2.5 Flash Lite25 in · 100 outTarifa publicada da API
Kimi K3750 in · 3,750 outTarifa publicada da API
Kimi K2.6 / K2.7 Code238 in · 1,000 outTarifa publicada da API
NVIDIA models25–140 in · 70–420 outTarifa publicada da API

Questions

How is a token call charged?

Input, cached input, output, and reasoning tokens are measured by the provider. A successful request is charged from actual usage; failed model calls are refunded.

Why can the final cost differ from the estimate?

The estimate reserves enough credit to start safely. The final amount uses the provider's measured usage and returns any unused reservation.