Noções de cobrança
Cobrança por uso de tokens; o saldo custeia todas as chaves e cada chave tem seu próprio limite de gastos.
A plataforma cobra por uso de tokens: cada chamada desconta do saldo da conta o seu consumo de tokens ao preço unitário do modelo. Esta página explica a lógica de cobrança e como auditá-la.
Como funciona a cobrança
- A unidade são tokens: o custo de uma chamada é o total de tokens de entrada + saída, informado exatamente no campo
usageda resposta (veja Conclusões de chat); - Os preços unitários são por modelo: os modelos têm preços diferentes — o tipo de cobrança e o preço no card da vitrine são a referência;
- Descontado do saldo: todos os modelos consomem o mesmo saldo da conta, descontado em tempo real após cada chamada.
Saldo versus limite de gastos da chave
São independentes e regem coisas diferentes:
| Dimensão | Abrangência | Onde definir |
|---|---|---|
| Saldo da conta | A fonte de recursos de todos os modelos e de todas as chaves | Adicione créditos na página "Créditos" (veja Recarga e resgate de gift card) |
| Limite de gastos da chave | Teto acumulado de uma única chave | Definido ao criar/editar uma chave na página "Chaves de API" |
- Saldo esgotado: todas as chamadas falham com erro de saldo insuficiente até você adicionar créditos;
- Limite da chave atingido: essa chave é recusada, mas as outras chaves e o saldo não são afetados. Adicionar créditos não eleva o limite de uma chave.
Auditando o consumo
- Visão geral da conta: saldo e tendência de uso (em tokens, ao longo do tempo);
- Páginas Uso / logs: modelo, quantidade de tokens e custo por chamada, agregáveis em um intervalo de tempo;
- Conciliação: compare a contagem de requisições da sua aplicação com os registros por requisição da página de logs para localizar divergências por status e horário.
Se os preços mudarem, os cards da vitrine e os comunicados da plataforma são a referência.

