Noções de cobrança

Cobrança por uso de tokens; o saldo custeia todas as chaves e cada chave tem seu próprio limite de gastos.

A plataforma cobra por uso de tokens: cada chamada desconta do saldo da conta o seu consumo de tokens ao preço unitário do modelo. Esta página explica a lógica de cobrança e como auditá-la.

Como funciona a cobrança

  • A unidade são tokens: o custo de uma chamada é o total de tokens de entrada + saída, informado exatamente no campo usage da resposta (veja Conclusões de chat);
  • Os preços unitários são por modelo: os modelos têm preços diferentes — o tipo de cobrança e o preço no card da vitrine são a referência;
  • Descontado do saldo: todos os modelos consomem o mesmo saldo da conta, descontado em tempo real após cada chamada.

Saldo versus limite de gastos da chave

São independentes e regem coisas diferentes:

DimensãoAbrangênciaOnde definir
Saldo da contaA fonte de recursos de todos os modelos e de todas as chavesAdicione créditos na página "Créditos" (veja Recarga e resgate de gift card)
Limite de gastos da chaveTeto acumulado de uma única chaveDefinido ao criar/editar uma chave na página "Chaves de API"
  • Saldo esgotado: todas as chamadas falham com erro de saldo insuficiente até você adicionar créditos;
  • Limite da chave atingido: essa chave é recusada, mas as outras chaves e o saldo não são afetados. Adicionar créditos não eleva o limite de uma chave.

Auditando o consumo

  1. Visão geral da conta: saldo e tendência de uso (em tokens, ao longo do tempo);
  2. Páginas Uso / logs: modelo, quantidade de tokens e custo por chamada, agregáveis em um intervalo de tempo;
  3. Conciliação: compare a contagem de requisições da sua aplicação com os registros por requisição da página de logs para localizar divergências por status e horário.

Se os preços mudarem, os cards da vitrine e os comunicados da plataforma são a referência.