Faturação e limites
Quando os créditos saem e quando voltam.
Como se cobra
As chamadas por API e a utilização no navegador partilham a mesma contabilidade: a mesma conta, a mesma tabela de preços e um único histórico em «Carteira», com a origem identificável.
- Imagens: preço unitário × quantidade. O preço vem do nível escolhido ou, se não houver níveis, do modelo.
- Vídeo: créditos por segundo × duração. Quanto maior a resolução, mais caro o segundo — ver specs em /v1/models.
- Conversação de texto: por token, com preços distintos de entrada e saída, arredondado para cima e com um mínimo de 1 crédito por chamada.
- Imagem e vídeo são debitados na submissão e não na conclusão, pelo que envios simultâneos não conseguem ultrapassar o saldo. O texto só pode ser contado depois de existirem os tokens, por isso é debitado a posteriori (antes da chamada há uma verificação mínima de saldo).
O que é devolvido
- Recusado pelo motor de renderização na submissão: devolução imediata.
- Falhado durante a renderização: devolvido quando a tarefa passa a failed.
- Abandonado sem ninguém a consultar: o serviço em segundo plano encerra-o e devolve.
- Resultado que não agrada: não há devolução. Tal como no estúdio, a renderização teve um custo real.
Limite de chamadas
Cada chave permite 120 chamadas por minuto; acima disso devolve 429 rate_limit_exceeded. O limiar existe para travar scripts descontrolados, não tráfego real: basta sondar nos intervalos recomendados em vez de um ciclo apertado.
Aplicam-se ainda limites de concorrência e quota diária ao nível da conta, definidos pelo teu plano, que surgem como 429 concurrency_limit_reached.
Perante um 429, recua antes de repetir (duplicando o tempo de espera, por exemplo). Repetir de imediato só bate na mesma parede.

