O gasto aparece antes da fatura
Cota e saldo são verificados antes de enviar a solicitação. Você vê o gasto por modelo, não um total no fim do mês.
GPT, Claude, Gemini, Seedream e Veo por uma API compatível com [OI]. Um saldo, um registro de solicitações e pagamento pelo uso, sem assinatura por serviço.
Compare os modelos disponíveis e o tamanho do contexto antes de rotear a carga.
Os créditos são a unidade interna de gasto. O custo de uma solicitação depende do modelo, do tipo de token e do cache; ele aparece no registro antes do pagamento.
Select your use case
No subscriptions, no expiration
Um pacote recarrega seu saldo de créditos de IA.
Transparent consumption
O custo em créditos de IA depende do modelo, do tipo de tokens e do cache.
Uma chave, um saldo, um registro. Você paga pelos tokens que realmente usa, não uma assinatura fixa por serviço.
GPT, Claude, Gemini, Seedream, Veo e mais por uma API compatível com [OI]. Trocar de modelo é mudar o campo model, não o seu código.
Sem taxa fixa por serviço. O saldo é cobrado pelo uso real: tokens de entrada, saída e cache são contados separadamente.
Recarregue com pacotes e veja o gasto por modelo. Defina limites em uma chave para que um cliente não esgote o orçamento da equipe.
A resposta chega conforme é gerada, não ao final. Se o cliente desconectar, a solicitação é encerrada e você paga apenas os tokens recebidos.
Cada solicitação guarda modelo, status, latência, tokens e custo. Uma cobrança contestada é resolvida pelo registro, não por capturas.
Emita uma chave por ferramenta e revogue com uma ação. Dá para ver qual chave foi usada por último e quando.
A solicitação entra uma vez e fica sob controle: roteamento, cota e registro são aplicados em um único ponto.
Cota e saldo são verificados antes de enviar a solicitação. Você vê o gasto por modelo, não um total no fim do mês.
O campo model da solicitação decide qual provedor responde. Trocar de modelo é mudar uma string, não sua integração.
O registro guarda proprietário, chave, modelo, status, latência, tokens e custo. Investigar um incidente não exige coletar dados manualmente.
Solicitação existente de um cliente
Camada de controle SaaS hospedada
Zero-buffer SSE & live trace log
Somente após as verificações da conta
Cadastre-se, emita uma chave e envie uma solicitação. Todo o resto é medido automaticamente.
Crie uma conta, recarregue o saldo e emita uma chave gw_. A partir daí ela funciona como a chave de qualquer cliente compatível com [OI].
No seu SDK, CLI ou configuração do agente, troque a URL base e a chave. O corpo da solicitação e o formato da resposta continuam iguais, então a integração não é reescrita.
Cada solicitação entra no registro com modelo, status, latência, tokens e custo. Sem coletar estatísticas manualmente.
Dá para ver quem usou um modelo, qual modelo respondeu e quanto custou. Sem coletar estatísticas manualmente.
Como o registro se parece
Um exemplo anonimizado de registro: proprietário, chave, modelo, cota e trace em uma linha.
Respostas breves sobre preço, dados e modelos.
Crie uma conta, recarregue o saldo e emita uma chave. A primeira solicitação pode sair de qualquer cliente compatível com [OI].