Pagamento por token · Sem assinaturas

Todos os modelos com uma única chave

GPT, Claude, Gemini, Seedream e Veo por uma API compatível com [OI]. Um saldo, um registro de solicitações e pagamento pelo uso, sem assinatura por serviço.

Modelos disponíveis para o tráfego da equipe.

Compare os modelos disponíveis e o tamanho do contexto antes de rotear a carga.

Pacotes de créditos de IA

Os créditos são a unidade interna de gasto. O custo de uma solicitação depende do modelo, do tipo de token e do cache; ele aparece no registro antes do pagamento.

Select your use case

No subscriptions, no expiration

Um pacote recarrega seu saldo de créditos de IA.

Transparent consumption

O custo em créditos de IA depende do modelo, do tipo de tokens e do cache.

Uma API em vez de dez assinaturas

Uma chave, um saldo, um registro. Você paga pelos tokens que realmente usa, não uma assinatura fixa por serviço.

Uma chave para todos os modelos

GPT, Claude, Gemini, Seedream, Veo e mais por uma API compatível com [OI]. Trocar de modelo é mudar o campo model, não o seu código.

Pague por tokens, não por assinaturas

Sem taxa fixa por serviço. O saldo é cobrado pelo uso real: tokens de entrada, saída e cache são contados separadamente.

Saldo e cotas sob controle

Recarregue com pacotes e veja o gasto por modelo. Defina limites em uma chave para que um cliente não esgote o orçamento da equipe.

Respostas em streaming e cancelamento

A resposta chega conforme é gerada, não ao final. Se o cliente desconectar, a solicitação é encerrada e você paga apenas os tokens recebidos.

Um registro para cada solicitação

Cada solicitação guarda modelo, status, latência, tokens e custo. Uma cobrança contestada é resolvida pelo registro, não por capturas.

Chaves e acesso em um só lugar

Emita uma chave por ferramenta e revogue com uma ação. Dá para ver qual chave foi usada por último e quando.

O que acontece com uma solicitação

A solicitação entra uma vez e fica sob controle: roteamento, cota e registro são aplicados em um único ponto.

O gasto aparece antes da fatura

Cota e saldo são verificados antes de enviar a solicitação. Você vê o gasto por modelo, não um total no fim do mês.

Troque o modelo sem reescrever código

O campo model da solicitação decide qual provedor responde. Trocar de modelo é mudar uma string, não sua integração.

Cada solicitação deixa um rastro

O registro guarda proprietário, chave, modelo, status, latência, tokens e custo. Investigar um incidente não exige coletar dados manualmente.

POST/v1/chat/completions
+1.2ms overhead
Seu aplicativogw_live_key

Solicitação existente de um cliente

Controle de orçamento< 0.8ms

Camada de controle SaaS hospedada

Registro em tempo realSSE Stream

Zero-buffer SSE & live trace log

Provedor do modelo200 OK

Somente após as verificações da conta

Do cadastro à primeira solicitação

Cadastre-se, emita uma chave e envie uma solicitação. Todo o resto é medido automaticamente.

Conta e chave em alguns minutos

Crie uma conta, recarregue o saldo e emita uma chave gw_. A partir daí ela funciona como a chave de qualquer cliente compatível com [OI].

Duas linhas mudam

No seu SDK, CLI ou configuração do agente, troque a URL base e a chave. O corpo da solicitação e o formato da resposta continuam iguais, então a integração não é reescrita.

O gasto aparece imediatamente

Cada solicitação entra no registro com modelo, status, latência, tokens e custo. Sem coletar estatísticas manualmente.

Controle do gasto em IA da sua equipe

Dá para ver quem usou um modelo, qual modelo respondeu e quanto custou. Sem coletar estatísticas manualmente.

  • Orçamentos de equipe
  • Chaves de API com escopo
  • Histórico de solicitações
  • Visibilidade de uso

Como o registro se parece

Um exemplo anonimizado de registro: proprietário, chave, modelo, cota e trace em uma linha.

Live Telemetry
usuáriousr_7f2...cota ok
chavegw_93...limite ok
modelogpt-5.5OpenAI
rastreamentotrc_41...registrado

Perguntas frequentes

Respostas breves sobre preço, dados e modelos.

Comece com uma chave.

Crie uma conta, recarregue o saldo e emita uma chave. A primeira solicitação pode sair de qualquer cliente compatível com [OI].