Uma API key. Os melhores modelos. Sem reescrever código.
TokenAPI é um gateway compatível com OpenAI. Chame IDs de modelo estáveis com o SDK que você já usa; roteamos cada requisição para um backend forte, trocamos de rota automaticamente em caso de falha e cobramos por token.
Seu código fala com um único endpoint. Nós cuidamos do resto.
Um ID de modelo é um produto estável, não um modelo fixo de um fornecedor. Por trás dele há uma rota principal e rotas de contingência ordenadas. Atualizações e mudanças de rota acontecem do nosso lado; suas requisições continuam exatamente iguais.
- 1
Seu app
model: "tokenapi-pro"para/v1/chat/completions - 2
Gateway TokenAPI
Autentica a key, aplica os limites e reserva o custo máximo.
- 3
Roteamento
Primeiro o backend principal; se falhar, a próxima rota assume antes de qualquer token ser enviado.
- 4
Resposta
Retornada em streaming no formato chamado e liquidada pelo uso real de tokens.
Feito para equipes que levam IA para produção.
Funciona com os SDKs que você já usa
Aponte o SDK oficial da OpenAI ou da Anthropic para a nossa base URL. Sem nova biblioteca cliente, sem reescrever código.
Nomes de modelo que nunca quebram seu código
Você chama um ID estável como tokenapi-pro. Mantemos ele servido por um backend forte, então sua integração nunca precisa mudar.
Failover automático
Se um backend estiver lento, com limite de taxa ou fora do ar, a requisição é refeita na próxima rota antes de você receber um único token.
Server-sent events em toda parte
Streaming token a token nos três formatos de API, incluindo chamadas de ferramentas e relatório de uso.
Contabilidade exata por requisição
Cada requisição é medida em microdólares. O custo máximo é reservado antecipadamente e liquidado pelo uso real, então o saldo nunca fica negativo.
Limites por API key
Limites de taxa, tetos de gasto, datas de expiração e modelos permitidos por key mantêm cada projeto e cada pessoa do time sob controle.
Pague pelo uso. Sem assinatura.
Preço por token
Cada modelo tem seu próprio preço de entrada e saída por milhão de tokens. Recarregue o saldo e use em qualquer modelo.
- Preços publicados por modelo
- Cobrança pelos tokens reais
- Reservas não usadas liberadas na hora
Sob medida
Limites de taxa maiores, faturamento e preços por volume para cargas de produção.
- Limites de taxa personalizados
- Várias keys com teto de gasto
- Suporte prioritário
Perguntas frequentes.
Quais modelos posso usar?
A lista atualizada, com recursos, tamanho de contexto e preços, está na página de Modelos. Cada modelo TokenAPI é servido por um provedor líder; podemos trocar o backend por trás de um ID para manter a qualidade e a disponibilidade. Pergunte a qualquer modelo em qual modelo ele roda e ele vai responder.
Preciso mudar meu código?
Só a base URL e a API key. Requisições e respostas seguem os formatos Chat Completions e Responses da OpenAI e o formato Messages da Anthropic.
E se um provedor ficar fora do ar?
Os modelos podem ter várias rotas de backend. Se a principal falhar antes de começar a responder, a próxima é tentada automaticamente e você recebe uma resposta normal.
Como sou cobrado?
Saldo pré-pago e preços por token para cada modelo. Antes de uma requisição rodar, reservamos o custo máximo possível; depois cobramos os tokens reais e liberamos o restante na hora.
Vocês guardam meus prompts?
Não. Registramos os metadados necessários para cobrança e suporte (modelo, tokens, custo, latência, status), não o conteúdo de prompts nem de respostas. As requisições são processadas pelo provedor que serve o modelo.
Como consigo uma API key?
Durante o acesso antecipado, cadastramos os clientes manualmente. Escreva para hello@tokenapi.biz e vamos preparar sua conta, seu saldo e suas keys.
Pegue sua API key.
O acesso antecipado está aberto. Conte o que você está construindo e vamos preparar sua conta, seu saldo e suas keys.