Una API key. Los mejores modelos. Sin reescribir código.
TokenAPI es un gateway compatible con OpenAI. Llama a IDs de modelo estables con el SDK que ya usas; enrutamos cada solicitud a un backend potente, cambiamos de ruta automáticamente ante fallos y facturamos por token.
Tu código habla con un solo endpoint. Nosotros nos encargamos del resto.
Un ID de modelo es un producto estable, no un modelo fijo de un proveedor. Detrás hay una ruta principal y rutas de respaldo ordenadas. Las mejoras o cambios de ruta ocurren de nuestro lado; tus solicitudes siguen exactamente igual.
- 1
Tu aplicación
model: "tokenapi-pro"a/v1/chat/completions - 2
Gateway de TokenAPI
Autentica la key, aplica los límites y reserva el coste máximo.
- 3
Enrutamiento
Primero el backend principal; si falla, la siguiente ruta toma el relevo antes de enviar ningún token.
- 4
Respuesta
Se devuelve en streaming en el formato que llamaste y se liquida según el uso real de tokens.
Pensado para equipos que llevan la IA a producción.
Funciona con los SDK que ya usas
Apunta el SDK oficial de OpenAI o Anthropic a nuestra base URL. Sin nuevas librerías ni reescrituras.
Nombres de modelo que no rompen tu código
Llamas a un ID estable como tokenapi-pro. Lo mantenemos servido por un backend potente, así que tu integración nunca tiene que cambiar.
Failover automático
Si un backend va lento, tiene límite de tasa o está caído, la solicitud se reintenta en la siguiente ruta antes de que recibas un solo token.
Server-sent events en todas partes
Streaming token a token en los tres formatos de API, incluidas las llamadas a herramientas y el informe de uso.
Contabilidad exacta por solicitud
Cada solicitud se mide en microdólares. Se reserva su coste máximo por adelantado y se liquida según el uso real, así el saldo nunca queda en negativo.
Límites por API key
Límites de tasa, topes de gasto, fechas de caducidad y modelos permitidos por key para cada proyecto y cada miembro del equipo.
Paga por uso. Sin suscripción.
Precio por token
Cada modelo tiene su propio precio de entrada y salida por millón de tokens. Recarga saldo y úsalo en cualquier modelo.
- Precios publicados por modelo
- Se cobra por tokens reales
- Las reservas no usadas se liberan al instante
A medida
Límites de tasa más altos, facturación y precios por volumen para cargas de producción.
- Límites de tasa a medida
- Varias keys con topes de gasto
- Soporte prioritario
Preguntas frecuentes.
¿Qué modelos puedo usar?
La lista actualizada, con capacidades, longitud de contexto y precios, está en la página de Modelos. Cada modelo de TokenAPI lo sirve un proveedor líder; podemos cambiar el backend detrás de un ID de modelo para mantener la calidad y la disponibilidad. Pregúntale a cualquier modelo sobre qué modelo funciona y te lo dirá.
¿Tengo que cambiar mi código?
Solo la base URL y la API key. Las solicitudes y respuestas siguen los formatos Chat Completions y Responses de OpenAI y el formato Messages de Anthropic.
¿Qué pasa si un proveedor sufre una caída?
Los modelos pueden tener varias rutas de backend. Si la principal falla antes de empezar a responder, se prueba automáticamente la siguiente y recibes una respuesta normal.
¿Cómo se factura?
Saldo prepago y precios por token para cada modelo. Antes de ejecutar una solicitud reservamos su coste máximo; después cobramos los tokens reales y liberamos el resto al momento.
¿Guardáis mis prompts?
No. Registramos los metadatos necesarios para facturación y soporte (modelo, tokens, coste, latencia, estado), no el contenido de prompts ni respuestas. Las solicitudes las procesa el proveedor que sirve el modelo.
¿Cómo obtengo una API key?
Durante el acceso anticipado damos de alta a los clientes manualmente. Escribe a hello@tokenapi.biz y prepararemos tu cuenta, tu saldo y tus keys.
Consigue tu API key.
El acceso anticipado está abierto. Cuéntanos qué estás construyendo y prepararemos tu cuenta, tu saldo y tus keys.