TokenAPI统一大模型 API
统一大模型 API

一个 Key 接入主流大模型 代码零改动

TokenAPI 是兼容 OpenAI 协议的大模型网关。用你现有的 SDK 调用稳定的模型 ID,我们把每个请求路由到优质的后端模型,故障时自动切换,按实际 token 计费。

1 个 Key调用平台全部模型
3 种 APIChat Completions · Responses · Messages
自动首个 token 前故障即切换
按 token用多少付多少
工作原理

只对接一个地址, 其余交给我们。

模型 ID 是一个稳定的产品,而不是写死的某家厂商模型。每个模型背后都有主路由和按优先级排列的备用路由。模型升级或切换后端都在我们这边完成,你的请求无需任何改动。

  1. 1

    你的应用

    向 /v1/chat/completions 发送 model: "tokenapi-pro"

  2. 2

    TokenAPI 网关

    校验 Key、执行限额,并预先冻结本次请求的最高费用。

  3. 3

    智能路由

    优先调用主路由;一旦失败,在返回任何 token 之前自动切换到下一条路由。

  4. 4

    返回结果

    按你调用的格式流式返回,结束后按实际 token 用量结算。

为什么选择 TokenAPI

为生产级 AI 应用而建。

即插即用

直接用现有 SDK

把 OpenAI 或 Anthropic 官方 SDK 的 base URL 指向我们即可,无需新的客户端库,也无需重写代码。

稳定 ID

模型名称永不失效

你调用的是 tokenapi-pro 这样的稳定模型 ID,我们负责让它始终由优质后端提供服务,你的集成永远不用改。

高可用

自动故障切换

后端响应慢、被限流或宕机时,请求会在你收到第一个 token 之前自动转到下一条路由。

流式输出

全面支持 SSE

三种 API 格式都支持逐 token 流式返回,包括工具调用和用量统计。

计费

每次请求精确记账

按微美元精确计量。请求前先冻结最高可能费用,结束后按实际用量结算,账户余额绝不会被透支。

管控

按 Key 设置限额

每个 Key 可单独设置速率限制、消费上限、有效期和可用模型,项目和成员各自可控。

价格

按量付费,无需订阅。

所有模型

按 token 计费

预充值

每个模型都有独立的每百万 token 输入、输出单价。充值一次余额,可用于任意模型。

  • 每个模型单独标价
  • 按实际 token 扣费
  • 未用完的冻结额度即时返还
查看模型价格
团队与大客户

定制方案

联系我们

面向生产环境的更高速率限制、对公开票与用量折扣。

  • 定制速率限制
  • 多个 Key 分别设消费上限
  • 优先技术支持
联系商务
常见问题

常见问题

可以使用哪些模型?

模型页面实时列出所有模型及其能力、上下文长度和价格。每个 TokenAPI 模型都由业界领先的上游模型提供方提供服务;为保证质量和可用性,我们可能调整某个模型 ID 背后的后端。直接问模型它运行在什么底层模型上,它会如实回答。

需要改代码吗?

只需改 base URL 和 API Key。请求和响应遵循 OpenAI Chat Completions、Responses 格式以及 Anthropic Messages 格式。

上游服务商故障怎么办?

每个模型可以配置多条后端路由。主路由在开始返回内容之前失败时,会自动尝试下一条路由,你收到的是一次正常的响应。

怎么计费?

预充值余额,每个模型按 token 单独定价。请求开始前冻结其最高可能费用,结束后按实际 token 扣费,剩余部分立即返还。

会保存我的提示词吗?

不会。我们只记录计费和售后所需的请求元数据(模型、token 数、费用、耗时、状态),不保存提示词和回复内容。请求由提供该模型的上游服务商处理。

如何获取 API Key?

目前处于抢先体验阶段,由我们人工开通。请发邮件至 hello@tokenapi.biz,我们会为你开通账户、充值并创建 Key。

开始使用

获取你的 API Key

抢先体验已开放。告诉我们你在做什么,我们会为你开通账户、余额和 Key。