一个 Key 接入主流大模型 代码零改动
TokenAPI 是兼容 OpenAI 协议的大模型网关。用你现有的 SDK 调用稳定的模型 ID,我们把每个请求路由到优质的后端模型,故障时自动切换,按实际 token 计费。
只对接一个地址, 其余交给我们。
模型 ID 是一个稳定的产品,而不是写死的某家厂商模型。每个模型背后都有主路由和按优先级排列的备用路由。模型升级或切换后端都在我们这边完成,你的请求无需任何改动。
- 1
你的应用
向
/v1/chat/completions发送model: "tokenapi-pro" - 2
TokenAPI 网关
校验 Key、执行限额,并预先冻结本次请求的最高费用。
- 3
智能路由
优先调用主路由;一旦失败,在返回任何 token 之前自动切换到下一条路由。
- 4
返回结果
按你调用的格式流式返回,结束后按实际 token 用量结算。
为生产级 AI 应用而建。
直接用现有 SDK
把 OpenAI 或 Anthropic 官方 SDK 的 base URL 指向我们即可,无需新的客户端库,也无需重写代码。
模型名称永不失效
你调用的是 tokenapi-pro 这样的稳定模型 ID,我们负责让它始终由优质后端提供服务,你的集成永远不用改。
自动故障切换
后端响应慢、被限流或宕机时,请求会在你收到第一个 token 之前自动转到下一条路由。
全面支持 SSE
三种 API 格式都支持逐 token 流式返回,包括工具调用和用量统计。
每次请求精确记账
按微美元精确计量。请求前先冻结最高可能费用,结束后按实际用量结算,账户余额绝不会被透支。
按 Key 设置限额
每个 Key 可单独设置速率限制、消费上限、有效期和可用模型,项目和成员各自可控。
按量付费,无需订阅。
常见问题
可以使用哪些模型?
模型页面实时列出所有模型及其能力、上下文长度和价格。每个 TokenAPI 模型都由业界领先的上游模型提供方提供服务;为保证质量和可用性,我们可能调整某个模型 ID 背后的后端。直接问模型它运行在什么底层模型上,它会如实回答。
需要改代码吗?
只需改 base URL 和 API Key。请求和响应遵循 OpenAI Chat Completions、Responses 格式以及 Anthropic Messages 格式。
上游服务商故障怎么办?
每个模型可以配置多条后端路由。主路由在开始返回内容之前失败时,会自动尝试下一条路由,你收到的是一次正常的响应。
怎么计费?
预充值余额,每个模型按 token 单独定价。请求开始前冻结其最高可能费用,结束后按实际 token 扣费,剩余部分立即返还。
会保存我的提示词吗?
不会。我们只记录计费和售后所需的请求元数据(模型、token 数、费用、耗时、状态),不保存提示词和回复内容。请求由提供该模型的上游服务商处理。
如何获取 API Key?
目前处于抢先体验阶段,由我们人工开通。请发邮件至 hello@tokenapi.biz,我们会为你开通账户、充值并创建 Key。
获取你的 API Key
抢先体验已开放。告诉我们你在做什么,我们会为你开通账户、余额和 Key。