TokenAPI統一大型語言模型 API
統一大型語言模型 API

一組 Key 串接主流大型模型 程式碼零修改

TokenAPI 是相容 OpenAI 協定的大型語言模型閘道。用你現有的 SDK 呼叫穩定的模型 ID,我們把每個請求路由到優質的後端模型,故障時自動切換,按實際 token 計費。

1 組 Key呼叫平台全部模型
3 種 APIChat Completions · Responses · Messages
自動首個 token 前故障即切換
按 token用多少付多少
運作方式

只串接一個位址, 其餘交給我們。

模型 ID 是一個穩定的產品,而不是寫死的某家廠商模型。每個模型背後都有主路由和依優先順序排列的備援路由。模型升級或切換後端都在我們這邊完成,你的請求不需任何修改。

  1. 1

    你的應用程式

    向 /v1/chat/completions 送出 model: "tokenapi-pro"

  2. 2

    TokenAPI 閘道

    驗證 Key、套用限額,並預先凍結本次請求的最高費用。

  3. 3

    智慧路由

    優先呼叫主路由;一旦失敗,在回傳任何 token 之前自動切換到下一條路由。

  4. 4

    回傳結果

    依你呼叫的格式串流回傳,結束後按實際 token 用量結算。

為什麼選擇 TokenAPI

為正式環境的 AI 應用而打造。

隨插即用

直接使用現有 SDK

把 OpenAI 或 Anthropic 官方 SDK 的 base URL 指向我們即可,不需要新的用戶端函式庫,也不必重寫程式碼。

穩定 ID

模型名稱永不失效

你呼叫的是 tokenapi-pro 這類穩定的模型 ID,我們負責讓它始終由優質後端提供服務,你的整合永遠不必修改。

高可用

自動故障切換

後端回應慢、遭到限流或停機時,請求會在你收到第一個 token 之前自動轉往下一條路由。

串流輸出

全面支援 SSE

三種 API 格式都支援逐 token 串流回傳,包括工具呼叫與用量統計。

計費

每次請求精確記帳

以微美元精確計量。請求前先凍結最高可能費用,結束後按實際用量結算,帳戶餘額絕不會被透支。

管控

依 Key 設定限額

每組 Key 可單獨設定速率限制、消費上限、有效期限與可用模型,專案與成員各自可控。

價格

按量付費,免訂閱。

所有模型

按 token 計費

預付儲值

每個模型都有獨立的每百萬 token 輸入、輸出單價。儲值一次餘額,可用於任何模型。

  • 每個模型個別標價
  • 按實際 token 扣款
  • 未用完的凍結額度立即退回
查看模型價格
團隊與企業

客製方案

聯絡我們

提供正式環境所需的更高速率限制、企業發票與用量折扣。

  • 客製速率限制
  • 多組 Key 分別設定消費上限
  • 優先技術支援
聯絡業務
常見問題

常見問題

可以使用哪些模型?

模型頁面即時列出所有模型及其能力、上下文長度與價格。每個 TokenAPI 模型都由業界領先的上游模型供應商提供服務;為確保品質與可用性,我們可能調整某個模型 ID 背後的後端。直接問模型它運行在哪個底層模型上,它會如實回答。

需要修改程式碼嗎?

只需更改 base URL 和 API Key。請求與回應遵循 OpenAI Chat Completions、Responses 格式以及 Anthropic Messages 格式。

上游供應商故障怎麼辦?

每個模型可以設定多條後端路由。主路由在開始回傳內容之前失敗時,會自動嘗試下一條路由,你收到的是一次正常的回應。

如何計費?

預付儲值,每個模型按 token 個別定價。請求開始前凍結其最高可能費用,結束後按實際 token 扣款,剩餘部分立即退回。

會保存我的提示詞嗎?

不會。我們只記錄計費與客服所需的請求中繼資料(模型、token 數、費用、耗時、狀態),不保存提示詞與回覆內容。請求由提供該模型的上游供應商處理。

如何取得 API Key?

目前為搶先體驗階段,由我們人工開通。請寄信至 hello@tokenapi.biz,我們會為你開通帳戶、儲值並建立 Key。

開始使用

取得你的 API Key

搶先體驗已開放。告訴我們你在打造什麼,我們會為你開通帳戶、餘額與 Key。