1 つの API キーで 主要モデルを コード変更なしで
TokenAPI は OpenAI 互換のゲートウェイです。いまお使いの SDK から安定したモデル ID を呼び出すだけ。リクエストは高品質なバックエンドへルーティングされ、障害時は自動で切り替わり、実際のトークン数で課金されます。
接続先は 1 つだけ。 あとはお任せください。
モデル ID は特定ベンダーに固定されたモデルではなく、安定したプロダクトです。その背後にはプライマリルートと優先順位付きのフォールバックがあります。モデルのアップグレードやルート変更はすべて当社側で行うため、リクエストは一切変わりません。
- 1
あなたのアプリ
/v1/chat/completionsにmodel: "tokenapi-pro"を送信 - 2
TokenAPI ゲートウェイ
キーを認証し、制限を適用し、最大コストを事前に確保します。
- 3
ルーティング
まずプライマリへ。失敗した場合は、トークンを返す前に次のルートへ切り替えます。
- 4
レスポンス
呼び出した形式でストリーミング返却し、実際のトークン使用量で精算します。
本番環境で AI を運用するチームのために。
既存の SDK がそのまま動く
OpenAI または Anthropic 公式 SDK の base URL を変えるだけ。新しいクライアントライブラリもコードの書き換えも不要です。
コードを壊さないモデル名
呼び出すのは tokenapi-pro のような安定したモデル ID。常に高品質なバックエンドで提供するので、統合を変更する必要はありません。
自動フェイルオーバー
バックエンドが遅い、レート制限中、ダウンしている場合でも、最初のトークンを受け取る前に次のルートで自動再試行します。
すべての API で SSE 対応
3 つの API 形式すべてで、ツール呼び出しや使用量レポートを含むトークン単位のストリーミングに対応します。
リクエスト単位の正確な精算
すべてのリクエストをマイクロドル単位で計測。最大コストを事前に確保し、実使用量で精算するため、残高がマイナスになることはありません。
API キーごとの制限
キーごとにレート制限、利用上限額、有効期限、利用可能モデルを設定でき、プロジェクトやメンバーごとに管理できます。
従量課金。サブスクリプション不要。
よくある質問
どのモデルが使えますか?
機能、コンテキスト長、料金を含む最新の一覧はモデルページに掲載しています。各 TokenAPI モデルは大手の上流モデルプロバイダーによって提供されており、品質と可用性を保つため、モデル ID の背後のバックエンドを変更することがあります。モデルにどの基盤モデルで動いているか尋ねれば、正直に答えます。
コードの変更は必要ですか?
base URL と API キーを変えるだけです。リクエストとレスポンスは OpenAI Chat Completions・Responses 形式および Anthropic Messages 形式に準拠しています。
プロバイダーに障害が起きたら?
モデルには複数のバックエンドルートを設定できます。プライマリが応答を始める前に失敗した場合、次のルートが自動で試され、通常どおりのレスポンスが返ります。
課金方法は?
プリペイド残高とモデルごとのトークン単価です。リクエスト実行前に最大コストを確保し、実際のトークン数を請求して残りを即時に返還します。
プロンプトは保存されますか?
いいえ。課金とサポートに必要なリクエストのメタデータ(モデル、トークン数、コスト、レイテンシ、ステータス)のみを記録し、プロンプトや応答の内容は保存しません。リクエストはそのモデルを提供する上流プロバイダーで処理されます。
API キーはどうすれば取得できますか?
現在はアーリーアクセス期間のため、手動でご案内しています。hello@tokenapi.biz までメールをいただければ、アカウント、残高、キーをご用意します。
API キーを取得しましょう。
アーリーアクセスを受付中です。開発中のものを教えていただければ、アカウント、残高、キーをご用意します。