TokenAPI統合 AI モデル API
統合 AI モデル API

1 つの API キーで 主要モデルを コード変更なしで

TokenAPI は OpenAI 互換のゲートウェイです。いまお使いの SDK から安定したモデル ID を呼び出すだけ。リクエストは高品質なバックエンドへルーティングされ、障害時は自動で切り替わり、実際のトークン数で課金されます。

キー 1 つ提供中のすべてのモデルに
3 つの APIChat Completions · Responses · Messages
自動最初のトークン前にフェイルオーバー
従量課金使った分だけお支払い
仕組み

接続先は 1 つだけ。 あとはお任せください。

モデル ID は特定ベンダーに固定されたモデルではなく、安定したプロダクトです。その背後にはプライマリルートと優先順位付きのフォールバックがあります。モデルのアップグレードやルート変更はすべて当社側で行うため、リクエストは一切変わりません。

  1. 1

    あなたのアプリ

    /v1/chat/completions に model: "tokenapi-pro" を送信

  2. 2

    TokenAPI ゲートウェイ

    キーを認証し、制限を適用し、最大コストを事前に確保します。

  3. 3

    ルーティング

    まずプライマリへ。失敗した場合は、トークンを返す前に次のルートへ切り替えます。

  4. 4

    レスポンス

    呼び出した形式でストリーミング返却し、実際のトークン使用量で精算します。

TokenAPI が選ばれる理由

本番環境で AI を運用するチームのために。

そのまま使える

既存の SDK がそのまま動く

OpenAI または Anthropic 公式 SDK の base URL を変えるだけ。新しいクライアントライブラリもコードの書き換えも不要です。

安定した ID

コードを壊さないモデル名

呼び出すのは tokenapi-pro のような安定したモデル ID。常に高品質なバックエンドで提供するので、統合を変更する必要はありません。

高可用性

自動フェイルオーバー

バックエンドが遅い、レート制限中、ダウンしている場合でも、最初のトークンを受け取る前に次のルートで自動再試行します。

ストリーミング

すべての API で SSE 対応

3 つの API 形式すべてで、ツール呼び出しや使用量レポートを含むトークン単位のストリーミングに対応します。

課金

リクエスト単位の正確な精算

すべてのリクエストをマイクロドル単位で計測。最大コストを事前に確保し、実使用量で精算するため、残高がマイナスになることはありません。

管理

API キーごとの制限

キーごとにレート制限、利用上限額、有効期限、利用可能モデルを設定でき、プロジェクトやメンバーごとに管理できます。

料金

従量課金。サブスクリプション不要。

全モデル共通

トークン従量課金

プリペイド

モデルごとに 100 万トークンあたりの入力・出力単価を設定しています。残高をチャージすれば、どのモデルにも使えます。

  • モデルごとに料金を掲載
  • 実際のトークン数で課金
  • 未使用の確保分は即時に返還
モデル料金を見る
チーム・大口利用

カスタム

ご相談ください

本番ワークロード向けに、より高いレート制限、請求書払い、ボリュームディスカウントをご用意します。

  • カスタムレート制限
  • 利用上限付きの複数キー
  • 優先サポート
営業に問い合わせる
よくある質問

よくある質問

どのモデルが使えますか?

機能、コンテキスト長、料金を含む最新の一覧はモデルページに掲載しています。各 TokenAPI モデルは大手の上流モデルプロバイダーによって提供されており、品質と可用性を保つため、モデル ID の背後のバックエンドを変更することがあります。モデルにどの基盤モデルで動いているか尋ねれば、正直に答えます。

コードの変更は必要ですか?

base URL と API キーを変えるだけです。リクエストとレスポンスは OpenAI Chat Completions・Responses 形式および Anthropic Messages 形式に準拠しています。

プロバイダーに障害が起きたら?

モデルには複数のバックエンドルートを設定できます。プライマリが応答を始める前に失敗した場合、次のルートが自動で試され、通常どおりのレスポンスが返ります。

課金方法は?

プリペイド残高とモデルごとのトークン単価です。リクエスト実行前に最大コストを確保し、実際のトークン数を請求して残りを即時に返還します。

プロンプトは保存されますか?

いいえ。課金とサポートに必要なリクエストのメタデータ(モデル、トークン数、コスト、レイテンシ、ステータス)のみを記録し、プロンプトや応答の内容は保存しません。リクエストはそのモデルを提供する上流プロバイダーで処理されます。

API キーはどうすれば取得できますか?

現在はアーリーアクセス期間のため、手動でご案内しています。hello@tokenapi.biz までメールをいただければ、アカウント、残高、キーをご用意します。

はじめる

API キーを取得しましょう。

アーリーアクセスを受付中です。開発中のものを教えていただければ、アカウント、残高、キーをご用意します。