TokenAPIEinheitliche KI-Modell-API
Einheitliche KI-Modell-API

Ein API-Schlüssel. Führende Modelle. Kein Umbau.

TokenAPI ist ein OpenAI-kompatibles Gateway. Rufen Sie stabile Modell-IDs mit dem SDK auf, das Sie bereits nutzen. Wir leiten jede Anfrage an ein leistungsstarkes Backend weiter, schalten bei Ausfällen automatisch um und rechnen pro Token ab.

1 Schlüsselfür alle unsere Modelle
3 APIsChat Completions · Responses · Messages
AutoFailover vor dem ersten Token
Pro Tokenzahlen Sie nur, was Sie nutzen
So funktioniert es

Ihr Code spricht mit einem Endpoint. Den Rest übernehmen wir.

Eine Modell-ID ist ein stabiles Produkt, kein fest verdrahtetes Anbietermodell. Dahinter stehen eine primäre Route und priorisierte Fallbacks. Upgrades und Umleitungen passieren bei uns; Ihre Anfragen bleiben exakt gleich.

  1. 1

    Ihre Anwendung

    model: "tokenapi-pro" an /v1/chat/completions

  2. 2

    TokenAPI-Gateway

    Prüft den Schlüssel, wendet Limits an und reserviert die maximalen Kosten.

  3. 3

    Routing

    Zuerst das primäre Backend; bei einem Fehler übernimmt die nächste Route, bevor ein Token gesendet wird.

  4. 4

    Antwort

    Wird im aufgerufenen Format gestreamt und anschließend nach dem tatsächlichen Tokenverbrauch abgerechnet.

Warum TokenAPI

Gebaut für Teams, die KI produktiv betreiben.

Sofort nutzbar

Funktioniert mit Ihren bestehenden SDKs

Richten Sie das offizielle OpenAI- oder Anthropic-SDK auf unsere Base URL. Keine neue Client-Bibliothek, kein Umschreiben.

Stabile IDs

Modellnamen, die Ihren Code nie brechen

Sie rufen eine stabile Modell-ID wie tokenapi-pro auf. Wir sorgen dafür, dass sie stets von einem starken Backend bedient wird; Ihre Integration muss sich nie ändern.

Ausfallsicherheit

Automatisches Failover

Ist ein Backend langsam, ratenbegrenzt oder ausgefallen, wird die Anfrage auf der nächsten Route wiederholt, bevor Sie ein einziges Token erhalten.

Streaming

Server-Sent Events überall

Token-für-Token-Streaming in allen drei API-Formaten, inklusive Tool-Aufrufen und Verbrauchsangaben.

Abrechnung

Exakte Abrechnung pro Anfrage

Jede Anfrage wird in Mikrodollar gemessen. Die maximalen Kosten werden vorab reserviert und nach dem tatsächlichen Verbrauch abgerechnet, sodass ein Guthaben nie ins Minus rutscht.

Kontrolle

Limits pro API-Schlüssel

Ratenlimits, Ausgabengrenzen, Ablaufdaten und erlaubte Modelle pro Schlüssel halten jedes Projekt und jedes Teammitglied im Rahmen.

Preise

Nutzungsbasiert. Ohne Abo.

Alle Modelle

Preis pro Token

Prepaid

Jedes Modell hat eigene Input- und Output-Preise pro Million Tokens. Laden Sie ein Guthaben auf und nutzen Sie es für jedes Modell.

  • Preise pro Modell ausgewiesen
  • Abrechnung nach tatsächlichen Tokens
  • Nicht genutzte Reservierungen sofort freigegeben
Modellpreise ansehen
Teams & Volumen

Individuell

Sprechen Sie uns an

Höhere Ratenlimits, Rechnungsstellung und Mengenpreise für Produktions-Workloads.

  • Individuelle Ratenlimits
  • Mehrere Schlüssel mit Ausgabengrenzen
  • Priorisierter Support
Vertrieb kontaktieren
FAQ

Häufige Fragen.

Welche Modelle kann ich nutzen?

Die aktuelle Liste mit Fähigkeiten, Kontextlänge und Preisen finden Sie auf der Modellseite. Jedes TokenAPI-Modell wird von einem führenden Upstream-Anbieter bereitgestellt; um Qualität und Verfügbarkeit hoch zu halten, können wir das Backend hinter einer Modell-ID wechseln. Fragen Sie ein Modell, auf welchem Modell es läuft, und es wird es Ihnen sagen.

Muss ich meinen Code ändern?

Nur die Base URL und den API-Schlüssel. Anfragen und Antworten folgen den OpenAI-Formaten Chat Completions und Responses sowie dem Anthropic-Format Messages.

Was passiert bei einem Ausfall eines Anbieters?

Modelle können mehrere Backend-Routen haben. Schlägt die primäre fehl, bevor sie zu antworten beginnt, wird automatisch die nächste versucht, und Sie erhalten eine normale Antwort.

Wie wird abgerechnet?

Prepaid-Guthaben und Preise pro Token je Modell. Vor einer Anfrage reservieren wir die maximal möglichen Kosten, berechnen dann die tatsächlichen Tokens und geben den Rest sofort frei.

Speichern Sie meine Prompts?

Nein. Wir protokollieren nur die für Abrechnung und Support nötigen Metadaten (Modell, Tokenanzahl, Kosten, Latenz, Status), nicht die Inhalte von Prompts oder Antworten. Anfragen werden vom Upstream-Anbieter verarbeitet, der das Modell bereitstellt.

Wie erhalte ich einen API-Schlüssel?

Während des Early Access richten wir Kunden manuell ein. Schreiben Sie an hello@tokenapi.biz, und wir richten Ihr Konto, Guthaben und Ihre Schlüssel ein.

Loslegen

Holen Sie sich Ihren API-Schlüssel.

Der Early Access ist geöffnet. Erzählen Sie uns, was Sie bauen, und wir richten Ihr Konto, Guthaben und Ihre Schlüssel ein.