Dokumentation

Verbinde dein Tool in einer Minute.

Jedes Tool braucht dieselben zwei Dinge: die Basis-URL unten und deinen Schlüssel. Wähl dein Tool und folge den Schritten.

Basis-URL · für jedes Tool gleichhttps://api.tokenlowcost.com/v1
API-Schlüssel · ein Schlüssel pro Modellsk-tlc-…

Schnellstart

Etwa eine Minute
  1. Schlüssel erstellen

    Wähl im Dashboard ein Modell und klick auf Schlüssel erstellen. Kopier den Schlüssel sofort: Er wird nur einmal angezeigt.

  2. Richte dein Tool ein

    Such dein Tool unten. Direkt nach dem Erstellen eines Schlüssels zeigt das Dashboard dieselben Schritte, mit deinem Schlüssel schon eingetragen.

  3. Loslegen

    Nutze dein Tool wie gewohnt. Jede Anfrage wird von deinem Guthaben bezahlt, und das Dashboard zeigt sie mit ihren Kosten.

Modelle

Sortiert, die besten zuerst

Jeder Schlüssel funktioniert mit einem Modell: dem, das du beim Erstellen wählst. Dieses Modell beantwortet jede Anfrage mit dem Schlüssel, egal welchen Modellnamen dein Tool sendet. Du willst zwei Modelle? Erstell zwei Schlüssel.

Aus demselben Grund listet GET /v1/models nur das Modell deines Schlüssels. Tools mit Modellliste wie Cline und Roo Code bieten nur dieses eine an.

Alle Modelle und ihre Preise findest du auf der Preisseite.

Abrechnung & Limits

Prepaid · pro Token

Du lädst zuerst Geld auf dein Guthaben. Neue Konten starten mit $50 Startguthaben – einmal pro Person. Jede Anfrage kostet ihre Tokens zum Preis deines Modells, und der Betrag wird vom Guthaben abgezogen. Das Dashboard listet jede Anfrage mit Tokens und Kosten auf.

Wiederholter Text kostet weniger. Hat das Modell den Anfang eines Prompts kürzlich gesehen, werden diese Tokens zum günstigeren Cache-Preis berechnet. Coding-Tools senden immer wieder denselben Kontext, das spart also viel.

Wann Anfragen stoppen

Was passiert istErgebnis
Schlüssellimit erreicht402 für diesen Schlüssel. Deine anderen Schlüssel funktionieren weiter.
Schlüssel abgelaufen403 für diesen Schlüssel.
Schlüssel widerrufenSofort 401. Das lässt sich nicht rückgängig machen.
Guthaben bei $0402 für alle Schlüssel, bis du auflädst. Das Guthaben fällt nie unter null.
Konto gesperrt403 für alle Schlüssel, und du kannst dich nicht anmelden. Gesperrt wird bei Verstößen gegen die Regeln.

Kontext & Denkaufwand

Optional, pro Schlüssel

Beim Erstellen eines Schlüssels kannst du auch diese zwei Einstellungen wählen. Der Dialog zeigt, was die Eingabe eines Prompts kostet, der das gewählte Fenster füllt.

EinstellungWas sie bewirkt
KontextfensterWie viel Text eine Anfrage fassen kann, von 128K Tokens bis zum Maximum des Modells. Es ist ein Limit des Schlüssels: Das Modell selbst ändert sich nicht. Anfragen über dem Limit werden abgelehnt und kosten nichts. Die Größe wird geschätzt und kann um ein paar Prozent abweichen.
DenkaufwandWie gründlich das Modell nachdenkt, bevor es antwortet. Bei Wie in der App entscheidet dein Tool. Eine feste Stufe gilt für jede Anfrage mit dem Schlüssel. Mehr Nachdenken bedeutet mehr Ausgabe-Tokens und kostet daher mehr.

Die Einrichtungsschritte im Dashboard geben beide Einstellungen an dein Tool weiter.

Lange Chats kosten mehr. Coding-Tools senden bei jedem Schritt den ganzen Chat, daher kostet jeder Schritt etwas mehr als der vorige, bis das Tool den Chat kürzt. Mit einem kleineren Kontextfenster passiert das früher. Manche Modelle berechnen außerdem mehr für sehr lange Prompts; die Preisseite zeigt, ab wann.
Cu

Cursor

Settings → Models
  1. Einstellungen öffnen

    Öffne in Cursor Settings → Models und scroll nach unten zu API Keys.

  2. Schlüssel und Basis-URL einfügen

    Füg deinen Schlüssel bei OpenAI API Key ein. Schalte Override OpenAI Base URL ein und füg die Basis-URL ein.

    OpenAI API Key            sk-tlc-your-key
    Override OpenAI Base URL  on
    Base URL                  https://api.tokenlowcost.com/v1
  3. Modellnamen hinzufügen

    Klick auf + Add model, gib einen Namen wie tlc-opus ein und schalte ihn ein. Der Name ist nur eine Bezeichnung: Das Modell bestimmt dein Schlüssel. Nimm einen Namen, den Cursor noch nicht hat, damit die Anfrage mit deinem Schlüssel rausgeht.

  4. Prüfen und chatten

    Klick neben dem Schlüssel auf Verify. Dann wähl dein Modell im Chat.

VS

VS Code

Integrierter Chat · ohne Erweiterung, ohne GitHub-Konto

Der in VS Code integrierte Chat kann deinen Schlüssel nutzen. Du brauchst VS Code 1.122 oder neuer. Wenn VS Code beim ersten Start eine Anmeldung verlangt, klick auf Continue without Signing In.

  1. Eigenen Endpunkt hinzufügen

    Drück Strg + Umschalt + P (Cmd auf dem Mac) und führ Chat: Manage Language Models aus. Klick auf Add Models, dann auf Custom Endpoint.

  2. Namen und Schlüssel eingeben

    Nenn ihn TokenLowCost und füg deinen Schlüssel ein. Bei API Type einfach Enter drücken.

  3. Modell einfügen

    VS Code öffnet eine Datei mit einem leeren Modell. Ersetz den Teil "models": [ … ] durch den Block unten und speichere. Das Dashboard gibt dir diesen Block direkt nach dem Erstellen fertig für deinen Schlüssel. Kopierst du von hier? Nimm den Claude-Block für Claude-Modelle, den anderen für den Rest, und ändere id und name auf dein Modell.

    
                  
    
                
  4. Modell wählen

    Öffne den Chat, klick im Eingabefeld auf den Modellnamen und wähl dein Modell.

VS Code speichert deinen Schlüssel im sicheren Speicher, nicht in der Datei. Der Chat funktioniert vollständig, inklusive Agent-Modus. Die grauen Vorschläge beim Tippen sind nicht dabei: Die kommen nur von GitHub Copilot.

Nicht bei GitHub angemeldet? Dann zeigt VS Code Set BYOK utility models. Klick auf Configure und wähl Main Agent Model, damit auch Chat-Titel und Commit-Nachrichten dein Modell nutzen. Das sind kleine Anfragen, abgerechnet wie jede andere.

Claude Code oder Codex in VS Code

Die Erweiterungen für Claude Code und Codex nutzen dieselben Einstellungen wie ihre Terminal-Versionen. Füg zuerst die Zeile für Claude Code oder Codex ein, installier dann die Erweiterung und starte VS Code neu. Öffne für Claude Code außerdem die Settings, such nach Claude Code login und aktivier Disable Login Prompt.

CC

Claude Code

Eine eingefügte Zeile

Eine Zeile speichert die Basis-URL, deinen Schlüssel und das Modell deines Schlüssels, und jedes neue Terminal übernimmt sie. Die Zeile unten ist für einen Claude-Opus-5.5-Schlüssel und enthält einen Platzhalter-Schlüssel. Das Dashboard zeigt sie passend zu deinem Schlüssel: mit Modell, Kontextfenster und Denkaufwand.


          

        
  1. Zeile einfügen

    Füg sie in PowerShell (Windows) oder Terminal (macOS, Linux) ein und drück Enter.

  2. Claude Code starten

    Führ claude im selben Fenster aus. Drück beim ersten Mal auf den Bildschirmen zu Textstil und Sicherheit Enter. Wenn gefragt wird, ob du dem Ordner vertraust, drück ↓, um Yes, I trust this folder zu wählen, dann Enter: Das vorausgewählte No, exit beendet Claude Code. Ein Anthropic-Konto brauchst du nicht.

Noch kein Claude Code? Führ in PowerShell irm https://claude.ai/install.ps1 | iex aus, unter macOS oder Linux curl -fsSL https://claude.ai/install.sh | bash. Wenn der Installer meldet, dass sein Ordner nicht in deinem PATH ist, mach, was er anzeigt. Nutzt du das Terminal in VS Code oder Cursor, starte den Editor nach dem Einfügen der Zeile neu.

Warum der Modellname? Ohne ihn glaubt Claude Code, es spreche mit Claude Opus 5.5, egal welches Modell dein Schlüssel hat. Das sagt es auch dem Modell und signiert Commits mit diesem Namen. Mit dem Namen kennt es das echte Modell. Ist das Modell kein Claude, meldet Claude Code eventuell, dass es das Modell nicht kennt. Das ist in Ordnung: Es kennt nur Claude-Modelle beim Namen, und die Anfragen funktionieren trotzdem.

Lieber eine Datei? Schreib das in ~/.claude/settings.json (unter Windows %USERPROFILE%\.claude\settings.json):

{
  "env": {
    "ANTHROPIC_BASE_URL": "https://api.tokenlowcost.com/v1",
    "ANTHROPIC_AUTH_TOKEN": "sk-tlc-your-key",
    "ANTHROPIC_MODEL": "claude-opus-5-5[1m]"
  }
}

Setz ANTHROPIC_MODEL auf das Modell deines Schlüssels: claude-opus-5-5, claude-sonnet-5, claude-haiku-4-5 oder für andere Modelle die ID aus der Preisliste, etwa gpt-6-sol. Häng [1m] an, wenn das Fenster des Schlüssels über 200K liegt.

Claude Code sendet auch kleine Hintergrundanfragen, etwa für Chat-Titel. Sie nutzen das Modell deines Schlüssels und werden wie jede andere Anfrage abgerechnet.

Cx

Codex

Eine eingefügte Zeile

Eine Zeile schreibt die Codex-Einstellungsdatei und speichert deinen Schlüssel. Hast du schon eine Codex-Konfiguration, bleibt sie als config.toml.bak erhalten. Diese Zeile enthält einen Platzhalter-Schlüssel; das Dashboard zeigt sie mit deinem.


          

        

Füg sie in PowerShell (Windows) oder Terminal (macOS, Linux) ein und drück Enter. Führ dann im selben Fenster codex aus und wähl Trust and continue. Ein ChatGPT-Konto brauchst du nicht.

Noch kein Codex? Installier es mit npm install -g @openai/codex. Codex funktioniert am besten mit OpenAI-Modellen wie GPT-6 Sol.

Lieber die Datei selbst bearbeiten? Das schreibt die Zeile in ~/.codex/config.toml. Wenn du es zu einer bestehenden Datei hinzufügst, müssen die ersten Zeilen über jeder [section] stehen.

Codex liest deinen Schlüssel aus der Umgebungsvariable TOKENLOWCOST_API_KEY, die die Zeile ebenfalls setzt. Setz sie dann auch selbst: Füg export TOKENLOWCOST_API_KEY=sk-tlc-your-key zu ~/.zshrc oder ~/.bashrc hinzu, oder führ unter Windows setx TOKENLOWCOST_API_KEY sk-tlc-your-key aus und öffne ein neues Fenster.

Cl

Cline, Roo Code & Continue

Erweiterungen für VS Code und JetBrains

Öffne in Cline oder Roo Code die Anbieter-Einstellungen und füll die Felder unten aus. Beim ersten Öffnen von Cline kommst du über Bring my own API key dorthin. Sobald der Schlüssel drin ist, zeigt die Modellliste nur das Modell deines Schlüssels: Wähl es aus.

API Provider  OpenAI Compatible
Base URL      https://api.tokenlowcost.com/v1
API Key       sk-tlc-your-key
Model ID      anthropic/claude-opus-5.5

Cline zeigt die Kosten als $0 an, weil es unsere Preise nicht kennt. Die echten Kosten stehen im Dashboard unter Nutzung.

Roo Code hängt bei API Request…? Ab VS Code 1.122 findet Roo Code 3.54 das Dateisuche-Tool nicht mehr, das VS Code verschoben hat, egal mit welchem Anbieter. Dieses VS-Code-Issue beschreibt einen Workaround. Cline hat das Problem nicht.

Für Continue schreibst du das in ~/.continue/config.yaml, anstelle des bisherigen Inhalts. Schon Modelle drin? Füg nur den TokenLowCost-Eintrag unter models: hinzu. Die Zeile tool_use erlaubt dem Agent-Modus, Dateien zu bearbeiten; ohne sie erkennt Continue nicht, dass das Modell Tools hat.

name: My Config
version: 0.0.1
schema: v1
models:
  - name: TokenLowCost
    provider: openai
    model: tlc-opus
    apiBase: https://api.tokenlowcost.com/v1
    apiKey: sk-tlc-your-key
    capabilities:
      - tool_use

Jedes andere Tool mit der Option OpenAI Compatible funktioniert genauso.

OA

OpenAI SDK

Python und TypeScript

Setz die Basis-URL und deinen Schlüssel. Der Rest ist der übliche SDK-Code.

from openai import OpenAI

client = OpenAI(
    base_url="https://api.tokenlowcost.com/v1",
    api_key="sk-tlc-your-key",
)

r = client.chat.completions.create(
    model="claude-opus-5.5",
    messages=[{"role": "user", "content": "Hello"}],
)
print(r.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.tokenlowcost.com/v1",
  apiKey: "sk-tlc-your-key",
});

const r = await client.chat.completions.create({
  model: "claude-opus-5.5",
  messages: [{ role: "user", content: "Hello" }],
});
console.log(r.choices[0].message.content);

Die TypeScript-Beispiele auf dieser Seite sind ES-Module: Speichere eins als main.mts und führ npx tsx main.mts aus.

Streaming

Füg stream=True hinzu. Die Token-Zahlen kommen im letzten Chunk, der auch ohne choices ankommen kann, also prüf zuerst chunk.choices.

stream = client.chat.completions.create(
    model="claude-opus-5.5",
    messages=[{"role": "user", "content": "Write a haiku about caching"}],
    stream=True,
)
for chunk in stream:
    if chunk.choices:
        print(chunk.choices[0].delta.content or "", end="")

Die Responses API funktioniert auch: client.responses.create(...).

An

Anthropic SDK

Python und TypeScript

Nutz dieselbe Basis-URL wie überall. Das SDK hängt /v1/messages an, und das passt so. Manche Modelle senden vor dem Text einen Thinking-Block, daher gibt das Beispiel nur die Textblöcke aus.

from anthropic import Anthropic

client = Anthropic(
    base_url="https://api.tokenlowcost.com/v1",
    api_key="sk-tlc-your-key",
)

msg = client.messages.create(
    model="claude-opus-5.5",
    max_tokens=512,
    messages=[{"role": "user", "content": "Hello"}],
)
for block in msg.content:
    if block.type == "text":
        print(block.text)
import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic({
  baseURL: "https://api.tokenlowcost.com/v1",
  apiKey: "sk-tlc-your-key",
});

const msg = await client.messages.create({
  model: "claude-opus-5.5",
  max_tokens: 512,
  messages: [{ role: "user", content: "Hello" }],
});
for (const block of msg.content) {
  if (block.type === "text") console.log(block.text);
}
$_

cURL

Einfache HTTP-Anfragen

Derselbe Schlüssel funktioniert in allen drei Anfrageformaten.

curl https://api.tokenlowcost.com/v1/chat/completions \
  -H "Authorization: Bearer sk-tlc-your-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "claude-opus-5.5", "messages": [{"role": "user", "content": "Hello"}]}'
curl https://api.tokenlowcost.com/v1/messages \
  -H "x-api-key: sk-tlc-your-key" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{"model": "claude-opus-5.5", "max_tokens": 256, "messages": [{"role": "user", "content": "Hello"}]}'
curl https://api.tokenlowcost.com/v1/responses \
  -H "Authorization: Bearer sk-tlc-your-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "gpt-6-sol", "input": "Hello"}'

Guthaben und die letzten 20 Anfragen abrufen:

curl https://api.tokenlowcost.com/v1/me -H "Authorization: Bearer sk-tlc-your-key"

Fehler

Was sie bedeuten und was zu tun ist

Wenn etwas schiefgeht, bekommst du einen Statuscode und eine kurze Meldung.

CodeBedeutungWas tun
401Der Schlüssel fehlt, ist falsch oder widerrufen.Prüf, ob du den ganzen Schlüssel eingefügt hast.
402Der Schlüssel hat sein Ausgabelimit erreicht, oder dein Guthaben ist $0.Lade auf oder erstell einen Schlüssel mit höherem Limit.
403Der Schlüssel ist abgelaufen oder das Konto gesperrt. Die Meldung sagt, was davon.Ist er abgelaufen, erstell einen neuen Schlüssel. Sperren sind in den Regeln erklärt.
400Wenn die Meldung sagt, dass der Prompt zu lang ist: Die Anfrage ist größer als das Kontextfenster des Schlüssels. Sie wird nicht berechnet.Starte einen neuen Chat oder nutze einen Schlüssel mit größerem Fenster.
404Falsche Adresse.Prüf den Teil nach /v1.
AndereUnverändert vom Modellanbieter weitergegeben, etwa wenn er überlastet ist.Versuch es in einer Minute noch einmal.

Ausgabelimits und Ablaufdaten legst du pro Schlüssel im Dashboard fest. Dein Guthaben findest du unter Abrechnung.

Bereit zum Verbinden?

Leg ein Konto an, hol dir $50 Guthaben und erstell deinen ersten Schlüssel. Das dauert etwa eine Minute.

API-Schlüssel holen