Verbinde dein Tool in einer Minute.
Jedes Tool braucht dieselben zwei Dinge: die Basis-URL unten und deinen Schlüssel. Wähl dein Tool und folge den Schritten.
https://api.tokenlowcost.com/v1Schnellstart
-
Schlüssel erstellen
Wähl im Dashboard ein Modell und klick auf Schlüssel erstellen. Kopier den Schlüssel sofort: Er wird nur einmal angezeigt.
-
Richte dein Tool ein
Such dein Tool unten. Direkt nach dem Erstellen eines Schlüssels zeigt das Dashboard dieselben Schritte, mit deinem Schlüssel schon eingetragen.
-
Loslegen
Nutze dein Tool wie gewohnt. Jede Anfrage wird von deinem Guthaben bezahlt, und das Dashboard zeigt sie mit ihren Kosten.
Modelle
Jeder Schlüssel funktioniert mit einem Modell: dem, das du beim Erstellen wählst. Dieses Modell beantwortet jede Anfrage mit dem Schlüssel, egal welchen Modellnamen dein Tool sendet. Du willst zwei Modelle? Erstell zwei Schlüssel.
Aus demselben Grund listet GET /v1/models nur das Modell deines Schlüssels. Tools mit Modellliste wie Cline und Roo Code bieten nur dieses eine an.
Alle Modelle und ihre Preise findest du auf der Preisseite.
Abrechnung & Limits
Du lädst zuerst Geld auf dein Guthaben. Neue Konten starten mit $50 Startguthaben – einmal pro Person. Jede Anfrage kostet ihre Tokens zum Preis deines Modells, und der Betrag wird vom Guthaben abgezogen. Das Dashboard listet jede Anfrage mit Tokens und Kosten auf.
Wann Anfragen stoppen
| Was passiert ist | Ergebnis |
|---|---|
| Schlüssellimit erreicht | 402 für diesen Schlüssel. Deine anderen Schlüssel funktionieren weiter. |
| Schlüssel abgelaufen | 403 für diesen Schlüssel. |
| Schlüssel widerrufen | Sofort 401. Das lässt sich nicht rückgängig machen. |
| Guthaben bei $0 | 402 für alle Schlüssel, bis du auflädst. Das Guthaben fällt nie unter null. |
| Konto gesperrt | 403 für alle Schlüssel, und du kannst dich nicht anmelden. Gesperrt wird bei Verstößen gegen die Regeln. |
Kontext & Denkaufwand
Beim Erstellen eines Schlüssels kannst du auch diese zwei Einstellungen wählen. Der Dialog zeigt, was die Eingabe eines Prompts kostet, der das gewählte Fenster füllt.
| Einstellung | Was sie bewirkt |
|---|---|
| Kontextfenster | Wie viel Text eine Anfrage fassen kann, von 128K Tokens bis zum Maximum des Modells. Es ist ein Limit des Schlüssels: Das Modell selbst ändert sich nicht. Anfragen über dem Limit werden abgelehnt und kosten nichts. Die Größe wird geschätzt und kann um ein paar Prozent abweichen. |
| Denkaufwand | Wie gründlich das Modell nachdenkt, bevor es antwortet. Bei Wie in der App entscheidet dein Tool. Eine feste Stufe gilt für jede Anfrage mit dem Schlüssel. Mehr Nachdenken bedeutet mehr Ausgabe-Tokens und kostet daher mehr. |
Die Einrichtungsschritte im Dashboard geben beide Einstellungen an dein Tool weiter.
Cursor
Einstellungen öffnen
Öffne in Cursor Settings → Models und scroll nach unten zu API Keys.
-
Schlüssel und Basis-URL einfügen
Füg deinen Schlüssel bei OpenAI API Key ein. Schalte Override OpenAI Base URL ein und füg die Basis-URL ein.
OpenAI API Key sk-tlc-your-key Override OpenAI Base URL on Base URL https://api.tokenlowcost.com/v1
Modellnamen hinzufügen
Klick auf + Add model, gib einen Namen wie
tlc-opusein und schalte ihn ein. Der Name ist nur eine Bezeichnung: Das Modell bestimmt dein Schlüssel. Nimm einen Namen, den Cursor noch nicht hat, damit die Anfrage mit deinem Schlüssel rausgeht.Prüfen und chatten
Klick neben dem Schlüssel auf Verify. Dann wähl dein Modell im Chat.
VS Code
Der in VS Code integrierte Chat kann deinen Schlüssel nutzen. Du brauchst VS Code 1.122 oder neuer. Wenn VS Code beim ersten Start eine Anmeldung verlangt, klick auf Continue without Signing In.
Eigenen Endpunkt hinzufügen
Drück Strg + Umschalt + P (Cmd auf dem Mac) und führ Chat: Manage Language Models aus. Klick auf Add Models, dann auf Custom Endpoint.
Namen und Schlüssel eingeben
Nenn ihn TokenLowCost und füg deinen Schlüssel ein. Bei API Type einfach Enter drücken.
-
Modell einfügen
VS Code öffnet eine Datei mit einem leeren Modell. Ersetz den Teil
"models": [ … ]durch den Block unten und speichere. Das Dashboard gibt dir diesen Block direkt nach dem Erstellen fertig für deinen Schlüssel. Kopierst du von hier? Nimm den Claude-Block für Claude-Modelle, den anderen für den Rest, und ändereidundnameauf dein Modell. Modell wählen
Öffne den Chat, klick im Eingabefeld auf den Modellnamen und wähl dein Modell.
Nicht bei GitHub angemeldet? Dann zeigt VS Code Set BYOK utility models. Klick auf Configure und wähl Main Agent Model, damit auch Chat-Titel und Commit-Nachrichten dein Modell nutzen. Das sind kleine Anfragen, abgerechnet wie jede andere.
Claude Code oder Codex in VS Code
Die Erweiterungen für Claude Code und Codex nutzen dieselben Einstellungen wie ihre Terminal-Versionen. Füg zuerst die Zeile für Claude Code oder Codex ein, installier dann die Erweiterung und starte VS Code neu. Öffne für Claude Code außerdem die Settings, such nach Claude Code login und aktivier Disable Login Prompt.
Claude Code
Eine Zeile speichert die Basis-URL, deinen Schlüssel und das Modell deines Schlüssels, und jedes neue Terminal übernimmt sie. Die Zeile unten ist für einen Claude-Opus-5.5-Schlüssel und enthält einen Platzhalter-Schlüssel. Das Dashboard zeigt sie passend zu deinem Schlüssel: mit Modell, Kontextfenster und Denkaufwand.
Zeile einfügen
Füg sie in PowerShell (Windows) oder Terminal (macOS, Linux) ein und drück Enter.
Claude Code starten
Führ
claudeim selben Fenster aus. Drück beim ersten Mal auf den Bildschirmen zu Textstil und Sicherheit Enter. Wenn gefragt wird, ob du dem Ordner vertraust, drück ↓, um Yes, I trust this folder zu wählen, dann Enter: Das vorausgewählte No, exit beendet Claude Code. Ein Anthropic-Konto brauchst du nicht.
irm https://claude.ai/install.ps1 | iex aus, unter macOS oder Linux curl -fsSL https://claude.ai/install.sh | bash. Wenn der Installer meldet, dass sein Ordner nicht in deinem PATH ist, mach, was er anzeigt. Nutzt du das Terminal in VS Code oder Cursor, starte den Editor nach dem Einfügen der Zeile neu.Warum der Modellname? Ohne ihn glaubt Claude Code, es spreche mit Claude Opus 5.5, egal welches Modell dein Schlüssel hat. Das sagt es auch dem Modell und signiert Commits mit diesem Namen. Mit dem Namen kennt es das echte Modell. Ist das Modell kein Claude, meldet Claude Code eventuell, dass es das Modell nicht kennt. Das ist in Ordnung: Es kennt nur Claude-Modelle beim Namen, und die Anfragen funktionieren trotzdem.
Lieber eine Datei? Schreib das in ~/.claude/settings.json (unter Windows %USERPROFILE%\.claude\settings.json):
{
"env": {
"ANTHROPIC_BASE_URL": "https://api.tokenlowcost.com/v1",
"ANTHROPIC_AUTH_TOKEN": "sk-tlc-your-key",
"ANTHROPIC_MODEL": "claude-opus-5-5[1m]"
}
}Setz ANTHROPIC_MODEL auf das Modell deines Schlüssels: claude-opus-5-5, claude-sonnet-5, claude-haiku-4-5 oder für andere Modelle die ID aus der Preisliste, etwa gpt-6-sol. Häng [1m] an, wenn das Fenster des Schlüssels über 200K liegt.
Claude Code sendet auch kleine Hintergrundanfragen, etwa für Chat-Titel. Sie nutzen das Modell deines Schlüssels und werden wie jede andere Anfrage abgerechnet.
Codex
Eine Zeile schreibt die Codex-Einstellungsdatei und speichert deinen Schlüssel. Hast du schon eine Codex-Konfiguration, bleibt sie als config.toml.bak erhalten. Diese Zeile enthält einen Platzhalter-Schlüssel; das Dashboard zeigt sie mit deinem.
Füg sie in PowerShell (Windows) oder Terminal (macOS, Linux) ein und drück Enter. Führ dann im selben Fenster codex aus und wähl Trust and continue. Ein ChatGPT-Konto brauchst du nicht.
npm install -g @openai/codex. Codex funktioniert am besten mit OpenAI-Modellen wie GPT-6 Sol.Lieber die Datei selbst bearbeiten? Das schreibt die Zeile in ~/.codex/config.toml. Wenn du es zu einer bestehenden Datei hinzufügst, müssen die ersten Zeilen über jeder [section] stehen.
Codex liest deinen Schlüssel aus der Umgebungsvariable TOKENLOWCOST_API_KEY, die die Zeile ebenfalls setzt. Setz sie dann auch selbst: Füg export TOKENLOWCOST_API_KEY=sk-tlc-your-key zu ~/.zshrc oder ~/.bashrc hinzu, oder führ unter Windows setx TOKENLOWCOST_API_KEY sk-tlc-your-key aus und öffne ein neues Fenster.
Cline, Roo Code & Continue
Öffne in Cline oder Roo Code die Anbieter-Einstellungen und füll die Felder unten aus. Beim ersten Öffnen von Cline kommst du über Bring my own API key dorthin. Sobald der Schlüssel drin ist, zeigt die Modellliste nur das Modell deines Schlüssels: Wähl es aus.
API Provider OpenAI Compatible Base URL https://api.tokenlowcost.com/v1 API Key sk-tlc-your-key Model ID anthropic/claude-opus-5.5
Cline zeigt die Kosten als $0 an, weil es unsere Preise nicht kennt. Die echten Kosten stehen im Dashboard unter Nutzung.
Für Continue schreibst du das in ~/.continue/config.yaml, anstelle des bisherigen Inhalts. Schon Modelle drin? Füg nur den TokenLowCost-Eintrag unter models: hinzu. Die Zeile tool_use erlaubt dem Agent-Modus, Dateien zu bearbeiten; ohne sie erkennt Continue nicht, dass das Modell Tools hat.
name: My Config
version: 0.0.1
schema: v1
models:
- name: TokenLowCost
provider: openai
model: tlc-opus
apiBase: https://api.tokenlowcost.com/v1
apiKey: sk-tlc-your-key
capabilities:
- tool_useJedes andere Tool mit der Option OpenAI Compatible funktioniert genauso.
OpenAI SDK
Setz die Basis-URL und deinen Schlüssel. Der Rest ist der übliche SDK-Code.
from openai import OpenAI
client = OpenAI(
base_url="https://api.tokenlowcost.com/v1",
api_key="sk-tlc-your-key",
)
r = client.chat.completions.create(
model="claude-opus-5.5",
messages=[{"role": "user", "content": "Hello"}],
)
print(r.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.tokenlowcost.com/v1",
apiKey: "sk-tlc-your-key",
});
const r = await client.chat.completions.create({
model: "claude-opus-5.5",
messages: [{ role: "user", content: "Hello" }],
});
console.log(r.choices[0].message.content);
Die TypeScript-Beispiele auf dieser Seite sind ES-Module: Speichere eins als main.mts und führ npx tsx main.mts aus.
Streaming
Füg stream=True hinzu. Die Token-Zahlen kommen im letzten Chunk, der auch ohne choices ankommen kann, also prüf zuerst chunk.choices.
stream = client.chat.completions.create(
model="claude-opus-5.5",
messages=[{"role": "user", "content": "Write a haiku about caching"}],
stream=True,
)
for chunk in stream:
if chunk.choices:
print(chunk.choices[0].delta.content or "", end="")Die Responses API funktioniert auch: client.responses.create(...).
Anthropic SDK
Nutz dieselbe Basis-URL wie überall. Das SDK hängt /v1/messages an, und das passt so. Manche Modelle senden vor dem Text einen Thinking-Block, daher gibt das Beispiel nur die Textblöcke aus.
from anthropic import Anthropic
client = Anthropic(
base_url="https://api.tokenlowcost.com/v1",
api_key="sk-tlc-your-key",
)
msg = client.messages.create(
model="claude-opus-5.5",
max_tokens=512,
messages=[{"role": "user", "content": "Hello"}],
)
for block in msg.content:
if block.type == "text":
print(block.text)
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic({
baseURL: "https://api.tokenlowcost.com/v1",
apiKey: "sk-tlc-your-key",
});
const msg = await client.messages.create({
model: "claude-opus-5.5",
max_tokens: 512,
messages: [{ role: "user", content: "Hello" }],
});
for (const block of msg.content) {
if (block.type === "text") console.log(block.text);
}
cURL
Derselbe Schlüssel funktioniert in allen drei Anfrageformaten.
curl https://api.tokenlowcost.com/v1/chat/completions \
-H "Authorization: Bearer sk-tlc-your-key" \
-H "Content-Type: application/json" \
-d '{"model": "claude-opus-5.5", "messages": [{"role": "user", "content": "Hello"}]}'
curl https://api.tokenlowcost.com/v1/messages \
-H "x-api-key: sk-tlc-your-key" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{"model": "claude-opus-5.5", "max_tokens": 256, "messages": [{"role": "user", "content": "Hello"}]}'
curl https://api.tokenlowcost.com/v1/responses \
-H "Authorization: Bearer sk-tlc-your-key" \
-H "Content-Type: application/json" \
-d '{"model": "gpt-6-sol", "input": "Hello"}'
Guthaben und die letzten 20 Anfragen abrufen:
curl https://api.tokenlowcost.com/v1/me -H "Authorization: Bearer sk-tlc-your-key"
Fehler
Wenn etwas schiefgeht, bekommst du einen Statuscode und eine kurze Meldung.
| Code | Bedeutung | Was tun |
|---|---|---|
| 401 | Der Schlüssel fehlt, ist falsch oder widerrufen. | Prüf, ob du den ganzen Schlüssel eingefügt hast. |
| 402 | Der Schlüssel hat sein Ausgabelimit erreicht, oder dein Guthaben ist $0. | Lade auf oder erstell einen Schlüssel mit höherem Limit. |
| 403 | Der Schlüssel ist abgelaufen oder das Konto gesperrt. Die Meldung sagt, was davon. | Ist er abgelaufen, erstell einen neuen Schlüssel. Sperren sind in den Regeln erklärt. |
| 400 | Wenn die Meldung sagt, dass der Prompt zu lang ist: Die Anfrage ist größer als das Kontextfenster des Schlüssels. Sie wird nicht berechnet. | Starte einen neuen Chat oder nutze einen Schlüssel mit größerem Fenster. |
| 404 | Falsche Adresse. | Prüf den Teil nach /v1. |
| Andere | Unverändert vom Modellanbieter weitergegeben, etwa wenn er überlastet ist. | Versuch es in einer Minute noch einmal. |
Ausgabelimits und Ablaufdaten legst du pro Schlüssel im Dashboard fest. Dein Guthaben findest du unter Abrechnung.
Bereit zum Verbinden?
Leg ein Konto an, hol dir $50 Guthaben und erstell deinen ersten Schlüssel. Das dauert etwa eine Minute.