Dokumentacja

Podłącz narzędzie w minutę.

Każde narzędzie potrzebuje tych samych dwóch rzeczy: bazowego URL-a poniżej i klucza. Wybierz narzędzie i wykonaj kroki.

Bazowy URL · ten sam dla każdego narzędziahttps://api.tokenlowcost.com/v1
Klucz API · jeden klucz na modelsk-tlc-…

Szybki start

Około minuty
  1. Utwórz klucz

    W panelu wybierz model i kliknij Utwórz klucz. Od razu skopiuj klucz: jest pokazywany tylko raz.

  2. Skonfiguruj narzędzie

    Znajdź swoje narzędzie poniżej. Zaraz po utworzeniu klucza panel pokaże te same kroki z już wpisanym kluczem.

  3. Zacznij pracę

    Korzystaj z narzędzia jak zwykle. Każde zapytanie jest opłacane z salda, a panel pokazuje je razem z kosztem.

Modele

W rankingu, najlepsze najpierw

Każdy klucz działa z jednym modelem: tym, który wybierzesz przy jego tworzeniu. Ten model odpowiada na każde zapytanie wysłane z tym kluczem, niezależnie od nazwy modelu, którą wyśle narzędzie. Chcesz dwóch modeli? Utwórz dwa klucze.

Z tego samego powodu GET /v1/models zwraca tylko model twojego klucza. Narzędzia z listą modeli, takie jak Cline i Roo Code, pokażą tylko ten jeden.

Wszystkie modele i ich ceny znajdziesz w cenniku.

Płatności i limity

Przedpłata · za tokeny

Najpierw doładowujesz saldo. Nowe konta dostają bonus powitalny $50, jeden na osobę. Każde zapytanie kosztuje tyle, ile jego tokeny w cenie twojego modelu, a ta kwota schodzi z salda. Panel pokazuje każde zapytanie z tokenami i kosztem.

Powtarzany tekst kosztuje mniej. Gdy model niedawno widział początek promptu, te tokeny są rozliczane po tańszej stawce cache. Narzędzia do kodowania wysyłają ten sam kontekst raz za razem, więc oszczędność jest duża.

Kiedy zapytania są wstrzymywane

Co się stałoSkutek
Osiągnięto limit klucza402 dla tego klucza. Pozostałe klucze działają dalej.
Klucz wygasł403 dla tego klucza.
Klucz unieważnionyOd razu 401. Tego nie da się cofnąć.
Saldo $0402 dla wszystkich kluczy, dopóki nie doładujesz salda. Saldo nigdy nie spada poniżej zera.
Konto zablokowane403 dla wszystkich kluczy i nie da się zalogować. Blokada grozi za złamanie zasad.

Kontekst i rozumowanie

Opcjonalnie, dla każdego klucza

Przy tworzeniu klucza możesz też wybrać te dwa ustawienia. Okno dialogowe pokazuje, ile kosztuje wejście promptu, który wypełnia wybrane okno kontekstu.

UstawienieCo robi
Okno kontekstuIle tekstu mieści jedno zapytanie, od 128K tokenów do maksimum modelu. To limit klucza: sam model się nie zmienia. Zapytania ponad limit są odrzucane i nic nie kosztują. Rozmiar jest szacowany, więc może się różnić o kilka procent.
Poziom rozumowaniaJak intensywnie model myśli, zanim odpowie. Przy opcji Jak w aplikacji decyduje narzędzie. Stały poziom obowiązuje dla każdego zapytania z tym kluczem. Więcej myślenia to więcej tokenów wyjściowych, więc drożej.

Kroki konfiguracji w panelu przekazują oba ustawienia do narzędzia.

Długie czaty kosztują więcej. Narzędzia do kodowania wysyłają cały czat przy każdym kroku, więc każdy krok kosztuje trochę więcej niż poprzedni, dopóki narzędzie nie skróci czatu. Przy mniejszym oknie kontekstu dzieje się to wcześniej. Niektóre modele liczą też więcej za bardzo długie prompty; cennik pokazuje, od kiedy.
Cu

Cursor

Settings → Models
  1. Otwórz ustawienia

    W Cursorze otwórz Settings → Models i przewiń w dół do API Keys.

  2. Wklej klucz i bazowy URL

    Wklej klucz w pole OpenAI API Key. Włącz Override OpenAI Base URL i wklej bazowy URL.

    OpenAI API Key            sk-tlc-your-key
    Override OpenAI Base URL  on
    Base URL                  https://api.tokenlowcost.com/v1
  3. Dodaj nazwę modelu

    Kliknij + Add model, wpisz nazwę, np. tlc-opus, i ją włącz. Nazwa to tylko etykieta: model wybiera twój klucz. Użyj nazwy, której Cursor jeszcze nie ma, żeby zapytanie poszło z twoim kluczem.

  4. Sprawdź i rozmawiaj

    Kliknij Verify obok klucza. Potem wybierz swój model w czacie.

VS

VS Code

Wbudowany czat · bez rozszerzeń i konta GitHub

Wbudowany czat VS Code może korzystać z twojego klucza. Potrzebujesz VS Code 1.122 lub nowszego. Jeśli przy pierwszym uruchomieniu VS Code poprosi o zalogowanie, kliknij Continue without Signing In.

  1. Dodaj własny endpoint

    Naciśnij Ctrl + Shift + P (Cmd na Macu) i uruchom Chat: Manage Language Models. Kliknij Add Models, a potem Custom Endpoint.

  2. Wpisz nazwę i klucz

    Nazwij go TokenLowCost i wklej klucz. Przy API Type po prostu naciśnij Enter.

  3. Wklej model

    VS Code otworzy plik z pustym modelem. Zastąp jego część "models": [ … ] blokiem poniżej i zapisz. Panel daje ten blok gotowy dla twojego klucza zaraz po jego utworzeniu. Kopiujesz stąd? Weź blok Claude dla modeli Claude, drugi dla pozostałych, i zmień id oraz name na swój model.

    
                  
    
                
  4. Wybierz model

    Otwórz czat, kliknij nazwę modelu w polu wiadomości i wybierz swój model.

VS Code trzyma klucz w bezpiecznym magazynie, nie w pliku. Czat działa w pełni, łącznie z trybem agenta. Szare podpowiedzi pojawiające się podczas pisania nie są objęte: dostarcza je tylko GitHub Copilot.

Nie logujesz się do GitHuba? Wtedy VS Code pokaże Set BYOK utility models. Kliknij Configure i wybierz Main Agent Model, żeby tytuły czatów i opisy commitów też tworzył twój model. To małe zapytania, rozliczane jak każde inne.

Claude Code lub Codex w VS Code

Rozszerzenia Claude Code i Codex używają tych samych ustawień co ich wersje terminalowe. Najpierw wklej linię dla Claude Code lub Codexa, potem zainstaluj rozszerzenie i uruchom ponownie VS Code. W przypadku Claude Code otwórz też Settings, wyszukaj Claude Code login i zaznacz Disable Login Prompt.

CC

Claude Code

Jedna wklejona linia

Jedna linia zapisuje bazowy URL, twój klucz i model klucza, a każdy nowy terminal je pobiera. Linia poniżej jest dla klucza Claude Opus 5.5 i zawiera przykładowy klucz. Panel pokaże ją dopasowaną do twojego klucza: z jego modelem, oknem kontekstu i poziomem rozumowania.


          

        
  1. Wklej linię

    Wklej ją do PowerShella (Windows) lub Terminala (macOS, Linux) i naciśnij Enter.

  2. Uruchom Claude Code

    Uruchom claude w tym samym oknie. Za pierwszym razem naciśnij Enter na ekranach stylu tekstu i bezpieczeństwa. Gdy zapyta, czy ufasz folderowi, naciśnij ↓, aby wybrać Yes, I trust this folder, a potem Enter: domyślnie zaznaczone No, exit zamyka Claude Code. Konto Anthropic nie jest potrzebne.

Nie masz jeszcze Claude Code? W PowerShellu uruchom irm https://claude.ai/install.ps1 | iex. W macOS lub Linuksie uruchom curl -fsSL https://claude.ai/install.sh | bash. Jeśli instalator napisze, że jego folderu nie ma w PATH, zrób to, co pokazuje. Jeśli używasz terminala w VS Code lub Cursorze, uruchom ponownie edytor po wklejeniu linii.

Po co nazwa modelu? Bez niej Claude Code myśli, że rozmawia z Claude Opus 5.5, niezależnie od modelu twojego klucza. Mówi to modelowi i podpisuje commity tą nazwą. Z nazwą zna prawdziwy model. Jeśli model to nie Claude, Claude Code może napisać, że go nie rozpoznaje. To nic: z nazwy zna tylko modele Claude, a zapytania i tak działają.

Wolisz plik? Wpisz to do ~/.claude/settings.json (w Windows: %USERPROFILE%\.claude\settings.json):

{
  "env": {
    "ANTHROPIC_BASE_URL": "https://api.tokenlowcost.com/v1",
    "ANTHROPIC_AUTH_TOKEN": "sk-tlc-your-key",
    "ANTHROPIC_MODEL": "claude-opus-5-5[1m]"
  }
}

Ustaw w ANTHROPIC_MODEL model twojego klucza: claude-opus-5-5, claude-sonnet-5, claude-haiku-4-5, a dla innych modeli ID z cennika, np. gpt-6-sol. Dodaj na końcu [1m], jeśli okno klucza przekracza 200K.

Claude Code wysyła też małe zapytania w tle, np. o tytuły czatów. Używają modelu twojego klucza i są rozliczane jak każde inne zapytanie.

Cx

Codex

Jedna wklejona linia

Jedna linia zapisuje plik ustawień Codexa i twój klucz. Jeśli masz już konfigurację Codexa, zostanie zachowana jako config.toml.bak. Ta linia zawiera przykładowy klucz; panel pokaże ją z twoim.


          

        

Wklej ją do PowerShella (Windows) lub Terminala (macOS, Linux) i naciśnij Enter. Potem uruchom codex w tym samym oknie i wybierz Trust and continue. Konto ChatGPT nie jest potrzebne.

Nie masz jeszcze Codexa? Zainstaluj go poleceniem npm install -g @openai/codex. Codex działa najlepiej z modelami OpenAI, np. GPT-6 Sol.

Wolisz edytować plik samodzielnie? Oto co linia zapisuje w ~/.codex/config.toml. Jeśli dodajesz to do istniejącego pliku, pierwsze linie muszą być nad każdą [section].

Codex odczytuje klucz ze zmiennej środowiskowej TOKENLOWCOST_API_KEY, którą linia też ustawia. Ustaw ją także samodzielnie: dodaj export TOKENLOWCOST_API_KEY=sk-tlc-your-key do ~/.zshrc lub ~/.bashrc, a w Windows uruchom setx TOKENLOWCOST_API_KEY sk-tlc-your-key i otwórz nowe okno.

Cl

Cline, Roo Code i Continue

Rozszerzenia do VS Code i JetBrains

W Cline lub Roo Code otwórz ustawienia dostawcy i wypełnij pola poniżej. Przy pierwszym uruchomieniu Cline wybierz Bring my own API key, żeby tam trafić. Po wpisaniu klucza lista modeli pokaże tylko model twojego klucza: wybierz go.

API Provider  OpenAI Compatible
Base URL      https://api.tokenlowcost.com/v1
API Key       sk-tlc-your-key
Model ID      anthropic/claude-opus-5.5

Cline pokazuje koszt $0, bo nie zna naszych cen. Prawdziwy koszt znajdziesz w sekcji Użycie w panelu.

Roo Code zawiesza się na API Request…? W VS Code 1.122 i nowszym Roo Code 3.54 nie znajduje narzędzia wyszukiwania plików, które VS Code przeniósł, niezależnie od dostawcy. To zgłoszenie w VS Code opisuje obejście. Cline nie ma tego problemu.

W Continue wpisz to do ~/.continue/config.yaml w miejsce obecnej zawartości. Masz już tam modele? Dodaj tylko wpis TokenLowCost pod models:. Linia tool_use pozwala trybowi Agent edytować pliki; bez niej Continue nie wie, że model ma narzędzia.

name: My Config
version: 0.0.1
schema: v1
models:
  - name: TokenLowCost
    provider: openai
    model: tlc-opus
    apiBase: https://api.tokenlowcost.com/v1
    apiKey: sk-tlc-your-key
    capabilities:
      - tool_use

Każde inne narzędzie z opcją OpenAI Compatible działa tak samo.

OA

OpenAI SDK

Python i TypeScript

Ustaw bazowy URL i klucz. Reszta to zwykły kod SDK.

from openai import OpenAI

client = OpenAI(
    base_url="https://api.tokenlowcost.com/v1",
    api_key="sk-tlc-your-key",
)

r = client.chat.completions.create(
    model="claude-opus-5.5",
    messages=[{"role": "user", "content": "Hello"}],
)
print(r.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.tokenlowcost.com/v1",
  apiKey: "sk-tlc-your-key",
});

const r = await client.chat.completions.create({
  model: "claude-opus-5.5",
  messages: [{ role: "user", content: "Hello" }],
});
console.log(r.choices[0].message.content);

Przykłady w TypeScripcie na tej stronie to moduły ES: zapisz jeden jako main.mts i uruchom npx tsx main.mts.

Streaming

Dodaj stream=True. Liczba tokenów przychodzi w ostatnim chunku, który może nie mieć choices, więc najpierw sprawdź chunk.choices.

stream = client.chat.completions.create(
    model="claude-opus-5.5",
    messages=[{"role": "user", "content": "Write a haiku about caching"}],
    stream=True,
)
for chunk in stream:
    if chunk.choices:
        print(chunk.choices[0].delta.content or "", end="")

Responses API też działa: client.responses.create(...).

An

Anthropic SDK

Python i TypeScript

Użyj tego samego bazowego URL-a co wszędzie. SDK doda do niego /v1/messages i tak ma być. Niektóre modele wysyłają blok myślenia przed tekstem, więc przykład wypisuje tylko bloki tekstowe.

from anthropic import Anthropic

client = Anthropic(
    base_url="https://api.tokenlowcost.com/v1",
    api_key="sk-tlc-your-key",
)

msg = client.messages.create(
    model="claude-opus-5.5",
    max_tokens=512,
    messages=[{"role": "user", "content": "Hello"}],
)
for block in msg.content:
    if block.type == "text":
        print(block.text)
import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic({
  baseURL: "https://api.tokenlowcost.com/v1",
  apiKey: "sk-tlc-your-key",
});

const msg = await client.messages.create({
  model: "claude-opus-5.5",
  max_tokens: 512,
  messages: [{ role: "user", content: "Hello" }],
});
for (const block of msg.content) {
  if (block.type === "text") console.log(block.text);
}
$_

cURL

Zwykłe zapytania HTTP

Ten sam klucz działa we wszystkich trzech formatach zapytań.

curl https://api.tokenlowcost.com/v1/chat/completions \
  -H "Authorization: Bearer sk-tlc-your-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "claude-opus-5.5", "messages": [{"role": "user", "content": "Hello"}]}'
curl https://api.tokenlowcost.com/v1/messages \
  -H "x-api-key: sk-tlc-your-key" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{"model": "claude-opus-5.5", "max_tokens": 256, "messages": [{"role": "user", "content": "Hello"}]}'
curl https://api.tokenlowcost.com/v1/responses \
  -H "Authorization: Bearer sk-tlc-your-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "gpt-6-sol", "input": "Hello"}'

Sprawdź saldo i ostatnie 20 zapytań:

curl https://api.tokenlowcost.com/v1/me -H "Authorization: Bearer sk-tlc-your-key"

Błędy

Co oznaczają i co zrobić

Gdy coś pójdzie nie tak, dostajesz kod statusu i krótki komunikat.

KodCo oznaczaCo zrobić
401Brak klucza albo klucz jest błędny lub unieważniony.Sprawdź, czy wklejono cały klucz.
402Klucz osiągnął limit wydatków albo saldo wynosi $0.Doładuj saldo albo utwórz klucz z wyższym limitem.
403Klucz wygasł albo konto jest zablokowane. Komunikat mówi, co się stało.Jeśli wygasł, utwórz nowy klucz. Blokady są opisane w zasadach.
400Jeśli komunikat mówi, że prompt jest za długi: zapytanie przekracza okno kontekstu klucza. Nie jest rozliczane.Zacznij nowy czat albo użyj klucza z większym oknem.
404Błędny adres.Sprawdź część po /v1.
InnePrzekazywane bez zmian od dostawcy modelu, np. gdy jest przeciążony.Spróbuj ponownie za minutę.

Limity wydatków i daty ważności ustawiasz dla każdego klucza w panelu. Saldo znajdziesz w sekcji Płatności.

Pora się podłączyć?

Załóż konto, odbierz $50 na saldo i utwórz pierwszy klucz. To zajmie około minuty.

Uzyskaj klucz API