Collega il tuo strumento in un minuto.
Ogni strumento ha bisogno delle stesse due cose: l'URL di base qui sotto e la tua chiave. Scegli il tuo strumento e segui i passaggi.
https://api.tokenlowcost.com/v1Avvio rapido
-
Crea una chiave
Nella dashboard, scegli un modello e fai clic su Crea chiave. Copia subito la chiave: viene mostrata una sola volta.
-
Configura il tuo strumento
Trova il tuo strumento qui sotto. Subito dopo aver creato una chiave, la dashboard mostra gli stessi passaggi con la chiave già inserita.
-
Inizia a lavorare
Usa il tuo strumento come sempre. Ogni richiesta viene pagata dal saldo e la dashboard la mostra con il suo costo.
Modelli
Ogni chiave funziona con un modello: quello che scegli quando la crei. Quel modello risponde a ogni richiesta fatta con la chiave, qualunque nome di modello invii il tuo strumento. Vuoi due modelli? Crea due chiavi.
Per lo stesso motivo, GET /v1/models elenca solo il modello della tua chiave. Gli strumenti che mostrano un elenco di modelli, come Cline e Roo Code, offrono solo quello.
Tutti i modelli e i loro prezzi sono nella pagina dei prezzi.
Fatturazione e limiti
Prima aggiungi denaro al tuo saldo. I nuovi account partono con $50 di credito di benvenuto, uno per persona. Ogni richiesta costa i suoi token al prezzo del tuo modello, e l'importo viene scalato dal saldo. La dashboard elenca ogni richiesta con token e costo.
Quando le richieste si fermano
| Cosa è successo | Risultato |
|---|---|
| Limite della chiave raggiunto | 402 per quella chiave. Le altre chiavi continuano a funzionare. |
| Chiave scaduta | 403 per quella chiave. |
| Chiave revocata | 401 subito. Non si può annullare. |
| Saldo a $0 | 402 per tutte le chiavi finché non ricarichi. Il saldo non scende mai sotto zero. |
| Account bloccato | 403 per tutte le chiavi e non puoi accedere. Si viene bloccati per aver violato le regole. |
Contesto e sforzo
Quando crei una chiave, puoi scegliere anche queste due impostazioni. La finestra di dialogo mostra quanto costa l'input di un prompt che riempie la finestra scelta.
| Impostazione | Cosa fa |
|---|---|
| Finestra di contesto | Quanto testo può contenere una richiesta, da 128K token fino al massimo del modello. È un limite della chiave: il modello in sé non cambia. Le richieste oltre il limite vengono rifiutate e non costano nulla. La dimensione è stimata, quindi può scostarsi di qualche punto percentuale. |
| Sforzo | Quanto il modello ragiona prima di rispondere. Con Come nell'app decide il tuo strumento. Un livello fisso vale per ogni richiesta fatta con la chiave. Più ragionamento significa più token di output, quindi costa di più. |
I passaggi di configurazione nella dashboard trasmettono entrambe le impostazioni al tuo strumento.
Cursor
Apri le impostazioni
In Cursor, apri Settings → Models e scorri fino a API Keys.
-
Incolla la chiave e l'URL di base
Incolla la chiave in OpenAI API Key. Attiva Override OpenAI Base URL e incolla l'URL di base.
OpenAI API Key sk-tlc-your-key Override OpenAI Base URL on Base URL https://api.tokenlowcost.com/v1
Aggiungi un nome di modello
Fai clic su + Add model, digita un nome come
tlc-opuse attivalo. Il nome è solo un'etichetta: il modello lo decide la tua chiave. Usa un nome che Cursor non ha già, così la richiesta parte con la tua chiave.Verifica e chatta
Fai clic su Verify accanto alla chiave. Poi scegli il tuo modello nella chat.
VS Code
La chat integrata in VS Code può usare la tua chiave. Serve VS Code 1.122 o successivo. Se al primo avvio VS Code ti chiede di accedere, fai clic su Continue without Signing In.
Aggiungi un endpoint personalizzato
Premi Ctrl + Maiusc + P (Cmd su Mac) ed esegui Chat: Manage Language Models. Fai clic su Add Models, poi su Custom Endpoint.
Inserisci un nome e la tua chiave
Chiamalo TokenLowCost e incolla la chiave. Su API Type, premi semplicemente Invio.
-
Incolla il modello
VS Code apre un file con un modello vuoto. Sostituisci la parte
"models": [ … ]con il blocco qui sotto e salva. La dashboard ti dà questo blocco già pronto per la tua chiave, subito dopo averla creata. Copi da qui? Usa il blocco Claude per i modelli Claude, l'altro per il resto, e cambiaidenamecon quelli del tuo modello. Scegli il modello
Apri la chat, fai clic sul nome del modello nella casella del messaggio e scegli il tuo modello.
Non hai fatto l'accesso a GitHub? Allora VS Code mostra Set BYOK utility models. Fai clic su Configure e scegli Main Agent Model, così anche i titoli delle chat e i messaggi di commit usano il tuo modello. Sono richieste piccole, addebitate come tutte le altre.
Claude Code o Codex in VS Code
Le estensioni Claude Code e Codex usano le stesse impostazioni delle loro versioni da terminale. Incolla prima la riga di Claude Code o di Codex, poi installa l'estensione e riavvia VS Code. Per Claude Code, apri anche Settings, cerca Claude Code login e spunta Disable Login Prompt.
Claude Code
Una riga salva l'URL di base, la tua chiave e il modello della chiave, e ogni nuovo terminale li usa. La riga qui sotto è per una chiave Claude Opus 5.5 e contiene una chiave segnaposto. La dashboard la mostra fatta per la tua chiave: modello, finestra di contesto e sforzo.
Incolla la riga
Incollala in PowerShell (Windows) o nel Terminale (macOS, Linux) e premi Invio.
Avvia Claude Code
Esegui
claudenella stessa finestra. La prima volta, premi Invio nelle schermate dello stile del testo e della sicurezza. Quando chiede se ti fidi della cartella, premi ↓ per scegliere Yes, I trust this folder, poi Invio: l'opzione preselezionata, No, exit, chiude Claude Code. Non ti serve un account Anthropic.
irm https://claude.ai/install.ps1 | iex. Su macOS o Linux, esegui curl -fsSL https://claude.ai/install.sh | bash. Se il programma di installazione dice che la sua cartella non è nel PATH, fai quello che indica. Se usi il terminale di VS Code o Cursor, riavvia l'editor dopo aver incollato la riga.Perché il nome del modello? Senza, Claude Code pensa di parlare con Claude Opus 5.5, qualunque sia il modello della tua chiave. Lo dice al modello e firma i commit con quel nome. Con il nome, conosce il modello reale. Se il modello non è un Claude, Claude Code potrebbe dire di non riconoscerlo. Va bene così: conosce per nome solo i modelli Claude, e le richieste funzionano comunque.
Preferisci un file? Metti questo in ~/.claude/settings.json (su Windows, %USERPROFILE%\.claude\settings.json):
{
"env": {
"ANTHROPIC_BASE_URL": "https://api.tokenlowcost.com/v1",
"ANTHROPIC_AUTH_TOKEN": "sk-tlc-your-key",
"ANTHROPIC_MODEL": "claude-opus-5-5[1m]"
}
}Imposta ANTHROPIC_MODEL sul modello della tua chiave: claude-opus-5-5, claude-sonnet-5, claude-haiku-4-5 o, per gli altri modelli, l'ID del listino, come gpt-6-sol. Aggiungi [1m] alla fine se la finestra della chiave supera i 200K.
Claude Code invia anche piccole richieste in background, come i titoli delle chat. Usano il modello della tua chiave e sono addebitate come qualsiasi altra richiesta.
Codex
Una riga scrive il file di impostazioni di Codex e salva la tua chiave. Se hai già una configurazione di Codex, viene conservata come config.toml.bak. Questa riga contiene una chiave segnaposto; la dashboard la mostra con la tua.
Incollala in PowerShell (Windows) o nel Terminale (macOS, Linux) e premi Invio. Poi esegui codex nella stessa finestra e scegli Trust and continue. Non ti serve un account ChatGPT.
npm install -g @openai/codex. Codex funziona meglio con i modelli OpenAI, come GPT-6 Sol.Preferisci modificare il file a mano? Ecco cosa scrive la riga in ~/.codex/config.toml. Se lo aggiungi a un file esistente, tieni le prime righe sopra qualsiasi [section].
Codex legge la chiave dalla variabile d'ambiente TOKENLOWCOST_API_KEY, che la riga imposta anche. Impostala anche tu: aggiungi export TOKENLOWCOST_API_KEY=sk-tlc-your-key a ~/.zshrc o ~/.bashrc, oppure su Windows esegui setx TOKENLOWCOST_API_KEY sk-tlc-your-key e apri una nuova finestra.
Cline, Roo Code e Continue
In Cline o Roo Code, apri le impostazioni del provider e compila i campi qui sotto. La prima volta che apri Cline, scegli Bring my own API key per arrivarci. Inserita la chiave, l'elenco dei modelli mostra solo il modello della tua chiave: selezionalo.
API Provider OpenAI Compatible Base URL https://api.tokenlowcost.com/v1 API Key sk-tlc-your-key Model ID anthropic/claude-opus-5.5
Cline mostra il costo come $0, perché non conosce i nostri prezzi. Il costo reale è in Utilizzo, nella tua dashboard.
Per Continue, metti questo in ~/.continue/config.yaml al posto del contenuto attuale. Hai già dei modelli? Aggiungi solo la voce TokenLowCost sotto models:. La riga tool_use permette alla modalità Agent di modificare i file; senza, Continue non sa che il modello ha degli strumenti.
name: My Config
version: 0.0.1
schema: v1
models:
- name: TokenLowCost
provider: openai
model: tlc-opus
apiBase: https://api.tokenlowcost.com/v1
apiKey: sk-tlc-your-key
capabilities:
- tool_useQualsiasi altro strumento con l'opzione OpenAI Compatible funziona allo stesso modo.
OpenAI SDK
Imposta l'URL di base e la tua chiave. Il resto è il solito codice dell'SDK.
from openai import OpenAI
client = OpenAI(
base_url="https://api.tokenlowcost.com/v1",
api_key="sk-tlc-your-key",
)
r = client.chat.completions.create(
model="claude-opus-5.5",
messages=[{"role": "user", "content": "Hello"}],
)
print(r.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.tokenlowcost.com/v1",
apiKey: "sk-tlc-your-key",
});
const r = await client.chat.completions.create({
model: "claude-opus-5.5",
messages: [{ role: "user", content: "Hello" }],
});
console.log(r.choices[0].message.content);
Gli esempi TypeScript di questa pagina sono moduli ES: salvane uno come main.mts ed esegui npx tsx main.mts.
Streaming
Aggiungi stream=True. Il conteggio dei token arriva nell'ultimo chunk, che può arrivare senza choices, quindi controlla prima chunk.choices.
stream = client.chat.completions.create(
model="claude-opus-5.5",
messages=[{"role": "user", "content": "Write a haiku about caching"}],
stream=True,
)
for chunk in stream:
if chunk.choices:
print(chunk.choices[0].delta.content or "", end="")Funziona anche la Responses API: client.responses.create(...).
Anthropic SDK
Usa lo stesso URL di base di sempre. L'SDK ci aggiunge /v1/messages, e va bene così. Alcuni modelli inviano un blocco di ragionamento prima del testo, quindi l'esempio stampa solo i blocchi di testo.
from anthropic import Anthropic
client = Anthropic(
base_url="https://api.tokenlowcost.com/v1",
api_key="sk-tlc-your-key",
)
msg = client.messages.create(
model="claude-opus-5.5",
max_tokens=512,
messages=[{"role": "user", "content": "Hello"}],
)
for block in msg.content:
if block.type == "text":
print(block.text)
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic({
baseURL: "https://api.tokenlowcost.com/v1",
apiKey: "sk-tlc-your-key",
});
const msg = await client.messages.create({
model: "claude-opus-5.5",
max_tokens: 512,
messages: [{ role: "user", content: "Hello" }],
});
for (const block of msg.content) {
if (block.type === "text") console.log(block.text);
}
cURL
La stessa chiave funziona in tutti e tre i formati di richiesta.
curl https://api.tokenlowcost.com/v1/chat/completions \
-H "Authorization: Bearer sk-tlc-your-key" \
-H "Content-Type: application/json" \
-d '{"model": "claude-opus-5.5", "messages": [{"role": "user", "content": "Hello"}]}'
curl https://api.tokenlowcost.com/v1/messages \
-H "x-api-key: sk-tlc-your-key" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{"model": "claude-opus-5.5", "max_tokens": 256, "messages": [{"role": "user", "content": "Hello"}]}'
curl https://api.tokenlowcost.com/v1/responses \
-H "Authorization: Bearer sk-tlc-your-key" \
-H "Content-Type: application/json" \
-d '{"model": "gpt-6-sol", "input": "Hello"}'
Controlla il saldo e le ultime 20 richieste:
curl https://api.tokenlowcost.com/v1/me -H "Authorization: Bearer sk-tlc-your-key"
Errori
Quando qualcosa va storto, ricevi un codice di stato e un breve messaggio.
| Codice | Cosa significa | Cosa fare |
|---|---|---|
| 401 | La chiave manca, è errata o è stata revocata. | Controlla di aver incollato la chiave intera. |
| 402 | La chiave ha raggiunto il limite di spesa, oppure il saldo è $0. | Ricarica, oppure crea una chiave con un limite più alto. |
| 403 | La chiave è scaduta oppure l'account è bloccato. Il messaggio dice quale dei due. | Se è scaduta, crea una nuova chiave. I blocchi sono spiegati nelle regole. |
| 400 | Se il messaggio dice che il prompt è troppo lungo: la richiesta supera la finestra di contesto della chiave. Non viene addebitata. | Inizia una nuova chat, oppure usa una chiave con una finestra più ampia. |
| 404 | Indirizzo errato. | Controlla la parte dopo /v1. |
| Altri | Inoltrato così com'è dal fornitore del modello, ad esempio quando è sovraccarico. | Riprova tra un minuto. |
Limiti di spesa e date di scadenza si impostano per chiave nella dashboard. Il saldo è in Fatturazione.
Tutto pronto per collegarti?
Crea un account, ricevi $50 di credito e crea la tua prima chiave. Ci vuole circa un minuto.