Documentación

Conecta tu herramienta en un minuto.

Todas las herramientas necesitan lo mismo: la URL base de abajo y tu clave. Elige tu herramienta y sigue los pasos.

URL base · la misma para todas las herramientashttps://api.tokenlowcost.com/v1
Clave de API · una clave por modelosk-tlc-…

Inicio rápido

Un minuto, más o menos
  1. Crea una clave

    En el panel, elige un modelo y haz clic en Crear clave. Copia la clave enseguida: solo se muestra una vez.

  2. Configura tu herramienta

    Busca tu herramienta abajo. Justo después de crear una clave, el panel muestra los mismos pasos con tu clave ya puesta.

  3. Empieza a trabajar

    Usa tu herramienta como siempre. Cada solicitud se paga con tu saldo, y el panel la muestra con su coste.

Modelos

Ordenados, los mejores primero

Cada clave funciona con un modelo: el que eliges al crearla. Ese modelo responde a todas las solicitudes hechas con la clave, sea cual sea el nombre de modelo que envíe tu herramienta. ¿Quieres dos modelos? Crea dos claves.

Por la misma razón, GET /v1/models solo muestra el modelo de tu clave. Las herramientas que muestran una lista de modelos, como Cline y Roo Code, ofrecen solo ese.

Todos los modelos y sus precios están en la página de precios.

Facturación y límites

Prepago · por token

Primero añades dinero a tu saldo. Las cuentas nuevas empiezan con $50 de crédito de bienvenida, uno por persona. Cada solicitud cuesta lo que suman sus tokens al precio de tu modelo, y ese importe se descuenta del saldo. El panel muestra cada solicitud con sus tokens y su coste.

El texto repetido cuesta menos. Cuando el modelo ha visto hace poco el inicio de un prompt, esos tokens se cobran a la tarifa de caché, más barata. Las herramientas de programación envían el mismo contexto una y otra vez, así que se ahorra mucho.

Cuándo se detienen las solicitudes

Qué pasóResultado
Límite de la clave alcanzado402 para esa clave. Tus otras claves siguen funcionando.
Clave caducada403 para esa clave.
Clave revocada401 al instante. No se puede deshacer.
Saldo en $0402 para todas las claves hasta que recargues. El saldo nunca baja de cero.
Cuenta bloqueada403 para todas las claves, y no puedes iniciar sesión. Los bloqueos son por incumplir las normas.

Contexto y esfuerzo

Opcional, por clave

Al crear una clave también puedes elegir estos dos ajustes. El diálogo muestra cuánto cuesta la entrada de un prompt que llena la ventana elegida.

AjusteQué hace
Ventana de contextoCuánto texto cabe en una solicitud, desde 128K tokens hasta el máximo del modelo. Es un límite de la clave: el modelo en sí no cambia. Las solicitudes que lo superan se rechazan y no cuestan nada. El tamaño es una estimación, así que puede desviarse un pequeño porcentaje.
EsfuerzoCuánto piensa el modelo antes de responder. Con Según la app, decide tu herramienta. Un nivel fijo se aplica a todas las solicitudes hechas con la clave. Pensar más significa más tokens de salida, así que cuesta más.

Los pasos de configuración del panel transmiten ambos ajustes a tu herramienta.

Los chats largos cuestan más. Las herramientas de programación envían todo el chat en cada paso, así que cada paso cuesta un poco más que el anterior, hasta que la herramienta acorta el chat. Con una ventana de contexto más pequeña eso ocurre antes. Algunos modelos también cobran más por prompts muy largos; la página de precios indica a partir de dónde.
Cu

Cursor

Settings → Models
  1. Abre los ajustes

    En Cursor, abre Settings → Models y baja hasta API Keys.

  2. Pega tu clave y la URL base

    Pega tu clave en OpenAI API Key. Activa Override OpenAI Base URL y pega la URL base.

    OpenAI API Key            sk-tlc-your-key
    Override OpenAI Base URL  on
    Base URL                  https://api.tokenlowcost.com/v1
  3. Añade un nombre de modelo

    Haz clic en + Add model, escribe un nombre como tlc-opus y actívalo. El nombre es solo una etiqueta: el modelo lo decide tu clave. Usa un nombre que Cursor no tenga ya, para que la solicitud salga con tu clave.

  4. Verifica y chatea

    Haz clic en Verify junto a la clave. Luego elige tu modelo en el chat.

VS

VS Code

Chat integrado · sin extensión ni cuenta de GitHub

El chat integrado en VS Code puede usar tu clave. Necesitas VS Code 1.122 o posterior. Si VS Code te pide iniciar sesión la primera vez que se abre, haz clic en Continue without Signing In.

  1. Añade un endpoint personalizado

    Pulsa Ctrl + Mayús + P (Cmd en Mac) y ejecuta Chat: Manage Language Models. Haz clic en Add Models y luego en Custom Endpoint.

  2. Escribe un nombre y tu clave

    Llámalo TokenLowCost y pega tu clave. En API Type, simplemente pulsa Intro.

  3. Pega tu modelo

    VS Code abre un archivo con un modelo vacío. Sustituye su parte "models": [ … ] por el bloque de abajo y guarda. El panel te da este bloque listo para tu clave justo después de crearla. ¿Lo copias de aquí? Usa el bloque de Claude para los modelos Claude y el otro para el resto, y cambia id y name por los de tu modelo.

    
                  
    
                
  4. Elige el modelo

    Abre el chat, haz clic en el nombre del modelo en el cuadro de mensaje y elige tu modelo.

VS Code guarda tu clave en su almacenamiento seguro, no en el archivo. El chat funciona por completo, modo agente incluido. Las sugerencias grises que aparecen mientras escribes no están incluidas: esas solo las da GitHub Copilot.

¿No has iniciado sesión en GitHub? Entonces VS Code muestra Set BYOK utility models. Haz clic en Configure y elige Main Agent Model, para que los títulos de chat y los mensajes de commit también usen tu modelo. Son solicitudes pequeñas, que se cobran como cualquier otra.

Claude Code o Codex en VS Code

Las extensiones de Claude Code y Codex usan los mismos ajustes que sus versiones de terminal. Primero pega la línea de Claude Code o de Codex, luego instala la extensión y reinicia VS Code. Para Claude Code, abre también Settings, busca Claude Code login y marca Disable Login Prompt.

CC

Claude Code

Una línea pegada

Una línea guarda la URL base, tu clave y el modelo de tu clave, y cada terminal nueva los toma. La línea de abajo es para una clave de Claude Opus 5.5 y lleva una clave de ejemplo. El panel la muestra hecha para tu clave: con su modelo, su ventana de contexto y su esfuerzo.


          

        
  1. Pega la línea

    Pégala en PowerShell (Windows) o en Terminal (macOS, Linux) y pulsa Intro.

  2. Ejecuta Claude Code

    Ejecuta claude en la misma ventana. La primera vez, pulsa Intro en las pantallas de estilo de texto y de seguridad. Cuando pregunte si confías en la carpeta, pulsa ↓ para elegir Yes, I trust this folder y luego Intro: la opción preseleccionada, No, exit, cierra Claude Code. No necesitas una cuenta de Anthropic.

¿Aún no tienes Claude Code? En PowerShell, ejecuta irm https://claude.ai/install.ps1 | iex. En macOS o Linux, ejecuta curl -fsSL https://claude.ai/install.sh | bash. Si el instalador dice que su carpeta no está en tu PATH, haz lo que indique. Si usas la terminal de VS Code o Cursor, reinicia el editor después de pegar la línea.

¿Por qué el nombre del modelo? Sin él, Claude Code cree que habla con Claude Opus 5.5, sea cual sea el modelo de tu clave. Se lo dice al propio modelo y firma los commits con ese nombre. Con el nombre, conoce el modelo real. Si el modelo no es Claude, Claude Code puede decir que no lo reconoce. No pasa nada: solo conoce por su nombre los modelos Claude, y las solicitudes funcionan igual.

¿Prefieres un archivo? Pon esto en ~/.claude/settings.json (en Windows, %USERPROFILE%\.claude\settings.json):

{
  "env": {
    "ANTHROPIC_BASE_URL": "https://api.tokenlowcost.com/v1",
    "ANTHROPIC_AUTH_TOKEN": "sk-tlc-your-key",
    "ANTHROPIC_MODEL": "claude-opus-5-5[1m]"
  }
}

Pon en ANTHROPIC_MODEL el modelo de tu clave: claude-opus-5-5, claude-sonnet-5, claude-haiku-4-5 o, para otros modelos, el ID de la lista de precios, como gpt-6-sol. Añade [1m] al final si la ventana de la clave supera los 200K.

Claude Code también envía pequeñas solicitudes en segundo plano, como los títulos de los chats. Usan el modelo de tu clave y se cobran como cualquier otra solicitud.

Cx

Codex

Una línea pegada

Una línea escribe el archivo de configuración de Codex y guarda tu clave. Si ya tienes una configuración de Codex, se conserva como config.toml.bak. Esta línea lleva una clave de ejemplo; el panel la muestra con la tuya.


          

        

Pégala en PowerShell (Windows) o en Terminal (macOS, Linux) y pulsa Intro. Luego ejecuta codex en la misma ventana y elige Trust and continue. No necesitas una cuenta de ChatGPT.

¿Aún no tienes Codex? Instálalo con npm install -g @openai/codex. Codex funciona mejor con modelos de OpenAI, como GPT-6 Sol.

¿Prefieres editar el archivo a mano? Esto es lo que la línea escribe en ~/.codex/config.toml. Si lo añades a un archivo existente, deja las primeras líneas por encima de cualquier [section].

Codex lee tu clave de la variable de entorno TOKENLOWCOST_API_KEY, que la línea también define. Defínela tú también: añade export TOKENLOWCOST_API_KEY=sk-tlc-your-key a ~/.zshrc o ~/.bashrc, o en Windows ejecuta setx TOKENLOWCOST_API_KEY sk-tlc-your-key y abre una ventana nueva.

Cl

Cline, Roo Code y Continue

Extensiones para VS Code y JetBrains

En Cline o Roo Code, abre los ajustes del proveedor y rellena los campos de abajo. La primera vez que abras Cline, elige Bring my own API key para llegar ahí. Con la clave puesta, la lista de modelos muestra solo el modelo de tu clave: selecciónalo.

API Provider  OpenAI Compatible
Base URL      https://api.tokenlowcost.com/v1
API Key       sk-tlc-your-key
Model ID      anthropic/claude-opus-5.5

Cline muestra el coste como $0 porque no conoce nuestros precios. El coste real está en Uso, en tu panel.

¿Roo Code se queda en API Request…? En VS Code 1.122 y posteriores, Roo Code 3.54 no encuentra la herramienta de búsqueda de archivos que VS Code cambió de sitio, uses el proveedor que uses. Esta incidencia de VS Code tiene una solución provisional. Cline no tiene ese problema.

Para Continue, pon esto en ~/.continue/config.yaml en lugar de lo que haya. ¿Ya tienes modelos ahí? Añade solo la entrada de TokenLowCost bajo models:. La línea tool_use permite que el modo Agent edite archivos; sin ella, Continue no sabe que el modelo tiene herramientas.

name: My Config
version: 0.0.1
schema: v1
models:
  - name: TokenLowCost
    provider: openai
    model: tlc-opus
    apiBase: https://api.tokenlowcost.com/v1
    apiKey: sk-tlc-your-key
    capabilities:
      - tool_use

Cualquier otra herramienta con la opción OpenAI Compatible funciona igual.

OA

OpenAI SDK

Python y TypeScript

Define la URL base y tu clave. El resto es el código habitual del SDK.

from openai import OpenAI

client = OpenAI(
    base_url="https://api.tokenlowcost.com/v1",
    api_key="sk-tlc-your-key",
)

r = client.chat.completions.create(
    model="claude-opus-5.5",
    messages=[{"role": "user", "content": "Hello"}],
)
print(r.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.tokenlowcost.com/v1",
  apiKey: "sk-tlc-your-key",
});

const r = await client.chat.completions.create({
  model: "claude-opus-5.5",
  messages: [{ role: "user", content: "Hello" }],
});
console.log(r.choices[0].message.content);

Los ejemplos de TypeScript de esta página son módulos ES: guarda uno como main.mts y ejecuta npx tsx main.mts.

Streaming

Añade stream=True. El recuento de tokens llega en el último fragmento, que puede venir sin choices, así que comprueba antes chunk.choices.

stream = client.chat.completions.create(
    model="claude-opus-5.5",
    messages=[{"role": "user", "content": "Write a haiku about caching"}],
    stream=True,
)
for chunk in stream:
    if chunk.choices:
        print(chunk.choices[0].delta.content or "", end="")

La Responses API también funciona: client.responses.create(...).

An

Anthropic SDK

Python y TypeScript

Usa la misma URL base que en todas partes. El SDK le añade /v1/messages, y no pasa nada. Algunos modelos envían un bloque de razonamiento antes del texto, así que el ejemplo imprime solo los bloques de texto.

from anthropic import Anthropic

client = Anthropic(
    base_url="https://api.tokenlowcost.com/v1",
    api_key="sk-tlc-your-key",
)

msg = client.messages.create(
    model="claude-opus-5.5",
    max_tokens=512,
    messages=[{"role": "user", "content": "Hello"}],
)
for block in msg.content:
    if block.type == "text":
        print(block.text)
import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic({
  baseURL: "https://api.tokenlowcost.com/v1",
  apiKey: "sk-tlc-your-key",
});

const msg = await client.messages.create({
  model: "claude-opus-5.5",
  max_tokens: 512,
  messages: [{ role: "user", content: "Hello" }],
});
for (const block of msg.content) {
  if (block.type === "text") console.log(block.text);
}
$_

cURL

Solicitudes HTTP directas

La misma clave funciona en los tres formatos de solicitud.

curl https://api.tokenlowcost.com/v1/chat/completions \
  -H "Authorization: Bearer sk-tlc-your-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "claude-opus-5.5", "messages": [{"role": "user", "content": "Hello"}]}'
curl https://api.tokenlowcost.com/v1/messages \
  -H "x-api-key: sk-tlc-your-key" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{"model": "claude-opus-5.5", "max_tokens": 256, "messages": [{"role": "user", "content": "Hello"}]}'
curl https://api.tokenlowcost.com/v1/responses \
  -H "Authorization: Bearer sk-tlc-your-key" \
  -H "Content-Type: application/json" \
  -d '{"model": "gpt-6-sol", "input": "Hello"}'

Consulta tu saldo y tus últimas 20 solicitudes:

curl https://api.tokenlowcost.com/v1/me -H "Authorization: Bearer sk-tlc-your-key"

Errores

Qué significan y qué hacer

Cuando algo falla, recibes un código de estado y un mensaje breve.

CódigoQué significaQué hacer
401Falta la clave, es incorrecta o está revocada.Comprueba que pegaste la clave completa.
402La clave alcanzó su límite de gasto o tu saldo es $0.Recarga o crea una clave con un límite mayor.
403La clave ha caducado o la cuenta está bloqueada. El mensaje indica cuál de las dos.Si caducó, crea una clave nueva. Los bloqueos se explican en las normas.
400Si el mensaje dice que el prompt es demasiado largo: la solicitud supera la ventana de contexto de la clave. No se cobra.Empieza un chat nuevo o usa una clave con una ventana mayor.
404Dirección incorrecta.Revisa la parte que va después de /v1.
OtrosSe reenvía tal cual desde el proveedor del modelo, por ejemplo cuando está saturado.Vuelve a intentarlo en un minuto.

Los límites de gasto y las fechas de caducidad se fijan por clave en el panel. Tu saldo está en Facturación.

¿Todo listo para conectar?

Crea una cuenta, recibe $50 de crédito y crea tu primera clave. Te llevará un minuto, más o menos.

Obtener clave de API