ES ▾
Obtener clave de API

Clasificación de LLM: Guía de inicio rápido de API de LLM sin censura

Esta guía de inicio rápido te guía por la conexión a nuestra API de LLM sin censura, cubriendo autenticación, peticiones básicas, streaming y llamadas a funciones con ejemplos concretos.

Base URL y autenticación

Nuestra API sigue el estándar de compatibilidad con OpenAI, lo que significa que puedes usar SDKs existentes con configuración mínima. La base URL es https://api.uncensoredllmleaderboard.com/v1. Para autenticarte, genera una clave de API desde tu panel y pásala en el encabezado Authorization como token Bearer. Cada cuenta tiene una clave, que puedes regenerar en cualquier momento para revocar el acceso. A diferencia de muchas opciones de proveedor de API LLM, no requerimos tarjeta de crédito para la prueba inicial, y los prompts no se usan para entrenamiento. Recuerda que nuestro modelo, identificado como "uncensored", es un modelo de pesos abiertos ajustado para responder sin rechazos para contenido adulto lícito, distinto de GPT o Claude.

Endpoint de completados de chat

La funcionalidad principal es texto de entrada, texto de salida a través del endpoint POST /v1/chat/completions. Envías un array de mensajes y recibes una respuesta generada. Este endpoint admite streaming mediante Server-Sent Events (SSE) y llamadas a funciones. Nuestro modelo tiene una ventana de contexto de 100.000 tokens tanto para el prompt como para la finalización. A diferencia de los rankings agregados que solo muestran puntuaciones, proporcionamos acceso inmediato a desarrolladores a este endpoint de finalizaciones de chat sin censura con precios predecibles y por adelantado. No hay capacidades de embeddings, imagen o audio aquí—solo generación de texto sin filtros. Usa el siguiente ejemplo para enviar tu primera petición:

curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

SDK de Python

Para desarrolladores de Python, el SDK oficial de OpenAI funciona listo para usar. Necesitas configurar el base_url y el api_key para apuntar a nuestra infraestructura. Este enfoque evita escribir clientes HTTP personalizados y aprovecha métodos familiares como client.chat.completions.create(). El SDK maneja la serialización JSON y la lógica de reintento automáticamente. Asegúrate de usar una versión reciente del paquete openai. El ID de modelo que debes especificar es "uncensored". Así es cómo inicializar el cliente y hacer una petición:

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK de Node

Los desarrolladores de Node.js pueden usar el paquete npm oficial openai. Similar a Python, configuras el cliente con nuestra base URL y tu clave de API. Esto te permite integrar el modelo sin censura en tus aplicaciones Node existentes sin reescribir la lógica de peticiones. El SDK admite patrones sincrónicos y asincrónicos. Recuerda que nuestro servicio es un proveedor de API LLM enfocado en costos de tokens sin filtros, no en SLAs empresariales. Usa este patrón para interactuar con el endpoint de finalizaciones de chat:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Respuestas en streaming

Para menor latencia y experiencias de usuario en tiempo real, habilita el streaming configurando stream: true. La API devuelve un stream de Server-Sent Events (SSE), permitiéndote procesar tokens a medida que se generan. Esto es útil para interfaces de chat o aplicaciones donde esperar la respuesta completa es demasiado lento. Los SDKs manejan el análisis de fragmentos SSE automáticamente. Ten en cuenta que el streaming no cambia los precios ni los límites; sigues pagando por los tokens totales utilizados. Así es cómo implementar streaming en tu código:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Límites de velocidad y cuotas

Nuestra API impone un límite de 300 peticiones por minuto por clave y un tamaño de cuerpo de petición de 8 MB. Si excedes el límite de peticiones, la API devuelve un código de estado 429. Los fallos de autenticación resultan en un error 401, típicamente debido a una clave inválida o faltante. Si tu crédito prepago se agota, recibirás un error 402. Los créditos se pagan con cripto (USDT o USDC), comenzando en $10, con bonificaciones para recargas más grandes. A diferencia de algunos modelos de precios de API de OpenAI, usamos un sistema de crédito prepago de pago por uso simple sin tarifas mensuales. El crédito de prueba gratis de $0,50 es válido por 7 días y no requiere tarjeta. La longitud del contexto está limitada a 100k tokens, así que monitorea el tamaño de tu entrada para evitar exceder los límites o incurrir en mayores costos.

Funciones y límites

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
ID del modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaciónAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredllmleaderboard.com/v1
Ventana de contexto100.000 tokens (entrada + salida)
Modo JSONresponse_format: {"type": "json_object"}
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Límite de peticiones300 por minuto por clave
Concurrencia8 peticiones a la vez por clave
Tamaño de peticiónhasta 8 MB
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Caducidadel crédito pagado no caduca, sin suscripción
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Bono+5 % desde $50, +10 % desde $100
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
AccesoGoogle o correo y contraseña
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Es este el mismo que GPT o Claude?

No. Nuestro modelo es un modelo de pesos abiertos identificado como "sin censura". No es GPT, Claude, Gemini ni DeepSeek. Está ajustado para responder sin rechazos para contenido adulto lícito y se sirve desde nuestros propios servidores GPU.

¿Cómo funciona la facturación?

Cobramos $0,25 por cada 1M de tokens de entrada y $1,00 por cada 1M de tokens de salida. Pagas mediante crédito prepago, que no caduca. No hay suscripciones ni cuotas mensuales. Los créditos se pueden recargar a partir de $10.

¿Almacenan mis prompts?

No usamos tus prompts para entrenamiento. Una cuenta requiere solo un correo electrónico y una contraseña. No ofrecemos garantías de SLA ni certificaciones como SOC2, pero priorizamos la privacidad para completados de chat sin censura.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la base URL. Esa es toda la configuración.

Obtener clave de API