Clasificación de LLM: Guía de inicio rápido de API de LLM sin censura
Esta guía de inicio rápido te guía por la conexión a nuestra API de LLM sin censura, cubriendo autenticación, peticiones básicas, streaming y llamadas a funciones con ejemplos concretos.
Base URL y autenticación
Nuestra API sigue el estándar de compatibilidad con OpenAI, lo que significa que puedes usar SDKs existentes con configuración mínima. La base URL es https://api.uncensoredllmleaderboard.com/v1. Para autenticarte, genera una clave de API desde tu panel y pásala en el encabezado Authorization como token Bearer. Cada cuenta tiene una clave, que puedes regenerar en cualquier momento para revocar el acceso. A diferencia de muchas opciones de proveedor de API LLM, no requerimos tarjeta de crédito para la prueba inicial, y los prompts no se usan para entrenamiento. Recuerda que nuestro modelo, identificado como "uncensored", es un modelo de pesos abiertos ajustado para responder sin rechazos para contenido adulto lícito, distinto de GPT o Claude.
Endpoint de completados de chat
La funcionalidad principal es texto de entrada, texto de salida a través del endpoint POST /v1/chat/completions. Envías un array de mensajes y recibes una respuesta generada. Este endpoint admite streaming mediante Server-Sent Events (SSE) y llamadas a funciones. Nuestro modelo tiene una ventana de contexto de 100.000 tokens tanto para el prompt como para la finalización. A diferencia de los rankings agregados que solo muestran puntuaciones, proporcionamos acceso inmediato a desarrolladores a este endpoint de finalizaciones de chat sin censura con precios predecibles y por adelantado. No hay capacidades de embeddings, imagen o audio aquí—solo generación de texto sin filtros. Usa el siguiente ejemplo para enviar tu primera petición:
curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK de Python
Para desarrolladores de Python, el SDK oficial de OpenAI funciona listo para usar. Necesitas configurar el base_url y el api_key para apuntar a nuestra infraestructura. Este enfoque evita escribir clientes HTTP personalizados y aprovecha métodos familiares como client.chat.completions.create(). El SDK maneja la serialización JSON y la lógica de reintento automáticamente. Asegúrate de usar una versión reciente del paquete openai. El ID de modelo que debes especificar es "uncensored". Así es cómo inicializar el cliente y hacer una petición:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK de Node
Los desarrolladores de Node.js pueden usar el paquete npm oficial openai. Similar a Python, configuras el cliente con nuestra base URL y tu clave de API. Esto te permite integrar el modelo sin censura en tus aplicaciones Node existentes sin reescribir la lógica de peticiones. El SDK admite patrones sincrónicos y asincrónicos. Recuerda que nuestro servicio es un proveedor de API LLM enfocado en costos de tokens sin filtros, no en SLAs empresariales. Usa este patrón para interactuar con el endpoint de finalizaciones de chat:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respuestas en streaming
Para menor latencia y experiencias de usuario en tiempo real, habilita el streaming configurando stream: true. La API devuelve un stream de Server-Sent Events (SSE), permitiéndote procesar tokens a medida que se generan. Esto es útil para interfaces de chat o aplicaciones donde esperar la respuesta completa es demasiado lento. Los SDKs manejan el análisis de fragmentos SSE automáticamente. Ten en cuenta que el streaming no cambia los precios ni los límites; sigues pagando por los tokens totales utilizados. Así es cómo implementar streaming en tu código:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Límites de velocidad y cuotas
Nuestra API impone un límite de 300 peticiones por minuto por clave y un tamaño de cuerpo de petición de 8 MB. Si excedes el límite de peticiones, la API devuelve un código de estado 429. Los fallos de autenticación resultan en un error 401, típicamente debido a una clave inválida o faltante. Si tu crédito prepago se agota, recibirás un error 402. Los créditos se pagan con cripto (USDT o USDC), comenzando en $10, con bonificaciones para recargas más grandes. A diferencia de algunos modelos de precios de API de OpenAI, usamos un sistema de crédito prepago de pago por uso simple sin tarifas mensuales. El crédito de prueba gratis de $0,50 es válido por 7 días y no requiere tarjeta. La longitud del contexto está limitada a 100k tokens, así que monitorea el tamaño de tu entrada para evitar exceder los límites o incurrir en mayores costos.
Funciones y límites
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| ID del modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredllmleaderboard.com/v1 |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Modo JSON | response_format: {"type": "json_object"} |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Límite de peticiones | 300 por minuto por clave |
| Concurrencia | 8 peticiones a la vez por clave |
| Tamaño de petición | hasta 8 MB |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Bono | +5 % desde $50, +10 % desde $100 |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
Errores y qué hacer
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Es este el mismo que GPT o Claude?
No. Nuestro modelo es un modelo de pesos abiertos identificado como "sin censura". No es GPT, Claude, Gemini ni DeepSeek. Está ajustado para responder sin rechazos para contenido adulto lícito y se sirve desde nuestros propios servidores GPU.
¿Cómo funciona la facturación?
Cobramos $0,25 por cada 1M de tokens de entrada y $1,00 por cada 1M de tokens de salida. Pagas mediante crédito prepago, que no caduca. No hay suscripciones ni cuotas mensuales. Los créditos se pueden recargar a partir de $10.
¿Almacenan mis prompts?
No usamos tus prompts para entrenamiento. Una cuenta requiere solo un correo electrónico y una contraseña. No ofrecemos garantías de SLA ni certificaciones como SOC2, pero priorizamos la privacidad para completados de chat sin censura.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la base URL. Esa es toda la configuración.