Ranking LLM: Guia Rápido da API LLM Sem Censura
Este guia rápido mostra como conectar à nossa API LLM sem censura, cobrindo autenticação, requisições básicas, streaming e chamada de funções com exemplos concretos.
Base URL & Autenticação
Nossa API segue o padrão de compatibilidade com OpenAI, o que significa que você pode usar SDKs existentes com configuração mínima. A base URL é https://api.uncensoredllmleaderboard.com/v1. Para autenticar, gere uma chave de API no seu painel e passe-a no cabeçalho Authorization como token Bearer. Cada conta recebe uma chave, que você pode regenerar a qualquer momento para revogar o acesso. Diferente de muitas opções de provedores de api llm, não exigimos cartão de crédito para o crédito de teste inicial, e os prompts não são usados para treinamento. Lembre-se de que nosso modelo, identificado como "uncensored", é um modelo de pesos abertos ajustado para responder sem recusas para conteúdo adulto lícito, distinto de GPT ou Claude.
Endpoint de Completions de Chat
A funcionalidade principal é texto de entrada, texto de saída via endpoint POST /v1/chat/completions. Você envia um array de mensagens e recebe uma resposta gerada. Este endpoint suporta streaming via Server-Sent Events (SSE) e chamada de funções. Nosso modelo possui uma janela de contexto de 100.000 tokens para prompt e conclusão. Diferente de rankings agregados que mostram apenas pontuações, fornecemos acesso imediato de desenvolvedores a este endpoint de conclusões de chat sem censura com preços previsíveis e antecipados. Não há capacidades de embeddings, imagem ou áudio aqui — apenas geração de texto bruta. Use o exemplo a seguir para enviar sua primeira requisição:
curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Para desenvolvedores Python, o SDK oficial da OpenAI funciona imediatamente. Você precisa definir o base_url e o api_key para apontar para nossa infraestrutura. Esta abordagem evita escrever clientes HTTP personalizados e aproveita métodos familiares como client.chat.completions.create(). O SDK lida com serialização JSON e lógica de retry automaticamente. Certifique-se de estar usando uma versão recente do pacote openai. O ID do modelo que você deve especificar é "uncensored". Veja como inicializar o cliente e fazer uma solicitação:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node
Desenvolvedores Node.js podem usar o pacote npm oficial openai. Similar ao Python, você configura o cliente com nossa base URL e sua chave de API. Isso permite integrar o modelo sem censura em suas aplicações Node existentes sem reescrever a lógica de requisição. O SDK suporta padrões síncronos e assíncronos. Lembre-se que nosso serviço é um provedor de API LLM focado em custos de token brutos, não em SLAs empresariais. Use este padrão para interagir com o endpoint de completions de chat:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respostas em Streaming
Para menor latência e experiências em tempo real, ative o streaming definindo stream: true. A API retorna um stream de Server-Sent Events (SSE), permitindo que você processe tokens conforme são gerados. Isso é útil para interfaces de chat ou aplicativos onde esperar pela resposta completa é muito lento. Os SDKs lidam com a análise dos chunks SSE automaticamente. Observe que o streaming não altera o preço ou limites; você ainda paga pelos tokens totais usados. Veja como implementar o streaming no seu código:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites de Taxa e Cotas
Nossa API impõe um limite de 300 requisições por minuto por chave e um tamanho de corpo de requisição de 8 MB. Se você exceder o limite de requisições, a API retorna um código de status 429. Falhas de autenticação resultam em erro 401, geralmente devido a uma chave inválida ou ausente. Se seu crédito pré-pago acabar, você receberá um erro 402. Os créditos são pagos via criptomoeda (USDT ou USDC), a partir de $10, com bônus para recargas maiores. Diferente de alguns modelos de preços de api open ai, usamos um sistema simples de crédito pré-pago pagamento por uso sem mensalidades. O crédito de teste grátis de $0,50 é válido por 7 dias e não requer cartão. O comprimento do contexto é limitado a 100k tokens, então monitore o tamanho da entrada para evitar exceder os limites ou incorrer em custos maiores.
Recursos e limites
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| ID do modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredllmleaderboard.com/v1 |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Modo JSON | response_format: {"type": "json_object"} |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Tamanho | até 8 MB por requisição |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Validade | crédito pago não expira, sem assinatura |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Isso é o mesmo que GPT ou Claude?
Não. Nosso modelo é um modelo de pesos abertos identificado como "sem censura". Não é GPT, Claude, Gemini ou DeepSeek. É ajustado para responder sem recusas para conteúdo adulto lícito e é servido por nossos próprios servidores GPU.
Como funciona o preço?
Cobramos $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. Você paga via crédito pré-pago, que nunca expira. Não há assinaturas ou mensalidades. Créditos podem ser recarregados a partir de $10.
Vocês armazenam meus prompts?
Não usamos seus prompts para treinamento. Uma conta requer apenas e-mail e senha. Não oferecemos garantias de SLA ou certificações como SOC2, mas priorizamos a privacidade para completions de chat sem censura.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a base URL. Essa é toda a configuração.