Classement LLM : Guide de démarrage rapide API LLM sans censure
Ce guide de démarrage rapide vous accompagne dans la connexion à notre API LLM sans censure, couvrant l'authentification, les requêtes de base, le streaming et l'appel de fonctions avec des exemples concrets.
Base URL & Authentification
Notre API suit la norme de compatibilité OpenAI, ce qui vous permet d'utiliser les SDK existants avec une configuration minimale. L'URL de base est https://api.uncensoredllmleaderboard.com/v1. Pour vous authentifier, générez une clé API depuis votre tableau de bord et transmettez-la dans l'en-tête Authorization en tant que jeton Bearer. Chaque compte dispose d'une seule clé, que vous pouvez régénérer à tout moment pour révoquer l'accès. Contrairement à de nombreuses options de fournisseur d'API LLM, nous ne demandons pas de carte bancaire pour l'essai initial, et les prompts ne sont pas utilisés pour l'entraînement. Notez que notre modèle, identifié comme « sans censure », est un modèle à poids ouverts ajusté pour répondre sans refus pour du contenu adulte légal, distinct de GPT ou Claude.
Endpoint Chat Complet
La fonctionnalité principale est l'entrée et la sortie de texte via l'endpoint POST /v1/chat/completions. Vous envoyez un tableau de messages et recevez une réponse générée. Cet endpoint supporte le streaming via Server-Sent Events (SSE) et l'appel de fonctions. Notre modèle dispose d'une fenêtre de contexte de 100 000 tokens pour le prompt et la complétion. Contrairement aux classements agrégés qui ne montrent que des scores, nous offrons un accès immédiat aux développeurs à cet endpoint de chat complet sans censure avec des tarifs prévisibles et transparents. Il n'y a pas de capacités d'embedding, d'image ou d'audio ici — juste de la génération de texte brute. Utilisez l'exemple suivant pour envoyer votre première requête :
curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Pour les développeurs Python, le SDK OpenAI officiel fonctionne directement. Vous devez définir base_url et api_key pour pointer vers notre infrastructure. Cette approche évite d'écrire des clients HTTP personnalisés et exploite des méthodes familières comme client.chat.completions.create(). Le SDK gère automatiquement la sérialisation JSON et la logique de retry. Assurez-vous d'utiliser une version récente du package openai. L'ID de modèle que vous devez spécifier est "uncensored". Voici comment initialiser le client et effectuer une requête :
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node
Les développeurs Node.js peuvent utiliser le package npm officiel openai. Similaire à Python, vous configurez le client avec notre URL de base et votre clé API. Cela vous permet d'intégrer le modèle sans censure dans vos applications Node existantes sans réécrire la logique des requêtes. Le SDK supporte les patterns synchrones et asynchrones. Notez que notre service est un fournisseur d'API LLM axé sur les coûts bruts des tokens, et non sur les SLA d'entreprise. Utilisez ce pattern pour interagir avec l'endpoint de chat complet :
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses en streaming
Pour une latence plus faible et des expériences utilisateur en temps réel, activez le streaming en définissant stream: true. L'API retourne un flux d'événements Server-Sent (SSE), vous permettant de traiter les tokens au fur et à mesure de leur génération. Cela est utile pour les interfaces de chat ou les applications où attendre la réponse complète est trop lent. Les SDK gèrent automatiquement l'analyse des chunks SSE. Notez que le streaming ne modifie pas la tarification ou les limites ; vous payez toujours pour le total de tokens utilisés. Voici comment implémenter le streaming dans votre code :
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites de débit et quotas
Notre API applique une limite de 300 requêtes par minute par clé et une taille de corps de requête de 8 Mo. Si vous dépassez la limite de débit, l'API renvoie un code d'état 429. Les échecs d'authentification entraînent une erreur 401, généralement due à une clé invalide ou manquante. Si votre crédit prépayé s'épuise, vous recevrez une erreur 402. Les crédits sont payés par crypto (USDT ou USDC), à partir de 10 $, avec des bonus pour les recharges plus importantes. Contrairement à certains modèles de tarification d'API open ai, nous utilisons un système de crédit prépayé paiement à l'usage simple, sans frais mensuels. Le crédit d'essai de 0,50 $ est valable 7 jours et ne nécessite pas de carte. La longueur du contexte est limitée à 100k tokens, surveillez donc la taille de votre entrée pour éviter de dépasser les limites ou d'engendrer des coûts plus élevés.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| ID du modèle | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authentification | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredllmleaderboard.com/v1 |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Mode JSON | response_format: {"type": "json_object"} |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Est-ce le même modèle que GPT ou Claude ?
Non. Notre modèle est un modèle à poids ouverts identifié comme « sans censure ». Ce n'est ni GPT, ni Claude, ni Gemini, ni DeepSeek. Il est ajusté pour répondre sans refus pour du contenu adulte légal et est servi depuis nos propres serveurs GPU.
Comment fonctionne la tarification ?
Nous facturons $0,25 par 1M de tokens d'entrée et $1,00 par 1M de tokens de sortie. Vous payez via un crédit prépayé, qui n'expire jamais. Il n'y a ni abonnements ni frais mensuels. Les crédits peuvent être rechargés à partir de $10.
Stockez-vous mes prompts ?
Nous n'utilisons pas vos prompts pour l'entraînement. Un compte nécessite uniquement un e-mail et un mot de passe. Nous ne proposons pas de garanties SLA ni de certifications type SOC2, mais nous privilégions la confidentialité pour les chat complet sans censure.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez la base URL. C'est toute la configuration.