LLM-Ranking: Schnellstartanleitung für die unzensierte LLM-API
Diese Schnellstartanleitung führt dich an die Verbindung zu unserer unzensierten LLM-API heran und behandelt Authentifizierung, einfache Anfragen, Streaming und Function Calling mit konkreten Beispielen.
Basis-URL & Authentifizierung
Unsere API folgt dem OpenAI-Kompatibilitätsstandard, sodass du bestehende SDKs mit minimaler Konfiguration nutzen kannst. Die Basis-URL ist https://api.uncensoredllmleaderboard.com/v1. Zur Authentifizierung generierst du einen API-Schlüssel in deinem Dashboard und übergibst ihn im Authorization-Header als Bearer-Token. Jedes Konto erhält einen Schlüssel, den du jederzeit neu generieren kannst, um den Zugriff zu widerrufen. Im Gegensatz zu vielen anderen LLM-API-Anbietern benötigen wir für das initiale Testguthaben keine Kreditkarte, und Prompts werden nicht zum Training verwendet. Denk daran, dass unser Modell, das als „unzensiert“ gilt, ein Open-Weight-Modell ist, das darauf trainiert wurde, ohne Ablehnungen auf legale erwachsene Inhalte zu antworten, und sich von GPT oder Claude unterscheidet.
Chat-Vervollständigungs-Endpunkt
Die Kernfunktionalität ist Text-ein, Text-aus über den POST /v1/chat/completions-Endpunkt. Du sendst ein Nachrichten-Array und erhältst eine generierte Antwort. Dieser Endpunkt unterstützt Streaming über Server-Sent Events (SSE) und Function Calling. Unser Modell verfügt über ein Kontextfenster mit 100.000 Token für sowohl Prompt als auch Vervollständigung. Im Gegensatz zu aggregierten Rankings, die nur Scores anzeigen, bieten wir Entwicklern sofortigen Zugriff auf diesen unzensierten Chat-Vervollständigungs-Endpunkt mit vorhersehbaren, transparenten Preisen. Es gibt hier keine Embedding-, Bild- oder Audio-Funktionen – nur reine Textgenerierung. Nutze das folgende Beispiel, um deine erste Anfrage zu senden:
curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
Für Python-Entwickler funktioniert das offizielle OpenAI SDK out of the box. Du musst die base_url und api_key so konfigurieren, dass sie auf unsere Infrastruktur verweisen. Dieser Ansatz vermeidet das Schreiben eigener HTTP-Clients und nutzt vertraute Methoden wie client.chat.completions.create(). Das SDK übernimmt die JSON-Serialisierung und Wiederholungslogik automatisch. Stelle sicher, dass du eine aktuelle Version des openai-Pakets verwendest. Die Modell-ID, die du angeben musst, ist "uncensored". So initialisierst du den Client und sendest eine Anfrage:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
Node.js-Entwickler können das offizielle openai npm-Paket nutzen. Ähnlich wie bei Python konfigurierst du den Client mit unserer Basis-URL und deinem API-Schlüssel. So kannst du das unzensierte Modell in deine bestehenden Node-Anwendungen integrieren, ohne die Anfrage-Logik neu schreiben zu müssen. Das SDK unterstützt sowohl synchrone als auch asynchrone Muster. Denk daran, dass unser Service ein LLM-API-Anbieter ist, der sich auf reine Token-Kosten konzentriert, nicht auf Unternehmens-SLAs. Nutze dieses Muster, um mit dem Chat-Vervollständigungs-Endpunkt zu interagieren:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-Antworten
Für geringere Latenz und Echtzeit-Benutzererfahrungen aktiviere Streaming, indem du stream: true setzt. Die API gibt einen Stream von Server-Sent Events (SSE) zurück, sodass du Token verarbeiten kannst, während sie generiert werden. Dies ist nützlich für Chat-Oberflächen oder Anwendungen, bei denen das Warten auf die vollständige Antwort zu langsam ist. Die SDKs verarbeiten die Parsing der SSE-Chunks automatisch. Beachte, dass Streaming die Preisgestaltung oder Limits nicht ändert; du zahlst weiterhin für die insgesamt genutzten Token. So implementierst du Streaming in deinem Code:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Ratenlimits & Kontingente
Unsere API erzwingt ein Limit von 300 Anfragen pro Minute pro Schlüssel und eine Anfragekörpergröße von 8 MB. Wenn du das Ratenlimit überschreitest, gibt die API einen 429-Statuscode zurück. Authentifizierungsfehler führen zu einem 401-Fehler, typischerweise aufgrund eines ungültigen oder fehlenden Schlüssels. Wenn dein Prepaid-Guthaben aufgebraucht ist, erhältst du einen 402-Fehler. Guthaben werden per Krypto (USDT oder USDC) bezahlt, beginnend bei $10, mit Boni für größere Aufladungen. Im Gegensatz zu einigen Open-AI-API-Preismodellen nutzen wir ein einfaches Pay-as-you-go-System mit Prepaid-Guthaben ohne monatliche Gebühren. Das Testguthaben von $0,50 ist 7 Tage gültig und erfordert keine Karte. Die Kontextlänge ist auf 100k Token begrenzt, also überwache deine Eingabegröße, um Limits nicht zu überschreiten oder höhere Kosten zu verursachen.
Funktionen und Limits
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.uncensoredllmleaderboard.com/v1 |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Anfragegröße | bis 8 MB |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist das dasselbe wie GPT oder Claude?
Nein. Unser Modell ist ein Open-Weight-Modell, das als „unzensiert“ gilt. Es ist nicht GPT, Claude, Gemini oder DeepSeek. Es wurde darauf trainiert, ohne Ablehnungen auf legale erwachsene Inhalte zu antworten, und wird von unseren eigenen GPU-Servern bereitgestellt.
Wie funktioniert die Preisgestaltung?
Wir berechnen $0,25 pro 1M Input-Token und $1,00 pro 1M Output-Token. Du zahlst mit Prepaid-Guthaben, das verfällt nie. Es gibt keine Abonnements oder monatlichen Gebühren. Guthaben können ab $10 aufgeladen werden.
Speichert ihr meine Prompts?
Wir verwenden deine Prompts nicht zum Training. Ein Konto erfordert nur eine E-Mail und ein Passwort. Wir bieten keine SLA-Garantien oder Zertifizierungen wie SOC2, legen aber großen Wert auf Privatsphäre bei unzensierten Chat-Vervollständigungen.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.