DE ▾
API-Schlüssel erhalten

LLM-Ranking: Schnellstartanleitung für die unzensierte LLM-API

Diese Schnellstartanleitung führt dich an die Verbindung zu unserer unzensierten LLM-API heran und behandelt Authentifizierung, einfache Anfragen, Streaming und Function Calling mit konkreten Beispielen.

Basis-URL & Authentifizierung

Unsere API folgt dem OpenAI-Kompatibilitätsstandard, sodass du bestehende SDKs mit minimaler Konfiguration nutzen kannst. Die Basis-URL ist https://api.uncensoredllmleaderboard.com/v1. Zur Authentifizierung generierst du einen API-Schlüssel in deinem Dashboard und übergibst ihn im Authorization-Header als Bearer-Token. Jedes Konto erhält einen Schlüssel, den du jederzeit neu generieren kannst, um den Zugriff zu widerrufen. Im Gegensatz zu vielen anderen LLM-API-Anbietern benötigen wir für das initiale Testguthaben keine Kreditkarte, und Prompts werden nicht zum Training verwendet. Denk daran, dass unser Modell, das als „unzensiert“ gilt, ein Open-Weight-Modell ist, das darauf trainiert wurde, ohne Ablehnungen auf legale erwachsene Inhalte zu antworten, und sich von GPT oder Claude unterscheidet.

Chat-Vervollständigungs-Endpunkt

Die Kernfunktionalität ist Text-ein, Text-aus über den POST /v1/chat/completions-Endpunkt. Du sendst ein Nachrichten-Array und erhältst eine generierte Antwort. Dieser Endpunkt unterstützt Streaming über Server-Sent Events (SSE) und Function Calling. Unser Modell verfügt über ein Kontextfenster mit 100.000 Token für sowohl Prompt als auch Vervollständigung. Im Gegensatz zu aggregierten Rankings, die nur Scores anzeigen, bieten wir Entwicklern sofortigen Zugriff auf diesen unzensierten Chat-Vervollständigungs-Endpunkt mit vorhersehbaren, transparenten Preisen. Es gibt hier keine Embedding-, Bild- oder Audio-Funktionen – nur reine Textgenerierung. Nutze das folgende Beispiel, um deine erste Anfrage zu senden:

curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK

Für Python-Entwickler funktioniert das offizielle OpenAI SDK out of the box. Du musst die base_url und api_key so konfigurieren, dass sie auf unsere Infrastruktur verweisen. Dieser Ansatz vermeidet das Schreiben eigener HTTP-Clients und nutzt vertraute Methoden wie client.chat.completions.create(). Das SDK übernimmt die JSON-Serialisierung und Wiederholungslogik automatisch. Stelle sicher, dass du eine aktuelle Version des openai-Pakets verwendest. Die Modell-ID, die du angeben musst, ist "uncensored". So initialisierst du den Client und sendest eine Anfrage:

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK

Node.js-Entwickler können das offizielle openai npm-Paket nutzen. Ähnlich wie bei Python konfigurierst du den Client mit unserer Basis-URL und deinem API-Schlüssel. So kannst du das unzensierte Modell in deine bestehenden Node-Anwendungen integrieren, ohne die Anfrage-Logik neu schreiben zu müssen. Das SDK unterstützt sowohl synchrone als auch asynchrone Muster. Denk daran, dass unser Service ein LLM-API-Anbieter ist, der sich auf reine Token-Kosten konzentriert, nicht auf Unternehmens-SLAs. Nutze dieses Muster, um mit dem Chat-Vervollständigungs-Endpunkt zu interagieren:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming-Antworten

Für geringere Latenz und Echtzeit-Benutzererfahrungen aktiviere Streaming, indem du stream: true setzt. Die API gibt einen Stream von Server-Sent Events (SSE) zurück, sodass du Token verarbeiten kannst, während sie generiert werden. Dies ist nützlich für Chat-Oberflächen oder Anwendungen, bei denen das Warten auf die vollständige Antwort zu langsam ist. Die SDKs verarbeiten die Parsing der SSE-Chunks automatisch. Beachte, dass Streaming die Preisgestaltung oder Limits nicht ändert; du zahlst weiterhin für die insgesamt genutzten Token. So implementierst du Streaming in deinem Code:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Ratenlimits & Kontingente

Unsere API erzwingt ein Limit von 300 Anfragen pro Minute pro Schlüssel und eine Anfragekörpergröße von 8 MB. Wenn du das Ratenlimit überschreitest, gibt die API einen 429-Statuscode zurück. Authentifizierungsfehler führen zu einem 401-Fehler, typischerweise aufgrund eines ungültigen oder fehlenden Schlüssels. Wenn dein Prepaid-Guthaben aufgebraucht ist, erhältst du einen 402-Fehler. Guthaben werden per Krypto (USDT oder USDC) bezahlt, beginnend bei $10, mit Boni für größere Aufladungen. Im Gegensatz zu einigen Open-AI-API-Preismodellen nutzen wir ein einfaches Pay-as-you-go-System mit Prepaid-Guthaben ohne monatliche Gebühren. Das Testguthaben von $0,50 ist 7 Tage gültig und erfordert keine Karte. Die Kontextlänge ist auf 100k Token begrenzt, also überwache deine Eingabegröße, um Limits nicht zu überschreiten oder höhere Kosten zu verursachen.

Funktionen und Limits

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Modell-IDuncensored
EndpunktePOST /v1/chat/completions · GET /v1/models
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.uncensoredllmleaderboard.com/v1
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
JSON-Modusresponse_format: {"type": "json_object"}
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Ratenlimit300 Anfragen pro Minute und Schlüssel
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Anfragegrößebis 8 MB
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten

Fehler und Lösungen

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Ist das dasselbe wie GPT oder Claude?

Nein. Unser Modell ist ein Open-Weight-Modell, das als „unzensiert“ gilt. Es ist nicht GPT, Claude, Gemini oder DeepSeek. Es wurde darauf trainiert, ohne Ablehnungen auf legale erwachsene Inhalte zu antworten, und wird von unseren eigenen GPU-Servern bereitgestellt.

Wie funktioniert die Preisgestaltung?

Wir berechnen $0,25 pro 1M Input-Token und $1,00 pro 1M Output-Token. Du zahlst mit Prepaid-Guthaben, das verfällt nie. Es gibt keine Abonnements oder monatlichen Gebühren. Guthaben können ab $10 aufgeladen werden.

Speichert ihr meine Prompts?

Wir verwenden deine Prompts nicht zum Training. Ein Konto erfordert nur eine E-Mail und ein Passwort. Wir bieten keine SLA-Garantien oder Zertifizierungen wie SOC2, legen aber großen Wert auf Privatsphäre bei unzensierten Chat-Vervollständigungen.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten