LLM Leaderboard: Ongecensureerde LLM API-snelstartgids
Deze snelstartgids laat je zien hoe je verbinding maakt met onze ongecensureerde LLM-API, inclusief authenticatie, basisverzoeken, streaming en function calling met concrete voorbeelden.
Basis-URL & Authenticatie
Onze API volgt de OpenAI-compatibiliteitsstandaard, wat betekent dat je bestaande SDK's kunt gebruiken met minimale configuratie. De basis-URL is https://api.uncensoredllmleaderboard.com/v1. Om te authenticeren, genereer je een API-sleutel in je dashboard en voeg je deze toe aan de Authorization-header als Bearer-token. Elk account krijgt één sleutel, die je op elk moment kunt regenereren om toegang te intrekken. In tegenstelling tot veel LLM-aanbieders, vereisen we geen creditcard voor de initiële proefversie en worden prompts niet gebruikt voor training. Onthoud dat ons model, geïdentificeerd als "ongecensureerd", een open-weight model is dat is afgestemd om zonder weigeringen te antwoorden op wettelijke volwassen inhoud, en verschilt van GPT of Claude.
Chat Completies Endpoint
De kernfunctionaliteit is tekst-in, tekst-uit via het POST /v1/chat/completions-endpoint. Je stuurt een berichtarray en ontvangt een gegenereerd antwoord. Dit endpoint ondersteunt streaming via Server-Sent Events (SSE) en function calling. Ons model heeft een contextvenster van 100.000 tokens voor zowel prompt als completion. In tegenstelling tot geaggregeerde leaderboards die alleen scores tonen, bieden we directe ontwikkelaars toegang tot dit ongecensureerde chat-completions-endpoint met voorspelbare, vooraf bekende prijzen. Er zijn hier geen embedding-, afbeeldings- of audiofuncties—alleen ruwe tekstgeneratie. Gebruik het volgende voorbeeld om je eerste verzoek te versturen:
curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
Voor Python-ontwikkelaars werkt de officiële OpenAI SDK direct. Je moet de base_url en api_key instellen om naar onze infrastructuur te verwijzen. Deze aanpak voorkomt het schrijven van aangepaste HTTP-clients en maakt gebruik van bekende methoden zoals client.chat.completions.create(). De SDK verwerkt JSON-serialisatie en retry-logica automatisch. Zorg ervoor dat je een recente versie van het openai-pakket gebruikt. De model-ID die je moet opgeven is "uncensored". Hier is hoe je de client initialiseert en een verzoek maakt:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
Node.js-ontwikkelaars kunnen het officiële openai npm-pakket gebruiken. Net als bij Python configureer je de client met onze basis-URL en je API-sleutel. Dit stelt je in staat het ongecensureerde model te integreren in je bestaande Node-applicaties zonder de verzoeklogica te herschrijven. De SDK ondersteunt zowel synchrone als asynchrone patronen. Onthoud dat onze service een LLM API-aanbieder is die zich richt op ruwe tokenkosten, niet op enterprise SLA's. Gebruik dit patroon om te communiceren met het chatcompleties endpoint:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming Antwoorden
Voor lagere latentie en real-time gebruikerservaringen, activeer streaming door stream: true in te stellen. De API retourneert een stream van Server-Sent Events (SSE), waardoor je tokens kunt verwerken terwijl ze worden gegenereerd. Dit is handig voor chatinterfaces of applicaties waar wachten op het volledige antwoord te langzaam is. De SDK's verwerken het parseren van SSE-chunks automatisch. Houd er rekening mee dat streaming de prijsstelling of limieten niet verandert; je betaalt nog steeds voor het totale aantal gebruikte tokens. Hier is hoe je streaming in je code implementeert:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Rate Limits & Quota's
Onze API handhaaft een limiet van 300 requests per minuut per sleutel en een verzoeklichaamsgrootte van 8 MB. Als je de rate limit overschrijdt, retourneert de API een 429-statuscode. Authenticatiefouten resulteren in een 401-fout, meestal door een ongeldige of ontbrekende sleutel. Als je prepaid tegoed op is, ontvang je een 402-fout. Credits worden betaald via crypto (USDT of USDC), startend bij $10, met bonussen voor grotere top-ups. In tegenstelling tot sommige open ai api prijsmodellen, gebruiken we een eenvoudig pay-as-you-go prepaid creditsysteem zonder maandelijkse kosten. Het trial credit van $0,50 is 7 dagen geldig en vereist geen kaart. De contextlengte is beperkt tot 100k tokens, dus houd je invoergrootte in de gaten om overschrijdingen van limieten of hogere kosten te vermijden.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Model-ID | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredllmleaderboard.com/v1 |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| JSON-modus | response_format: {"type": "json_object"} |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Verzoekgrootte | tot 8 MB |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is dit hetzelfde als GPT of Claude?
Nee. Ons model is een open-weight model geïdentificeerd als "uncensored". Het is geen GPT, Claude, Gemini of DeepSeek. Het is afgestemd op het beantwoorden zonder weigeringen voor wettelijk volwassen inhoud en wordt geleverd vanaf onze eigen GPU-servers.
Hoe werkt de prijsstelling?
We rekenen $0,25 per 1M input tokens en $1,00 per 1M output tokens. Je betaalt via prepaid tegoed, dat nooit vervalt. Er zijn geen abonnementen of maandelijkse kosten. Credits kunnen worden opgewaard vanaf $10.
Bewaar je mijn prompts?
We gebruiken je prompts niet voor training. Een account vereist alleen een e-mailadres en wachtwoord. We bieden geen SLA-garanties of certificeringen zoals SOC2, maar we geven prioriteit aan privacy voor ongecensureerde chatcompleties.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.