NL ▾
API-sleutel aanvragen

LLM Leaderboard: Ongecensureerde LLM API-snelstartgids

Deze snelstartgids laat je zien hoe je verbinding maakt met onze ongecensureerde LLM-API, inclusief authenticatie, basisverzoeken, streaming en function calling met concrete voorbeelden.

Basis-URL & Authenticatie

Onze API volgt de OpenAI-compatibiliteitsstandaard, wat betekent dat je bestaande SDK's kunt gebruiken met minimale configuratie. De basis-URL is https://api.uncensoredllmleaderboard.com/v1. Om te authenticeren, genereer je een API-sleutel in je dashboard en voeg je deze toe aan de Authorization-header als Bearer-token. Elk account krijgt één sleutel, die je op elk moment kunt regenereren om toegang te intrekken. In tegenstelling tot veel LLM-aanbieders, vereisen we geen creditcard voor de initiële proefversie en worden prompts niet gebruikt voor training. Onthoud dat ons model, geïdentificeerd als "ongecensureerd", een open-weight model is dat is afgestemd om zonder weigeringen te antwoorden op wettelijke volwassen inhoud, en verschilt van GPT of Claude.

Chat Completies Endpoint

De kernfunctionaliteit is tekst-in, tekst-uit via het POST /v1/chat/completions-endpoint. Je stuurt een berichtarray en ontvangt een gegenereerd antwoord. Dit endpoint ondersteunt streaming via Server-Sent Events (SSE) en function calling. Ons model heeft een contextvenster van 100.000 tokens voor zowel prompt als completion. In tegenstelling tot geaggregeerde leaderboards die alleen scores tonen, bieden we directe ontwikkelaars toegang tot dit ongecensureerde chat-completions-endpoint met voorspelbare, vooraf bekende prijzen. Er zijn hier geen embedding-, afbeeldings- of audiofuncties—alleen ruwe tekstgeneratie. Gebruik het volgende voorbeeld om je eerste verzoek te versturen:

curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK

Voor Python-ontwikkelaars werkt de officiële OpenAI SDK direct. Je moet de base_url en api_key instellen om naar onze infrastructuur te verwijzen. Deze aanpak voorkomt het schrijven van aangepaste HTTP-clients en maakt gebruik van bekende methoden zoals client.chat.completions.create(). De SDK verwerkt JSON-serialisatie en retry-logica automatisch. Zorg ervoor dat je een recente versie van het openai-pakket gebruikt. De model-ID die je moet opgeven is "uncensored". Hier is hoe je de client initialiseert en een verzoek maakt:

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK

Node.js-ontwikkelaars kunnen het officiële openai npm-pakket gebruiken. Net als bij Python configureer je de client met onze basis-URL en je API-sleutel. Dit stelt je in staat het ongecensureerde model te integreren in je bestaande Node-applicaties zonder de verzoeklogica te herschrijven. De SDK ondersteunt zowel synchrone als asynchrone patronen. Onthoud dat onze service een LLM API-aanbieder is die zich richt op ruwe tokenkosten, niet op enterprise SLA's. Gebruik dit patroon om te communiceren met het chatcompleties endpoint:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming Antwoorden

Voor lagere latentie en real-time gebruikerservaringen, activeer streaming door stream: true in te stellen. De API retourneert een stream van Server-Sent Events (SSE), waardoor je tokens kunt verwerken terwijl ze worden gegenereerd. Dit is handig voor chatinterfaces of applicaties waar wachten op het volledige antwoord te langzaam is. De SDK's verwerken het parseren van SSE-chunks automatisch. Houd er rekening mee dat streaming de prijsstelling of limieten niet verandert; je betaalt nog steeds voor het totale aantal gebruikte tokens. Hier is hoe je streaming in je code implementeert:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Rate Limits & Quota's

Onze API handhaaft een limiet van 300 requests per minuut per sleutel en een verzoeklichaamsgrootte van 8 MB. Als je de rate limit overschrijdt, retourneert de API een 429-statuscode. Authenticatiefouten resulteren in een 401-fout, meestal door een ongeldige of ontbrekende sleutel. Als je prepaid tegoed op is, ontvang je een 402-fout. Credits worden betaald via crypto (USDT of USDC), startend bij $10, met bonussen voor grotere top-ups. In tegenstelling tot sommige open ai api prijsmodellen, gebruiken we een eenvoudig pay-as-you-go prepaid creditsysteem zonder maandelijkse kosten. Het trial credit van $0,50 is 7 dagen geldig en vereist geen kaart. De contextlengte is beperkt tot 100k tokens, dus houd je invoergrootte in de gaten om overschrijdingen van limieten of hogere kosten te vermijden.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Model-IDuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthenticatieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredllmleaderboard.com/v1
Contextvenster100.000 tokens (invoer + uitvoer)
JSON-modusresponse_format: {"type": "json_object"}
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Verzoekgroottetot 8 MB
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Bonus+5% vanaf $50, +10% vanaf $100
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Is dit hetzelfde als GPT of Claude?

Nee. Ons model is een open-weight model geïdentificeerd als "uncensored". Het is geen GPT, Claude, Gemini of DeepSeek. Het is afgestemd op het beantwoorden zonder weigeringen voor wettelijk volwassen inhoud en wordt geleverd vanaf onze eigen GPU-servers.

Hoe werkt de prijsstelling?

We rekenen $0,25 per 1M input tokens en $1,00 per 1M output tokens. Je betaalt via prepaid tegoed, dat nooit vervalt. Er zijn geen abonnementen of maandelijkse kosten. Credits kunnen worden opgewaard vanaf $10.

Bewaar je mijn prompts?

We gebruiken je prompts niet voor training. Een account vereist alleen een e-mailadres en wachtwoord. We bieden geen SLA-garanties of certificeringen zoals SOC2, maar we geven prioriteit aan privacy voor ongecensureerde chatcompleties.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.

API-sleutel aanvragen