Classifica LLM: Guida rapida API LLM senza censura
Questa guida rapida ti accompagna nel collegamento alla nostra API LLM senza censura, coprendo autenticazione, richieste di base, streaming e chiamata di funzioni con esempi concreti.
Base URL & Autenticazione
La nostra API segue lo standard di compatibilità OpenAI, il che significa che puoi utilizzare SDK esistenti con configurazioni minime. L'URL di base è https://api.uncensoredllmleaderboard.com/v1. Per l'autenticazione, genera una chiave API dal tuo dashboard e trasmettila nell'intestazione Authorization come token Bearer. Ogni account dispone di una chiave, che puoi rigenerare in qualsiasi momento per revocare l'accesso. A differenza di molte altre opzioni di provider API LLM, non richiediamo una carta di credito per la prova iniziale e i prompt non vengono utilizzati per l'addestramento. Ricorda che il nostro modello, identificato come "uncensored", è un modello a pesi aperti ottimizzato per rispondere senza rifiuti per contenuti adulti leciti, distinto da GPT o Claude.
Endpoint Completamenti Chat
La funzionalità principale è testo-in, testo-out tramite l'endpoint POST /v1/chat/completions. Invii un array di messaggi e ricevi una risposta generata. Questo endpoint supporta lo streaming tramite Server-Sent Events (SSE) e la chiamata di funzioni. Il nostro modello ha una finestra di contesto di 100.000 token sia per il prompt che per il completamento. A differenza delle classifiche aggregate che mostrano solo punteggi, offriamo accesso immediato agli sviluppatori a questo endpoint di completamenti chat senza censura con prezzi prevedibili e trasparenti. Non ci sono capacità di embedding, immagini o audio qui—solo generazione di testo grezzo. Usa l'esempio seguente per inviare la tua prima richiesta:
curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Per gli sviluppatori Python, l'SDK ufficiale di OpenAI funziona subito. Devi impostare base_url e api_key per puntare alla nostra infrastruttura. Questo approccio evita di scrivere client HTTP personalizzati e sfrutta metodi familiari come client.chat.completions.create(). L'SDK gestisce automaticamente la serializzazione JSON e la logica di retry. Assicurati di utilizzare una versione recente del pacchetto openai. L'ID del modello che devi specificare è "uncensored". Ecco come inizializzare il client ed effettuare una richiesta:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node
Gli sviluppatori Node.js possono utilizzare il pacchetto npm ufficiale openai. Similmente a Python, configuri il client con la nostra base URL e la tua chiave API. Questo ti permette di integrare il modello senza censura nelle tue applicazioni Node esistenti senza riscrivere la logica delle richieste. L'SDK supporta sia modelli sincroni che asincroni. Ricorda che il nostro servizio è un provider api llm focalizzato sui costi grezzi dei token, non su SLA enterprise. Usa questo pattern per interagire con l'endpoint di completamenti chat:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Risposte in streaming
Per latenza inferiore ed esperienze utente in tempo reale, abilita lo streaming impostando stream: true. L'API restituisce uno stream di Server-Sent Events (SSE), permettendoti di elaborare i token man mano che vengono generati. Questo è utile per interfacce chat o applicazioni dove aspettare la risposta completa è troppo lento. Gli SDK gestiscono automaticamente il parsing dei chunk SSE. Nota che lo streaming non cambia la tariffazione o i limiti; paghi ancora per i token totali utilizzati. Ecco come implementare lo streaming nel tuo codice:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti di velocità e quote
La nostra API impone un limite di 300 richieste al minuto per chiave e una dimensione del corpo della richiesta di 8 MB. Se superi il limite di richieste, l'API restituisce un codice di stato 429. I fallimenti di autenticazione risultano in un errore 401, solitamente dovuto a una chiave non valida o mancante. Se il tuo credito prepagato si esaurisce, riceverai un errore 402. I crediti sono pagati tramite cripto (USDT o USDC), a partire da $10, con bonus per ricariche più grandi. A differenza di alcuni modelli di tariffazione api open ai, utilizziamo un semplice sistema di credito prepagato pay as you go senza canoni mensili. Il credito di prova gratuito di $0,50 è valido per 7 giorni e non richiede carta. La lunghezza del contesto è limitata a 100k token, quindi monitora la dimensione del tuo input per evitare di superare i limiti o sostenere costi maggiori.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredllmleaderboard.com/v1 |
| Finestra di contesto | 100.000 token (input + output) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Concorrenza | 8 richieste contemporanee per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Bonus | +5% da $50, +10% da $100 |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
È uguale a GPT o Claude?
No. Il nostro modello è un modello a pesi aperti identificato come "uncensored". Non è GPT, Claude, Gemini o DeepSeek. È ottimizzato per rispondere senza rifiuti per contenuti adulti leciti ed è erogato dai nostri server GPU.
Come funziona la tariffazione?
Addebitiamo $0,25 per 1M token di input e $1,00 per 1M token di output. Paghi tramite credito prepagato, che non scade mai. Non ci sono abbonamenti o canoni mensili. I crediti possono essere ricaricati a partire da $10.
Memorizzate i miei prompt?
Non utilizziamo i tuoi prompt per l'addestramento. Un account richiede solo email e password. Non offriamo garanzie SLA o certificazioni come SOC2, ma diamo priorità alla privacy per i completamenti chat senza censura.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia la base URL. È tutta qui la configurazione.