Ranking LLM: Przewodnik szybkiego startu API LLM bez cenzury
Ten przewodnik szybkiego startu przeprowadzi Cię przez połączenie z naszym API LLM bez cenzury, obejmując uwierzytelnianie, podstawowe zapytania, strumieniowanie i wywoływanie funkcji z konkretnymi przykładami.
Base URL i uwierzytelnianie
Nasz API jest zgodny ze standardem OpenAI, co oznacza, że możesz używać istniejących SDK przy minimalnej konfiguracji. Base URL to https://api.uncensoredllmleaderboard.com/v1. Aby się uwierzytelnić, wygeneruj klucz API w panelu i przekaż go w nagłówku Authorization jako token Bearer. Każde konto otrzymuje jeden klucz, który możesz wygenerować ponownie w dowolnym momencie, aby unieważnić dostęp. W przeciwieństwie do wielu opcji dostawców API LLM, nie wymagamy karty kredytowej do początkowego kredytu próbnego, a prompty nie są używane do trenowania. Pamiętaj, że nasz model, oznaczony jako „uncensored”, to model o otwartych wagach dostosowany do odpowiadania bez odmów dla legalnej treści dla dorosłych, różniący się od GPT lub Claude.
Endpoint uzupełnień czatu
Podstawowa funkcjonalność to tekst-wejściowy, tekst-wyjściowy przez endpoint POST /v1/chat/completions. Wysyłasz tablicę wiadomości i otrzymujesz wygenerowaną odpowiedź. Ten endpoint obsługuje strumieniowanie za pomocą Server-Sent Events (SSE) oraz wywoływanie funkcji. Nasz model ma 100 000-tokenowe okno kontekstu zarówno dla promptu, jak i uzupełnienia. W przeciwieństwie do agregowanych rankingów, które pokazują tylko wyniki, zapewniamy bezpośredni dostęp deweloperski do tego endpointu uzupełnień czatu bez cenzury z przewidywalną, z góry określoną ceną. Nie ma tu embeddingów, obrazów ani możliwości audio — tylko surowa generacja tekstu. Użyj poniższego przykładu, aby wysłać swoje pierwsze zapytanie:
curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Dla programistów Python oficjalne SDK OpenAI działa od ręki. Musisz ustawić base_url i api_key, aby wskazywały na naszą infrastrukturę. To podejście unika pisania własnych klientów HTTP i wykorzystuje znane metody takie jak client.chat.completions.create(). SDK automatycznie obsługuje serializację JSON i logikę ponownych prób. Upewnij się, że używasz najnowszej wersji pakietu openai. ID modelu, który musisz podać, to "uncensored". Oto jak zainicjować klienta i wysłać zapytanie:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node
Deweloperzy Node.js mogą użyć oficjalnego pakietu npm openai. Podobnie jak w Pythonie, konfigurujesz klienta z naszym base URL i kluczem API. Pozwala to na integrację modelu bez cenzury w istniejących aplikacjach Node bez przepisywania logiki zapytań. SDK obsługuje zarówno wzorce synchroniczne, jak i asynchroniczne. Pamiętaj, że nasza usługa to dostawca API LLM skupiony na surowych kosztach tokenów, a nie na SLA dla przedsiębiorstw. Użyj tego wzorca do interakcji z endpointem uzupełnień czatu:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Odpowiedzi strumieniowe
Dla niższego opóźnienia i doświadczeń w czasie rzeczywistym włącz strumieniowanie, ustawiając stream: true. API zwraca strumień Server-Sent Events (SSE), pozwalając Ci przetwarzać tokeny w miarę ich generowania. Jest to przydatne dla interfejsów czatu lub aplikacji, gdzie oczekiwanie na pełną odpowiedź jest zbyt wolne. SDK automatycznie przetwarzają fragmenty SSE. Pamiętaj, że strumieniowanie nie zmienia cennika ani limitów; nadal płacisz za całkowitą liczbę użytych tokenów. Oto jak zaimplementować strumieniowanie w swoim kodzie:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limity zapytań i limity
Nasze API narzuca limit 300 zapytań na minutę na klucz i rozmiar ciała zapytania 8 MB. Jeśli przekroczysz limit zapytań, API zwróci kod statusu 429. Niepowodzenia uwierzytelniania skutkują błędem 401, zwykle z powodu nieprawidłowego lub brakującego klucza. Jeśli Twój przedpłacony kredyt się wyczerpie, otrzymasz błąd 402. Kredyty są opłacane kryptowalutą (USDT lub USDC), zaczynając od $10, z bonusami za większe doładowania. W przeciwieństwie do niektórych modeli cenowych API OpenAI, używamy prostego systemu przedpłaconego kredytu pay-as-you-go bez opłat miesięcznych. Darmowy kredyt próbny $0,50 jest ważny przez 7 dni i nie wymaga karty. Długość kontekstu jest ograniczona do 100k tokenów, więc monitoruj rozmiar wejścia, aby uniknąć przekroczenia limitów lub poniesienia wyższych kosztów.
Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| ID modelu | uncensored |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredllmleaderboard.com/v1 |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Rozmiar zapytania | do 8 MB |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Bonus | +5% od $50, +10% od $100 |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy to to samo co GPT lub Claude?
Nie. Nasz model to model o otwartych wagach oznaczony jako „bezcenzurowy”. Nie jest to GPT, Claude, Gemini ani DeepSeek. Jest dostrojony do odpowiadania bez odmów dla legalnej treści dla dorosłych i jest obsługiwany przez własne serwery GPU.
Jak działa cennik?
Pobieramy $0,25 za 1M tokenów wejściowych i $1,00 za 1M tokenów wyjściowych. Płacisz przedpłaconym kredetem, który nigdy nie wygasa. Nie ma subskrypcji ani opłat miesięcznych. Kredyty można doładować od kwoty $10.
Czy przechowujecie moje prompty?
Nie używamy Twoich promptów do trenowania. Konto wymaga tylko adresu e-mail i hasła. Nie oferujemy gwarancji SLA ani certyfikatów takich jak SOC2, ale priorytetowo traktujemy prywatność w bezscenzurowych uzupełnieniach czatu.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień base URL. To cała konfiguracja.