Таблица лидеров LLM: Руководство по быстрому старту API LLM без цензуры
Это руководство поможет вам подключиться к нашему API LLM без цензуры, охватывая аутентификацию, базовые запросы, потоковую передачу и вызов функций с конкретными примерами.
Базовый URL и аутентификация
Наш API следует стандарту совместимости OpenAI, что позволяет использовать существующие SDK с минимальной настройкой. Базовый URL: https://api.uncensoredllmleaderboard.com/v1. Для аутентификации сгенерируйте API-ключ в панели управления и передайте его в заголовке Authorization в виде Bearer-токена. У каждого аккаунта есть один ключ, который можно перегенерировать в любое время, чтобы отозвать доступ. В отличие от многих других провайдеров LLM API, нам не нужна кредитная карта для начального пробного периода, а промпты не используются для обучения. Помните, что наша модель, идентифицируемая как «uncensored», — это модель с открытыми весами, настроенная на ответы без отказов для законного контента для взрослых, в отличие от GPT или Claude.
Эндпоинт завершений чата
Основная функциональность — text-in, text-out через эндпоинт POST /v1/chat/completions. Вы отправляете массив сообщений и получаете сгенерированный ответ. Этот эндпоинт поддерживает потоковую передачу через Server-Sent Events (SSE) и вызов функций. У нашей модели контекстное окно на 100 000 токенов как для промпта, так и для завершения. В отличие от агрегированных лидербордов, которые показывают только оценки, мы предоставляем немедленный доступ разработчиков к этому эндпоинту завершения чата без цензуры с предсказуемым, прозрачным ценообразованием. Здесь нет эмбеддингов, изображений или аудио — только генерация текста. Используйте следующий пример для отправки первого запроса:
curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Для разработчиков на Python официальный SDK OpenAI работает из коробки. Вам нужно установить base_url и api_key, указав на нашу инфраструктуру. Этот подход позволяет избежать написания пользовательских HTTP-клиентов и использует знакомые методы, такие как client.chat.completions.create(). SDK автоматически обрабатывает сериализацию JSON и логику повторных попыток. Убедитесь, что вы используете недавнюю версию пакета openai. Идентификатор модели, который вы должны указать, — "uncensored". Вот как инициализировать клиент и выполнить запрос:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node
Разработчики на Node.js могут использовать официальный npm-пакет openai. Как и в Python, вы настраиваете клиент с нашим базовым URL и API-ключом. Это позволяет интегрировать модель без цензуры в существующие Node-приложения без переписывания логики запросов. SDK поддерживает как синхронные, так и асинхронные шаблоны. Помните, что наш сервис — это провайдер LLM API, ориентированный на прозрачные затраты на токены, а не на корпоративные SLA. Используйте этот шаблон для взаимодействия с эндпоинтом завершения чата:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Потоковые ответы
Для снижения задержки и обеспечения работы в реальном времени включите потоковую передачу, установив stream: true. API возвращает поток Server-Sent Events (SSE), позволяя обрабатывать токены по мере их генерации. Это полезно для интерфейсов чата или приложений, где ожидание полного ответа слишком медленное. SDK автоматически обрабатывают парсинг фрагментов SSE. Обратите внимание, что потоковая передача не меняет ценообразование или лимиты; вы все равно платите за общее количество использованных токенов. Вот как реализовать потоковую передачу в вашем коде:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Лимиты запросов и квоты
Наш API устанавливает лимит в 300 запросов в минуту на ключ и размер тела запроса до 8 МБ. Если вы превысите лимит запросов, API вернет статус-код 429. Ошибки аутентификации приводят к ошибке 401, обычно из-за недействительного или отсутствующего ключа. Если ваш предоплаченный баланс иссякнет, вы получите ошибку 402. Кредиты оплачиваются криптовалютой (USDT или USDC), начиная с $10, с бонусами за большие пополнения. В отличие от некоторых моделей ценообразования OpenAI API, мы используем простую систему предоплаченного баланса с оплатой по факту использования и без ежемесячных платежей. Пробный баланс в размере $0,50 действителен в течение 7 дней и не требует карты. Длина контекста ограничена 100k токенов, поэтому следите за размером ввода, чтобы не превысить лимиты и не понести дополнительные расходы.
Технические характеристики
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| ID модели | uncensored |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Авторизация | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredllmleaderboard.com/v1 |
| Контекстное окно | 100 000 токенов (вход и ответ вместе) |
| JSON-режим | response_format: {"type": "json_object"} |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| Максимум ответа | до остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Лимит запросов | 300 запросов в минуту на ключ |
| Параллельные запросы | до 8 одновременно на ключ |
| Размер запроса | до 8 МБ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Бонус | +5% от $50, +10% от $100 |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
| Вход | Google или e-mail и пароль |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Это то же самое, что GPT или Claude?
Нет. Наша модель — это модель с открытыми весами, идентифицированная как «без цензуры». Это не GPT, Claude, Gemini или DeepSeek. Она настроена на ответы без отказов для законного контента для взрослых и обслуживается с наших собственных GPU-серверов.
Как работает ценообразование?
Мы берем $0,25 за 1M входных токенов и $1,00 за 1M выходных токенов. Вы платите предоплаченным балансом, который не сгорает. Нет подписок или ежемесячных платежей. Баланс можно пополнить от $10.
Вы сохраняете мои промпты?
Мы не используем ваши промпты для обучения. Для создания учетной записи нужны только электронная почта и пароль. Мы не предоставляем гарантий SLA или сертификатов типа SOC2, но мы ставим конфиденциальность во главу угла для завершений чата без цензуры.
Ваш ключ — в одной форме от вас
Создайте учетную запись, скопируйте ключ, измените базовый URL. Вот и вся настройка.