LLM 리더보드: 무검열 LLM API 빠른 시작 가이드
이 빠른 시작 가이드는 인증, 기본 요청, 스트리밍, 함수 호출과 함께 무검열 LLM API 연결 방법을 안내합니다.
Base URL 및 인증
당사의 API는 OpenAI 호환 표준을 따르므로 최소한의 구성으로 기존 SDK를 사용할 수 있습니다. 베이스 URL은 https://api.uncensoredllmleaderboard.com/v1입니다. 인증하려면 대시보드에서 API 키를 생성하고 Authorization 헤더에 Bearer 토큰으로 전달하십시오. 각 계정에는 키가 하나씩 부여되며, 언제든지 재생성하여 접근 권한을 무효화할 수 있습니다. 많은 LLM API 제공 옵션과 달리 초기 체험에는 신용카드가 필요하지 않으며 프롬프트는 학습에 사용되지 않습니다. "uncensored"로 식별되는 당사 모델은 합법적인 성인 콘텐츠에 대해 거절 없이 답변하도록 조정된 오픈 웨이트 모델이며, GPT나 Claude와 구별됩니다.
채팅 완성 엔드포인트
핵심 기능은 POST /v1/chat/completions 엔드포인트를 통한 텍스트 입력 및 텍스트 출력입니다. 메시지 배열을 보내고 생성된 응답을 받습니다. 이 엔드포인트는 서버 전송 이벤트(SSE)를 통한 스트리밍과 함수 호출을 지원합니다. 당사 모델은 프롬프트와 결과 모두에 대해 100,000 토큰 컨텍스트 창을 제공합니다. 점수만 표시하는 집계 리더보드와 달리, 당사는 예측 가능한 선납 가격으로 이 무검열 채팅 완료 엔드포인트에 대한 즉각적인 개발자 접근을 제공합니다. 여기에는 임베딩, 이미지 또는 오디오 기능이 없습니다. 순수 텍스트 생성만 가능합니다. 첫 번째 요청을 보내려면 다음 예시를 사용하십시오:
curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
Python 개발자의 경우 공식 OpenAI SDK가 바로 작동합니다. base_url과 api_key을 당사 인프라를 가리키도록 설정해야 합니다. 이 방식은 사용자 정의 HTTP 클라이언트를 작성할 필요가 없으며 client.chat.completions.create()과 같은 익숙한 메서드를 활용할 수 있습니다. SDK는 JSON 직렬화 및 재시도 로직을 자동으로 처리합니다. openai 패키지의 최신 버전을 사용하고 있는지 확인하십시오. 지정해야 할 모델 ID는 "uncensored"입니다. 클라이언트 초기화 및 요청 생성 방법은 다음과 같습니다:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
Node.js 개발자는 공식 openai npm 패키지를 사용할 수 있습니다. Python과 마찬가지로 당사 베이스 URL과 API 키를 사용하여 클라이언트를 구성합니다. 이를 통해 요청 로직을 다시 작성하지 않고도 기존 Node 애플리케이션에 무검열 모델을 통합할 수 있습니다. SDK는 동기식 및 비동기식 패턴을 모두 지원합니다. 당사 서비스는 엔터프라이즈 SLA가 아닌 순수 토큰 비용에 중점을 둔 LLM API 제공업체임을 기억하십시오. 채팅 완료 엔드포인트와 상호 작용하려면 다음 패턴을 사용하십시오:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
스트리밍 응답
낮은 지연 시간과 실시간 사용자 경험을 위해 stream: true을 설정하여 스트리밍을 활성화하세요. API는 서버 전송 이벤트(SSE) 스트림을 반환하여 생성되는 토큰을 처리할 수 있습니다. 이는 전체 응답을 기다리는 것이 너무 느린 채팅 인터페이스나 애플리케이션에 유용합니다. SDK는 SSE 청크의 파싱을 자동으로 처리합니다. 스트리밍은 가격이나 제한을 변경하지 않습니다. 사용된 총 토큰에 대해 여전히 요금이 청구됩니다. 코드에서 스트리밍을 구현하는 방법은 다음과 같습니다:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
속도 제한 및 할당량
당사 API는 키당 분당 300개의 요청과 8 MB의 요청 본문 크기로 제한을 적용합니다. 속도 제한을 초과하면 API는 429 상태 코드를 반환합니다. 인증 실패는 일반적으로 키가 잘못되었거나 누락되어 401 오류를 발생시킵니다. 선불 크레딧이 소진되면 402 오류가 발생합니다. 크레딧은 USDT 또는 USDC와 같은 암호화폐를 통해 결제하며, 최소 결제 금액은 $10이며 더 큰 충전 시 보너스가 제공됩니다. 일부 OpenAI API 가격 책정 모델과 달리 당사는 월 구독료 없이 간단한 선불 크레딧 선불 사용량 기반 과금 시스템을 사용합니다. $0.50의 무료 체험 크레딧은 7일 동안 유효하며 카드가 필요하지 않습니다. 컨텍스트 창 길이는 100k 토큰으로 제한되므로 한도를 초과하거나 비용이 더 많이 발생하는 것을 피하기 위해 입력 크기를 모니터링하십시오.
기술 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 모델 ID | uncensored |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 인증 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredllmleaderboard.com/v1 |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| JSON 모드 | response_format: {"type": "json_object"} |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 속도 제한 | 키당 분당 300회 |
| 동시 요청 | 키당 동시 8개 |
| 요청 크기 | 최대 8 MB |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
GPT나 Claude와 같은가요?
아닙니다. 저희 모델은 "무검열"로 식별되는 오픈 웨이트 모델입니다. GPT, Claude, Gemini, DeepSeek가 아닙니다. 합법적인 성인 콘텐츠에 대해 거부 없이 답변하도록 튜닝되었으며 자체 GPU 서버에서 제공됩니다.
가격 정책은 어떻게 되나요?
입력 토큰 1M당 $0.25, 출력 토큰 1M당 $1.00을 청구합니다. 선불 크레딧으로 결제하며 크레딧은 만료되지 않습니다. 구독이나 월 요금이 없습니다. 크레딧은 $10부터 충전할 수 있습니다.
프롬프트를 저장하나요?
프롬프트를 학습에 사용하지 않습니다. 계정 생성에는 이메일과 비밀번호만 필요합니다. SOC2와 같은 SLA 보장이나 인증은 제공하지 않지만 무검열 채팅 완성에 대한 프라이버시를 최우선으로 합니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 Base URL을 변경하세요. 설정은 이것뿐입니다.