VI ▾
Lấy khóa API

Bảng xếp hạng LLM: Hướng dẫn nhanh API LLM không kiểm duyệt

Hướng dẫn nhanh này sẽ hướng dẫn bạn cách kết nối với API LLM không kiểm duyệt của chúng tôi, bao gồm xác thực, yêu cầu cơ bản, truyền phát và gọi hàm với các ví dụ cụ thể.

Base URL & Xác thực

API của chúng tôi tuân theo tiêu chuẩn tương thích OpenAI, nghĩa là bạn có thể sử dụng các SDK hiện có với cấu hình tối thiểu. URL cơ sở là https://api.uncensoredllmleaderboard.com/v1. Để xác thực, hãy tạo khóa API từ bảng điều khiển của bạn và chuyển nó trong tiêu đề Authorization dưới dạng token Bearer. Mỗi tài khoản nhận được một khóa, bạn có thể tạo lại bất cứ lúc nào để thu hồi quyền truy cập. Không giống như nhiều tùy chọn nhà cung cấp llm api khác, chúng tôi không yêu cầu thẻ tín dụng cho bản dùng thử ban đầu, và prompt không được sử dụng để huấn luyện. Hãy nhớ rằng mô hình của chúng tôi, được xác định là "không kiểm duyệt", là một mô hình trọng số mở được tinh chỉnh để trả lời mà không từ chối đối với nội dung người lớn hợp pháp, khác biệt với GPT hoặc Claude.

Endpoint Hoàn thành Chat

Chức năng cốt lõi là văn bản vào, văn bản ra thông qua endpoint POST /v1/chat/completions. Bạn gửi một mảng tin nhắn và nhận một phản hồi được tạo ra. Endpoint này hỗ trợ truyền phát qua Server-Sent Events (SSE) và gọi hàm. Mô hình của chúng tôi có cửa sổ ngữ cảnh 100.000 token cho cả prompt và bản hoàn thành. Không giống như các bảng xếp hạng tổng hợp chỉ hiển thị điểm số, chúng tôi cung cấp quyền truy cập ngay lập tức cho nhà phát triển vào endpoint bản hoàn thành chat không kiểm duyệt này với giá cả minh bạch, rõ ràng. Không có khả năng nhúng, hình ảnh hoặc âm thanh ở đây—chỉ là tạo văn bản thô. Sử dụng ví dụ sau để gửi yêu cầu đầu tiên của bạn:

curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

SDK Python

Đối với nhà phát triển Python, SDK OpenAI chính thức hoạt động ngay lập tức. Bạn cần đặt base_url và api_key trỏ đến cơ sở hạ tầng của chúng tôi. Cách tiếp cận này tránh việc viết các máy khách HTTP tùy chỉnh và tận dụng các phương thức quen thuộc như client.chat.completions.create(). SDK tự động xử lý tuần tự hóa JSON và logic thử lại. Đảm bảo bạn đang sử dụng phiên bản mới nhất của gói openai. ID mô hình bạn phải chỉ định là "uncensored". Đây là cách khởi tạo máy khách và thực hiện yêu cầu:

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK Node

Nhà phát triển Node.js có thể sử dụng gói npm openai chính thức. Tương tự như Python, bạn cấu hình máy khách với base URL và khóa API của chúng tôi. Điều này cho phép bạn tích hợp mô hình không kiểm duyệt vào các ứng dụng Node hiện có mà không cần viết lại logic yêu cầu. SDK hỗ trợ cả mô hình đồng bộ và bất đồng bộ. Hãy nhớ rằng dịch vụ của chúng tôi là một nhà cung cấp api llm tập trung vào chi phí token thô, không phải SLA doanh nghiệp. Sử dụng mẫu này để tương tác với endpoint hoàn thành chat:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát

Để giảm độ trễ và trải nghiệm người dùng theo thời gian thực, hãy bật truyền phát bằng cách đặt stream: true. API trả về một luồng Server-Sent Events (SSE), cho phép bạn xử lý các token khi chúng được tạo. Điều này hữu ích cho các giao diện trò chuyện hoặc ứng dụng nơi việc chờ phản hồi đầy đủ là quá chậm. Các SDK tự động xử lý phân tích các chunk SSE. Lưu ý rằng truyền phát không thay đổi giá cả hoặc giới hạn; bạn vẫn phải trả tiền cho tổng số token đã sử dụng. Đây là cách triển khai truyền phát trong mã của bạn:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Giới hạn tốc độ & Hạn mức

API của chúng tôi áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa và kích thước thân yêu cầu 8 MB. Nếu bạn vượt quá giới hạn tốc độ, API sẽ trả về mã trạng thái 429. Lỗi xác thực dẫn đến lỗi 401, thường do khóa không hợp lệ hoặc bị thiếu. Nếu tín dụng trả trước của bạn hết, bạn sẽ nhận được lỗi 402. Tín dụng được thanh toán bằng tiền điện tử (USDT hoặc USDC), bắt đầu từ $10, với tiền thưởng cho các lần nạp thêm lớn hơn. Không giống như một số mô hình giá api open ai khác, chúng tôi sử dụng hệ thống tín dụng trả trước trả theo nhu cầu đơn giản với không có phí hàng tháng. Tín dụng dùng thử miễn phí $0,50 có giá trị trong 7 ngày và không yêu cầu thẻ. Độ dài ngữ cảnh được giới hạn ở 100k token, vì vậy hãy theo dõi kích thước đầu vào của bạn để tránh vượt quá giới hạn hoặc phát sinh chi phí cao hơn.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
ID mô hìnhuncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Xác thựcAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredllmleaderboard.com/v1
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Chế độ JSONresponse_format: {"type": "json_object"}
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Đây có phải là GPT hay Claude không?

Không. Mô hình của chúng tôi là một mô hình trọng số mở, được xác định là "không kiểm duyệt". Nó không phải là GPT, Claude, Gemini hay DeepSeek. Nó được tinh chỉnh để trả lời mà không từ chối đối với nội dung người lớn hợp pháp và được phục vụ từ các máy chủ GPU của riêng chúng tôi.

Giá cả hoạt động như thế nào?

Chúng tôi tính $0,25 cho mỗi 1 triệu token đầu vào và $1,00 cho mỗi 1 triệu token đầu ra. Bạn thanh toán bằng tín dụng trả trước, không bao giờ hết hạn. Không có gói đăng ký hoặc phí hàng tháng. Tín dụng có thể được nạp thêm bắt đầu từ $10.

Bạn có lưu trữ prompt của tôi không?

Chúng tôi không sử dụng prompt của bạn để huấn luyện. Tài khoản chỉ yêu cầu email và mật khẩu. Chúng tôi không cung cấp bảo đảm SLA hoặc chứng nhận như SOC2, nhưng chúng tôi ưu tiên quyền riêng tư cho các hoàn thành chat không kiểm duyệt.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.

Lấy khóa API