Bảng xếp hạng LLM: Hướng dẫn nhanh API LLM không kiểm duyệt
Hướng dẫn nhanh này sẽ hướng dẫn bạn cách kết nối với API LLM không kiểm duyệt của chúng tôi, bao gồm xác thực, yêu cầu cơ bản, truyền phát và gọi hàm với các ví dụ cụ thể.
Base URL & Xác thực
API của chúng tôi tuân theo tiêu chuẩn tương thích OpenAI, nghĩa là bạn có thể sử dụng các SDK hiện có với cấu hình tối thiểu. URL cơ sở là https://api.uncensoredllmleaderboard.com/v1. Để xác thực, hãy tạo khóa API từ bảng điều khiển của bạn và chuyển nó trong tiêu đề Authorization dưới dạng token Bearer. Mỗi tài khoản nhận được một khóa, bạn có thể tạo lại bất cứ lúc nào để thu hồi quyền truy cập. Không giống như nhiều tùy chọn nhà cung cấp llm api khác, chúng tôi không yêu cầu thẻ tín dụng cho bản dùng thử ban đầu, và prompt không được sử dụng để huấn luyện. Hãy nhớ rằng mô hình của chúng tôi, được xác định là "không kiểm duyệt", là một mô hình trọng số mở được tinh chỉnh để trả lời mà không từ chối đối với nội dung người lớn hợp pháp, khác biệt với GPT hoặc Claude.
Endpoint Hoàn thành Chat
Chức năng cốt lõi là văn bản vào, văn bản ra thông qua endpoint POST /v1/chat/completions. Bạn gửi một mảng tin nhắn và nhận một phản hồi được tạo ra. Endpoint này hỗ trợ truyền phát qua Server-Sent Events (SSE) và gọi hàm. Mô hình của chúng tôi có cửa sổ ngữ cảnh 100.000 token cho cả prompt và bản hoàn thành. Không giống như các bảng xếp hạng tổng hợp chỉ hiển thị điểm số, chúng tôi cung cấp quyền truy cập ngay lập tức cho nhà phát triển vào endpoint bản hoàn thành chat không kiểm duyệt này với giá cả minh bạch, rõ ràng. Không có khả năng nhúng, hình ảnh hoặc âm thanh ở đây—chỉ là tạo văn bản thô. Sử dụng ví dụ sau để gửi yêu cầu đầu tiên của bạn:
curl https://api.uncensoredllmleaderboard.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Đối với nhà phát triển Python, SDK OpenAI chính thức hoạt động ngay lập tức. Bạn cần đặt base_url và api_key trỏ đến cơ sở hạ tầng của chúng tôi. Cách tiếp cận này tránh việc viết các máy khách HTTP tùy chỉnh và tận dụng các phương thức quen thuộc như client.chat.completions.create(). SDK tự động xử lý tuần tự hóa JSON và logic thử lại. Đảm bảo bạn đang sử dụng phiên bản mới nhất của gói openai. ID mô hình bạn phải chỉ định là "uncensored". Đây là cách khởi tạo máy khách và thực hiện yêu cầu:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmleaderboard.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node
Nhà phát triển Node.js có thể sử dụng gói npm openai chính thức. Tương tự như Python, bạn cấu hình máy khách với base URL và khóa API của chúng tôi. Điều này cho phép bạn tích hợp mô hình không kiểm duyệt vào các ứng dụng Node hiện có mà không cần viết lại logic yêu cầu. SDK hỗ trợ cả mô hình đồng bộ và bất đồng bộ. Hãy nhớ rằng dịch vụ của chúng tôi là một nhà cung cấp api llm tập trung vào chi phí token thô, không phải SLA doanh nghiệp. Sử dụng mẫu này để tương tác với endpoint hoàn thành chat:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmleaderboard.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Phản hồi truyền phát
Để giảm độ trễ và trải nghiệm người dùng theo thời gian thực, hãy bật truyền phát bằng cách đặt stream: true. API trả về một luồng Server-Sent Events (SSE), cho phép bạn xử lý các token khi chúng được tạo. Điều này hữu ích cho các giao diện trò chuyện hoặc ứng dụng nơi việc chờ phản hồi đầy đủ là quá chậm. Các SDK tự động xử lý phân tích các chunk SSE. Lưu ý rằng truyền phát không thay đổi giá cả hoặc giới hạn; bạn vẫn phải trả tiền cho tổng số token đã sử dụng. Đây là cách triển khai truyền phát trong mã của bạn:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Giới hạn tốc độ & Hạn mức
API của chúng tôi áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa và kích thước thân yêu cầu 8 MB. Nếu bạn vượt quá giới hạn tốc độ, API sẽ trả về mã trạng thái 429. Lỗi xác thực dẫn đến lỗi 401, thường do khóa không hợp lệ hoặc bị thiếu. Nếu tín dụng trả trước của bạn hết, bạn sẽ nhận được lỗi 402. Tín dụng được thanh toán bằng tiền điện tử (USDT hoặc USDC), bắt đầu từ $10, với tiền thưởng cho các lần nạp thêm lớn hơn. Không giống như một số mô hình giá api open ai khác, chúng tôi sử dụng hệ thống tín dụng trả trước trả theo nhu cầu đơn giản với không có phí hàng tháng. Tín dụng dùng thử miễn phí $0,50 có giá trị trong 7 ngày và không yêu cầu thẻ. Độ dài ngữ cảnh được giới hạn ở 100k token, vì vậy hãy theo dõi kích thước đầu vào của bạn để tránh vượt quá giới hạn hoặc phát sinh chi phí cao hơn.
Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| ID mô hình | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredllmleaderboard.com/v1 |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Thưởng | +5% từ $50, +10% từ $100 |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Đăng nhập | Google hoặc email và mật khẩu |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Đây có phải là GPT hay Claude không?
Không. Mô hình của chúng tôi là một mô hình trọng số mở, được xác định là "không kiểm duyệt". Nó không phải là GPT, Claude, Gemini hay DeepSeek. Nó được tinh chỉnh để trả lời mà không từ chối đối với nội dung người lớn hợp pháp và được phục vụ từ các máy chủ GPU của riêng chúng tôi.
Giá cả hoạt động như thế nào?
Chúng tôi tính $0,25 cho mỗi 1 triệu token đầu vào và $1,00 cho mỗi 1 triệu token đầu ra. Bạn thanh toán bằng tín dụng trả trước, không bao giờ hết hạn. Không có gói đăng ký hoặc phí hàng tháng. Tín dụng có thể được nạp thêm bắt đầu từ $10.
Bạn có lưu trữ prompt của tôi không?
Chúng tôi không sử dụng prompt của bạn để huấn luyện. Tài khoản chỉ yêu cầu email và mật khẩu. Chúng tôi không cung cấp bảo đảm SLA hoặc chứng nhận như SOC2, nhưng chúng tôi ưu tiên quyền riêng tư cho các hoàn thành chat không kiểm duyệt.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.