Bắt đầu nhanh
Tích hợp API LLM không kiểm duyệt của chúng tôi trong vài phút bằng cách thay đổi URL cơ sở và khóa API. Hướng dẫn nhanh này sẽ hướng dẫn bạn qua xác thực, hoàn thành trò chuyện, truyền phát và gọi hàm bằng các máy khách tương thích OpenAI tiêu chuẩn.
https://api.llmrouterapi.com/v1uncensored
Xác thực và URL cơ sở
Bắt đầu bằng cách tạo tài khoản tại Lấy khóa API. Khi đăng ký, bạn sẽ nhận được một khóa API duy nhất ngay lập tức. Không cần nhập thẻ tín dụng để dùng thử, và các prompt không được sử dụng để huấn luyện. Các yêu cầu của bạn sẽ xác thực với endpoint được lưu trữ bằng khóa này.
URL cơ sở cho tất cả các yêu cầu là https://api.llmrouterapi.com/v1. URL này tương thích với các SDK OpenAI chính thức và bất kỳ máy khách tương thích OpenAI tiêu chuẩn nào. Chỉ cần định cấu hình máy khách của bạn trỏ đến URL cơ sở này và đặt tiêu đề của bạn thành Authorization: Bearer YOUR_API_KEY. Không cần logic định tuyến phức tạp; chúng tôi xử lý cơ sở hạ tầng cho bạn.
Yêu cầu đầu tiên: Hoàn thành trò chuyện
Gửi yêu cầu đầu tiên đến endpoint POST /v1/chat/completions. Bạn phải chỉ định ID mô hình là "uncensored". Đây là một mô hình ngôn ngữ lớn trọng số mở được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người trưởng thành hợp pháp. Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token, bao gồm cả prompt và kết quả.
Dưới đây là một ví dụ cơ bản sử dụng curl để minh họa cấu trúc tải trọng JSON tiêu chuẩn.
curl https://api.llmrouterapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Sử dụng SDK Python
Đối với nhà phát triển Python, gói openai chính thức hoạt động ngay lập tức. Cấu hình máy khách để sử dụng URL cơ sở của chúng tôi và khóa API của bạn. Điều này đảm bảo mã hiện tại của bạn hoạt động ngay lập tức chỉ bằng cách thay đổi URL cơ sở và khóa API. Máy khách tự động xử lý việc tuần tự hóa và phân tích lỗi.
Đảm bảo bạn chỉ định mô hình là uncensored trong quá trình khởi tạo hoặc yêu cầu của bạn. Cách tiếp cận này loại bỏ sự phức tạp khi tích hợp và cho phép bạn tận dụng hệ sinh thái các công cụ LLM hiện có.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Tích hợp Node.js
Các nhà phát triển Node.js có thể sử dụng gói npm openai hoặc bất kỳ khách hàng nào dựa trên fetch. Đặt baseURL thành endpoint của chúng tôi và cung cấp khóa của bạn trong các tiêu đề. Phương pháp này rất lý tưởng cho các ứng dụng phía máy chủ hoặc các hàm biên giới nơi bạn cần kiểm soát lập trình đối với vòng đời yêu cầu.
API hỗ trợ gọi công cụ và hàm, cho phép bạn định nghĩa các hàm tùy chỉnh trong các hoàn thành trò chuyện của mình. Điều này cho phép logic phức tạp và truy xuất dữ liệu trực tiếp từ cấu trúc phản hồi của mô hình.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Phản hồi truyền phát
Để giảm độ trễ và cải thiện trải nghiệm người dùng, hãy bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về luồng Sự kiện được gửi bởi máy chủ (SSE), cung cấp token khi chúng được tạo. Điều này đặc biệt hữu ích cho các giao diện trò chuyện nơi người dùng mong đợi phản hồi ngay lập tức.
Mỗi phần chứa nội dung một phần, cho phép bạn hiển thị văn bản theo tiến triển. Tính năng này hoạt động liền mạch với các máy khách truyền phát tương thích OpenAI tiêu chuẩn, không yêu cầu logic phân tích bổ sung cho cấu trúc sự kiện.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Giới hạn, Lỗi và Danh sách mô hình
Theo dõi mức sử dụng và xử lý lỗi một cách khéo léo. API áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa và giới hạn kích thước yêu cầu 8 MB. Nếu khóa của bạn không hợp lệ, bạn sẽ nhận được lỗi 401. Mã trạng thái 402 cho biết tín dụng trả trước không đủ. Lỗi 429 cho biết bạn đã vượt quá giới hạn tốc độ.
Bạn có thể liệt kê các mô hình khả dụng qua GET /v1/models, kết quả sẽ trả về mô hình uncensored. Lưu ý rằng dịch vụ này không cung cấp embedding, tạo hình ảnh hoặc âm thanh. Để quản lý tài khoản, bạn có thể tạo lại khóa API của mình bất cứ lúc nào, điều này sẽ thu hồi khóa trước đó. Tín dụng không hết hạn và bạn có thể nạp tiền bắt đầu từ 10 USD.
Hỏi đáp
Cấu trúc giá cả như thế nào?
Chúng tôi cung cấp tín dụng trả trước trả theo nhu cầu không có phí hàng tháng. Chi phí là $0,25 cho mỗi 1 triệu token đầu vào và $1,00 cho mỗi 1 triệu token đầu ra. Tín dụng không bao giờ hết hạn, và bạn có thể nạp tiền qua tiền điện tử (USDT hoặc USDC) bắt đầu từ $10.
API này có hỗ trợ gọi công cụ không?
Đúng, <code>POST /v1/chat/completions</code> endpoint hỗ trợ gọi hàm và công cụ. Bạn có thể định nghĩa các hàm tùy chỉnh trong yêu cầu của mình, và mô hình sẽ trả về dữ liệu JSON có cấu trúc khi phù hợp.
Cửa sổ ngữ cảnh hỗ trợ bao nhiêu token?
Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token. Tổng số này bao gồm cả prompt (đầu vào) và completion (đầu ra). Hãy đảm bảo tổng số token của bạn nằm trong giới hạn này để có hiệu suất tối ưu.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.
Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| ID mô hình | uncensored |
| Base URL | https://api.llmrouterapi.com/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Thưởng | +5% từ $50, +10% từ $100 |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Đăng nhập | Google hoặc email và mật khẩu |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |