VI ▾
Lấy khóa API

Bắt đầu nhanh

Tích hợp API LLM không kiểm duyệt của chúng tôi trong vài phút bằng cách thay đổi URL cơ sở và khóa API. Hướng dẫn nhanh này sẽ hướng dẫn bạn qua xác thực, hoàn thành trò chuyện, truyền phát và gọi hàm bằng các máy khách tương thích OpenAI tiêu chuẩn.

https://api.llmrouterapi.com/v1uncensored

Xác thực và URL cơ sở

Bắt đầu bằng cách tạo tài khoản tại Lấy khóa API. Khi đăng ký, bạn sẽ nhận được một khóa API duy nhất ngay lập tức. Không cần nhập thẻ tín dụng để dùng thử, và các prompt không được sử dụng để huấn luyện. Các yêu cầu của bạn sẽ xác thực với endpoint được lưu trữ bằng khóa này.

URL cơ sở cho tất cả các yêu cầu là https://api.llmrouterapi.com/v1. URL này tương thích với các SDK OpenAI chính thức và bất kỳ máy khách tương thích OpenAI tiêu chuẩn nào. Chỉ cần định cấu hình máy khách của bạn trỏ đến URL cơ sở này và đặt tiêu đề của bạn thành Authorization: Bearer YOUR_API_KEY. Không cần logic định tuyến phức tạp; chúng tôi xử lý cơ sở hạ tầng cho bạn.

Yêu cầu đầu tiên: Hoàn thành trò chuyện

Gửi yêu cầu đầu tiên đến endpoint POST /v1/chat/completions. Bạn phải chỉ định ID mô hình là "uncensored". Đây là một mô hình ngôn ngữ lớn trọng số mở được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người trưởng thành hợp pháp. Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token, bao gồm cả prompt và kết quả.

Dưới đây là một ví dụ cơ bản sử dụng curl để minh họa cấu trúc tải trọng JSON tiêu chuẩn.

curl https://api.llmrouterapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Sử dụng SDK Python

Đối với nhà phát triển Python, gói openai chính thức hoạt động ngay lập tức. Cấu hình máy khách để sử dụng URL cơ sở của chúng tôi và khóa API của bạn. Điều này đảm bảo mã hiện tại của bạn hoạt động ngay lập tức chỉ bằng cách thay đổi URL cơ sở và khóa API. Máy khách tự động xử lý việc tuần tự hóa và phân tích lỗi.

Đảm bảo bạn chỉ định mô hình là uncensored trong quá trình khởi tạo hoặc yêu cầu của bạn. Cách tiếp cận này loại bỏ sự phức tạp khi tích hợp và cho phép bạn tận dụng hệ sinh thái các công cụ LLM hiện có.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Tích hợp Node.js

Các nhà phát triển Node.js có thể sử dụng gói npm openai hoặc bất kỳ khách hàng nào dựa trên fetch. Đặt baseURL thành endpoint của chúng tôi và cung cấp khóa của bạn trong các tiêu đề. Phương pháp này rất lý tưởng cho các ứng dụng phía máy chủ hoặc các hàm biên giới nơi bạn cần kiểm soát lập trình đối với vòng đời yêu cầu.

API hỗ trợ gọi công cụ và hàm, cho phép bạn định nghĩa các hàm tùy chỉnh trong các hoàn thành trò chuyện của mình. Điều này cho phép logic phức tạp và truy xuất dữ liệu trực tiếp từ cấu trúc phản hồi của mô hình.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát

Để giảm độ trễ và cải thiện trải nghiệm người dùng, hãy bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về luồng Sự kiện được gửi bởi máy chủ (SSE), cung cấp token khi chúng được tạo. Điều này đặc biệt hữu ích cho các giao diện trò chuyện nơi người dùng mong đợi phản hồi ngay lập tức.

Mỗi phần chứa nội dung một phần, cho phép bạn hiển thị văn bản theo tiến triển. Tính năng này hoạt động liền mạch với các máy khách truyền phát tương thích OpenAI tiêu chuẩn, không yêu cầu logic phân tích bổ sung cho cấu trúc sự kiện.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Giới hạn, Lỗi và Danh sách mô hình

Theo dõi mức sử dụng và xử lý lỗi một cách khéo léo. API áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa và giới hạn kích thước yêu cầu 8 MB. Nếu khóa của bạn không hợp lệ, bạn sẽ nhận được lỗi 401. Mã trạng thái 402 cho biết tín dụng trả trước không đủ. Lỗi 429 cho biết bạn đã vượt quá giới hạn tốc độ.

Bạn có thể liệt kê các mô hình khả dụng qua GET /v1/models, kết quả sẽ trả về mô hình uncensored. Lưu ý rằng dịch vụ này không cung cấp embedding, tạo hình ảnh hoặc âm thanh. Để quản lý tài khoản, bạn có thể tạo lại khóa API của mình bất cứ lúc nào, điều này sẽ thu hồi khóa trước đó. Tín dụng không hết hạn và bạn có thể nạp tiền bắt đầu từ 10 USD.

Hỏi đáp

Cấu trúc giá cả như thế nào?

Chúng tôi cung cấp tín dụng trả trước trả theo nhu cầu không có phí hàng tháng. Chi phí là $0,25 cho mỗi 1 triệu token đầu vào và $1,00 cho mỗi 1 triệu token đầu ra. Tín dụng không bao giờ hết hạn, và bạn có thể nạp tiền qua tiền điện tử (USDT hoặc USDC) bắt đầu từ $10.

API này có hỗ trợ gọi công cụ không?

Đúng, <code>POST /v1/chat/completions</code> endpoint hỗ trợ gọi hàm và công cụ. Bạn có thể định nghĩa các hàm tùy chỉnh trong yêu cầu của mình, và mô hình sẽ trả về dữ liệu JSON có cấu trúc khi phù hợp.

Cửa sổ ngữ cảnh hỗ trợ bao nhiêu token?

Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token. Tổng số này bao gồm cả prompt (đầu vào) và completion (đầu ra). Hãy đảm bảo tổng số token của bạn nằm trong giới hạn này để có hiệu suất tối ưu.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.

Lấy khóa APIĐọc tài liệu

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
ID mô hìnhuncensored
Base URLhttps://api.llmrouterapi.com/v1
EndpointPOST /v1/chat/completions · GET /v1/models
Xác thựcAuthorization: Bearer YOUR_KEY
Chế độ JSONresponse_format: {"type": "json_object"}
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Thưởng+5% từ $50, +10% từ $100
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Đăng nhậpGoogle hoặc email và mật khẩu

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây