PL ▾
Pobierz klucz API

Szybki start integracji

Zintegruj nasz model LLM bez cenzury w kilka minut, zmieniając podstawowy adres URL i klucz API. Ten przewodnik poprowadzi Cię przez uwierzytelnianie, uzupełnianie czatu, strumieniowanie i wywoływanie funkcji przy użyciu standardowych klientów kompatybilnych z OpenAI.

https://api.llmrouterapi.com/v1uncensored

Uwierzytelnianie i podstawowy adres URL

Zacznij od założenia konta w Pobierz klucz API. Po rejestracji natychmiast otrzymujesz unikalny klucz API. Nie musisz podawać karty kredytowej do wersji próbnej, a prompty nie są używane do trenowania modeli. Twoje zapytania uwierzytelniają się wobec hostowanego endpointu za pomocą tego klucza.

Podstawowy adres URL dla wszystkich zapytań to https://api.llmrouterapi.com/v1. Ten adres URL jest kompatybilny z oficjalnymi SDK OpenAI oraz dowolnym standardowym klientem kompatybilnym z OpenAI. Po prostu skonfiguruj swojego klienta tak, aby wskazywał na ten podstawowy adres URL i ustaw nagłówek Authorization: Bearer YOUR_API_KEY. Nie jest wymagana skomplikowana logika routingu; my zajmujemy się infrastrukturą za Ciebie.

Pierwsze zapytanie: Uzupełnianie czatu

Wyślij swoje pierwsze zapytanie do endpointu POST /v1/chat/completions. Musisz określić identyfikator modelu jako "uncensored". Jest to model o otwartych wagach, dostrojony do odpowiadania bez odmów treści dla użytkowników dorosłych. Obsługuje okno kontekstu 100 000 tokenów, obejmujące zarówno prompt, jak i completion.

Poniżej znajduje się podstawowy przykład użycia curla demonstrujący strukturę standardowego ładunku JSON.

curl https://api.llmrouterapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Użycie SDK Pythona

Dla programistów Pythona oficjalny pakiet openai działa od razu po instalacji. Skonfiguruj klienta tak, aby używał naszego podstawowego adresu URL i Twojego klucza API. Dzięki temu Twój istniejący kod zadziała natychmiast po prostu przez zmianę podstawowego adresu URL i klucza API. Klient automatycznie zajmuje się serializacją i parsowaniem błędów.

Upewnij się, że określasz model jako uncensored podczas inicjalizacji lub w zapytaniu. To podejście eliminuje tarcia integracyjne i pozwala wykorzystać bogaty ekosystem istniejących narzędzi LLM.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integracja Node.js

Programiści Node.js mogą użyć pakietu npm openai lub dowolnego klienta opartego na fetch. Ustaw baseURL na nasz endpoint i podaj swój klucz w nagłówkach. Ta metoda jest idealna dla aplikacji po stronie serwera lub funkcji brzegowych, gdzie potrzebujesz programistycznej kontroli nad cyklem życia zapytania.

API obsługuje wywoływanie narzędzi i funkcji, pozwalając zdefiniować własne funkcje w ramach uzupełniania czatu. Umożliwia to złożoną logikę i pobieranie danych bezpośrednio ze struktury odpowiedzi modelu.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Odpowiedzi strumieniowe

Aby zmniejszyć opóźnienia i poprawić doświadczenie użytkownika, włącz strumieniowanie, ustawiając stream: true w zapytaniu. API zwraca strumień zdarzeń wysłanych przez serwer (SSE), dostarczając tokeny w miarę ich generowania. Jest to szczególnie przydatne w interfejsach czatu, gdzie użytkownicy oczekują natychmiastowej informacji zwrotnej.

Każdy fragment zawiera częściową treść, co pozwala renderować tekst progresywnie. Ta funkcja działa bezproblemowo ze standardowymi klientami strumieniowania kompatybilnymi z OpenAI, nie wymagając dodatkowej logiki parsowania struktury zdarzeń.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limity, błędy i lista modeli

Monitoruj swoje zużycie i obsługuj błędy w sposób elegancki. API narzuca limit 300 zapytań na minutę na klucz oraz limit rozmiaru ciała zapytania na 8 MB. Jeśli Twój klucz jest nieprawidłowy, otrzymasz błąd 401. Status 402 oznacza niewystarczający przedpłacony kredyt. Błąd 429 sygnalizuje przekroczenie limitu zapytań.

Możesz wyświetlić dostępne modele za pomocą GET /v1/models, co zwróci model uncensored. Zauważ, że ta usługa nie oferuje embeddingów, generowania obrazów ani audio. W przypadku zarządzania kontem możesz wygenerować ponownie swój klucz API w dowolnym momencie, co unieważni poprzedni. Kredyty nie wygasają, a doładowanie możesz wykonać od kwoty $10.

Pytania i odpowiedzi

Jaka jest struktura cenowa?

Oferujemy przedpłacony kredyt rozliczany za zużycie bez miesięcznych opłat. Koszt to $0.25 za 1M tokenów wejściowych i $1.00 za 1M tokenów wyjściowych. Kredyty nigdy nie wygasają, a doładowanie możesz zrealizować kryptowalutami (USDT lub USDC) od kwoty $10.

Czy to API obsługuje wywoływanie narzędzi?

Tak, endpoint <code>POST /v1/chat/completions</code> obsługuje wywoływanie funkcji i narzędzi. Możesz zdefiniować własne funkcje w zapytaniu, a model zwróci dane w formacie JSON, gdy będzie to stosowne.

Ile tokenów obsługuje okno kontekstu?

Model obsługuje okno kontekstu o pojemności 100 000 tokenów. Całkowita liczba obejmuje zarówno prompt (wejście), jak i completion (wyjście). Upewnij się, że łączna liczba tokenów mieści się w tym limicie dla optymalnej wydajności.

Twój klucz jest o jeden formularz stąd

Załóż konto, skopiuj klucz, zmień podstawowy adres URL. To cała konfiguracja.

Pobierz klucz APIPrzeczytaj dokumentację

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
ID modeluuncensored
Base URLhttps://api.llmrouterapi.com/v1
EndpointyPOST /v1/chat/completions · GET /v1/models
UwierzytelnianieAuthorization: Bearer YOUR_KEY
Tryb JSONresponse_format: {"type": "json_object"}
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Równoległe zapytaniado 8 jednocześnie na klucz
Limit zapytań300 zapytań na minutę na klucz
Rozmiar zapytaniado 8 MB
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Bonus+5% od $50, +10% od $100
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
LogowanieGoogle albo e-mail i hasło

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund