Integration Schnellstart
Integriere unsere unzensierte LLM-API in wenigen Minuten, indem du deine Basis-URL und deinen API-Schlüssel austauschst. Diese Schnellstartanleitung führt dich durch Authentifizierung, Chat-Completions, Streaming und Function Calling mit standardmäßigen OpenAI-kompatiblen Clients.
https://api.llmrouterapi.com/v1uncensored
Authentifizierung und Basis-URL
Erstelle zunächst ein Konto unter API-Schlüssel erhalten. Nach der Anmeldung erhältst du sofort einen eindeutigen API-Schlüssel. Für die Testphase ist keine Kreditkarte erforderlich, und Prompts werden nicht zum Training verwendet. Deine Anfragen authentifizieren sich über diesen Schlüssel am gehosteten Endpunkt.
Die Basis-URL für alle Anfragen ist https://api.llmrouterapi.com/v1. Diese URL ist mit den offiziellen OpenAI-SDKs und jedem standardmäßigen OpenAI-kompatiblen Client kompatibel. Konfiguriere deinen Client einfach so, dass er auf diese Basis-URL zeigt, und setze deinen Header auf Authorization: Bearer YOUR_API_KEY. Keine komplexe Routing-Logik ist erforderlich; wir kümmern uns um die Infrastruktur.
Erste Anfrage: Chat Completions
Sende deine erste Anfrage an den Endpunkt POST /v1/chat/completions. Du musst die Modell-ID als "uncensored" angeben. Dieses Modell ist ein Open-Weight-LLM, das darauf trainiert wurde, ohne Inhaltsablehnungen für die legale Erwachsenen-Nutzung zu antworten. Es unterstützt ein Kontextfenster mit 100.000 Token, das sowohl Prompt als auch Completion abdeckt.
Unten findest du ein grundlegendes Beispiel mit curl, das die Standard-JSON-Payload-Struktur demonstriert.
curl https://api.llmrouterapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK verwenden
Für Python-Entwickler funktioniert das offizielle openai-Paket out of the box. Konfiguriere den Client mit unserer Basis-URL und deinem API-Schlüssel. So funktioniert dein bestehender Code sofort, indem du einfach die Basis-URL und den API-Schlüssel austauschst. Der Client übernimmt automatisch die Serialisierung und Fehleranalyse.
Stelle sicher, dass du das Modell als uncensored initialisierst oder in der Anfrage angibst. Dieser Ansatz eliminiert Integrationsprobleme und ermöglicht es dir, das robuste Ökosystem bestehender LLM-Tools zu nutzen.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js-Integration
Node.js-Entwickler können das npm-Paket openai oder einen beliebigen fetch-basierten Client verwenden. Setze die baseURL auf unseren Endpunkt und gib deinen Schlüssel in den Headern an. Diese Methode ist ideal für serverseitige Anwendungen oder Edge-Funktionen, bei denen du programmatische Kontrolle über den Anfragelebenszyklus benötigst.
Die API unterstützt Tool- und Function Calling, sodass du benutzerdefinierte Funktionen in deinen Chat-Vervollständigungen definieren kannst. Dies ermöglicht komplexe Logik und Datenabfragen direkt aus der Antwortstruktur des Modells.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-Antworten
Für geringere Latenz und eine bessere Benutzererfahrung aktiviere Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt einen Server-Sent Events (SSE)-Stream zurück, der Token liefert, sobald sie generiert werden. Dies ist besonders nützlich für Chat-Schnittstellen, bei denen Benutzer sofortiges Feedback erwarten.
Jeder Chunk enthält teilweise Inhalte, sodass du Text progressiv rendern kannst. Diese Funktion funktioniert nahtlos mit Standard-OpenAI-kompatiblen Streaming-Clients und erfordert keine zusätzliche Parsing-Logik für die Ereignisstruktur.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limits, Fehler und Modellauflistung
Überwache deine Nutzung und behandle Fehler angemessen. Die API begrenzt auf 300 Anfragen pro Minute pro Schlüssel und eine Anfragekörpergröße von 8 MB. Bei einem ungültigen Schlüssel erhältst du einen 401-Fehler. Ein 402-Status zeigt unzureichendes Prepaid-Guthaben an. Ein 429-Fehler signalisiert, dass du das Ratenlimit überschritten hast.
Du kannst verfügbare Modelle über GET /v1/models auflisten, was das uncensored-Modell zurückgibt. Beachte, dass dieser Dienst keine Embeddings, Bild- oder Audio-Generierung anbietet. Zur Kontoverwaltung kannst du deinen API-Schlüssel jederzeit neu generieren, wodurch der vorherige ungültig wird. Guthaben verfallen nie, und du kannst ab 10 $ aufladen.
Fragen und Antworten
Wie ist die Preisstruktur?
Wir bieten Prepaid-Guthaben im Pay as you go-Modus ohne monatliche Gebühren. Der Preis beträgt $0,25 pro 1 Mio. Input-Token und $1,00 pro 1 Mio. Output-Token. Guthaben verfällt nie, und du kannst ab $10 per Krypto (USDT oder USDC) aufladen.
Unterstützt diese API Tool Calling?
Ja, der <code>POST /v1/chat/completions</code>-Endpunkt unterstützt Function Calling und Tool Calling. Du kannst benutzerdefinierte Funktionen in deiner Anfrage definieren, und das Modell gibt bei Bedarf strukturierte JSON-Daten zurück.
Wie viele Token unterstützt das Kontextfenster?
Das Modell unterstützt ein Kontextfenster mit 100.000 Token. Diese Gesamtzahl umfasst sowohl den Prompt (Input) als auch die Completion (Output). Stelle sicher, dass deine kombinierte Token-Anzahl innerhalb dieses Limits liegt, um optimale Leistung zu gewährleisten.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.
Technische Daten
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Base-URL | https://api.llmrouterapi.com/v1 |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| JSON-Modus | response_format: {"type": "json_object"} |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |