Guide d'intégration
Intégrez notre API LLM sans censure en quelques minutes en modifiant votre URL de base et votre clé API. Ce guide rapide vous accompagne pour l'authentification, les complétions de chat, le streaming et l'appel de fonctions à l'aide de clients compatibles OpenAI standards.
https://api.llmrouterapi.com/v1uncensored
Authentification et URL de base
Commencez par créer un compte sur Obtenir la clé API. À l’inscription, vous recevez immédiatement une clé API unique. Aucune carte bancaire n’est nécessaire pour l’essai, et les prompts ne sont pas utilisés pour l’entraînement. Vos requêtes s’authentifient auprès de l’endpoint hébergé à l’aide de cette clé.
L'URL de base pour toutes les requêtes est https://api.llmrouterapi.com/v1. Cette URL est compatible avec les SDK officiels OpenAI et tout client standard compatible OpenAI. Configurez simplement votre client pour pointer vers cette URL de base et définissez votre en-tête sur Authorization: Bearer YOUR_API_KEY. Aucune logique de routage complexe n'est requise ; nous gérons l'infrastructure pour vous.
Première requête : Complétions de chat
Envoyez votre première requête à l’endpoint POST /v1/chat/completions. Vous devez spécifier l’ID du modèle comme "uncensored". Ce modèle est un grand modèle de langage à poids ouverts, ajusté pour répondre sans refus de contenu pour une utilisation adulte légale. Il prend en charge une fenêtre de contexte de 100 000 tokens, couvrant à la fois le prompt et la complétion.
Voici un exemple de base utilisant curl pour démontrer la structure standard du payload JSON.
curl https://api.llmrouterapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Utilisation du SDK Python
Pour les développeurs Python, le package officiel openai fonctionne directement. Configurez le client pour utiliser notre URL de base et votre clé API. Cela garantit que votre code existant fonctionne instantanément en modifiant simplement l'URL de base et la clé API. Le client gère automatiquement la sérialisation et l'analyse des erreurs.
Assurez-vous de spécifier le modèle comme uncensored dans votre initialisation ou votre requête. Cette approche élimine les frictions d'intégration et vous permet de tirer parti de l'écosystème robuste des outils LLM existants.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Intégration Node.js
Les développeurs Node.js peuvent utiliser le package npm openai ou tout client basé sur fetch. Définissez le baseURL sur notre endpoint et fournissez votre clé dans les en-têtes. Cette méthode est idéale pour les applications côté serveur ou les fonctions edge où vous avez besoin d'un contrôle programmatique sur le cycle de vie de la requête.
L'API prend en charge l'appel d'outils et de fonctions, vous permettant de définir des fonctions personnalisées dans vos complétions de chat. Cela permet une logique complexe et la récupération de données directement à partir de la structure de réponse du modèle.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses en streaming
Pour une latence plus faible et une meilleure expérience utilisateur, activez le streaming en définissant stream: true dans votre requête. L'API renvoie un flux Server-Sent Events (SSE), délivrant les tokens au fur et à mesure de leur génération. Cela est particulièrement utile pour les interfaces de chat où les utilisateurs s'attendent à un retour immédiat.
Chaque chunk contient du contenu partiel, ce qui vous permet d’afficher le texte de manière progressive. Cette fonctionnalité fonctionne sans problème avec les clients de streaming compatibles standards OpenAI, sans nécessiter de logique de parsing supplémentaire pour la structure des événements.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, erreurs et liste des modèles
Surveillez votre utilisation et gérez les erreurs avec élégance. L’API applique une limite de 300 requêtes par minute par clé et une limite de corps de requête de 8 MB. Si votre clé est invalide, vous recevrez une erreur 401. Un statut 402 indique un crédit prépayé insuffisant. Une erreur 429 signale que vous avez dépassé la limite de débit.
Vous pouvez lister les modèles disponibles via GET /v1/models, qui retournera le modèle uncensored. Notez que ce service ne propose pas d’embeddings, de génération d’images ou de génération audio. Pour la gestion de votre compte, vous pouvez régénérer votre clé API à tout moment, ce qui révoquera la précédente. Les crédits n’expirent jamais, et vous pouvez recharger à partir de 10 $.
Questions et réponses
Quelle est la structure tarifaire ?
Nous proposons un crédit prépayé avec paiement à l’usage, sans frais mensuels. Le coût est de $0,25 par 1M de tokens d’entrée et de $1,00 par 1M de tokens de sortie. Les crédits n’expirent jamais, et vous pouvez recharger via crypto (USDT ou USDC) à partir de 10 $.
Cette API prend-elle en charge l'appel d'outils ?
Oui, l’endpoint <code>POST /v1/chat/completions</code> prend en charge l’appel de fonctions et d’outils. Vous pouvez définir des fonctions personnalisées dans votre requête, et le modèle retournera des données JSON structurées lorsque cela est approprié.
Combien de tokens la fenêtre de contexte prend-elle en charge ?
Le modèle prend en charge une fenêtre de contexte de 100 000 tokens. Ce total inclut à la fois le prompt (entrée) et la complétion (sortie). Assurez-vous que le nombre total de tokens reste dans cette limite pour des performances optimales.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.
Caractéristiques techniques
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| ID du modèle | uncensored |
| Base URL | https://api.llmrouterapi.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authentification | Authorization: Bearer YOUR_KEY |
| Mode JSON | response_format: {"type": "json_object"} |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrence | 8 requêtes simultanées par clé |
| Limite de débit | 300 requêtes par minute et par clé |
| Taille | jusqu'à 8 Mo par requête |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |