FR ▾
Obtenir une clé API

Guide d'intégration

Intégrez notre API LLM sans censure en quelques minutes en modifiant votre URL de base et votre clé API. Ce guide rapide vous accompagne pour l'authentification, les complétions de chat, le streaming et l'appel de fonctions à l'aide de clients compatibles OpenAI standards.

https://api.llmrouterapi.com/v1uncensored

Authentification et URL de base

Commencez par créer un compte sur Obtenir la clé API. À l’inscription, vous recevez immédiatement une clé API unique. Aucune carte bancaire n’est nécessaire pour l’essai, et les prompts ne sont pas utilisés pour l’entraînement. Vos requêtes s’authentifient auprès de l’endpoint hébergé à l’aide de cette clé.

L'URL de base pour toutes les requêtes est https://api.llmrouterapi.com/v1. Cette URL est compatible avec les SDK officiels OpenAI et tout client standard compatible OpenAI. Configurez simplement votre client pour pointer vers cette URL de base et définissez votre en-tête sur Authorization: Bearer YOUR_API_KEY. Aucune logique de routage complexe n'est requise ; nous gérons l'infrastructure pour vous.

Première requête : Complétions de chat

Envoyez votre première requête à l’endpoint POST /v1/chat/completions. Vous devez spécifier l’ID du modèle comme "uncensored". Ce modèle est un grand modèle de langage à poids ouverts, ajusté pour répondre sans refus de contenu pour une utilisation adulte légale. Il prend en charge une fenêtre de contexte de 100 000 tokens, couvrant à la fois le prompt et la complétion.

Voici un exemple de base utilisant curl pour démontrer la structure standard du payload JSON.

curl https://api.llmrouterapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Utilisation du SDK Python

Pour les développeurs Python, le package officiel openai fonctionne directement. Configurez le client pour utiliser notre URL de base et votre clé API. Cela garantit que votre code existant fonctionne instantanément en modifiant simplement l'URL de base et la clé API. Le client gère automatiquement la sérialisation et l'analyse des erreurs.

Assurez-vous de spécifier le modèle comme uncensored dans votre initialisation ou votre requête. Cette approche élimine les frictions d'intégration et vous permet de tirer parti de l'écosystème robuste des outils LLM existants.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Intégration Node.js

Les développeurs Node.js peuvent utiliser le package npm openai ou tout client basé sur fetch. Définissez le baseURL sur notre endpoint et fournissez votre clé dans les en-têtes. Cette méthode est idéale pour les applications côté serveur ou les fonctions edge où vous avez besoin d'un contrôle programmatique sur le cycle de vie de la requête.

L'API prend en charge l'appel d'outils et de fonctions, vous permettant de définir des fonctions personnalisées dans vos complétions de chat. Cela permet une logique complexe et la récupération de données directement à partir de la structure de réponse du modèle.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Réponses en streaming

Pour une latence plus faible et une meilleure expérience utilisateur, activez le streaming en définissant stream: true dans votre requête. L'API renvoie un flux Server-Sent Events (SSE), délivrant les tokens au fur et à mesure de leur génération. Cela est particulièrement utile pour les interfaces de chat où les utilisateurs s'attendent à un retour immédiat.

Chaque chunk contient du contenu partiel, ce qui vous permet d’afficher le texte de manière progressive. Cette fonctionnalité fonctionne sans problème avec les clients de streaming compatibles standards OpenAI, sans nécessiter de logique de parsing supplémentaire pour la structure des événements.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites, erreurs et liste des modèles

Surveillez votre utilisation et gérez les erreurs avec élégance. L’API applique une limite de 300 requêtes par minute par clé et une limite de corps de requête de 8 MB. Si votre clé est invalide, vous recevrez une erreur 401. Un statut 402 indique un crédit prépayé insuffisant. Une erreur 429 signale que vous avez dépassé la limite de débit.

Vous pouvez lister les modèles disponibles via GET /v1/models, qui retournera le modèle uncensored. Notez que ce service ne propose pas d’embeddings, de génération d’images ou de génération audio. Pour la gestion de votre compte, vous pouvez régénérer votre clé API à tout moment, ce qui révoquera la précédente. Les crédits n’expirent jamais, et vous pouvez recharger à partir de 10 $.

Questions et réponses

Quelle est la structure tarifaire ?

Nous proposons un crédit prépayé avec paiement à l’usage, sans frais mensuels. Le coût est de $0,25 par 1M de tokens d’entrée et de $1,00 par 1M de tokens de sortie. Les crédits n’expirent jamais, et vous pouvez recharger via crypto (USDT ou USDC) à partir de 10 $.

Cette API prend-elle en charge l'appel d'outils ?

Oui, l’endpoint <code>POST /v1/chat/completions</code> prend en charge l’appel de fonctions et d’outils. Vous pouvez définir des fonctions personnalisées dans votre requête, et le modèle retournera des données JSON structurées lorsque cela est approprié.

Combien de tokens la fenêtre de contexte prend-elle en charge ?

Le modèle prend en charge une fenêtre de contexte de 100 000 tokens. Ce total inclut à la fois le prompt (entrée) et la complétion (sortie). Assurez-vous que le nombre total de tokens reste dans cette limite pour des performances optimales.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir clé APILire la documentation

Caractéristiques techniques

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
ID du modèleuncensored
Base URLhttps://api.llmrouterapi.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthentificationAuthorization: Bearer YOUR_KEY
Mode JSONresponse_format: {"type": "json_object"}
Fenêtre de contexte100 000 tokens (entrée + sortie)
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concurrence8 requêtes simultanées par clé
Limite de débit300 requêtes par minute et par clé
Taillejusqu'à 8 Mo par requête
Validitéle crédit payé n'expire jamais, sans abonnement
Bonus+5 % dès 50 $, +10 % dès 100 $
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé
Clésune clé active par compte ; une nouvelle remplace l'ancienne
ConnexionGoogle ou e-mail et mot de passe

Codes d'erreur

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes