Inicio rápido de integración
Integra nuestra API LLM sin censura en minutos cambiando tu URL base y clave de API. Esta guía rápida te guía a través de la autenticación, finalizaciones de chat, streaming y llamadas a funciones usando clientes compatibles con OpenAI.
https://api.llmrouterapi.com/v1uncensored
Autenticación y URL base
Comienza creando una cuenta en Obtener clave de API. Al registrarte, recibes una clave de API única de inmediato. No es necesario ingresar una tarjeta de crédito para la prueba, y los prompts no se utilizan para el entrenamiento. Tus peticiones se autentican contra el endpoint alojado utilizando esta clave.
La URL base para todas las peticiones es https://api.llmrouterapi.com/v1. Esta URL es compatible con los SDKs oficiales de OpenAI y cualquier cliente estándar compatible con OpenAI. Simplemente configura tu cliente para apuntar a esta URL base y establece tu encabezado en Authorization: Bearer YOUR_API_KEY. No se requiere lógica de enrutamiento compleja; nosotros gestionamos la infraestructura por ti.
Primera petición: Finalizaciones de chat
Envía tu primera petición al endpoint POST /v1/chat/completions. Debes especificar el ID del modelo como "uncensored". Este modelo es un modelo de lenguaje grande de pesos abiertos ajustado para responder sin rechazos de contenido para uso adulto lícito. Admite una ventana de contexto de 100.000 tokens, que cubre tanto el prompt como la finalización.
A continuación se muestra un ejemplo básico usando curl para demostrar la estructura estándar de la carga útil JSON.
curl https://api.llmrouterapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Uso del SDK de Python
Para desarrolladores de Python, el paquete oficial openai funciona de forma inmediata. Configura el cliente para usar nuestra URL base y tu clave de API. Esto garantiza que tu código existente funcione al instante simplemente cambiando la URL base y la clave de API. El cliente maneja la serialización y el análisis de errores de forma automática.
Asegúrate de especificar el modelo como uncensored en tu inicialización o petición. Este enfoque elimina la fricción de integración y te permite aprovechar el ecosistema robusto de herramientas LLM existentes.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integración con Node.js
Los desarrolladores de Node.js pueden usar el paquete npm openai o cualquier cliente basado en fetch. Establece el baseURL a nuestro endpoint y proporciona tu clave en los encabezados. Este método es ideal para aplicaciones del lado del servidor o funciones de borde donde necesitas control programático sobre el ciclo de vida de la petición.
La API admite llamadas a herramientas y funciones, permitiéndote definir funciones personalizadas dentro de tus finalizaciones de chat. Esto habilita lógica compleja y recuperación de datos directamente desde la estructura de respuesta del modelo.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respuestas en streaming
Para menor latencia y mejor experiencia de usuario, habilita el streaming estableciendo stream: true en tu petición. La API devuelve un flujo de Server-Sent Events (SSE), entregando tokens a medida que se generan. Esto es particularmente útil para interfaces de chat donde los usuarios esperan retroalimentación inmediata.
Cada fragmento contiene contenido parcial, permitiéndote renderizar texto progresivamente. Esta función funciona sin problemas con clientes de streaming compatibles con OpenAI estándar, sin requerir lógica de análisis adicional para la estructura de eventos.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Límites, errores y listado de modelos
Monitorea tu uso y maneja los errores de forma elegante. La API aplica un límite de 300 peticiones por minuto por clave y un límite de cuerpo de petición de 8 MB. Si tu clave no es válida, recibirás un error 401. Un estado 402 indica que no hay suficiente crédito prepago. Un error 429 indica que has excedido el límite de peticiones.
Puedes listar los modelos disponibles mediante GET /v1/models, lo que devolverá el modelo uncensored. Ten en cuenta que este servicio no ofrece incrustaciones, imágenes ni generación de audio. Para la gestión de la cuenta, puedes regenerar tu clave de API en cualquier momento, lo que invalida la anterior. Los créditos no caducan y puedes recargar a partir de $10.
Preguntas y respuestas
¿Cuál es la estructura de precios?
Ofrecemos crédito prepago de pago por uso sin cuotas mensuales. El costo es de $0,25 por cada 1M de tokens de entrada y $1,00 por cada 1M de tokens de salida. Los créditos no caducan y puedes recargar mediante criptomonedas (USDT o USDC) a partir de $10.
¿Esta API admite llamadas a funciones?
Sí, el <code>endpoint POST /v1/chat/completions</code> admite llamadas a funciones y herramientas. Puedes definir funciones personalizadas en tu petición y el modelo devolverá datos JSON estructurados cuando sea apropiado.
¿Cuántos tokens admite la ventana de contexto?
El modelo admite una ventana de contexto de 100.000 tokens. Este total incluye tanto el prompt (entrada) como la finalización (salida). Asegúrate de que tu conteo combinado de tokens se mantenga dentro de este límite para un rendimiento óptimo.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.
Especificaciones técnicas
Una tabla con cada límite, función y precio.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| ID del modelo | uncensored |
| Base URL | https://api.llmrouterapi.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Modo JSON | response_format: {"type": "json_object"} |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrencia | 8 peticiones a la vez por clave |
| Límite de peticiones | 300 por minuto por clave |
| Tamaño de petición | hasta 8 MB |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Bono | +5 % desde $50, +10 % desde $100 |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Acceso | Google o correo y contraseña |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |