Integrazione Guida rapida
Integra la nostra API LLM senza censura in pochi minuti modificando l'URL di base e la chiave API. Questa guida rapida ti guida attraverso l'autenticazione, i completamenti di chat, lo streaming e la chiamata di funzioni utilizzando client compatibili con OpenAI standard.
https://api.llmrouterapi.com/v1uncensored
Autenticazione e URL di base
Inizia creando un account su Ottieni chiave API. Alla registrazione ricevi immediatamente una chiave API univoca. Non serve inserire una carta di credito per la prova e i prompt non vengono usati per l'addestramento. Le tue richieste si autenticano contro l'endpoint ospitato usando questa chiave.
L'URL di base per tutte le richieste è https://api.llmrouterapi.com/v1. Questo URL è compatibile con gli SDK ufficiali OpenAI e qualsiasi client standard compatibile con OpenAI. Configura semplicemente il tuo client per puntare a questo URL di base e imposta l'intestazione su Authorization: Bearer YOUR_API_KEY. Non è necessaria una logica di routing complessa; gestiamo noi l'infrastruttura per te.
Prima richiesta: Completamenti di chat
Invia la tua prima richiesta all'endpoint POST /v1/chat/completions. Devi specificare l'ID del modello come "uncensored". Questo modello è un large language model a pesi aperti, ottimizzato per rispondere senza rifiuti sui contenuti per uso adulto lecito. Supporta una finestra di contesto di 100.000 token, che copre sia il prompt che il completamento.
Di seguito è riportato un esempio di base utilizzando curl per dimostrare la struttura standard del payload JSON.
curl https://api.llmrouterapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Utilizzo dell'SDK Python
Per gli sviluppatori Python, il pacchetto ufficiale openai funziona immediatamente. Configura il client per utilizzare il nostro URL di base e la tua chiave API. Questo garantisce che il tuo codice esistente funzioni istantaneamente semplicemente modificando l'URL di base e la chiave API. Il client gestisce la serializzazione e l'analisi degli errori automaticamente.
Assicurati di specificare il modello come uncensored nell'inizializzazione o nella richiesta. Questo approccio elimina l'attrito di integrazione e ti consente di sfruttare il robusto ecosistema degli strumenti LLM esistenti.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integrazione Node.js
Gli sviluppatori Node.js possono utilizzare il pacchetto npm openai o qualsiasi client basato su fetch. Imposta baseURL sul nostro endpoint e fornisci la tua chiave nelle intestazioni. Questo metodo è ideale per applicazioni lato server o funzioni edge dove hai bisogno di controllo programmatico sul ciclo di vita della richiesta.
L'API supporta la chiamata di strumenti e funzioni, consentendoti di definire funzioni personalizzate all'interno dei tuoi completamenti di chat. Questo abilita logica complessa e recupero dati direttamente dalla struttura della risposta del modello.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Risposte in streaming
Per una latenza inferiore e una migliore esperienza utente, abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce uno stream di Server-Sent Events (SSE), consegnando i token man mano che vengono generati. Questo è particolarmente utile per le interfacce di chat dove gli utenti si aspettano feedback immediato.
Ogni chunk contiene contenuto parziale, permettendoti di visualizzare il testo in modo progressivo. Questa funzione funziona perfettamente con i client di streaming compatibili con OpenAI, senza richiedere logica di parsing aggiuntiva per la struttura degli eventi.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti, errori e elenco dei modelli
Monitora il tuo utilizzo e gestisci gli errori in modo elegante. L'API applica un limite di 300 richieste al minuto per chiave e un limite del corpo della richiesta di 8 MB. Se la tua chiave non è valida, riceverai un errore 401. Uno stato 402 indica credito prepagato insufficiente. Un errore 429 segnala che hai superato il limite di richieste.
Puoi elencare i modelli disponibili tramite GET /v1/models, che restituirà il modello uncensored. Nota che questo servizio non offre embeddings, immagini o generazione audio. Per la gestione dell'account, puoi rigenerare la tua chiave API in qualsiasi momento, il che revoca quella precedente. I crediti non scadono e puoi ricaricare a partire da $10.
Domande e risposte
Qual è la struttura dei prezzi?
Offriamo credito prepagato a consumo senza canoni mensili. Il costo è di $0,25 per 1M di token in input e $1,00 per 1M di token in output. I crediti non scadono mai e puoi ricaricare tramite criptovalute (USDT o USDC) a partire da $10.
Questa API supporta la chiamata di strumenti?
Sì, l'endpoint <code>POST /v1/chat/completions</code> supporta la chiamata di funzioni e strumenti. Puoi definire funzioni personalizzate nella tua richiesta e il modello restituirà dati JSON strutturati quando appropriato.
Quanti token supporta la finestra di contesto?
Il modello supporta una finestra di contesto di 100.000 token. Questo totale include sia il prompt (input) che il completamento (output). Assicurati che il conteggio combinato dei token rimanga entro questo limite per prestazioni ottimali.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Base URL | https://api.llmrouterapi.com/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Modalità JSON | response_format: {"type": "json_object"} |
| Finestra di contesto | 100.000 token (input + output) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Bonus | +5% da $50, +10% da $100 |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |