IT ▾
Ottieni la chiave API

Integrazione Guida rapida

Integra la nostra API LLM senza censura in pochi minuti modificando l'URL di base e la chiave API. Questa guida rapida ti guida attraverso l'autenticazione, i completamenti di chat, lo streaming e la chiamata di funzioni utilizzando client compatibili con OpenAI standard.

https://api.llmrouterapi.com/v1uncensored

Autenticazione e URL di base

Inizia creando un account su Ottieni chiave API. Alla registrazione ricevi immediatamente una chiave API univoca. Non serve inserire una carta di credito per la prova e i prompt non vengono usati per l'addestramento. Le tue richieste si autenticano contro l'endpoint ospitato usando questa chiave.

L'URL di base per tutte le richieste è https://api.llmrouterapi.com/v1. Questo URL è compatibile con gli SDK ufficiali OpenAI e qualsiasi client standard compatibile con OpenAI. Configura semplicemente il tuo client per puntare a questo URL di base e imposta l'intestazione su Authorization: Bearer YOUR_API_KEY. Non è necessaria una logica di routing complessa; gestiamo noi l'infrastruttura per te.

Prima richiesta: Completamenti di chat

Invia la tua prima richiesta all'endpoint POST /v1/chat/completions. Devi specificare l'ID del modello come "uncensored". Questo modello è un large language model a pesi aperti, ottimizzato per rispondere senza rifiuti sui contenuti per uso adulto lecito. Supporta una finestra di contesto di 100.000 token, che copre sia il prompt che il completamento.

Di seguito è riportato un esempio di base utilizzando curl per dimostrare la struttura standard del payload JSON.

curl https://api.llmrouterapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Utilizzo dell'SDK Python

Per gli sviluppatori Python, il pacchetto ufficiale openai funziona immediatamente. Configura il client per utilizzare il nostro URL di base e la tua chiave API. Questo garantisce che il tuo codice esistente funzioni istantaneamente semplicemente modificando l'URL di base e la chiave API. Il client gestisce la serializzazione e l'analisi degli errori automaticamente.

Assicurati di specificare il modello come uncensored nell'inizializzazione o nella richiesta. Questo approccio elimina l'attrito di integrazione e ti consente di sfruttare il robusto ecosistema degli strumenti LLM esistenti.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integrazione Node.js

Gli sviluppatori Node.js possono utilizzare il pacchetto npm openai o qualsiasi client basato su fetch. Imposta baseURL sul nostro endpoint e fornisci la tua chiave nelle intestazioni. Questo metodo è ideale per applicazioni lato server o funzioni edge dove hai bisogno di controllo programmatico sul ciclo di vita della richiesta.

L'API supporta la chiamata di strumenti e funzioni, consentendoti di definire funzioni personalizzate all'interno dei tuoi completamenti di chat. Questo abilita logica complessa e recupero dati direttamente dalla struttura della risposta del modello.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Risposte in streaming

Per una latenza inferiore e una migliore esperienza utente, abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce uno stream di Server-Sent Events (SSE), consegnando i token man mano che vengono generati. Questo è particolarmente utile per le interfacce di chat dove gli utenti si aspettano feedback immediato.

Ogni chunk contiene contenuto parziale, permettendoti di visualizzare il testo in modo progressivo. Questa funzione funziona perfettamente con i client di streaming compatibili con OpenAI, senza richiedere logica di parsing aggiuntiva per la struttura degli eventi.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limiti, errori e elenco dei modelli

Monitora il tuo utilizzo e gestisci gli errori in modo elegante. L'API applica un limite di 300 richieste al minuto per chiave e un limite del corpo della richiesta di 8 MB. Se la tua chiave non è valida, riceverai un errore 401. Uno stato 402 indica credito prepagato insufficiente. Un errore 429 segnala che hai superato il limite di richieste.

Puoi elencare i modelli disponibili tramite GET /v1/models, che restituirà il modello uncensored. Nota che questo servizio non offre embeddings, immagini o generazione audio. Per la gestione dell'account, puoi rigenerare la tua chiave API in qualsiasi momento, il che revoca quella precedente. I crediti non scadono e puoi ricaricare a partire da $10.

Domande e risposte

Qual è la struttura dei prezzi?

Offriamo credito prepagato a consumo senza canoni mensili. Il costo è di $0,25 per 1M di token in input e $1,00 per 1M di token in output. I crediti non scadono mai e puoi ricaricare tramite criptovalute (USDT o USDC) a partire da $10.

Questa API supporta la chiamata di strumenti?

Sì, l'endpoint <code>POST /v1/chat/completions</code> supporta la chiamata di funzioni e strumenti. Puoi definire funzioni personalizzate nella tua richiesta e il modello restituirà dati JSON strutturati quando appropriato.

Quanti token supporta la finestra di contesto?

Il modello supporta una finestra di contesto di 100.000 token. Questo totale include sia il prompt (input) che il completamento (output). Assicurati che il conteggio combinato dei token rimanga entro questo limite per prestazioni ottimali.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.

Ottieni chiave APILeggi la documentazione

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
ID modellouncensored
Base URLhttps://api.llmrouterapi.com/v1
EndpointPOST /v1/chat/completions · GET /v1/models
AutenticazioneAuthorization: Bearer YOUR_KEY
Modalità JSONresponse_format: {"type": "json_object"}
Finestra di contesto100.000 token (input + output)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concorrenza8 richieste contemporanee per chiave
Limite di frequenza300 richieste al minuto per chiave
Dimensionefino a 8 MB per richiesta
Scadenzail credito pagato non scade, nessun abbonamento
Bonus+5% da $50, +10% da $100
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
AccessoGoogle oppure e-mail e password

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi