Início rápido de integração
Integre nossa API LLM sem censura em minutos substituindo sua URL base e chave de API. Este guia rápido orienta você pela autenticação, conclusões de chat, streaming e chamada de funções usando clientes compatíveis com OpenAI.
https://api.llmrouterapi.com/v1uncensored
Autenticação e URL Base
Comece criando uma conta em Obter chave de API. Ao se registrar, você recebe uma chave de API exclusiva imediatamente. Não há necessidade de inserir cartão de crédito para a avaliação e os prompts não são usados para treinamento. Suas requisições se autenticam contra o endpoint hospedado usando esta chave.
A URL base para todas as requisições é https://api.llmrouterapi.com/v1. Esta URL é compatível com os SDKs oficiais da OpenAI e qualquer cliente padrão compatível com OpenAI. Basta configurar seu cliente para apontar para esta URL base e definir seu cabeçalho para Authorization: Bearer YOUR_API_KEY. Não é necessária lógica complexa de roteamento; cuidamos da infraestrutura para você.
Primeira Requisição: Conclusões de Chat
Envie sua primeira requisição para o endpoint POST /v1/chat/completions. Você deve especificar o ID do modelo como "uncensored". Este modelo é um modelo de linguagem de grande escala de pesos abertos ajustado para responder sem recusas de conteúdo para uso adulto legal. Ele suporta uma janela de contexto de 100.000 tokens, cobrindo tanto o prompt quanto a conclusão.
Abaixo está um exemplo básico usando curl para demonstrar a estrutura padrão do payload JSON.
curl https://api.llmrouterapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Usando o SDK Python
Para desenvolvedores Python, o pacote oficial openai funciona imediatamente. Configure o cliente para usar nossa URL base e sua chave de API. Isso garante que seu código existente funcione instantaneamente apenas substituindo a URL base e a chave de API. O cliente lida com serialização e análise de erros automaticamente.
Certifique-se de especificar o modelo como uncensored na sua inicialização ou requisição. Esta abordagem elimina a fricção de integração e permite que você aproveite o ecossistema robusto de ferramentas LLM existentes.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integração Node.js
Desenvolvedores Node.js podem usar o pacote npm openai ou qualquer cliente baseado em fetch. Defina o baseURL para nosso endpoint e forneça sua chave nos cabeçalhos. Este método é ideal para aplicações server-side ou funções de borda onde você precisa de controle programático sobre o ciclo de vida da requisição.
A API suporta chamada de ferramentas e funções, permitindo que você defina funções personalizadas dentro de suas conclusões de chat. Isso permite lógica complexa e recuperação de dados diretamente na estrutura de resposta do modelo.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respostas em Streaming
Para menor latência e melhor experiência do usuário, ative o streaming definindo stream: true na sua requisição. A API retorna um stream de Server-Sent Events (SSE), entregando tokens conforme são gerados. Isso é particularmente útil para interfaces de chat onde os usuários esperam feedback imediato.
Cada chunk contém conteúdo parcial, permitindo que você renderize o texto progressivamente. Este recurso funciona perfeitamente com clientes de streaming compatíveis com OpenAI padrão, não exigindo lógica de análise adicional para a estrutura de eventos.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, Erros e Listagem de Modelos
Monitore seu uso e trate erros de forma elegante. A API impõe um limite de 300 requisições por minuto por chave e um limite de corpo de requisição de 8 MB. Se sua chave for inválida, você receberá um erro 401. Um status 402 indica crédito pré-pago insuficiente. Um erro 429 sinaliza que você excedeu o limite de requisições.
Você pode listar os modelos disponíveis via GET /v1/models, que retornará o modelo uncensored. Observe que este serviço não oferece embeddings, geração de imagens ou geração de áudio. Para gerenciar sua conta, você pode regenerar sua chave de API a qualquer momento, o que revoga a anterior. Os créditos nunca expiram e você pode recarregar a partir de $10.
Perguntas e respostas
Qual é a estrutura de preços?
Oferecemos crédito pré-pago pagamento por uso sem mensalidades. O custo é $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. Os créditos nunca expiram e você pode recarregar via criptomoeda (USDT ou USDC) a partir de $10.
Esta API suporta chamada de ferramentas?
Sim, o endpoint <code>POST /v1/chat/completions</code> suporta chamada de funções e ferramentas. Você pode definir funções personalizadas na sua requisição e o modelo retornará dados JSON estruturados quando apropriado.
Quantos tokens a janela de contexto suporta?
O modelo suporta uma janela de contexto de 100.000 tokens. Esse total inclui tanto o prompt (entrada) quanto a conclusão (saída). Certifique-se de que a contagem combinada de tokens permaneça dentro desse limite para desempenho ideal.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.
Especificações técnicas
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| ID do modelo | uncensored |
| Base URL | https://api.llmrouterapi.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Modo JSON | response_format: {"type": "json_object"} |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Limite de taxa | 300 requisições por minuto por chave |
| Tamanho | até 8 MB por requisição |
| Validade | crédito pago não expira, sem assinatura |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Login | Google ou e-mail e senha |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |