통합 빠른 시작
기본 URL과 API 키를 교체하여 몇 분 안에 무검열 LLM API를 통합하십시오. 이 빠른 시작 가이드는 표준 OpenAI 호환 클라이언트를 사용하여 인증, 채팅 완성, 스트리밍 및 함수 호출 방법을 안내합니다.
https://api.llmrouterapi.com/v1uncensored
인증 및 기본 URL
API 키 받기에서 계정을 생성하는 것으로 시작하십시오. 가입 시 즉시 고유한 API 키가 제공됩니다. 체험을 위해 신용카드를 입력할 필요가 없으며, 프롬프트는 학습에 사용되지 않습니다. 요청은 이 키를 사용하여 호스팅된 엔드포인트에서 인증됩니다.
모든 요청의 기본 URL은 https://api.llmrouterapi.com/v1입니다. 이 URL은 공식 OpenAI SDK 및 모든 표준 OpenAI 호환 클라이언트와 호환됩니다. 클라이언트를 구성하여 이 기본 URL을 가리키게 하고 헤더를 Authorization: Bearer YOUR_API_KEY로 설정하십시오. 복잡한 라우팅 로직이 필요하지 않습니다. 인프라는 저희가 처리합니다.
첫 번째 요청: 채팅 완성
POST /v1/chat/completions 엔드포인트로 첫 번째 요청을 보내십시오. 모델 ID를 "uncensored"로 지정해야 합니다. 이 모델은 합법적인 성인용 콘텐츠 거부 없이 답변하도록 조정된 오픈 웨이트 대형 언어 모델입니다. 프롬프트와 완성을 모두 포함하는 100,000개의 토큰 컨텍스트 창을 지원합니다.
아래는 표준 JSON 페이로드 구조를 시연하기 위한 curl 기본 예제입니다.
curl https://api.llmrouterapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK 사용
Python 개발자를 위해 공식 openai 패키지는 그대로 작동합니다. 클라이언트를 설정하여 기본 URL과 API 키를 사용하세요. 이렇게 하면 기본 URL과 API 키를 단순히 교체하기만 해도 기존 코드가 즉시 작동합니다. 클라이언트는 직렬화 및 오류 파싱을 자동으로 처리합니다.
초기화 또는 요청에서 모델을 uncensored로 지정하십시오. 이 방법은 통합 마찰을 제거하고 기존 LLM 도구의 강력한 생태계를 활용할 수 있게 합니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmrouterapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node.js 통합
Node.js 개발자는 openai npm 패키지 또는 fetch 기반 클라이언트를 사용할 수 있습니다. baseURL을 엔드포인트로 설정하고 헤더에 키를 제공하십시오. 이 방법은 요청 수명 주기에 대한 프로그래밍 제어가 필요한 서버 측 애플리케이션이나 엣지 함수에 이상적입니다.
API는 도구 및 함수 호출을 지원하여 채팅 완성 내에서 사용자 정의 함수를 정의할 수 있습니다. 이를 통해 모델의 응답 구조에서 직접 복잡한 로직과 데이터 검색이 가능합니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmrouterapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
스트리밍 응답
낮은 지연 시간과 향상된 사용자 경험을 위해 요청에 stream: true을 설정하여 스트리밍을 활성화하십시오. API는 서버 전송 이벤트(SSE) 스트림을 반환하여 생성되는 대로 토큰을 제공합니다. 이는 사용자가 즉각적인 피드백을 기대하는 채팅 인터페이스에 특히 유용합니다.
각 청크에는 부분 콘텐츠가 포함되어 있어 텍스트를 점진적으로 렌더링할 수 있습니다. 이 기능은 이벤트 구조에 대한 추가 파싱 로직 없이 표준 OpenAI 호환 스트리밍 클라이언트와 원활하게 작동합니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
제한, 오류 및 모델 목록
사용량을 모니터링하고 오류를 우아하게 처리하십시오. API는 키당 분당 300개의 요청 제한과 8 MB 요청 본문 제한을 적용합니다. 키가 유효하지 않으면 401 오류가 발생합니다. 402 상태는 선불 크레딧이 부족함을 나타냅니다. 429 오류는 속도 제한을 초과했음을 나타냅니다.
GET /v1/models를 통해 사용 가능한 모델을 나열할 수 있으며, 이는 uncensored 모델을 반환합니다. 이 서비스는 임베딩, 이미지 또는 오디오 생성을 제공하지 않습니다. 계정 관리의 경우 이전 키를 무효화하면서 API 키를 언제든지 재생성할 수 있습니다. 크레딧은 만료되지 않으며, 최소 $10부터 충전할 수 있습니다.
질문과 답변
가격 구조는 어떻게 되나요?
월 요금 없이 종량제 선불 크레딧을 제공합니다. 입력 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $1.00입니다. 크레딧은 만료되지 않으며, 최소 $10부터 USDT 또는 USDC로 암호화폐를 통해 충전할 수 있습니다.
이 API는 도구 호출을 지원하나요?
네, <code>POST /v1/chat/completions</code> 엔드포인트는 함수 호출과 도구 호출을 지원합니다. 요청에 사용자 정의 함수를 정의하면 모델이 적절한 경우 구조화된 JSON 데이터를 반환합니다.
컨텍스트 창은 몇 개의 토큰을 지원하나요?
이 모델은 100,000개의 토큰을 지원하는 컨텍스트 창을 제공합니다. 이 총량에는 프롬프트(입력)와 완성(출력)이 모두 포함됩니다. 최적의 성능을 위해 결합된 토큰 수가 이 제한 내에 있도록 하십시오.
기술 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 모델 ID | uncensored |
| Base URL | https://api.llmrouterapi.com/v1 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 인증 | Authorization: Bearer YOUR_KEY |
| JSON 모드 | response_format: {"type": "json_object"} |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 동시 요청 | 키당 동시 8개 |
| 속도 제한 | 키당 분당 300회 |
| 요청 크기 | 최대 8 MB |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
| 로그인 | Google 또는 이메일과 비밀번호 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |