무검열 대형 언어 모델 API 빠른 통합하기
기본 구성과 간단한 코드 예제를 통해 몇 분 안에 무검열 대형 언어 모델을 애플리케이션에 연결하세요. 당사는 OpenAI 표준 프로토콜을 준수하는 API 중계 서비스를 제공하며, 스트리밍 출력과 도구 호출을 지원하여 콘텐츠 제한 없는 애플리케이션을 빠르게 구축할 수 있도록 돕습니다.
기본 구성
API 중계소에 접근하는 핵심은 Base URL과 인증 토큰을 올바르게 설정하는 것입니다. 당사 서비스는 OpenAI 프로토콜과 완전히 호환되므로, Base URL을 https://api.llmzhongzhuan.com/v1로 설정하고 요청 헤더에 API 키를 포함하기만 하면 됩니다.
각 계정은 API 키를 하나만 할당받으며, 등록 즉시 키가 표시됩니다. 키를 변경하려면 백엔드에서 다시 생성하면 이전 키는 즉시 무효화됩니다. 이 설계는 인증 프로세스를 단순화하여 접근 보안을 보장합니다. 당사는 다중 키 병렬 관리를 지원하지 않으므로, 애플리케이션 아키텍처에 따라 키를 적절히 보관하는 것이 좋습니다.
생성형 대화 인터페이스
표준 대화 인터페이스는 POST /v1/chat/completions에 위치합니다. 요청 본문에는 model(uncensored로 고정), messages 배열 및 선택적 매개변수가 포함되어야 합니다. 이 인터페이스는 비스트리밍 응답을 지원하며, 전체 반환 결과가 필요한 시나리오에 적합합니다.
모델은 독립적으로 배포된 고성능 GPU 서버에서 실행되며, 컨텍스트 창은 최대 100,000 토큰까지 지원합니다. 긴 텍스트 처리부터 복잡한 지시 따르기까지 안정적인 네이티브 API 접근 경험을 제공합니다.
curl https://api.llmzhongzhuan.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
스트리밍 응답 (SSE)
실시간 피드백이 필요한 애플리케이션의 경우, stream: true 매개변수를 활성화하여 Server-Sent Events (SSE)를 통해 청크 단위의 응답을 받을 수 있습니다. 스트리밍 전송은 첫 글자 지연 시간 (TTFT)을 크게 줄여 사용자 경험을 향상시킵니다.
서버는 응답이 끝날 때까지 JSON 조각을 지속적으로 푸시합니다. 클라이언트는 이러한 조각을 자체적으로 조립하여 전체 텍스트를 생성해야 합니다. 이 모드는 챗봇 또는 실시간 콘텐츠 생성 시나리오에 매우 적합하여 데이터가 최종 사용자에게 빠르게 도달하도록 보장합니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
모델 목록 조회
GET /v1/models를 통해 현재 사용 가능한 모델 목록을 가져올 수 있습니다. 요청은 id, object 및 owned_by 등의 필드를 포함하는 표준 JSON 응답을 반환합니다.
현재 단일 모델 ID는 uncensored입니다. 이 모델은 오픈 웨이트 모델로, 콘텐츠 검열 제거를 위해 특별히 미세 조정되었으며 성인 콘텐츠, 보안 연구 및 논쟁적 주제에 적합합니다. 당사는 임베딩 (Embedding) 또는 멀티모달 생성 서비스를 제공하지 않으며, 순수 텍스트 대화에 집중합니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
오류 처리 및 속도 제한
서비스는 표준 HTTP 상태 코드 규정을 따릅니다. 401 Unauthorized는 API 키가 무효임을 의미합니다. 402 Payment Required는 계정 잔액이 부족하여 충전 후 요청을 계속해야 함을 의미합니다. 429 Too Many Requests는 속도 제한을 초과했음을 의미하며, 현재 제한은 분당 300회 요청입니다.
또한, 단일 요청 본문 크기는 8 MB로 제한됩니다. 속도 제한에 도달한 경우 지수 백오프 재시도 전략을 구현하는 것이 좋습니다. 당사는 무검열 AI 서비스의 높은 처리량을 유지하면서도 자원 할당의 공정성을 보장합니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
예제 코드
아래는 Python SDK를 사용하여 스트리밍 요청을 수행하는 전체 예제입니다. 이 코드는 클라이언트 초기화, 메시지 히스토리 구축 및 SSE 데이터 스트림 처리 방법을 보여줍니다.
openai 라이브러리가 설치되어 있고 YOUR_API_KEY이 실제 키로 대체되었는지 확인하십시오. 이 예제는 API 중계소 인터페이스를 통해 무제한 AI의 실시간 생성 결과를 어떻게 가져올 수 있는지 직관적으로 보여주며, 개발자가 기존 시스템에 빠르게 통합할 수 있도록 도와줍니다.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 모델 ID | uncensored |
| 인증 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmzhongzhuan.com/v1 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| JSON 모드 | response_format: {"type": "json_object"} |
| 동시 요청 | 키당 동시 8개 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 속도 제한 | 키당 분당 300회 |
| 요청 크기 | 최대 8 MB |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
자주 묻는 질문
계정에 여러 API 키를 보유할 수 있나요?
계정당 API 키는 하나만 엄격히 허용됩니다. 키를 교체하려면 백엔드에서 새 키를 생성하면 이전 키는 즉시 무효화됩니다.
API 키를 여러 애플리케이션에 사용할 수 있나요?
네, 단일 API 키는 동일한 계정의 할당량을 공유하는 한 여러 애플리케이션 또는 환경에서 재사용할 수 있습니다. 각 계정에 키가 하나만 있으므로, 요청 빈도와 잔액을 모니터링하여 다중 애플리케이션 사용을 관리하는 것이 좋습니다.
무검열 모델은 모든 성인 콘텐츠를 포함하나요?
모델은 합법적인 성인 콘텐츠, 허구적 이야기, 논쟁적 주제에 대해 무검열이지만 미성년자 관련 성 콘텐츠는 엄격히 금지합니다.
양식을 작성하여 키를 받으세요
계정을 생성하고 키를 복사한 후 Base URL을 수정하세요. 구성이 이렇게 간단합니다.