NL ▾

Snelle integratie van het ongecensureerde LLM-API

Koppel het ongecensureerde LLM binnen enkele minuten aan je app met basisconfiguratie en eenvoudige codevoorbeelden. Wij bieden een API-gateway die compatibel is met het OpenAI-protocol, met ondersteuning voor streaming en tool calling, zodat je snel apps kunt bouwen zonder inhoudsbeperkingen.

Basisconfiguratie

De kern van de toegang tot het api-relaistation ligt in het correct configureren van de Base URL en de authenticatiegegevens. Onze service is volledig compatibel met het OpenAI-protocol; je hoeft alleen de Base URL in te stellen op https://api.llmzhongzhuan.com/v1 en je API-sleutel mee te sturen in de request headers.

Elk account krijgt één API-sleutel toegewezen, die direct na registratie zichtbaar is. U kunt deze via de backend opnieuw genereren; de oude sleutel vervalt dan direct. Deze aanpak vereenvoudigt de authenticatie en zorgt voor toegangssbeveiliging. We ondersteunen geen parallel beheer van meerdere sleutels; bewaar uw sleutels zorgvuldig op basis van uw applicatie-architectuur.

Generatieve gespreksinterface

De standaard gespreksinterface bevindt zich op POST /v1/chat/completions. De request body moet een model (vast ingesteld op uncensored), een messages-array en optionele parameters bevatten. Deze interface ondersteunt niet-streaming-antwoorden, wat geschikt is voor scenario's waarin je het volledige antwoord nodig hebt.

Het model draait op geïsoleerde, hoogpresterende GPU-servers met een contextvenster van maximaal 100.000 tokens. Of je nu lange teksten verwerkt of complexe instructies volgt, je krijgt een stabiele native API-toegang.

curl https://api.llmzhongzhuan.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Streaming-antwoord (SSE)

Voor apps die realtime feedback nodig hebben, kun je de parameter stream: true inschakelen om via Server-Sent Events (SSE) geblokkeerde antwoorden te ontvangen. Streaming verlaagt de Time To First Token (TTFT) aanzienlijk en verbetert de gebruikerservaring.

De server stuurt continu JSON-fragmenten totdat het antwoord compleet is. De client moet deze fragmenten zelf samenvoegen tot volledige tekst. Deze modus is ideaal voor chatbots of realtime contentgeneratie, zodat gegevens snel bij de eindgebruiker aankomen.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Modellijst opvragen

Met GET /v1/models kun je de lijst met beschikbare modellen opvragen. De request retourneert een standaard JSON-antwoord met velden zoals id, object en owned_by.

Er is momenteel slechts één model-ID: uncensored. Dit open-weight model is specifiek afgestemd om content censorship te verwijderen en is geschikt voor volwassen inhoud, veiligheidsresearch en controversiële onderwerpen. Let op: we bieden geen embedding- of multimodale generatiediensten aan; we richten ons op pure tekstconversatie.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Foutafhandeling en rate limit

De service volgt de standaard HTTP-statuscodes. 401 Unauthorized betekent dat de API-sleutel ongeldig is; 402 Payment Required betekent dat het accounttegoed onvoldoende is en je moet opwaarderen om door te gaan; 429 Too Many Requests betekent dat je de rate limit hebt bereikt, momenteel beperkt tot 300 verzoeken per minuut.

Bovendien is de limiet voor de grootte van een enkel request body 8 MB. Bij rate limits raden we aan een exponential backoff retry strategy toe te passen. Onze ongecensureerde AI-service waarborgt eerlijke resourceverdeling bij hoge doorvoer.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Voorbeeldcode

Hieronder volgt een compleet voorbeeld voor het versturen van een streaming-verzoek met de Python SDK. De code toont hoe je de client initialiseert, de messagegeschiedenis opbouwt en SSE-datastromen verwerkt.

Zorg ervoor dat de openai-bibliotheek is geïnstalleerd en vervang YOUR_API_KEY door uw daadwerkelijke sleutel. Deze voorbeeldcode toont duidelijk hoe u via de api zhongzhuan-interface realtime resultaten van unlimited AI kunt ophalen, zodat ontwikkelaars snel kunnen integreren in hun bestaande systemen.

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
EndpointsPOST /v1/chat/completions · GET /v1/models
Model-IDuncensored
AuthenticatieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmzhongzhuan.com/v1
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Contextvenster100.000 tokens (invoer + uitvoer)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
JSON-modusresponse_format: {"type": "json_object"}
Gelijktijdige verzoekentot 8 tegelijk per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rate limit300 verzoeken per minuut per sleutel
Verzoekgroottetot 8 MB
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Bonus+5% vanaf $50, +10% vanaf $100
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Veelgestelde vragen

Kan een account meerdere API-sleutels hebben?

Elk account is strikt beperkt tot één API-sleutel. Als je de sleutel wilt vervangen, kun je een nieuwe genereren in het dashboard; de oude sleutel wordt dan direct ongeldig. Deze aanpak vereenvoudigt het rechtenbeheer en zorgt ervoor dat de toegangsgegevens van elk account uniek en duidelijk zijn.

Kan een API-sleutel voor meerdere apps worden gebruikt?

Ja, een enkele API-sleutel kan worden hergebruikt voor meerdere apps of omgevingen, zolang ze dezelfde accountlimieten delen. Omdat elk account slechts één sleutel heeft, raden we aan het gebruik te beheren door de verzoekfrequentie en het saldo te monitoren.

Bevat het ongecensureerde model alle volwassen inhoud?

Het model onderwerpt lawful adult content, fictieve verhalen en controversiële onderwerpen niet aan censorship, maar verbiedt strikt seksuele inhoud met minderjarigen. Dit is de enige harde content restriction, bedoeld om te voldoen aan basiscompliance-eisen. Andere soorten volwassen inhoud worden normaal gegenereerd.

Vul het formulier in om je sleutel te ontvangen

Maak een account aan, kopieer uw sleutel, pas de Base URL aan. Configureren is zo simpel.

API-sleutel ophalen