Snelle integratie van het ongecensureerde LLM-API
Koppel het ongecensureerde LLM binnen enkele minuten aan je app met basisconfiguratie en eenvoudige codevoorbeelden. Wij bieden een API-gateway die compatibel is met het OpenAI-protocol, met ondersteuning voor streaming en tool calling, zodat je snel apps kunt bouwen zonder inhoudsbeperkingen.
Basisconfiguratie
De kern van de toegang tot het api-relaistation ligt in het correct configureren van de Base URL en de authenticatiegegevens. Onze service is volledig compatibel met het OpenAI-protocol; je hoeft alleen de Base URL in te stellen op https://api.llmzhongzhuan.com/v1 en je API-sleutel mee te sturen in de request headers.
Elk account krijgt één API-sleutel toegewezen, die direct na registratie zichtbaar is. U kunt deze via de backend opnieuw genereren; de oude sleutel vervalt dan direct. Deze aanpak vereenvoudigt de authenticatie en zorgt voor toegangssbeveiliging. We ondersteunen geen parallel beheer van meerdere sleutels; bewaar uw sleutels zorgvuldig op basis van uw applicatie-architectuur.
Generatieve gespreksinterface
De standaard gespreksinterface bevindt zich op POST /v1/chat/completions. De request body moet een model (vast ingesteld op uncensored), een messages-array en optionele parameters bevatten. Deze interface ondersteunt niet-streaming-antwoorden, wat geschikt is voor scenario's waarin je het volledige antwoord nodig hebt.
Het model draait op geïsoleerde, hoogpresterende GPU-servers met een contextvenster van maximaal 100.000 tokens. Of je nu lange teksten verwerkt of complexe instructies volgt, je krijgt een stabiele native API-toegang.
curl https://api.llmzhongzhuan.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Streaming-antwoord (SSE)
Voor apps die realtime feedback nodig hebben, kun je de parameter stream: true inschakelen om via Server-Sent Events (SSE) geblokkeerde antwoorden te ontvangen. Streaming verlaagt de Time To First Token (TTFT) aanzienlijk en verbetert de gebruikerservaring.
De server stuurt continu JSON-fragmenten totdat het antwoord compleet is. De client moet deze fragmenten zelf samenvoegen tot volledige tekst. Deze modus is ideaal voor chatbots of realtime contentgeneratie, zodat gegevens snel bij de eindgebruiker aankomen.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Modellijst opvragen
Met GET /v1/models kun je de lijst met beschikbare modellen opvragen. De request retourneert een standaard JSON-antwoord met velden zoals id, object en owned_by.
Er is momenteel slechts één model-ID: uncensored. Dit open-weight model is specifiek afgestemd om content censorship te verwijderen en is geschikt voor volwassen inhoud, veiligheidsresearch en controversiële onderwerpen. Let op: we bieden geen embedding- of multimodale generatiediensten aan; we richten ons op pure tekstconversatie.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Foutafhandeling en rate limit
De service volgt de standaard HTTP-statuscodes. 401 Unauthorized betekent dat de API-sleutel ongeldig is; 402 Payment Required betekent dat het accounttegoed onvoldoende is en je moet opwaarderen om door te gaan; 429 Too Many Requests betekent dat je de rate limit hebt bereikt, momenteel beperkt tot 300 verzoeken per minuut.
Bovendien is de limiet voor de grootte van een enkel request body 8 MB. Bij rate limits raden we aan een exponential backoff retry strategy toe te passen. Onze ongecensureerde AI-service waarborgt eerlijke resourceverdeling bij hoge doorvoer.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Voorbeeldcode
Hieronder volgt een compleet voorbeeld voor het versturen van een streaming-verzoek met de Python SDK. De code toont hoe je de client initialiseert, de messagegeschiedenis opbouwt en SSE-datastromen verwerkt.
Zorg ervoor dat de openai-bibliotheek is geïnstalleerd en vervang YOUR_API_KEY door uw daadwerkelijke sleutel. Deze voorbeeldcode toont duidelijk hoe u via de api zhongzhuan-interface realtime resultaten van unlimited AI kunt ophalen, zodat ontwikkelaars snel kunnen integreren in hun bestaande systemen.
API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Model-ID | uncensored |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmzhongzhuan.com/v1 |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| JSON-modus | response_format: {"type": "json_object"} |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Verzoekgrootte | tot 8 MB |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inloggen | Google of e-mail en wachtwoord |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Veelgestelde vragen
Kan een account meerdere API-sleutels hebben?
Elk account is strikt beperkt tot één API-sleutel. Als je de sleutel wilt vervangen, kun je een nieuwe genereren in het dashboard; de oude sleutel wordt dan direct ongeldig. Deze aanpak vereenvoudigt het rechtenbeheer en zorgt ervoor dat de toegangsgegevens van elk account uniek en duidelijk zijn.
Kan een API-sleutel voor meerdere apps worden gebruikt?
Ja, een enkele API-sleutel kan worden hergebruikt voor meerdere apps of omgevingen, zolang ze dezelfde accountlimieten delen. Omdat elk account slechts één sleutel heeft, raden we aan het gebruik te beheren door de verzoekfrequentie en het saldo te monitoren.
Bevat het ongecensureerde model alle volwassen inhoud?
Het model onderwerpt lawful adult content, fictieve verhalen en controversiële onderwerpen niet aan censorship, maar verbiedt strikt seksuele inhoud met minderjarigen. Dit is de enige harde content restriction, bedoeld om te voldoen aan basiscompliance-eisen. Andere soorten volwassen inhoud worden normaal gegenereerd.
Vul het formulier in om je sleutel te ontvangen
Maak een account aan, kopieer uw sleutel, pas de Base URL aan. Configureren is zo simpel.