DE ▾

Schnelle Integration des unzensierten LLM-API

Integriere das unzensierte Large Language Model in deine Anwendung, indem du die Basis-Konfiguration und einfache Code-Beispiele nutzt. Wir bieten eine API-Proxy-Dienstleistung an, die dem OpenAI-Standardprotokoll entspricht, und unterstützen Streaming-Ausgabe sowie Function Calling, damit du schnell Anwendungen ohne Inhaltsfilter aufbauen kannst.

Basis-Konfiguration

Der Kern der Anbindung an die API-Weiterleitung liegt in der korrekten Konfiguration der Base URL und der Authentifizierungsdaten. Unser Service ist vollständig mit dem OpenAI-Protokoll kompatibel. Sie müssen nur die Base URL auf https://api.llmzhongzhuan.com/v1 setzen und Ihren API-Schlüssel im Anfragekopf mitführen.

Jedes Konto erhält nur einen API-Schlüssel, der nach der Registrierung sofort angezeigt wird. Wenn Sie ihn wechseln möchten, können Sie im Backend einen neuen generieren; der alte Schlüssel wird sofort ungültig. Dieses Design vereinfacht den Authentifizierungsprozess und stellt die Sicherheit der Zugänge sicher. Wir unterstützen kein paralleles Management mehrerer Schlüssel; wir empfehlen, den Schlüssel angemessen gemäß Ihrer Anwendungsarchitektur zu verwalten.

Generative Schnittstelle für Dialoge

Die Standard-Chat-Schnittstelle befindet sich unter POST /v1/chat/completions. Der Anfragetext muss das Feld model (fest auf uncensored gesetzt), das Array messages sowie optionale Parameter enthalten. Die Schnittstelle unterstützt nicht-streamende Antworten und eignet sich für Szenarien, in denen vollständige Rückgabewerte erforderlich sind.

Das Modell läuft auf dedizierten Hochleistungs-GPU-Servern mit einem Kontextfenster von bis zu 100.000 Token. Egal ob lange Textverarbeitung oder das Befolgen komplexer Anweisungen, bietet es eine stabile native API-Anbindungserfahrung.

curl https://api.llmzhongzhuan.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Streaming-Antwort (SSE)

Für Anwendungen, die Echtzeit-Feedback benötigen, aktivieren Sie den Parameter stream: true, um Blockantworten über Server-Sent Events (SSE) zu erhalten. Das Streaming reduziert die Zeit bis zum ersten Token (TTFT) erheblich und verbessert die Benutzererfahrung.

Der Server sendet kontinuierlich JSON-Fragmente, bis die Antwort abgeschlossen ist. Der Client muss diese Fragmente selbst zusammensetzen, um den vollständigen Text zu generieren. Dieser Modus eignet sich hervorragend für Chatbots oder Echtzeit-Inhaltsgenerierungsszenarien und stellt sicher, dass Daten schnell beim Endbenutzer ankommen.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Modelllistenabfrage

Über GET /v1/models können Sie die Liste der aktuell verfügbaren Modelle abrufen. Die Anfrage gibt eine standardmäßige JSON-Antwort mit Feldern wie id, object und owned_by zurück.

Derzeit gibt es nur eine Modell-ID: uncensored. Dieses Open-Weight-Modell wurde speziell optimiert, um Inhaltsfilter zu entfernen, und eignet sich für Erwachseneninhalte, Sicherheitsforschung und kontroverse Themen. Bitte beachten Sie, dass wir keine Embedding- oder Multimodal-Generierungsdienste anbieten; wir konzentrieren uns auf reines Text-Dialog.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Fehlerbehandlung und Ratenlimit

Der Service folgt den Standards für HTTP-Statuscodes. 401 Unauthorized bedeutet, dass der API-Schlüssel ungültig ist; 402 Payment Required bedeutet, dass das Kontoguthaben nicht ausreicht und Sie aufladen müssen, um Anfragen fortzusetzen; 429 Too Many Requests bedeutet, dass das Ratenlimit ausgelöst wurde, mit einem aktuellen Limit von 300 Anfragen pro Minute.

Darüber hinaus ist die Größe des einzelnen Anforderungstextes auf 8 MB begrenzt. Wenn Sie auf das Ratenlimit stoßen, wird eine exponentielle Backoff-Wiederholungsstrategie empfohlen. Unser unzensierter AI-Service gewährleistet bei hoher Durchsatzleistung die Fairness der Ressourcenverteilung.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Code-Beispiele

Hier ist ein vollständiges Beispiel für eine Streaming-Anfrage mit dem Python SDK. Der Code zeigt, wie du den Client initialisierst, die Nachrichtenverlauf erstellst und den SSE-Datenstrom verarbeitest.

Stellen Sie sicher, dass die openai-Bibliothek installiert ist und ersetzen Sie YOUR_API_KEY durch Ihren tatsächlichen Schlüssel. Dieses Beispiel zeigt anschaulich, wie Sie über die API-Weiterleitung-Schnittstelle Echtzeit-Generierungsergebnisse der unbegrenzten KI erhalten, was Entwicklern die schnelle Integration in bestehende Systeme erleichtert.

Funktionen und Limits

Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
EndpunktePOST /v1/chat/completions · GET /v1/models
Modell-IDuncensored
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.llmzhongzhuan.com/v1
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
JSON-Modusresponse_format: {"type": "json_object"}
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Ratenlimit300 Anfragen pro Minute und Schlüssel
Anfragegrößebis 8 MB
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehler und Lösungen

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Häufig gestellte Fragen

Kann ein Konto mehrere API-Schlüssel haben?

Jedes Konto hat streng genommen nur einen API-Schlüssel. Um den Schlüssel zu wechseln, können Sie im Backend einen neuen Schlüssel generieren; der alte Schlüssel wird sofort ungültig. Dieses Design vereinfacht das Berechtigungsmanagement und stellt sicher, dass die Zugangsdaten jedes Kontos eindeutig und klar sind.

Kann ein API-Schlüssel für mehrere Anwendungen verwendet werden?

Ja, ein einzelner API-Schlüssel kann in mehreren Apps oder Umgebungen wiederverwendet werden, solange sie dasselbe Kontingent desselben Kontos teilen. Da jedes Konto nur einen Schlüssel hat, empfehlen wir, die Nutzung durch Überwachung der Anfragfrequenz und des Guthabens zu verwalten.

Beinhaltet das unzensierte Modell alle erwachsenen Inhalte?

Das Modell ist bei legalen Erwachseneninhalten, fiktiven Geschichten und kontroversen Themen unzensiert, verbietet jedoch strikt sexuellen Inhalt, der Minderjährige betrifft. Dies ist die einzige harte Inhaltsbeschränkung, die darauf abzielt, grundlegende Compliance-Anforderungen zu erfüllen. Andere Arten von Erwachseneninhalten werden normal generiert.

Füllen Sie einfach das Formular aus, um den Schlüssel zu erhalten

Erstellen Sie ein Konto, kopieren Sie den Schlüssel, ändern Sie die Base URL. Die Konfiguration ist so einfach.

API-Schlüssel erhalten