Schnelle Integration des unzensierten LLM-API
Integriere das unzensierte Large Language Model in deine Anwendung, indem du die Basis-Konfiguration und einfache Code-Beispiele nutzt. Wir bieten eine API-Proxy-Dienstleistung an, die dem OpenAI-Standardprotokoll entspricht, und unterstützen Streaming-Ausgabe sowie Function Calling, damit du schnell Anwendungen ohne Inhaltsfilter aufbauen kannst.
Basis-Konfiguration
Der Kern der Anbindung an die API-Weiterleitung liegt in der korrekten Konfiguration der Base URL und der Authentifizierungsdaten. Unser Service ist vollständig mit dem OpenAI-Protokoll kompatibel. Sie müssen nur die Base URL auf https://api.llmzhongzhuan.com/v1 setzen und Ihren API-Schlüssel im Anfragekopf mitführen.
Jedes Konto erhält nur einen API-Schlüssel, der nach der Registrierung sofort angezeigt wird. Wenn Sie ihn wechseln möchten, können Sie im Backend einen neuen generieren; der alte Schlüssel wird sofort ungültig. Dieses Design vereinfacht den Authentifizierungsprozess und stellt die Sicherheit der Zugänge sicher. Wir unterstützen kein paralleles Management mehrerer Schlüssel; wir empfehlen, den Schlüssel angemessen gemäß Ihrer Anwendungsarchitektur zu verwalten.
Generative Schnittstelle für Dialoge
Die Standard-Chat-Schnittstelle befindet sich unter POST /v1/chat/completions. Der Anfragetext muss das Feld model (fest auf uncensored gesetzt), das Array messages sowie optionale Parameter enthalten. Die Schnittstelle unterstützt nicht-streamende Antworten und eignet sich für Szenarien, in denen vollständige Rückgabewerte erforderlich sind.
Das Modell läuft auf dedizierten Hochleistungs-GPU-Servern mit einem Kontextfenster von bis zu 100.000 Token. Egal ob lange Textverarbeitung oder das Befolgen komplexer Anweisungen, bietet es eine stabile native API-Anbindungserfahrung.
curl https://api.llmzhongzhuan.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Streaming-Antwort (SSE)
Für Anwendungen, die Echtzeit-Feedback benötigen, aktivieren Sie den Parameter stream: true, um Blockantworten über Server-Sent Events (SSE) zu erhalten. Das Streaming reduziert die Zeit bis zum ersten Token (TTFT) erheblich und verbessert die Benutzererfahrung.
Der Server sendet kontinuierlich JSON-Fragmente, bis die Antwort abgeschlossen ist. Der Client muss diese Fragmente selbst zusammensetzen, um den vollständigen Text zu generieren. Dieser Modus eignet sich hervorragend für Chatbots oder Echtzeit-Inhaltsgenerierungsszenarien und stellt sicher, dass Daten schnell beim Endbenutzer ankommen.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Modelllistenabfrage
Über GET /v1/models können Sie die Liste der aktuell verfügbaren Modelle abrufen. Die Anfrage gibt eine standardmäßige JSON-Antwort mit Feldern wie id, object und owned_by zurück.
Derzeit gibt es nur eine Modell-ID: uncensored. Dieses Open-Weight-Modell wurde speziell optimiert, um Inhaltsfilter zu entfernen, und eignet sich für Erwachseneninhalte, Sicherheitsforschung und kontroverse Themen. Bitte beachten Sie, dass wir keine Embedding- oder Multimodal-Generierungsdienste anbieten; wir konzentrieren uns auf reines Text-Dialog.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Fehlerbehandlung und Ratenlimit
Der Service folgt den Standards für HTTP-Statuscodes. 401 Unauthorized bedeutet, dass der API-Schlüssel ungültig ist; 402 Payment Required bedeutet, dass das Kontoguthaben nicht ausreicht und Sie aufladen müssen, um Anfragen fortzusetzen; 429 Too Many Requests bedeutet, dass das Ratenlimit ausgelöst wurde, mit einem aktuellen Limit von 300 Anfragen pro Minute.
Darüber hinaus ist die Größe des einzelnen Anforderungstextes auf 8 MB begrenzt. Wenn Sie auf das Ratenlimit stoßen, wird eine exponentielle Backoff-Wiederholungsstrategie empfohlen. Unser unzensierter AI-Service gewährleistet bei hoher Durchsatzleistung die Fairness der Ressourcenverteilung.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Code-Beispiele
Hier ist ein vollständiges Beispiel für eine Streaming-Anfrage mit dem Python SDK. Der Code zeigt, wie du den Client initialisierst, die Nachrichtenverlauf erstellst und den SSE-Datenstrom verarbeitest.
Stellen Sie sicher, dass die openai-Bibliothek installiert ist und ersetzen Sie YOUR_API_KEY durch Ihren tatsächlichen Schlüssel. Dieses Beispiel zeigt anschaulich, wie Sie über die API-Weiterleitung-Schnittstelle Echtzeit-Generierungsergebnisse der unbegrenzten KI erhalten, was Entwicklern die schnelle Integration in bestehende Systeme erleichtert.
Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Modell-ID | uncensored |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.llmzhongzhuan.com/v1 |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Häufig gestellte Fragen
Kann ein Konto mehrere API-Schlüssel haben?
Jedes Konto hat streng genommen nur einen API-Schlüssel. Um den Schlüssel zu wechseln, können Sie im Backend einen neuen Schlüssel generieren; der alte Schlüssel wird sofort ungültig. Dieses Design vereinfacht das Berechtigungsmanagement und stellt sicher, dass die Zugangsdaten jedes Kontos eindeutig und klar sind.
Kann ein API-Schlüssel für mehrere Anwendungen verwendet werden?
Ja, ein einzelner API-Schlüssel kann in mehreren Apps oder Umgebungen wiederverwendet werden, solange sie dasselbe Kontingent desselben Kontos teilen. Da jedes Konto nur einen Schlüssel hat, empfehlen wir, die Nutzung durch Überwachung der Anfragfrequenz und des Guthabens zu verwalten.
Beinhaltet das unzensierte Modell alle erwachsenen Inhalte?
Das Modell ist bei legalen Erwachseneninhalten, fiktiven Geschichten und kontroversen Themen unzensiert, verbietet jedoch strikt sexuellen Inhalt, der Minderjährige betrifft. Dies ist die einzige harte Inhaltsbeschränkung, die darauf abzielt, grundlegende Compliance-Anforderungen zu erfüllen. Andere Arten von Erwachseneninhalten werden normal generiert.
Füllen Sie einfach das Formular aus, um den Schlüssel zu erhalten
Erstellen Sie ein Konto, kopieren Sie den Schlüssel, ändern Sie die Base URL. Die Konfiguration ist so einfach.