Häufige Fragen zur API-Zwischenschaltung: Vom Schlüssel zur Fehlerbehebung
Hier findest du Antworten auf die wiederkehrenden Fragen bei der Integration und Nutzung, gruppiert in: Erste Schritte, Guthaben & Abrechnung, Fehler, Leistungsgrenzen, Inhalte & Datenschutz. Jede Antwort enthält konkrete Zahlen und Handlungsschritte. Finde schnell deine Lösung; bei Unklarheiten sieh dir die API-Details an.
Wichtige Punkte
- Die Registrierung erfordert nur E-Mail und Passwort; der Schlüssel wird sofort angezeigt. Neue Konten erhalten 0,50 $ Testguthaben für 7 Tage, ohne Zahlungsinformationen.
- 402 bedeutet kein Guthaben, 429 bedeutet zu viele Anfragen, 503 bedeutet „bitte später versuchen“. Die Lösungen unterscheiden sich deutlich.
- Kontextfenster mit 100.000 Token, maximale Ausgabe pro Anfrage 32.000 Token, Request-Body nicht größer als 8 MB. Es wird ausschließlich Text unterstützt.
- Prompts werden nicht zum Training verwendet.
Erste Schritte
Wie erhalte ich meinen ersten Schlüssel?
Gehe zur Seite „Schlüssel erhalten“, registriere dich mit E-Mail und Passwort. Der Schlüssel wird sofort angezeigt. Keine Zahlungsinformationen nötig. Kopiere den Schlüssel in deine Umgebungsvariablen, um mit der Nutzung zu beginnen.
Wie viele Schlüssel kann ein Konto haben?
Pro Konto nur ein Schlüssel. Bei Bedarf kann ein neuer generiert werden. Beachte: Der alte Schlüssel wird sofort ungültig, und alle Dienste, die ihn noch nutzen, erhalten 401. Bereite daher den Rollout des neuen Schlüssels vor, bevor du den Vorgang startest.
Wie lauten die Endpunkt-URL und der Modellname?
Die URL ist https://api.llmzhongzhuan.com/v1,对话请求发往 /v1/chat/completions. Die Modellliste erhältst du über GET /v1/models. Es gibt nur ein Modell: uncensored.
Wie passe ich bestehenden OpenAI-Code an?
In der Regel musst du nur zwei Dinge ändern: Ersetze die base_url durch die oben genannte Adresse und ersetze den Schlüssel durch den der Website. Ändere das model-Feld auf unzensiert. Die Struktur von Request- und Response-Body bleibt im Format der OpenAI-Chat-Kompletion, sodass der meiste Code unverändert bleibt. Siehe Framework-Konfiguration für konkrete Implementierungen.
Guthaben & Abrechnung
Wie hoch ist das Testguthaben und wie wird es berechnet?
Neue Konten erhalten 0,50 $, gültig für 7 Tage. Preise: 0,25 $ pro 1 Mio. Input-Token, 1,00 $ pro 1 Mio. Output-Token. Bei 800 Input- und 400 Output-Token pro Anfrage kostet dies ca. 0,0006 $. Das Testguthaben reicht für ca. 800 Anfragen. Dies ist eine Schätzung; die tatsächliche Anzahl hängt von der Prompt-Länge ab.
Verfällt das Guthaben nach dem Aufladen?
Nein. Das aufgeladene Prepaid-Guthaben verfällt nie. Es gibt kein Abo und keine Verfallsregel. Nur das Testguthaben ist 7 Tage gültig.
Wie erfahre ich, wie viel eine Anfrage gekostet hat?
Die Antwort enthält usage mit Input- und Output-Token-Anzahl. Bei Streaming-Anfragen wird am Ende ein zusätzliches Chunk mit usage gesendet. Multipliziere diese Zahlen mit den Preisen. Siehe Stabilitätspraxis für Monitoring-Beispiele.
Wo finde ich die vollständigen Preise?
Die Preise richten sich nach der Preisseite. Dort sind die Einheitspreise für Input und Output klar angegeben; es gibt keine versteckten Kosten pro Anfrage.
Fehler & Ratenlimit
Was bedeutet 402?
Der Fehlercode no_credit bedeutet, dass das Kontoguthaben aufgebraucht oder das Testguthaben abgelaufen ist. Die einzige Lösung: Lade dein Prepaid-Guthaben auf. Wiederhole die Anfrage nicht, da dies nur zusätzliche Requests erzeugt.
Wie gehe ich mit 429 um?
Jeder Schlüssel erlaubt maximal 300 Anfragen pro Minute; bei Überschreiten wird 429 zurückgegeben. Reduziere zunächst die Sende-rate und füge eine Backoff-Wiederholung mit zufälligem Jitter hinzu. Für Batch-Verarbeitung empfehlen wir parallele Anfragen mit einem Taktgeber zur Glättung; Beispielcode findest du im Abschnitt zur Stabilität.
Ist 503 upstream_busy ein Fehler?
Kein permanenter Fehler. Der Dienst ist nur vorübergehend ausgelastet. Warte einige Sekunden und versuche es erneut. Nutze exponentielles Backoff und begrenze die Anzahl der Wiederholungen.
Was bedeutet 403 content_blocked?
Die Anfrage wurde aufgrund von Inhaltsfiltern blockiert. Sexuelle Inhalte mit Minderjährigen werden unabhängig von Fiktion oder Rollenspiel immer mit 403 zurückgegeben. Wiederhole die Anfrage nicht; überprüfe und passe den Request an.
Leistungsgrenzen
Wie lang ist der Kontext und wie lang kann die Ausgabe sein?
Die Gesamtlänge des Kontextfensters beträgt 100.000 Token; Input und Output zusammen dürfen diesen Wert nicht überschreiten. max_tokens beträgt standardmäßig 2048, kann aber pro Anfrage auf maximal 32.000 gesetzt werden. Wird die Obergrenze überschritten (Input plus max_tokens), wird 400 zurückgegeben. Reserve bei langen Texten ausreichend Platz für das Input.
Werden Streaming und Function Calling unterstützt?
Alles wird unterstützt. Setze stream auf true, um SSE-Streaming-Ausgaben zu erhalten; Tool Calls verwenden das OpenAI-Tools-Format. Häufige Sampling-Parameter wie temperature, top_p und stop werden durchgereicht.
Kann ich Vektoren, Bilder oder Audio generieren?
Nein. Wir bieten ausschließlich Text-Chat an. Es gibt keine Vektoren, Bilder, Audio, Video oder Fine-Tuning, und es steht nur ein Modell zur Verfügung. Wenn deine Anwendung diese Fähigkeiten benötigt, müssen zusätzliche Lösungen integriert werden.
Gibt es Limits für den Request-Body?
Ja. Der Request-Body darf 8 MB nicht überschreiten. Achte bei langen Prompts nicht nur auf die Token-Anzahl, sondern auch auf die Byte-Größe.
Go-Live & Betrieb
Was sind die wichtigsten Schritte vor dem Go-Live?
Bestätige zunächst die Modellliste über /v1/models und führe Tests mit langen Inputs, Streaming und Fehlerpfaden durch. Schreibe dann separate Handler für die Fehlercodes 402, 429 und 503 und speichere die usage-Daten. Lege eine Warnschwelle für das Guthaben fest, damit du nicht erst in Stoßzeiten feststellst, dass das Guthaben aufgebraucht ist. Vergiss nicht, diese Checks in den Release-Prozess aufzunehmen und vom On-Call-Team abhaken zu lassen.
Was tun, wenn online plötzlich alles mit 401 antwortet?
Prüfe zuerst, ob jemand im Backend den API-Schlüssel neu generiert hat, da alte Schlüssel nach der Neugenerierung sofort ungültig werden. Prüfe dann, ob die Umgebungsvariablen bei der letzten Veröffentlichung verloren gegangen sind oder ob Leerzeichen und Zeilenumbrüche in den Schlüssel eingefügt wurden. Wenn du den aktuell gültigen Schlüssel nur an einer Stelle speicherst, sparst du dir den Großteil dieser Fehlersuche.
Was ist zu beachten, wenn mehrere Dienste denselben API-Schlüssel verwenden?
Rate Limits werden schlüsselbasiert zusammengefasst. Die Summe aller Anfragen aller Dienste darf 300 pro Minute nicht überschreiten. Wenn ein Batch-Job das Limit ausschöpft, erhalten auch Online-Dienste 429. Wir empfehlen, für Batch-Jobs ein separates Limit zu setzen und Online-Anfragen zu priorisieren. Führe Batch-Jobs bei Bedarf nachts versetzt aus.
Wie vermeidest du, dass die Kosten unbemerkt über das erwartete Maß steigen?
Die Ausgabe-Token kosten viermal so viel wie Input-Token. Kontrolliere daher primär max_tokens und die im Prompt geforderte Textlänge. Analysiere die usage nach Funktionen; wenn sich die durchschnittliche Ausgabelänge einer Funktion plötzlich verdoppelt, prüfe, ob dies an Änderungen im Prompt liegt. Der Vorteil des Prepaid-Modells ist, dass die Dienste bei Aufbrauch des Guthabens stoppen, sodass es zu keinen unerwarteten Überzügen kommt.
Inhalt und Datenschutz
Welche Inhalte sind erlaubt?
Legale erwachsene Inhalte, fiktionale Kreationen und kontroverse Themen werden nicht direkt abgelehnt; der Dienst richtet sich an Nutzer ab 18 Jahren. Sexuelle Inhalte mit Minderjährigen werden jedoch immer blockiert. Zu Kosten und Kompromissen bei solchen Diensten lies Kosten und Kompromisse der uneingeschränkten AI-API.
Werden meine Prompts zum Training verwendet?
Nein, Prompts werden nicht zum Training verwendet. Was die Speicherung oder Protokollierung sonst noch betrifft, sieh bitte in der Dokumentation nach.
Wie unterscheidet sich dieser Dienst von einem Aggregator?
Wir bieten nur ein Modell an, sodass keine umfangreiche Zuordnung von Modellnamen erforderlich ist. Die Modellliste kannst du selbst über /v1/models prüfen. Um die allgemeinen Prinzipien und Risiken von Aggregatoren zu verstehen, lies zunächst Die Funktionsweise von Aggregatoren.
Häufig gestellte Fragen
Wie fange ich an?
Registriere dich mit E-Mail und Passwort; der Schlüssel wird sofort angezeigt, keine Zahlungsinformationen erforderlich. Neue Konten erhalten 0.50 USD Testguthaben, das 7 Tage gültig ist.
Was tun bei Fehlercode 402?
Der Fehlercode 402 bedeutet no_credit: Das Guthaben ist aufgebraucht oder das Testguthaben ist abgelaufen. Lade dein Prepaid-Guthaben auf, aber wiederhole die Anfrage nicht.
Wie hoch ist das Ratenlimit?
Pro Schlüssel 300 Anfragen pro Minute; bei Überschreitung wird 429 zurückgegeben. Wir empfehlen, die parallelen Anfragen mit Backoff-Strategien zu puffern, um die Ratenlimits einzuhalten.
Wie lang sind Kontext und Output maximal?
Das Kontextfenster umfasst insgesamt 100.000 Token, max_tokens beträgt standardmäßig 2048 und maximal 32.000. Der Request-Body darf 8 MB nicht überschreiten.
Werden Prompts zum Training verwendet?
Nein, Prompts werden nicht zum Training verwendet.
Fülle einfach das Formular aus, um deinen API-Schlüssel zu erhalten
Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Die Konfiguration ist so einfach.