FR ▾

Intégration rapide du modèle de langage sans censure

Grâce à une configuration de base et à des exemples de code simples, intégrez le modèle de langage sans censure à votre application en quelques minutes. Nous proposons un service de point de passage API conforme au protocole standard OpenAI, prenant en charge le streaming et l'appel de fonctions, pour vous aider à construire rapidement des applications sans limites de contenu.

Configuration de base

L'intégration au point de passage API repose sur la configuration correcte de l'URL de base et des identifiants d'authentification. Notre service est entièrement compatible avec le protocole OpenAI : il vous suffit de définir l'URL de base sur https://api.llmzhongzhuan.com/v1 et d'inclure votre clé API dans les en-têtes de la requête.

Chaque compte se voit attribuer une seule clé API, affichée immédiatement après l'inscription. Si vous souhaitez la remplacer, vous pouvez en générer une nouvelle dans le panneau d'administration ; l'ancienne deviendra immédiatement invalide. Cette conception simplifie le processus d'authentification et garantit la sécurité des accès. Nous ne prenons pas en charge la gestion parallèle de plusieurs clés ; il est recommandé de conserver soigneusement votre clé en fonction de l'architecture de votre application.

Interface de conversation générative

L'interface de conversation standard se trouve sur POST /v1/chat/completions. Le corps de la requête doit inclure model (fixé à uncensored), le tableau messages et des paramètres optionnels. Cette interface prend en charge les réponses non streamées, adaptées aux scénarios nécessitant un résultat complet.

Le modèle s'exécute sur des serveurs GPU haute performance dédiés, avec une fenêtre de contexte allant jusqu'à 100 000 tokens. Qu'il s'agisse du traitement de longs textes ou du respect d'instructions complexes, il offre une expérience d'accès API native stable.

curl https://api.llmzhongzhuan.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Réponse en streaming (SSE)

Pour les applications nécessitant des retours en temps réel, activez le paramètre stream: true pour obtenir des réponses par blocs via Server-Sent Events (SSE). Le streaming réduit considérablement le temps de génération du premier token (TTFT) et améliore l'expérience utilisateur.

Le serveur envoie continuellement des fragments JSON jusqu'à la fin de la réponse. Le client doit assembler ces fragments pour reconstituer le texte complet. Ce mode est idéal pour les chatbots ou les scénarios de génération de contenu en temps réel, garantissant que les données atteignent rapidement l'utilisateur final.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Requête de liste des modèles

L'endpoint GET /v1/models permet d'obtenir la liste des modèles actuellement disponibles. La requête renvoie une réponse JSON standard contenant les champs id, object et owned_by, entre autres.

Il n'existe actuellement qu'un seul ID de modèle : uncensored. Il s'agit d'un modèle à poids ouverts, spécialement optimisé pour supprimer la censure des contenus, adapté aux contenus pour adultes, à la recherche en sécurité et aux sujets controversés. Veuillez noter que nous ne proposons pas de services d'embedding ni de génération multimodale ; nous nous concentrons sur la conversation textuelle pure.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Gestion des erreurs et limites de débit

Le service respecte les normes standard des codes d'état HTTP. 401 Unauthorized indique que la clé API est invalide ; 402 Payment Required indique un solde insuffisant, nécessitant un rechargement pour continuer à envoyer des requêtes ; 429 Too Many Requests indique que la limite de débit est atteinte, avec une limite actuelle de 300 requêtes par minute.

De plus, la taille maximale du corps de la requête est de 8 Mo. En cas de limitation de débit, il est recommandé de mettre en œuvre une stratégie de nouvelle tentative avec backoff exponentiel. Notre service d'IA sans censure garantit l'équité de l'allocation des ressources tout en maintenant un débit élevé.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Exemples de code

Voici un exemple complet d'utilisation du SDK Python pour une requête en streaming. Le code montre comment initialiser le client, construire l'historique des messages et traiter le flux de données SSE.

Assurez-vous d'avoir installé la bibliothèque openai et remplacez YOUR_API_KEY par votre clé réelle. Cet exemple montre clairement comment obtenir des résultats de génération en temps réel d'une IA sans limites via l'interface api zhongzhuan, facilitant l'intégration rapide des développeurs dans les systèmes existants.

Fonctions et limites

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
EndpointsPOST /v1/chat/completions · GET /v1/models
ID du modèleuncensored
AuthentificationAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmzhongzhuan.com/v1
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Fenêtre de contexte100 000 tokens (entrée + sortie)
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Mode JSONresponse_format: {"type": "json_object"}
Concurrence8 requêtes simultanées par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite de débit300 requêtes par minute et par clé
Taillejusqu'à 8 Mo par requête
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Bonus+5 % dès 50 $, +10 % dès 100 $
Validitéle crédit payé n'expire jamais, sans abonnement
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Clésune clé active par compte ; une nouvelle remplace l'ancienne
ConnexionGoogle ou e-mail et mot de passe
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions fréquentes

Un compte peut-il posséder plusieurs clés API ?

Chaque compte est strictement limité à une seule clé API. Pour la remplacer, vous pouvez en générer une nouvelle dans le panneau d'administration ; l'ancienne sera immédiatement révoquée. Cette conception simplifie la gestion des permissions et garantit qu'un seul identifiant d'accès est unique et clair pour chaque compte.

La clé API peut-elle être utilisée pour plusieurs applications ?

Oui, une clé API unique peut être réutilisée sur plusieurs applications ou environnements, tant qu'ils partagent le quota du même compte. Comme chaque compte ne dispose que d'une seule clé, il est recommandé de gérer l'utilisation multi-applications en surveillant la fréquence des requêtes et le solde.

Le modèle sans censure inclut-il tous les contenus pour adultes ?

Le modèle n'exerce aucune censure sur les contenus adultes licites, les histoires de fiction et les sujets controversés, mais interdit strictement les contenus sexuels impliquant des mineurs. Il s'agit de la seule restriction de contenu rigide, destinée à respecter les exigences de conformité de base. Les autres types de contenus pour adultes sont générés normalement.

Remplissez simplement le formulaire pour obtenir votre clé

Créez un compte, copiez la clé, modifiez l'URL de base. La configuration est aussi simple que cela.

Obtenir la clé API