Intégration rapide du modèle de langage sans censure
Grâce à une configuration de base et à des exemples de code simples, intégrez le modèle de langage sans censure à votre application en quelques minutes. Nous proposons un service de point de passage API conforme au protocole standard OpenAI, prenant en charge le streaming et l'appel de fonctions, pour vous aider à construire rapidement des applications sans limites de contenu.
Configuration de base
L'intégration au point de passage API repose sur la configuration correcte de l'URL de base et des identifiants d'authentification. Notre service est entièrement compatible avec le protocole OpenAI : il vous suffit de définir l'URL de base sur https://api.llmzhongzhuan.com/v1 et d'inclure votre clé API dans les en-têtes de la requête.
Chaque compte se voit attribuer une seule clé API, affichée immédiatement après l'inscription. Si vous souhaitez la remplacer, vous pouvez en générer une nouvelle dans le panneau d'administration ; l'ancienne deviendra immédiatement invalide. Cette conception simplifie le processus d'authentification et garantit la sécurité des accès. Nous ne prenons pas en charge la gestion parallèle de plusieurs clés ; il est recommandé de conserver soigneusement votre clé en fonction de l'architecture de votre application.
Interface de conversation générative
L'interface de conversation standard se trouve sur POST /v1/chat/completions. Le corps de la requête doit inclure model (fixé à uncensored), le tableau messages et des paramètres optionnels. Cette interface prend en charge les réponses non streamées, adaptées aux scénarios nécessitant un résultat complet.
Le modèle s'exécute sur des serveurs GPU haute performance dédiés, avec une fenêtre de contexte allant jusqu'à 100 000 tokens. Qu'il s'agisse du traitement de longs textes ou du respect d'instructions complexes, il offre une expérience d'accès API native stable.
curl https://api.llmzhongzhuan.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Réponse en streaming (SSE)
Pour les applications nécessitant des retours en temps réel, activez le paramètre stream: true pour obtenir des réponses par blocs via Server-Sent Events (SSE). Le streaming réduit considérablement le temps de génération du premier token (TTFT) et améliore l'expérience utilisateur.
Le serveur envoie continuellement des fragments JSON jusqu'à la fin de la réponse. Le client doit assembler ces fragments pour reconstituer le texte complet. Ce mode est idéal pour les chatbots ou les scénarios de génération de contenu en temps réel, garantissant que les données atteignent rapidement l'utilisateur final.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Requête de liste des modèles
L'endpoint GET /v1/models permet d'obtenir la liste des modèles actuellement disponibles. La requête renvoie une réponse JSON standard contenant les champs id, object et owned_by, entre autres.
Il n'existe actuellement qu'un seul ID de modèle : uncensored. Il s'agit d'un modèle à poids ouverts, spécialement optimisé pour supprimer la censure des contenus, adapté aux contenus pour adultes, à la recherche en sécurité et aux sujets controversés. Veuillez noter que nous ne proposons pas de services d'embedding ni de génération multimodale ; nous nous concentrons sur la conversation textuelle pure.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Gestion des erreurs et limites de débit
Le service respecte les normes standard des codes d'état HTTP. 401 Unauthorized indique que la clé API est invalide ; 402 Payment Required indique un solde insuffisant, nécessitant un rechargement pour continuer à envoyer des requêtes ; 429 Too Many Requests indique que la limite de débit est atteinte, avec une limite actuelle de 300 requêtes par minute.
De plus, la taille maximale du corps de la requête est de 8 Mo. En cas de limitation de débit, il est recommandé de mettre en œuvre une stratégie de nouvelle tentative avec backoff exponentiel. Notre service d'IA sans censure garantit l'équité de l'allocation des ressources tout en maintenant un débit élevé.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Exemples de code
Voici un exemple complet d'utilisation du SDK Python pour une requête en streaming. Le code montre comment initialiser le client, construire l'historique des messages et traiter le flux de données SSE.
Assurez-vous d'avoir installé la bibliothèque openai et remplacez YOUR_API_KEY par votre clé réelle. Cet exemple montre clairement comment obtenir des résultats de génération en temps réel d'une IA sans limites via l'interface api zhongzhuan, facilitant l'intégration rapide des développeurs dans les systèmes existants.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Authentification | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmzhongzhuan.com/v1 |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de débit | 300 requêtes par minute et par clé |
| Taille | jusqu'à 8 Mo par requête |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions fréquentes
Un compte peut-il posséder plusieurs clés API ?
Chaque compte est strictement limité à une seule clé API. Pour la remplacer, vous pouvez en générer une nouvelle dans le panneau d'administration ; l'ancienne sera immédiatement révoquée. Cette conception simplifie la gestion des permissions et garantit qu'un seul identifiant d'accès est unique et clair pour chaque compte.
La clé API peut-elle être utilisée pour plusieurs applications ?
Oui, une clé API unique peut être réutilisée sur plusieurs applications ou environnements, tant qu'ils partagent le quota du même compte. Comme chaque compte ne dispose que d'une seule clé, il est recommandé de gérer l'utilisation multi-applications en surveillant la fréquence des requêtes et le solde.
Le modèle sans censure inclut-il tous les contenus pour adultes ?
Le modèle n'exerce aucune censure sur les contenus adultes licites, les histoires de fiction et les sujets controversés, mais interdit strictement les contenus sexuels impliquant des mineurs. Il s'agit de la seule restriction de contenu rigide, destinée à respecter les exigences de conformité de base. Les autres types de contenus pour adultes sont générés normalement.
Remplissez simplement le formulaire pour obtenir votre clé
Créez un compte, copiez la clé, modifiez l'URL de base. La configuration est aussi simple que cela.