Integrazione rapida del modello grande senza censura tramite API
Con una configurazione di base e semplici esempi di codice, integra il modello grande senza censura nella tua applicazione in pochi minuti. Offriamo un servizio gateway API conforme al protocollo standard OpenAI, che supporta lo streaming e la chiamata di funzioni, aiutandoti a costruire rapidamente applicazioni senza limiti di contenuto.
Configurazione di base
Il punto chiave per connettersi al gateway API è configurare correttamente l'URL di base e le credenziali di autenticazione. Il nostro servizio è completamente compatibile con il protocollo OpenAI: devi solo impostare l'URL di base su https://api.llmzhongzhuan.com/v1 e includere la tua chiave API nelle intestazioni delle richieste.
A ogni account viene assegnata una sola chiave API, che viene visualizzata immediatamente dopo la registrazione. Se desideri cambiarla, puoi rigenerarla dal pannello di controllo; la chiave precedente diventerà immediatamente invalida. Questa progettazione semplifica il processo di autenticazione, garantendo la sicurezza dell'accesso. Non supportiamo la gestione parallela di più chiavi; ti consigliamo di conservare la chiave in modo appropriato in base all'architettura della tua applicazione.
Interfaccia conversazionale generativa
L'interfaccia conversazionale standard si trova su POST /v1/chat/completions. Il corpo della richiesta deve includere model (fisso su uncensored), l'array messages e parametri opzionali. L'interfaccia supporta risposte non in streaming, adatta per scenari che richiedono risultati completi.
Il modello gira su server GPU ad alte prestazioni indipendenti, con una finestra di contesto fino a 100.000 token. Che si tratti di elaborazione di testi lunghi o di esecuzione di istruzioni complesse, offre un'esperienza di accesso API nativo stabile.
curl https://api.llmzhongzhuan.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Risposta in streaming (SSE)
Per le applicazioni che richiedono feedback in tempo reale, abilita il parametro stream: true per ottenere risposte in blocco tramite Server-Sent Events (SSE). Il trasferimento in streaming riduce significativamente il tempo alla prima parola (TTFT), migliorando l'esperienza utente.
Il server invia continuamente frammenti JSON fino alla fine della risposta. Il client deve assemblare questi frammenti per generare il testo completo. Questo modello è ideale per chatbot o scenari di generazione di contenuti in tempo reale, garantendo che i dati raggiungano rapidamente gli utenti finali.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Query elenco modelli
Puoi ottenere l'elenco dei modelli attualmente disponibili tramite GET /v1/models. La richiesta restituirà una risposta JSON standard contenente campi come id, object e owned_by.
Attualmente è disponibile un solo ID modello: uncensored. Questo è un modello a pesi aperti, ottimizzato specificamente per rimuovere la censura sui contenuti, adatto per contenuti per adulti, ricerca sulla sicurezza e temi controversi. Nota che non offriamo servizi di embedding (Embedding) o generazione multimodale, concentrandoci esclusivamente sulla conversazione testuale.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Gestione errori e limiti di richiesta
Il servizio segue le norme standard sui codici di stato HTTP. 401 Unauthorized indica che la chiave API non è valida; 402 Payment Required indica che il saldo dell'account è insufficiente e devi ricaricarlo per continuare a inviare richieste; 429 Too Many Requests indica che è stato attivato il limite di richieste, con un limite attuale di 300 richieste al minuto.
Inoltre, la dimensione massima del corpo della richiesta è di 8 MB. In caso di limitazione, ti consigliamo di implementare una strategia di nuovo tentativo con backoff esponenziale. Il nostro servizio AI senza censura garantisce l'equità nella distribuzione delle risorse mantenendo un alto throughput.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Codice di esempio
Di seguito è riportato un esempio completo di richiesta in streaming utilizzando l'SDK Python. Il codice mostra come inizializzare il client, costruire la cronologia dei messaggi e gestire il flusso di dati SSE.
Assicurati di aver installato la libreria openai e di aver sostituito YOUR_API_KEY con la chiave effettiva. Questo esempio mostra chiaramente come ottenere risultati di generazione AI illimitati in tempo reale tramite l'interfaccia api zhongzhuan, facilitando l'integrazione rapida degli sviluppatori nei sistemi esistenti.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID modello | uncensored |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmzhongzhuan.com/v1 |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Finestra di contesto | 100.000 token (input + output) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Modalità JSON | response_format: {"type": "json_object"} |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Bonus | +5% da $50, +10% da $100 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande frequenti
L'account può avere più chiavi API?
Ogni account è limitato a una sola chiave API. Per cambiarla, puoi generarne una nuova dal pannello di controllo; la vecchia diventerà immediatamente invalida. Questa progettazione semplifica la gestione dei permessi, garantendo che le credenziali di accesso di ogni account siano uniche e chiare.
La chiave API può essere usata per più applicazioni?
Sì, una singola chiave API può essere riutilizzata in più applicazioni o ambienti, purché condividano le quote dello stesso account. Poiché ogni account ha una sola chiave, ti consigliamo di monitorare la frequenza delle richieste e il saldo per gestire l'uso su più applicazioni.
Il modello senza censura include tutti i contenuti per adulti?
Il modello non censura i contenuti per adulti leciti, le storie di fantasia e i temi controversi, ma vieta rigorosamente i contenuti sessuali che coinvolgono minori. Questa è l'unica limitazione rigida, volta a soddisfare i requisiti di conformità di base. Gli altri tipi di contenuti per adulti vengono generati normalmente.
Compila semplicemente il modulo per ottenere la chiave
Crea un account, copia la chiave, modifica l'URL di base. La configurazione è così semplice.