IT ▾

Integrazione rapida del modello grande senza censura tramite API

Con una configurazione di base e semplici esempi di codice, integra il modello grande senza censura nella tua applicazione in pochi minuti. Offriamo un servizio gateway API conforme al protocollo standard OpenAI, che supporta lo streaming e la chiamata di funzioni, aiutandoti a costruire rapidamente applicazioni senza limiti di contenuto.

Configurazione di base

Il punto chiave per connettersi al gateway API è configurare correttamente l'URL di base e le credenziali di autenticazione. Il nostro servizio è completamente compatibile con il protocollo OpenAI: devi solo impostare l'URL di base su https://api.llmzhongzhuan.com/v1 e includere la tua chiave API nelle intestazioni delle richieste.

A ogni account viene assegnata una sola chiave API, che viene visualizzata immediatamente dopo la registrazione. Se desideri cambiarla, puoi rigenerarla dal pannello di controllo; la chiave precedente diventerà immediatamente invalida. Questa progettazione semplifica il processo di autenticazione, garantendo la sicurezza dell'accesso. Non supportiamo la gestione parallela di più chiavi; ti consigliamo di conservare la chiave in modo appropriato in base all'architettura della tua applicazione.

Interfaccia conversazionale generativa

L'interfaccia conversazionale standard si trova su POST /v1/chat/completions. Il corpo della richiesta deve includere model (fisso su uncensored), l'array messages e parametri opzionali. L'interfaccia supporta risposte non in streaming, adatta per scenari che richiedono risultati completi.

Il modello gira su server GPU ad alte prestazioni indipendenti, con una finestra di contesto fino a 100.000 token. Che si tratti di elaborazione di testi lunghi o di esecuzione di istruzioni complesse, offre un'esperienza di accesso API nativo stabile.

curl https://api.llmzhongzhuan.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Risposta in streaming (SSE)

Per le applicazioni che richiedono feedback in tempo reale, abilita il parametro stream: true per ottenere risposte in blocco tramite Server-Sent Events (SSE). Il trasferimento in streaming riduce significativamente il tempo alla prima parola (TTFT), migliorando l'esperienza utente.

Il server invia continuamente frammenti JSON fino alla fine della risposta. Il client deve assemblare questi frammenti per generare il testo completo. Questo modello è ideale per chatbot o scenari di generazione di contenuti in tempo reale, garantendo che i dati raggiungano rapidamente gli utenti finali.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Query elenco modelli

Puoi ottenere l'elenco dei modelli attualmente disponibili tramite GET /v1/models. La richiesta restituirà una risposta JSON standard contenente campi come id, object e owned_by.

Attualmente è disponibile un solo ID modello: uncensored. Questo è un modello a pesi aperti, ottimizzato specificamente per rimuovere la censura sui contenuti, adatto per contenuti per adulti, ricerca sulla sicurezza e temi controversi. Nota che non offriamo servizi di embedding (Embedding) o generazione multimodale, concentrandoci esclusivamente sulla conversazione testuale.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Gestione errori e limiti di richiesta

Il servizio segue le norme standard sui codici di stato HTTP. 401 Unauthorized indica che la chiave API non è valida; 402 Payment Required indica che il saldo dell'account è insufficiente e devi ricaricarlo per continuare a inviare richieste; 429 Too Many Requests indica che è stato attivato il limite di richieste, con un limite attuale di 300 richieste al minuto.

Inoltre, la dimensione massima del corpo della richiesta è di 8 MB. In caso di limitazione, ti consigliamo di implementare una strategia di nuovo tentativo con backoff esponenziale. Il nostro servizio AI senza censura garantisce l'equità nella distribuzione delle risorse mantenendo un alto throughput.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Codice di esempio

Di seguito è riportato un esempio completo di richiesta in streaming utilizzando l'SDK Python. Il codice mostra come inizializzare il client, costruire la cronologia dei messaggi e gestire il flusso di dati SSE.

Assicurati di aver installato la libreria openai e di aver sostituito YOUR_API_KEY con la chiave effettiva. Questo esempio mostra chiaramente come ottenere risultati di generazione AI illimitati in tempo reale tramite l'interfaccia api zhongzhuan, facilitando l'integrazione rapida degli sviluppatori nei sistemi esistenti.

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
EndpointPOST /v1/chat/completions · GET /v1/models
ID modellouncensored
AutenticazioneAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmzhongzhuan.com/v1
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Finestra di contesto100.000 token (input + output)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Modalità JSONresponse_format: {"type": "json_object"}
Concorrenza8 richieste contemporanee per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite di frequenza300 richieste al minuto per chiave
Dimensionefino a 8 MB per richiesta
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Bonus+5% da $50, +10% da $100
Scadenzail credito pagato non scade, nessun abbonamento
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
AccessoGoogle oppure e-mail e password
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande frequenti

L'account può avere più chiavi API?

Ogni account è limitato a una sola chiave API. Per cambiarla, puoi generarne una nuova dal pannello di controllo; la vecchia diventerà immediatamente invalida. Questa progettazione semplifica la gestione dei permessi, garantendo che le credenziali di accesso di ogni account siano uniche e chiare.

La chiave API può essere usata per più applicazioni?

Sì, una singola chiave API può essere riutilizzata in più applicazioni o ambienti, purché condividano le quote dello stesso account. Poiché ogni account ha una sola chiave, ti consigliamo di monitorare la frequenza delle richieste e il saldo per gestire l'uso su più applicazioni.

Il modello senza censura include tutti i contenuti per adulti?

Il modello non censura i contenuti per adulti leciti, le storie di fantasia e i temi controversi, ma vieta rigorosamente i contenuti sessuali che coinvolgono minori. Questa è l'unica limitazione rigida, volta a soddisfare i requisiti di conformità di base. Gli altri tipi di contenuti per adulti vengono generati normalmente.

Compila semplicemente il modulo per ottenere la chiave

Crea un account, copia la chiave, modifica l'URL di base. La configurazione è così semplice.

Ottieni la chiave API