ES ▾

Integración rápida del API de modelo grande sin censura

Con una configuración básica y ejemplos de código sencillos, integra el modelo grande sin censura en tu aplicación en minutos. Ofrecemos un servicio de endpoint de API compatible con el protocolo estándar de OpenAI, con soporte para streaming y llamadas a herramientas, para que construyas aplicaciones sin restricciones de contenido rápidamente.

Configuración básica

Conectarse al endpoint de API implica configurar correctamente la URL base y las credenciales de autenticación. Nuestro servicio es totalmente compatible con el protocolo de OpenAI; solo necesitas establecer la URL base en https://api.llmzhongzhuan.com/v1 e incluir tu clave de API en los encabezados de la petición.

Cada cuenta recibe una única clave de API, que se muestra inmediatamente tras el registro. Si necesitas cambiarla, puedes regenerarla en el panel; la clave anterior caducará de inmediato. Este diseño simplifica el flujo de autenticación y garantiza la seguridad del acceso. No admitimos la gestión paralela de varias claves; se recomienda guardar la clave adecuadamente según la arquitectura de tu aplicación.

Interfaz de conversación generativa

La interfaz de conversación estándar está en POST /v1/chat/completions. El cuerpo de la petición debe incluir model (fijo en uncensored), el array messages y parámetros opcionales. Esta interfaz admite respuestas no en streaming, ideales para escenarios que requieren el resultado completo.

El modelo se ejecuta en servidores GPU de alto rendimiento independientes, con una ventana de contexto de hasta 100,000 tokens. Tanto para el procesamiento de texto largo como para la ejecución de instrucciones complejas, ofrece una experiencia de acceso a la API nativa y estable.

curl https://api.llmzhongzhuan.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Respuesta en streaming (SSE)

Para aplicaciones que requieren retroalimentación en tiempo real, activa el parámetro stream: true para obtener respuestas en fragmentos mediante Server-Sent Events (SSE). El streaming reduce significativamente la latencia del primer token (TTFT) y mejora la experiencia del usuario.

El servidor envía continuamente fragmentos de JSON hasta que finalice la respuesta. El cliente debe ensamblar estos fragmentos para generar el texto completo. Este modo es ideal para chatbots o escenarios de generación de contenido en tiempo real, asegurando que los datos lleguen rápidamente al usuario final.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Consulta de lista de modelos

Mediante GET /v1/models puedes obtener la lista de modelos disponibles actualmente. La petición devolverá una respuesta JSON estándar que incluye campos como id, object y owned_by.

Actualmente solo hay un ID de modelo: uncensored. Este modelo de pesos abiertos ha sido ajustado específicamente para eliminar la censura de contenido, siendo adecuado para contenido para adultos, investigación de seguridad y temas controvertidos. Ten en cuenta que no ofrecemos servicios de embeddings ni generación multimodal; nos especializamos en conversación de texto puro.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Manejo de errores y límites de peticiones

El servicio sigue la normativa de códigos de estado HTTP estándar. 401 Unauthorized indica que la clave de API no es válida; 402 Payment Required indica que el saldo de la cuenta es insuficiente y necesitas recargar para continuar con las peticiones; 429 Too Many Requests indica que se ha superado el límite de peticiones, actualmente limitado a 300 peticiones por minuto.

Además, el tamaño máximo del cuerpo de una petición es de 8 MB. Si encuentras límites de peticiones, se recomienda implementar una estrategia de reintento con retroceso exponencial. Nuestro servicio de IA sin censura mantiene un alto rendimiento mientras garantiza la equidad en la asignación de recursos.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Código de ejemplo

A continuación se muestra un ejemplo completo de una petición en streaming usando el SDK de Python. El código muestra cómo inicializar el cliente, construir el historial de mensajes y procesar el flujo de datos SSE.

Asegúrate de tener instalada la biblioteca openai y reemplaza YOUR_API_KEY con tu clave real. Este ejemplo muestra claramente cómo obtener resultados de generación en tiempo real de IA sin límites a través de la interfaz endpoint de API, facilitando la integración rápida de desarrolladores en sistemas existentes.

Funciones y límites

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
EndpointsPOST /v1/chat/completions · GET /v1/models
ID del modelouncensored
AutenticaciónAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmzhongzhuan.com/v1
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Ventana de contexto100.000 tokens (entrada + salida)
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Modo JSONresponse_format: {"type": "json_object"}
Concurrencia8 peticiones a la vez por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Límite de peticiones300 por minuto por clave
Tamaño de peticiónhasta 8 MB
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Bono+5 % desde $50, +10 % desde $100
Caducidadel crédito pagado no caduca, sin suscripción
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
AccesoGoogle o correo y contraseña
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas frecuentes

¿Puede una cuenta tener varias claves de API?

Cada cuenta tiene estrictamente una sola clave de API. Si necesitas cambiarla, puedes generar una nueva en el panel; la anterior caducará de inmediato. Este diseño simplifica la gestión de permisos y garantiza que las credenciales de acceso de cada cuenta sean únicas y claras.

¿Se puede usar una clave de API para varias aplicaciones?

Sí, una única clave de API se puede reutilizar en varias aplicaciones o entornos, siempre que compartan la cuota de la misma cuenta. Dado que cada cuenta tiene solo una clave, se recomienda gestionar el uso en múltiples aplicaciones monitoreando la frecuencia de peticiones y el saldo.

¿El modelo sin censura incluye todo el contenido para adultos?

El modelo no censura contenido para adultos lícito, historias de ficción y temas controvertidos, pero prohíbe estrictamente el contenido sexual que involucre a menores. Esta es la única restricción de contenido estricta, diseñada para cumplir con los requisitos básicos de cumplimiento. Otros tipos de contenido para adultos se generan con normalidad.

Solo completa el formulario para obtener la clave

Crea una cuenta, copia la clave y modifica la URL base. La configuración es así de sencilla.

Obtener clave de API