FAQ de API de reenvío: desde obtener la clave hasta depurar errores
Aquí respondemos las preguntas que los desarrolladores hacen repetidamente al integrar y usar la API, organizadas en cinco grupos: inicio, saldo y facturación, errores, límites de capacidad, contenido y privacidad. Cada respuesta incluye números y acciones concretas para que compares con tu caso; si no encuentras lo que buscas, vuelve a la documentación para ver los detalles del endpoint.
Puntos clave
- El registro solo requiere correo y contraseña; la clave se muestra al instante. La cuenta nueva recibe 0,50 USD de crédito de prueba válido por 7 días, sin necesidad de datos de pago.
- 402 indica falta de saldo, 429 indica peticiones excesivas y 503 indica espera; cada uno tiene un manejo distinto.
- Ventana de contexto de 100,000 tokens, máximo 32,000 tokens de salida, cuerpo de petición de hasta 8 MB. Solo texto.
- Los prompts no se utilizan para entrenamiento.
Inicio
¿Cómo obtener la primera clave?
Ve a la página de obtención de claves, regístrate con correo y contraseña y la clave se mostrará al instante. No necesitas datos de pago; cópiala y añádela a una variable de entorno para empezar a llamar a la API.
¿Cuántas claves puede tener una cuenta?
Una clave por cuenta. Puedes regenerarla cuando quieras, pero ten en cuenta: al regenerar, la clave anterior se invalida de inmediato y todos los servicios que la usen empezarán a recibir 401. Prepara el flujo de distribución de la nueva clave antes de actuar.
¿Cuáles son la dirección del endpoint y el nombre del modelo?
La dirección es https://api.llmzhongzhuan.com/v1,对话请求发往 /v1/chat/completions. Consulta la lista de modelos con GET /v1/models. Solo hay un modelo: uncensored.
¿Cómo modifico el código existente de OpenAI?
Normalmente solo necesitas cambiar dos cosas: la base_url por la dirección anterior, la clave por la de este sitio y el campo model por uncensored. La estructura del cuerpo y la respuesta sigue el formato de chat completions de OpenAI, así que la mayoría del código no cambia. Para detalles por framework, consulta Configuración de frameworks.
Saldo y facturación
¿Cuánto es el crédito de prueba y cómo se calcula?
0,50 USD de regalo para cuentas nuevas, con un periodo de validez de 7 días. Calculado a 0,25 USD por millón de tokens de entrada y 1,00 USD por millón de salida. Suponiendo 800 tokens de entrada y 400 de salida por petición, el coste es de aprox. 0,0006 USD. El crédito de prueba cubre unas 800 peticiones. Esto es una estimación; el uso real depende de la longitud de tu prompt.
¿Caduca el saldo después de recargar?
No. El saldo prepago no tiene suscripción ni fecha de vencimiento. Solo el crédito de prueba caduca a los 7 días.
¿Cómo saber cuánto cuesta una petición?
La respuesta incluye usage con el conteo de tokens de entrada y salida. En streaming, el último fragmento contiene usage. Multiplica estos números por el precio unitario para obtener el coste. Para monitorización, consulta Prácticas de estabilidad.
¿Dónde veo el precio completo?
Los precios están en la página de precios. Se muestran las tarifas unitarias de entrada y salida sin costes ocultos por petición.
Errores y límites
¿Qué significa el 402?
El código no_credit indica que el saldo está agotado o la prueba ha expirado. La única solución es recargar el saldo prepago. No reintentes; el reintento fallará y generará peticiones innecesarias.
¿Cómo manejar el 429?
Máximo 300 peticiones por minuto y por clave; si excedes, obtienes 429. Reduce la tasa de envío y añade reintentos con retroceso y jitter. Para lotes, usa el límite de concurrencia y un medidor para suavizar el envío. Código de ejemplo en la sección de estabilidad.
¿Es 503 upstream_busy una avería?
No es una avería permanente; indica que el servicio está ocupado. Reintenta en unos segundos. Usa retroceso exponencial y limita el número máximo de reintentos.
¿Qué causa 403 content_blocked?
Indica que la petición activó el filtro de contenido. El contenido sexual con menores se bloquea siempre (403), sea ficción o roleplay. No reintentes al recibir 403; revisa y modifica el contenido de la petición.
Límites de capacidad
¿Cuál es la longitud del contexto y cuánto puedes generar?
La longitud total del contexto es de 100,000 tokens; la suma de entrada y salida no puede superarla. max_tokens es 2048 por defecto, con un máximo de 32,000. Si la entrada más max_tokens supera el límite, recibirás un 400. Deja espacio para la entrada al escribir textos largos.
¿Soporta streaming y llamadas a funciones?
Todos. Configura stream en true para obtener salida en streaming SSE. Las llamadas a funciones usan el formato tools de OpenAI. Los parámetros de muestreo comunes como temperature, top_p y stop se pasan directamente.
¿Puede generar vectores, imágenes o audio?
No. Solo ofrecemos chat de texto. No hay vectores, imágenes, audio, video ni fine-tuning, y solo hay un modelo. Si necesitas esas capacidades, combina con otras soluciones.
¿Hay límite en el tamaño del cuerpo de la petición?
Sí, no puede superar 8 MB. Al incluir documentos largos en el prompt, vigila tanto los tokens como el tamaño en bytes.
Puesta en producción y operaciones
¿Qué debes hacer antes de ir a producción?
Usa /v1/models para confirmar la lista de modelos y ejecuta pruebas con entradas largas, streaming y rutas de error. Escribe ramas de manejo para 402, 429 y 503, y persiste el usage en disco. Configura una alerta de saldo para no descubrir el saldo bajo en horas pico. Incluye estas comprobaciones en el flujo de lanzamiento para verificación por turnos.
¿Qué se debe verificar primero si en producción todo devuelve 401?
Verifica si alguien regeneró la clave en el panel, ya que la clave anterior se invalida inmediatamente tras la regeneración. Luego comprueba si las variables de entorno se perdieron en el último lanzamiento o si la clave tiene espacios o saltos de línea. Guarda la clave activa en un solo lugar para evitar la mayoría de estos problemas.
¿Qué se debe tener en cuenta si varias servicios comparten una sola clave?
El límite de peticiones se calcula de forma agregada por clave; la suma de las peticiones de todos los servicios no puede superar las 300 por minuto. Si una tarea por lotes consume todo el límite, los servicios en línea también recibirán 429. Se recomienda establecer un límite de velocidad independiente para los lotes, priorizar las peticiones en línea y, si es necesario, ejecutar los lotes en horarios de menor tráfico durante la noche.
¿Cómo evitar que los costos superen silenciosamente lo previsto?
El precio por token de salida es cuatro veces el de entrada; prioriza controlar max_tokens y la longitud solicitada en el prompt. Analiza estadísticamente el usage por función: si el promedio de salida se duplica, revisa si fue por cambios en el prompt. El crédito prepago detiene el servicio al agotarse, evitando facturas inesperadas.
Contenido y privacidad
¿Qué contenido está permitido?
El contenido para adultos legal, la ficción y los temas controvertidos no se rechazan directamente; el servicio está dirigido a usuarios mayores de 18 años. El contenido sexual que involucre a menores siempre se bloquea. Para conocer los costos y compensaciones de este tipo de servicios, lee Costos y compensaciones de la API de IA sin restricciones.
¿Se usarán mis prompts para entrenamiento?
No, los prompts no se usan para entrenamiento. Además, esta página no detalla otros almacenamiento ni registros; consulta la documentación para más información.
¿En qué se diferencia este servicio de un agregador o proxy?
Este sitio solo ofrece un modelo, por lo que no hay una gran cantidad de nombres de modelos que mapear; puedes verificar la lista de modelos tú mismo a través de /v1/models. Para entender los principios generales y riesgos de los proxies, primero puedes leer Principios del proxy.
Preguntas frecuentes
¿Cómo empezar a usarlo?
Regístrate con correo electrónico y contraseña; la clave se mostrará de inmediato sin necesidad de ingresar información de pago. Las cuentas nuevas tienen un saldo de prueba de 0,50 USD válido durante 7 días.
¿Qué hacer si devuelve 402?
El código de error 402 es no_credit, lo que indica que el saldo se agotó o la prueba ha caducado. Debes recargar el saldo de crédito prepago; no reintentes la petición.
¿Cuál es el límite de velocidad?
Cada clave permite 300 peticiones por minuto; si se supera, se devuelve 429. Se recomienda usar un límite de concurrencia con reintentos con retroceso para suavizar el envío.
¿Cuál es la longitud máxima del contexto y de la salida?
La longitud total del contexto es de 100.000 tokens, max_tokens tiene un valor predeterminado de 2048 y un máximo de 32.000, y el cuerpo de la petición no supera los 8 MB.
¿Se usarán los prompts para entrenamiento?
No, los prompts no se usarán para entrenamiento.
Solo completa el formulario para obtener la clave
Crea una cuenta, copia la clave y modifica la Base URL. La configuración es así de sencilla.