FAQ da API de Proxy: Da obtenção da chave à depuração de erros
Reunimos aqui as perguntas mais frequentes sobre integração e uso, organizadas em cinco grupos: início, créditos e cobrança, erros, limites de capacidade, conteúdo e privacidade. Cada resposta traz números e ações concretas para você verificar. Se não encontrar, consulte os detalhes da API na página do documento.
Pontos principais
- O registro pede apenas e-mail e senha; a chave aparece imediatamente. Novas contas recebem 0,50 USD de crédito de teste válido por 7 dias, sem necessidade de preencher informações de pagamento.
- 402 indica falta de saldo, 429 indica limite excedido e 503 indica indisponibilidade temporária. Cada erro exige uma ação diferente.
- Janela de contexto de 100.000 tokens, saída máxima de 32.000 por requisição, corpo da requisição até 8 MB, apenas texto.
- Os prompts não são usados para treinamento.
Comece a usar
Como obter a primeira chave?
Acesse a página de obtenção de chave, registre-se com e-mail e senha. A chave aparece imediatamente. Não é necessário preencher informações de pagamento; copie a chave e defina-a como variável de ambiente para começar a usar.
Quantas chaves posso ter por conta?
Uma por conta. Você pode regenerá-la, mas a chave antiga será invalidada imediatamente. Prepare o fluxo de atualização antes de regenerar para evitar erros 401.
Qual o endereço da API e o nome do modelo?
Endpoint: https://api.llmzhongzhuan.com/v1,对话请求发往 /v1/chat/completions. Liste os modelos com GET /v1/models. O único modelo disponível é uncensored.
Como adaptar o código OpenAI existente?
Basta alterar dois pontos: substitua o base_url pelo endereço acima e a chave pela chave do site. Altere o campo model para uncensored. A estrutura da requisição e resposta segue o padrão de chat completion da OpenAI, então a maior parte do código permanece inalterada. Veja Configuração de frameworks.
Saldo e Cobrança
Qual o valor do crédito de teste e como é calculado?
Novas contas recebem US$ 0,50 com validade de 7 dias. O custo é calculado a US$ 0,25 por milhão de tokens de entrada e US$ 1,00 por milhão de tokens de saída. Com 800 tokens de entrada e 400 de saída por requisição, o custo é de aprox. US$ 0,0006. O crédito permite cerca de 800 requisições. Esta é uma estimativa; o valor real depende do tamanho do seu prompt.
O saldo expira após o recarregamento?
Não. O crédito pré-pago não tem validade. Apenas o crédito de teste expira em 7 dias.
Como saber o custo de uma requisição?
A resposta inclui usage, com as contagens de tokens de entrada e saída. Em streaming, o último fragmento automaticamente adiciona um com usage. Multiplique esses valores pelo preço unitário para obter o custo. Para monitoramento, consulte práticas de estabilidade.
Onde ver a tabela de preços completa?
Consulte a página de preços. Os preços de entrada e saída estão claros, sem taxas ocultas.
Erros e Limites
O que significa o erro 402?
O código no_credit indica que o saldo ou o crédito de teste acabou. A solução é recarregar o crédito pré-pago. Não tente novamente; a falha persistirá e gerará requisições desnecessárias.
Como lidar com o erro 429?
Limite de 300 requisições/min por chave; exceder gera 429. Reduza a taxa e use retry com jitter. Para batch, use semáforo. Veja o código na seção de estabilidade.
503 upstream_busy é uma falha permanente?
Não. Indica serviço ocupado. Tente novamente após alguns segundos. Use backoff exponencial e limite o número máximo de tentativas.
O que causa o 403 content_blocked?
Sua solicitação acionou o filtro de conteúdo. Conteúdo sexual envolvendo menores (fictício ou roleplay) retorna 403. Não tente novamente; revise o corpo da requisição.
Limites de Capacidade
Qual o tamanho do contexto e da saída?
A janela de contexto total é de 100,000 tokens. A soma de entrada e saída não pode exceder esse limite. max_tokens é 2048 por padrão, com máximo de 32,000. Se entrada + max_tokens ultrapassarem o limite, retorna 400. Lembre-se de deixar espaço para a entrada ao escrever textos longos.
Suporta streaming e chamada de funções?
Sim. Defina stream=true para saída via SSE. Chamada de funções usa o formato tools da OpenAI. Parâmetros como temperature, top_p e stop são repassados.
Suporta embeddings, imagens ou áudio?
Não. Apenas texto. Não há embeddings, imagens, áudio, vídeo ou fine-tuning. Se precisar dessas capacidades, integre outras soluções.
Há limite de tamanho no corpo da requisição?
Sim, máximo de 8 MB. Ao inserir documentos longos no prompt, monitore tanto o número de tokens quanto o tamanho em bytes.
Lançamento e Operação
Quais as principais ações antes do lançamento?
Confirme a lista de modelos usando /v1/models e execute testes cobrindo entradas longas, streaming e caminhos de erro. Em seguida, crie branches de tratamento para os códigos 402, 429 e 503 e persista o usage. Por fim, configure um alerta de saldo para evitar descobrir que o crédito acabou apenas durante os horários de pico. Não esqueça de incluir essas verificações no processo de lançamento, com confirmação ponto a ponto pelo plantonista.
O que verificar primeiro quando todos os retornos online retornam 401?
Confirme primeiro se alguém regenerou a chave no painel, pois a chave antiga fica inválida imediatamente após a regeneração. Em seguida, verifique se as variáveis de ambiente foram perdidas na última implantação ou se há espaços e quebras de linha misturados na chave. Manter a chave ativa em apenas um local elimina a maior parte dessas investigações.
O que observar quando vários serviços compartilham a mesma chave?
O limite de requisições é calculado agregando todas as requisições de todos os serviços, que não podem exceder 300 requisições por minuto. Se uma tarefa em lote consumir todo o limite, os serviços online também receberão 429. Recomenda-se aplicar um limite separado para o lote, priorizar as requisições online e, se necessário, executar o lote fora do horário de pico à noite.
Como evitar que os custos ultrapassem a expectativa silenciosamente?
O preço por token de saída é quatro vezes maior que o de entrada, portanto, controle prioritariamente o max_tokens e o tamanho do texto exigido no prompt. Estatistique o usage por função e, se a média de saída de uma função dobrar repentinamente, verifique se isso foi causado por alterações no prompt. A vantagem do modo de crédito pré-pago é que o serviço para quando o saldo acaba, evitando contas extras inesperadas.
Conteúdo e privacidade
Quais conteúdos são permitidos?
Conteúdo adulto legal, ficção e temas controversos não são rejeitados diretamente; o serviço é voltado para usuários adultos acima de 18 anos. Conteúdo sexual envolvendo menores é sempre bloqueado. Para entender os custos e compensações desse tipo de serviço, leia Custo e compensações da API de IA sem censura.
Meus prompts serão usados para treinamento?
Não, os prompts não serão usados para treinamento. Além disso, esta página não fornece detalhes sobre outros armazenamento ou logs; consulte a documentação para mais informações.
Como este serviço difere de um agregador de roteamento?
Este site oferece apenas um modelo, sem necessidade de mapear diversos nomes de modelos. Você pode verificar a lista de modelos diretamente via /v1/models. Para entender os princípios gerais e riscos do roteamento, leia primeiro o artigo Princípios do roteamento.
Perguntas frequentes
Como começar a usar?
Registre-se com e-mail e senha; a chave aparece imediatamente, sem necessidade de preencher informações de pagamento. Novas contas recebem 0,50 USD de crédito de teste, válido por 7 dias.
O que fazer ao receber 402?
O código de erro 402 é no_credit, indicando que o saldo acabou ou o teste expirou. Recarregue o crédito pré-pago e não tente novamente.
Qual é o limite de requisições?
Cada chave permite 300 requisições por minuto; acima disso, retorna 429. Recomenda-se usar um limite de requisições simultâneas com backoff para suavizar o envio.
Qual é o tamanho máximo do contexto e da saída?
O tamanho total da janela de contexto é de 100.000 tokens, max_tokens tem valor padrão de 2048 e máximo de 32.000, e o corpo da requisição não deve exceder 8 MB.
Os prompts serão usados para treinamento?
Não, os prompts não serão usados para treinamento.
Basta preencher o formulário para obter a chave
Crie uma conta, copie a chave e altere o Base URL. A configuração é simples assim.