中转 API 常见问题:从拿密钥到排查报错
这里把开发者在接入和使用中反复问到的问题集中回答,按“开始使用、额度与计费、报错、能力边界、内容与隐私”五组排列。每个回答都尽量落到具体数字和动作上,你可以直接对照自己的情况查找,找不到再回到文档页看接口细节。
要点
- 注册只要邮箱和密码,密钥立刻显示;新账号有 0.50 美元试用额度,7 天有效,无需填写支付信息。
- 402 说明没有余额,429 说明请求太快,503 说明稍后再试,三者处理方式完全不同。
- 上下文 100,000 token,单次输出最大 16,000,请求体不超过 8 MB,仅支持文本。
- 提示词不会被用于训练。
开始使用
怎么拿到第一把密钥?
打开获取密钥页,用邮箱和密码注册,注册完成后密钥会立刻显示在页面上。整个过程不需要填写任何支付信息,复制下来放进环境变量就可以开始调用。
一个账号能有几把密钥?
每个账号一把。需要更换时可以重新生成,但要注意:重新生成之后旧密钥会马上失效,所有还在使用旧密钥的服务都会开始收到 401,所以请先准备好新密钥的下发流程再操作。
接口地址和模型名分别是什么?
地址是 https://api.llmzhongzhuan.com/v1,对话请求发往 /v1/chat/completions,模型清单用 GET /v1/models 查看。模型名只有一个,写作 uncensored。
已有的 OpenAI 代码需要怎么改?
通常只要改两处:把 base_url 换成上面的地址,把密钥换成本站的密钥,再把 model 字段改成 uncensored。请求体和响应体的结构保持 OpenAI 对话补全的格式,所以大部分代码不用动。具体框架写法见 框架配置。
额度与计费
试用额度有多少,怎么算?
新账号赠送 0.50 美元,有效期 7 天。按输入每百万 token 0.25 美元、输出每百万 token 1.00 美元计算,假设每次请求输入 800 token、输出 400 token,一次约 0.0006 美元,试用额度大约能发 800 多次这样的请求。这只是按假设做的估算,实际取决于你的提示词长度。
充值之后余额会过期吗?
不会。充值的是预付费余额,没有订阅,也没有到期清零的规则。需要注意的只有试用额度,它在 7 天后失效。
怎么知道一次请求花了多少?
响应里带有 usage,包含输入和输出的 token 数。流式请求时,最后会自动多出一个携带 usage 的分片。拿这两个数字乘以单价即可得到该次费用,监控落盘的写法可以参考 稳定性实践。
完整价格在哪里看?
价格以 定价页 为准。页面上写明了输入和输出两档单价,没有隐藏的按次费用。
报错与限流
返回 402 是什么意思?
错误码为 no_credit,表示账户余额已经用完,或者试用额度已过期。解决办法只有一个:充值预付费余额。这个错误不要重试,重试不会成功,只会产生多余的请求。
返回 429 要怎么处理?
每个密钥每分钟最多 300 次请求,超出就是 429。先降低发送速率,再加上带随机抖动的退避重试。批处理建议用并发上限加节拍器来平滑发送,示例代码在稳定性那一篇里。
503 upstream_busy 是故障吗?
不是永久性故障,意思是服务暂时繁忙。几秒之后重试通常就能成功,建议使用指数退避,并限制最多重试的次数。
403 content_blocked 是怎么回事?
说明这次请求触发了内容拦截。涉及未成年人的性内容无论是否为虚构、角色扮演,都会一律返回 403。遇到 403 不要重试,请检查并修改请求内容。
能力边界
上下文有多长,输出能写多长?
上下文总长为 100,000 token,输入和输出合计不能超过它。max_tokens 默认 2048,单次最大可设到 16,000。输入加 max_tokens 超过上限时会返回 400,写长文时记得给输入留出空间。
支持流式和工具调用吗?
都支持。把 stream 设为 true 即可得到 SSE 流式输出;工具调用采用 OpenAI 的 tools 格式。temperature、top_p、stop 这些常见采样参数会被透传。
能做向量、画图或语音吗?
不能。本站只提供文本对话,没有向量、图像、音频、视频和微调,也只有一个模型。如果业务需要这些能力,需要另外搭配其他方案。
请求体有大小限制吗?
有,单个请求体不能超过 8 MB。把很长的文档放进提示词时,除了 token 数,也要留意整体字节数。
上线与日常运维
正式上线前最该做哪几件事?
先用 /v1/models 确认模型清单,再跑一遍包含长输入、流式和错误路径的测试。然后给 402、429、503 分别写好处理分支,并把 usage 落盘。最后给余额设一个提醒线,避免在高峰时段才发现额度见底。别忘了把这些检查项写进发布流程,由值班同学逐项确认。
线上突然全部返回 401,先查什么?
先确认有没有人在后台重新生成过密钥,因为重新生成后旧密钥会立刻失效。其次检查环境变量是否在最近一次发布中丢失,或者密钥里被混入了空格和换行。把当前生效的密钥只保存在一个地方,能省掉大部分此类排查。
多个服务共用一把密钥,要注意什么?
限流是按密钥合并计算的,所有服务的请求加起来每分钟不能超过 300 次。如果其中一个批处理任务把额度占满,在线业务也会收到 429。建议给批处理单独限速,把在线请求的优先级放在前面,必要时让批处理在夜间错峰执行。
怎样避免费用悄悄超出预期?
输出 token 的单价是输入的四倍,所以优先控制 max_tokens 和提示词里要求的篇幅。再按功能统计 usage,一旦某个功能的平均输出突然翻倍,就去检查是不是提示词改动引起的。预付费模式的好处是余额用完就停,不会出现意外的超额账单。
内容与隐私
哪些内容会被允许?
合法的成人内容、虚构创作和有争议的话题不会被直接拒绝,服务面向 18 岁以上的成年用户。涉及未成年人的性内容则始终被拦截。关于这类服务的成本和取舍,可以读 无限制 AI API 的成本与权衡。
我的提示词会被拿去训练吗?
不会,提示词不会被用于训练。除此之外,本页不对其他存储或日志细节作出说明,请以文档为准。
这个服务和聚合型中转有什么不同?
本站只提供一个模型,没有大量模型名需要映射,模型清单可以通过 /v1/models 自己核对。想了解中转的一般原理与风险,可以先读 中转原理 那一篇。
常见问题
怎么开始使用?
用邮箱和密码注册,密钥会立即显示,无需填写支付信息。新账号有 0.50 美元试用额度,7 天内有效。
返回 402 怎么办?
402 的错误码是 no_credit,表示余额用完或试用已过期,需要充值预付费余额,不要重试。
限流是多少?
每个密钥每分钟 300 次请求,超出返回 429,建议用并发上限加退避重试来平滑发送。
上下文和输出最长是多少?
上下文总长 100,000 token,max_tokens 默认 2048、最大 16,000,请求体不超过 8 MB。
提示词会用于训练吗?
不会,提示词不会被用于训练。
只需填写表单即可获取密钥
创建账户,复制密钥,修改 Base URL。配置就是这么简单。