JA ▾

API 常见问题:キー取得からエラー調査まで

ここでは、開発者が統合と利用で繰り返し質問する内容をまとめ、利用開始、クレジットと課金、エラー、機能の境界、コンテンツとプライバシーの 5 つのグループに分けて回答します。各回答は具体的な数値とアクションに基づいているため、自身の状況に合わせて参照できます。該当しない場合は、ドキュメントの API 詳細ページに戻ってください。

更新日:

要点

  1. 登録はメールとパスワードのみでキーが即座に表示されます。新規アカウントには 0.50 ドルの試用クレジットが 7 日間付与され、支払い情報は不要です。
  2. 402 は残高不足、429 はリクエスト過多、503 は一時的なサービス混雑を意味し、対応方法はそれぞれ異なります。
  3. コンテキストウィンドウは 100,000 トークン、1 回のリクエストで最大 32,000 トークンの出力、リクエストボディは 8 MB 以下、テキストのみ対応。
  4. プロンプトはトレーニングには使用されません。

利用開始

最初のキーはどのように取得しますか?

キー取得ページを開き、メールとパスワードで登録してください。登録完了後、キーがページ上に表示されます。支払い情報の入力は不要で、コピーして環境変数に設定するだけで呼び出しを開始できます。

1 アカウントで何本のキーが作成できますか?

1 アカウントにつき 1 本です。変更する場合は再生成できますが、注意が必要です。再生成すると旧キーは直ちに無効化され、旧キーを使用しているすべてのサービスで 401 が返るようになります。新しいキーの配布フローを準備してから操作してください。

エンドポイントとモデル名は?

エンドポイントは https://api.llmzhongzhuan.com/v1,对话请求发往 /v1/chat/completions です。モデル一覧は GET /v1/models で確認できます。モデル名は 1 つで、uncensored と表記します。

既存の OpenAI 用コードをどう変更すればよいですか?

通常、base_url を上記のエンドポイントに変更し、キーを当サイトのキーに置き換え、model フィールドを uncensored に変更するだけで済みます。リクエストボディとレスポンスボディの構造は OpenAI のチャット補完形式を維持するため、大部分のコードは変更不要です。具体的なフレームワークの記述は フレームワーク設定 を参照してください。

クレジットと課金

試用クレジットの額と計算方法は?

新規アカウントには 0.50 ドルの無料トライアルクレジットを 7 日間付与します。入力は百万トークンあたり 0.25 ドル、出力は百万トークンあたり 1.00 ドルです。1 回のリクエストで入力 800 トークン、出力 400 トークンと仮定すると、コストは約 0.0006 ドルとなり、無料トライアルクレジットでは約 800 回超のリクエストが可能です。これは仮定に基づく概算であり、実際の使用はプロンプトの長さに依存します。

チャージした残高は期限切れになりますか?

なりません。チャージするのは前払いクレジットであり、サブスクリプションはなく、期限切れで残高がゼロになるルールはありません。注意が必要なのは試用クレジットだけで、これは 7 日後に失効します。

1 回のリクエストでいくら消費したかを確認するには?

レスポンスには usage が含まれており、入力と出力のトークン数がわかります。ストリーミングリクエストの場合、最終的に usage を含むチャンクが自動的に追加されます。これらの数値に単価を掛けることでその回の費用が算出できます。監視の実装例は 安定性の実践 を参照してください。

完全な価格表はどこで確認できますか?

価格は 価格ページ を基準とします。ページには入力と出力の単価が明記されており、隠れた従量課金はありません。

エラーとレート制限

402 が返された意味は?

エラーコードは no_credit で、アカウント残高が尽きたか試用期限が切れたことを意味します。解決策は 1 つ:前払いクレジットをチャージすることです。このエラーは再試行しても成功せず、不要なリクエストが発生するだけなので再試行しないでください。

429 が返された場合の対応は?

各 API キーは 1 分あたり最大 300 件のリクエストまでで、超過すると 429 エラーになります。送信レートを下げてから、ランダムなジッター付きのバックオフで再試行してください。バッチ処理では、同時リクエストの上限にメトロノームを追加して送信を平滑化することをお勧めします。例は安定性の実践記事をご覧ください。

503 upstream_busy は障害ですか?

恒久的な障害ではありません。サービスが一時的に混雑していることを意味します。数秒後に再試行すれば通常成功します。指数バックオフを使用し、再試行の最大回数を制限することをお勧めします。

リクエストがコンテンツフィルタに引っかかったことを示します。未成年者関連の性的コンテンツは、フィクションやロールプレイであっても一律で 403 が返ります。403 が返った場合は再試行せず、リクエスト内容を確認して修正してください。

機能の境界

コンテキストの長さと出力の最大長は?

コンテキストの合計は 100,000 トークンで、入力と出力の合計はこれを超えてはいけません。max_tokens はデフォルト 2048、単回最大 32,000 に設定できます。入力と max_tokens の合計が上限を超えると 400 が返ります。長文を作成する際は、入力に十分なスペースを確保してください。

ストリーミングと関数呼び出しはサポートされていますか?

どちらもサポートしています。stream を true に設定すると SSE ストリーミング出力が得られます。関数呼び出しは OpenAI の tools 形式を採用しています。temperature、top_p、stop などの一般的なサンプリングパラメータは透過されます。

ベクトル、画像生成、音声は利用できますか?

できません。当サイトはテキスト会話のみを提供しており、ベクトル、画像、音声、動画、ファインチューニングは提供していません。モデルも 1 つのみです。これらの機能が必要な場合は、他のソリューションと組み合わせる必要があります。

リクエストボディにサイズ制限はありますか?

あります。単一のリクエストボディは 8 MB を超えてはいけません。長いドキュメントをプロンプトに含める際は、トークン数だけでなく、全体のバイト数にも注意してください。

公開と日常運用

本番公開前に最も重要な作業は?

/v1/models でモデルリストを確認し、長い入力、ストリーミング、エラーパスを含むテストを実行してください。次に、402、429、503 用の処理分岐を記述し、usage を保存してください。最後に、残高にアラートラインを設定し、ピーク時に残高が底をついていないか確認してください。これらのチェック項目をリリースプロセスに組み込み、担当者が確認してください。

本番環境で 401 が一斉に返された場合、まず何を調べますか?

まず、バックエンドで API キーが再生成されていないか確認してください。再生成すると旧キーは直ちに無効になります。次に、環境変数が最新のリリースで失われていないか、またはキーにスペースや改行が混入していないか確認してください。現在有効なキーを 1 か所に保存するだけで、このようなトラブルシューティングの大部分が省けます。

複数のサービスで1つのキーを共有する際の注意点は何ですか?

レート制限はキーごとに統合して計算されるため、全サービスのリクエスト合計は1分あたり300回を超えてはいけません。バッチ処理タスクがリソースを占有すると、オンラインサービスにも 429 が返されます。バッチ処理に個別のレート制限を設定し、オンラインリクエストの優先度を高く保つことを推奨します。必要に応じて、バッチ処理を夜間にずらして実行してください。

費用が予期せず超過するのをどう避けますか?

出力トークンの単価は入力の4倍であるため、max_tokens とプロンプトで指定する文章量を優先的に制御してください。また、機能ごとに usage を集計し、ある機能の平均出力が急増した場合は、プロンプトの変更が原因ではないか確認してください。前払いクレジットの利点は、残高がなくなるとサービスが停止し、予期せぬ過剰請求が発生しない点です。

コンテンツとプライバシー

どのようなコンテンツが許可されますか?

合法なアダルトコンテンツ、フィクション、論争のあるトピックは直接拒否されず、18 歳以上の成人向けにサービスを提供しています。未成年者関連の性的コンテンツは常にブロックされます。このようなサービスのコストとトレードオフについては、無制限 AI API のコストとトレードオフをお読みください。

私のプロンプトはトレーニングに使用されますか?

いいえ、プロンプトはトレーニングには使用されません。これ以外については、ストレージやログの詳細については本ページで言及しないため、ドキュメントを参照してください。

このサービスとプロキシ(中継)サービスは何が違いますか?

当サイトは1つのモデルのみを提供しており、多数のモデル名をマッピングする必要はありません。モデル一覧は /v1/models で自ら確認できます。プロキシの一般的な原理とリスクについては、まず プロキシの原理 をお読みください。

よくある質問

使い始めるには?

メールアドレスとパスワードで登録すると、API キーが直ちに表示され、支払い情報の入力は不要です。新規アカウントには 0.50 ドルの無料トライアルクレジットが付与され、7 日間で有効期限が切れます。

402 が返されたらどうするか?

402 のエラーコードは no_credit で、残高が枯渇したか無料トライラーが期限切れになったことを示します。再試行せずに、前払いクレジットにチャージしてください。

レート制限はいくらか?

各 API キーは 1 分あたり 300 件のリクエストまでで、超過すると 429 エラーが返ります。同時リクエストの上限とバックオフ再試行を使用して送信を平滑化することをお勧めします。

コンテキストウィンドウと出力の最大長はいくらか?

コンテキストウィンドウの総長は 100,000 トークン、max_tokens のデフォルトは 2048、最大は 32,000、リクエストボディは 8 MB 以下です。

プロンプトはトレーニングに使用されますか?

いいえ、プロンプトはトレーニングには使用されません。

フォームに記入するだけで API キーを取得できます

アカウントを作成し、API キーをコピーし、Base URL を変更します。設定はこれだけです。

API キーを取得