JA ▾

無検閲大規模言語モデル API のクイック統合

基本設定とシンプルなコード例により、数分で無検閲大規模言語モデルをアプリケーションに統合できます。OpenAI 標準プロトコルに準拠した API 中継サービスを提供し、ストリーミング出力とツール呼び出しをサポートすることで、コンテンツ制限のないアプリケーションの迅速な構築を支援します。

基本設定

API 中継サービスへの接続の核心は、Base URL と認証情報を正しく設定することにあります。当社のサービスは OpenAI プロトコルと完全に互換性があり、Base URL を https://api.llmzhongzhuan.com/v1 に設定し、リクエストヘッダーに API キーを含めるだけで利用可能です。

各アカウントには API キーが 1 つのみ割り当てられ、登録直後に表示されます。変更が必要な場合はバックエンドで再生成でき、古いキーは直ちに無効になります。この設計により認証プロセスが簡素化され、アクセスの安全性が確保されます。複数のキーを並行管理することはサポートしていませんので、アプリケーションのアーキテクチャに応じてキーを適切に保管することをお勧めします。

生成型会話インターフェース

標準的な会話インターフェースは POST /v1/chat/completions にあります。リクエストボディには model(固定値は uncensored)、messages 配列、およびオプションのパラメータを含める必要があります。このインターフェースは非ストリーミングレスポンスをサポートしており、完全な戻り値が必要な場面に適しています。

モデルは独立してデプロイされた高性能 GPU サーバー上で動作し、コンテキストウィンドウは最大 100,000 トークンです。長文の処理から複雑な指示の遵守まで、安定したネイティブな API 接続体験を提供します。

curl https://api.llmzhongzhuan.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

ストリーミングレスポンス (SSE)

リアルタイムのフィードバックが必要なアプリケーションでは、stream: true パラメータを有効にすることで、Server-Sent Events (SSE) を介してチャンクごとのレスポンスを取得できます。ストリーミング転送は初字生成遅延 (TTFT) を大幅に削減し、ユーザーエクスペリエンスを向上させます。

サーバー側はレスポンス終了まで JSON 断片を継続的にプッシュします。クライアント側ではこれらの断片を独自に組み合わせて完全なテキストを生成する必要があります。このモードはチャットボットやリアルタイムコンテンツ生成のシナリオに最適で、データの迅速なエンドユーザーへの到達を保証します。

from openai import OpenAI

client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

モデル一覧の取得

GET /v1/models により、現在利用可能なモデルの一覧を取得できます。リクエストは id、object、owned_by などのフィールドを含む標準的な JSON レスポンスを返します。

現在利用可能なモデル ID は 1 つのみです:uncensored。このモデルはオープンウェイトモデルであり、コンテンツの検閲除去のために特別にチューニングされており、成人向けコンテンツ、セキュリティ研究、論争の的となるトピックに適しています。埋め込み (Embedding) やマルチモーダル生成サービスは提供せず、純粋なテキスト会話に注力しています。

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

エラー処理とレート制限

サービスは標準的な HTTP ステータスコードの仕様に従います。401 Unauthorized は API キーが無効であることを示し、402 Payment Required はアカウント残高が不足しており、チャージ後にリクエストを継続できることを示します。429 Too Many Requests はレート制限に到達したことを示し、現在の制限は 1 分あたり 300 リクエストです。

さらに、1 回のリクエストボディのサイズ制限は 8 MB です。レート制限に遭遇した場合は、指数関数的バックオフによる再試行戦略の実装をお勧めします。当社の無検閲 AI サービスは高いスループットを維持しつつ、リソース配分の公平性を確保します。

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

コード例

以下は Python SDK を使用したストリーミングリクエストの完全な例です。このコードは、クライアントの初期化、メッセージ履歴の構築、SSE データストリームの処理方法を示しています。

openai ライブラリがインストールされており、YOUR_API_KEY が実際のキーに置き換えられていることを確認してください。この例は、api 中継インターフェースを通じて制限のない AI のリアルタイム生成結果を取得する方法を直感的に示しており、開発者が既存システムへの迅速な統合を容易にします。

API 仕様

購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。

項目内容
形式OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作
エンドポイントPOST /v1/chat/completions · GET /v1/models
モデル IDuncensored
認証Authorization: Bearer YOUR_KEY
Base URLhttps://api.llmzhongzhuan.com/v1
最大出力100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし)
パラメータtemperature、top_p、stop、seed、presence_penalty、frequency_penalty
ストリーミング対応 — SSE、最後のチャンクにトークン使用量
コンテキスト長100,000 トークン(入力+出力)
関数呼び出し対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送
JSON モードresponse_format: {"type": "json_object"}
同時実行キーごとに同時 8 リクエストまで
レスポンスヘッダーX-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency
レート制限キーごとに毎分 300 リクエスト
リクエストサイズ最大 8 MB
無料トライアル$0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大
チャージUSDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額
ボーナス$50 以上で +5%、$100 以上で +10%
有効期限購入クレジットは失効なし、サブスクなし
課金前払いクレジットから実使用量で課金。エラーと拒否は無料
料金入力 100 万トークン $0.25 · 出力 100 万トークン $1.00
キーアカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効
ログインGoogle またはメール+パスワード
コンテンツ成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否

エラーコード

エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。

コードタイプ意味
400bad_requestJSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過
401missing_key · invalid_key · key_revokedキーなし・誤り・新しいキーに置換済み
402no_credit残高ゼロ — チャージすれば即再開
403content_blocked未成年者を含む性的コンテンツ — 拒否、課金なし
404not_found不明なエンドポイント
413request_too_large本文が 8 MB 超
429rate_limited · concurrency毎分 300 回または同時 8 件を超過 — 待って再試行
503upstream_busyモデル混雑 — 数秒後に再試行

よくある質問

アカウントに複数の API キーを持たせることはできますか?

各アカウントには API キーが 1 つのみ割り当てられます。キーを変更する必要がある場合は、バックエンドで新しいキーを生成でき、古いキーは直ちに無効になります。この設計により権限管理が簡素化され、各アカウントのアクセス認証情報が一意かつ明確に保たれます。

API キーは複数のアプリケーションで利用できますか?

はい、単一の API キーは、同じアカウントのクォータを共有する限り、複数のアプリケーションや環境で再利用できます。各アカウントにはキーが 1 つのみであるため、リクエスト頻度と残高を監視することで、複数アプリケーションの使用状況を管理することをお勧めします。

無検閲モデルはすべての成人向けコンテンツを含みますか?

モデルは法的な成人向けコンテンツ、フィクション、論争の的となるトピックに対して検閲を行いませんが、未成年者に関連する性的コンテンツは厳格に禁止されています。これは基本的なコンプライアンス要件を満たすために設けられた唯一の硬性のコンテンツ制限であり、その他の種類の成人向けコンテンツは通常通り生成されます。

フォームに記入するだけでキーを取得できます

アカウントを作成し、キーをコピーし、Base URL を変更します。設定はこれだけです。

API キーを取得