PL ▾

Szybka integracja API dużego modelu bez cenzury

Za pomocą podstawowej konfiguracji i prostych przykładów kodu podłącz w kilka minut duży model bez cenzury do swojej aplikacji. Oferujemy usługę API zgodną ze standardowym protokołem OpenAI, obsługującą strumieniowanie i wywoływanie narzędzi, co pomaga szybko budować aplikacje bez ograniczeń treści.

Podstawowa konfiguracja

Kluczem do podłączenia się do API relay jest poprawna konfiguracja Base URL i poświadczeń. Nasza usługa jest w pełni zgodna z protokołem OpenAI; wystarczy ustawić Base URL na https://api.llmzhongzhuan.com/v1 i dodać nagłówek z kluczem API.

Każdemu kontu przypisany jest dokładnie jeden klucz API, który jest wyświetlany natychmiast po rejestracji. Jeśli chcesz go zmienić, wygeneruj nowy w panelu; stary zostanie natychmiast unieważniony. To upraszcza proces uwierzytelniania i zapewnia bezpieczeństwo dostępu. Nie obsługujemy równoległego zarządzania wieloma kluczami; zalecamy bezpieczne przechowywanie kluczy zgodnie z architekturą Twojej aplikacji.

Interfejs generatywnego dialogu

Standardowy interfejs dialogu znajduje się pod POST /v1/chat/completions. Treść żądania musi zawierać model (ustawiony na uncensored), tablicę messages oraz parametry opcjonalne. Interfejs obsługuje odpowiedzi niestrumieniowe, co jest odpowiednie dla scenariuszy wymagających pełnego wyniku.

Model działa na niezależnie zainstalowanych serwerach GPU o wysokiej wydajności, z oknem kontekstu do 100,000 tokenów. Zapewnia stabilne, natywne połączenie API zarówno przy długich tekstach, jak i złożonych instrukcjach.

curl https://api.llmzhongzhuan.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Odpowiedź strumieniowa (SSE)

W aplikacjach wymagających natychmiastowej informacji zwrotnej włącz parametr stream: true, aby otrzymywać odpowiedzi w blokach za pomocą Server-Sent Events (SSE). Strumieniowanie znacząco redukuje opóźnienie pierwszego znaku (TTFT), poprawiając doświadczenie użytkownika.

Serwer nieprzerwanie przesyła fragmenty JSON, aż do zakończenia odpowiedzi. Klient musi samodzielnie złożyć te fragmenty, aby wygenerować pełny tekst. Tryb ten jest idealny do chatbotów lub generowania treści w czasie rzeczywistym, zapewniając szybkie dotarcie danych do użytkowników końcowych.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Lista modeli

Poprzez GET /v1/models możesz pobrać listę dostępnych modeli. Żądanie zwróci standardową odpowiedź JSON zawierającą pola id, object oraz owned_by.

Obecnie dostępny jest tylko jeden model: uncensored. Jest to model o otwartych wagach, dostrojony w celu usunięcia cenzury treści, idealny do treści dla dorosłych, badań nad bezpieczeństwem i kontrowersyjnych tematów. Nie oferujemy embeddingów ani usług multimodalnych; skupiamy się na czystej konwersacji tekstowej.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Obsługa błędów i limit zapytań

Usługa przestrzega standardowych kodów stanu HTTP. 401 Unauthorized oznacza nieprawidłowy klucz API; 402 Payment Required oznacza niewystarczające środki na koncie — do kontynuacji żądań konieczne jest doładowanie; 429 Too Many Requests oznacza przekroczenie limitu zapytań, który wynosi obecnie 300 żądań na minutę.

Dodatkowo, maksymalny rozmiar treści żądania wynosi 8 MB. W przypadku przekroczenia limitu zalecamy zastosowanie strategii ponawiania z wykładniczym opóźnieniem. Nasza usługa AI bez cenzury zapewnia sprawiedliwy podział zasobów przy jednoczesnym utrzymaniu wysokiej przepustowości.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Przykłady kodu

Poniżej znajduje się kompletny przykład żądania strumieniowego za pomocą Python SDK. Kod pokazuje, jak zainicjować klienta, zbudować historię wiadomości i przetworzyć strumień danych SSE.

Upewnij się, że zainstalowano bibliotekę openai i zamień YOUR_API_KEY na właściwy klucz. Przykład pokazuje, jak uzyskać nieograniczone wyniki generowania AI przez api relay, co ułatwia programistom szybką integrację z istniejącymi systemami.

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
EndpointyPOST /v1/chat/completions · GET /v1/models
ID modeluuncensored
UwierzytelnianieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmzhongzhuan.com/v1
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Tryb JSONresponse_format: {"type": "json_object"}
Równoległe zapytaniado 8 jednocześnie na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limit zapytań300 zapytań na minutę na klucz
Rozmiar zapytaniado 8 MB
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Bonus+5% od $50, +10% od $100
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
LogowanieGoogle albo e-mail i hasło
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Często zadawane pytania

Czy konto może mieć wiele kluczy API?

Każde konto ma przypisany dokładnie jeden klucz API. Jeśli chcesz go zmienić, wygeneruj nowy w panelu; stary zostanie natychmiast unieważniony. To upraszcza zarządzanie uprawnieniami i zapewnia jednoznaczność dostępu.

Czy klucz API można używać w wielu aplikacjach?

Tak, pojedynczy klucz API można wielokrotnie używać w różnych aplikacjach lub środowiskach, o ile korzystają one z limitów tego samego konta. Ponieważ każde konto ma tylko jeden klucz, zalecamy monitorowanie częstotliwości żądań i salda.

Czy model bez cenzury obejmuje wszystkie treści dla dorosłych?

Model nie cenzuruje treści dla dorosłych, fikcji i tematów kontrowersyjnych, ale surowo zabrania treści seksualnych z udziałem niepełnoletnich. To jedyne sztywne ograniczenie treści, zapewniające podstawową zgodność z przepisami. Pozostałe treści dla dorosłych są generowane normalnie.

Wypełnij formularz, aby uzyskać klucz

Utwórz konto, skopiuj klucz i zmień Base URL. Konfiguracja jest taka prosta.

Uzyskaj klucz API