Szybka integracja API dużego modelu bez cenzury
Za pomocą podstawowej konfiguracji i prostych przykładów kodu podłącz w kilka minut duży model bez cenzury do swojej aplikacji. Oferujemy usługę API zgodną ze standardowym protokołem OpenAI, obsługującą strumieniowanie i wywoływanie narzędzi, co pomaga szybko budować aplikacje bez ograniczeń treści.
Podstawowa konfiguracja
Kluczem do podłączenia się do API relay jest poprawna konfiguracja Base URL i poświadczeń. Nasza usługa jest w pełni zgodna z protokołem OpenAI; wystarczy ustawić Base URL na https://api.llmzhongzhuan.com/v1 i dodać nagłówek z kluczem API.
Każdemu kontu przypisany jest dokładnie jeden klucz API, który jest wyświetlany natychmiast po rejestracji. Jeśli chcesz go zmienić, wygeneruj nowy w panelu; stary zostanie natychmiast unieważniony. To upraszcza proces uwierzytelniania i zapewnia bezpieczeństwo dostępu. Nie obsługujemy równoległego zarządzania wieloma kluczami; zalecamy bezpieczne przechowywanie kluczy zgodnie z architekturą Twojej aplikacji.
Interfejs generatywnego dialogu
Standardowy interfejs dialogu znajduje się pod POST /v1/chat/completions. Treść żądania musi zawierać model (ustawiony na uncensored), tablicę messages oraz parametry opcjonalne. Interfejs obsługuje odpowiedzi niestrumieniowe, co jest odpowiednie dla scenariuszy wymagających pełnego wyniku.
Model działa na niezależnie zainstalowanych serwerach GPU o wysokiej wydajności, z oknem kontekstu do 100,000 tokenów. Zapewnia stabilne, natywne połączenie API zarówno przy długich tekstach, jak i złożonych instrukcjach.
curl https://api.llmzhongzhuan.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Odpowiedź strumieniowa (SSE)
W aplikacjach wymagających natychmiastowej informacji zwrotnej włącz parametr stream: true, aby otrzymywać odpowiedzi w blokach za pomocą Server-Sent Events (SSE). Strumieniowanie znacząco redukuje opóźnienie pierwszego znaku (TTFT), poprawiając doświadczenie użytkownika.
Serwer nieprzerwanie przesyła fragmenty JSON, aż do zakończenia odpowiedzi. Klient musi samodzielnie złożyć te fragmenty, aby wygenerować pełny tekst. Tryb ten jest idealny do chatbotów lub generowania treści w czasie rzeczywistym, zapewniając szybkie dotarcie danych do użytkowników końcowych.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmzhongzhuan.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Lista modeli
Poprzez GET /v1/models możesz pobrać listę dostępnych modeli. Żądanie zwróci standardową odpowiedź JSON zawierającą pola id, object oraz owned_by.
Obecnie dostępny jest tylko jeden model: uncensored. Jest to model o otwartych wagach, dostrojony w celu usunięcia cenzury treści, idealny do treści dla dorosłych, badań nad bezpieczeństwem i kontrowersyjnych tematów. Nie oferujemy embeddingów ani usług multimodalnych; skupiamy się na czystej konwersacji tekstowej.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmzhongzhuan.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Obsługa błędów i limit zapytań
Usługa przestrzega standardowych kodów stanu HTTP. 401 Unauthorized oznacza nieprawidłowy klucz API; 402 Payment Required oznacza niewystarczające środki na koncie — do kontynuacji żądań konieczne jest doładowanie; 429 Too Many Requests oznacza przekroczenie limitu zapytań, który wynosi obecnie 300 żądań na minutę.
Dodatkowo, maksymalny rozmiar treści żądania wynosi 8 MB. W przypadku przekroczenia limitu zalecamy zastosowanie strategii ponawiania z wykładniczym opóźnieniem. Nasza usługa AI bez cenzury zapewnia sprawiedliwy podział zasobów przy jednoczesnym utrzymaniu wysokiej przepustowości.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Przykłady kodu
Poniżej znajduje się kompletny przykład żądania strumieniowego za pomocą Python SDK. Kod pokazuje, jak zainicjować klienta, zbudować historię wiadomości i przetworzyć strumień danych SSE.
Upewnij się, że zainstalowano bibliotekę openai i zamień YOUR_API_KEY na właściwy klucz. Przykład pokazuje, jak uzyskać nieograniczone wyniki generowania AI przez api relay, co ułatwia programistom szybką integrację z istniejącymi systemami.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| ID modelu | uncensored |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmzhongzhuan.com/v1 |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Tryb JSON | response_format: {"type": "json_object"} |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Rozmiar zapytania | do 8 MB |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Bonus | +5% od $50, +10% od $100 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Logowanie | Google albo e-mail i hasło |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Często zadawane pytania
Czy konto może mieć wiele kluczy API?
Każde konto ma przypisany dokładnie jeden klucz API. Jeśli chcesz go zmienić, wygeneruj nowy w panelu; stary zostanie natychmiast unieważniony. To upraszcza zarządzanie uprawnieniami i zapewnia jednoznaczność dostępu.
Czy klucz API można używać w wielu aplikacjach?
Tak, pojedynczy klucz API można wielokrotnie używać w różnych aplikacjach lub środowiskach, o ile korzystają one z limitów tego samego konta. Ponieważ każde konto ma tylko jeden klucz, zalecamy monitorowanie częstotliwości żądań i salda.
Czy model bez cenzury obejmuje wszystkie treści dla dorosłych?
Model nie cenzuruje treści dla dorosłych, fikcji i tematów kontrowersyjnych, ale surowo zabrania treści seksualnych z udziałem niepełnoletnich. To jedyne sztywne ograniczenie treści, zapewniające podstawową zgodność z przepisami. Pozostałe treści dla dorosłych są generowane normalnie.
Wypełnij formularz, aby uzyskać klucz
Utwórz konto, skopiuj klucz i zmień Base URL. Konfiguracja jest taka prosta.