ID ▾

FAQ API Proxy: Dari Mendapatkan Kunci hingga Troubleshooting Error

Di sini kami menjawab pertanyaan yang sering diajukan pengembang saat integrasi dan penggunaan, dikelompokkan menjadi lima kategori: Memulai, Saldo & Penagihan, Error, Batas Kemampuan, serta Konten & Privasi. Setiap jawaban mencakup angka dan langkah spesifik agar Anda dapat langsung mencocokkan dengan situasi Anda.

Diperbarui pada

Poin Penting

  1. Pendaftaran hanya memerlukan email dan kata sandi, kunci API langsung ditampilkan. Akun baru mendapatkan saldo uji coba $0,50 yang berlaku 7 hari tanpa perlu informasi pembayaran.
  2. Error 402 menandakan tidak ada saldo, 429 menandakan permintaan terlalu cepat, dan 503 menandakan coba lagi nanti. Penanganannya sangat berbeda.
  3. Konteks 100.000 token, output maksimum per kali 32.000, body permintaan tidak melebihi 8 MB, hanya mendukung teks.
  4. Prompt tidak akan digunakan untuk pelatihan.

Memulai Penggunaan

Bagaimana cara mendapatkan kunci pertama?

Buka halaman kunci, daftar dengan email dan kata sandi. Kunci langsung muncul tanpa perlu info pembayaran. Salin ke variabel lingkungan untuk mulai memanggil.

Berapa banyak kunci yang bisa dimiliki satu akun?

Satu kunci per akun. Jika perlu diganti, Anda dapat membuat ulang kunci. Namun, kunci lama akan langsung tidak berlaku setelah dibuat ulang, sehingga layanan yang masih menggunakannya akan menerima error 401. Siapkan proses distribusi kunci baru sebelum melakukan perubahan.

Apa alamat endpoint dan nama modelnya?

Alamatnya adalah https://api.llmzhongzhuan.com/v1,对话请求发往 /v1/chat/completions. Daftar model dapat dilihat melalui GET /v1/models. Hanya ada satu nama model, yaitu uncensored.

Bagaimana cara mengubah kode OpenAI yang sudah ada?

Biasanya cukup mengubah dua hal: ganti base_url dengan alamat di atas, ganti kunci API dengan kunci situs ini, dan ubah field model menjadi uncensored. Struktur body permintaan dan respons tetap mengikuti format OpenAI chat completions, sehingga sebagian besar kode tidak perlu diubah. Lihat Konfigurasi Framework untuk detail framework.

Saldo & Penagihan

Berapa besar saldo uji coba dan bagaimana perhitungannya?

Akun baru mendapatkan bonus $0,50 yang berlaku selama 7 hari. Harga dihitung berdasarkan $0,25 per 1 juta token input dan $1,00 per 1 juta token output. Dengan asumsi setiap permintaan menggunakan 800 token input dan 400 token output, biaya per permintaan sekitar $0,0006. Saldo uji coba ini dapat digunakan untuk sekitar 800 permintaan. Ini hanya estimasi berdasarkan asumsi; penggunaan aktual tergantung panjang prompt Anda.

Apakah saldo akan kedaluwarsa setelah diisi ulang?

Tidak. Saldo yang diisi adalah saldo prabayar tanpa langganan atau aturan pengosongan saldo saat jatuh tempo. Satu-satunya yang kedaluwarsa adalah saldo uji coba setelah 7 hari.

Bagaimana cara mengetahui biaya per permintaan?

Respons menyertakan usage yang berisi jumlah token input dan output. Untuk permintaan streaming, akan ada fragment tambahan di akhir yang membawa usage. Kalikan jumlah token tersebut dengan harga satuan untuk mengetahui biaya. Untuk implementasi monitoring, lihat Praktik Stabilitas.

Di mana melihat harga lengkap?

Harga mengacu pada Halaman Harga. Halaman tersebut mencantumkan harga satuan untuk input dan output tanpa biaya tambahan tersembunyi.

Error & Batas Laju

Apa arti error 402?

Kode error adalah no_credit, yang menandakan saldo akun telah habis atau masa uji coba telah berakhir. Satu-satunya solusi adalah mengisi ulang saldo prabayar. Jangan lakukan retry karena akan gagal dan hanya menghasilkan permintaan berlebih.

Bagaimana menangani error 429?

Setiap kunci API dibatasi maksimal 300 permintaan per menit. Jika melebihi, akan muncul 429. Turunkan laju pengiriman dan gunakan retry dengan backoff yang memiliki jitter acak. Untuk batch processing, gunakan batas konkurensi dan timer untuk meratakan pengiriman. Contoh kode tersedia di artikel stabilitas.

Apakah 503 upstream_busy adalah gangguan?

Bukan. Error ini berarti layanan sedang sibuk sementara. Coba lagi beberapa detik kemudian biasanya berhasil. Disarankan menggunakan exponential backoff dan membatasi jumlah maksimum retry.

Apa penyebab 403 content_blocked?

Penjelasan tentang permintaan ini yang memicu pemblokiran konten. Konten seksual yang melibatkan anak di bawah umur akan selalu dikembalikan dengan status 403, baik itu fiksi maupun roleplay. Jika Anda menerima 403, jangan coba lagi; periksa dan ubah konten permintaan.

Batas Kemampuan

Seberapa panjang konteks, seberapa panjang output yang dapat ditulis?

Total panjang konteks adalah 100,000 token, jumlah input dan output tidak boleh melebihi ini. max_tokens default adalah 2048, nilai maksimum per permintaan dapat diatur hingga 32,000. Jika input ditambah max_tokens melebihi batas, akan mengembalikan 400. Ingat untuk menyisakan ruang bagi input saat menulis teks panjang.

Apakah mendukung streaming dan function calling?

Keduanya didukung. Setel stream ke true untuk mendapatkan output streaming SSE. Function calling menggunakan format tools OpenAI. Parameter sampling umum seperti temperature, top_p, dan stop akan diteruskan.

Dapatkah melakukan vektor, pembuatan gambar, atau suara?

Tidak. Situs ini hanya menyediakan chat teks. Tidak ada vektor, gambar, audio, video, atau fine-tuning, dan hanya tersedia satu model. Jika bisnis Anda membutuhkan kemampuan tersebut, Anda perlu menggabungkannya dengan solusi lain.

Apakah ada batas ukuran body permintaan?

Ya, body permintaan tunggal tidak boleh melebihi 8 MB. Saat memasukkan dokumen panjang ke dalam prompt, perhatikan jumlah byte total selain jumlah token.

Peluncuran & Operasi Harian

Apa langkah terpenting yang harus dilakukan sebelum peluncuran resmi?

Gunakan /v1/models untuk memverifikasi daftar model terlebih dahulu, lalu jalankan pengujian yang mencakup input panjang, streaming, dan jalur kesalahan. Setelah itu, siapkan cabang penanganan untuk kode 402, 429, dan 503, serta simpan data usage ke penyimpanan permanen. Terakhir, atur batas peringatan untuk saldo agar Anda tidak baru menyadari saldo hampir habis saat lalu lintas puncak. Jangan lupa sertakan item pemeriksaan ini dalam proses rilis agar rekan yang bertugas dapat memverifikasinya satu per satu.

Apa yang harus diperiksa terlebih dahulu jika semua permintaan secara tiba-tiba mengembalikan 401?

Pertama, pastikan tidak ada yang telah membuat ulang kunci di panel admin, karena kunci lama akan langsung tidak berlaku setelah dibuat ulang. Kedua, periksa apakah variabel lingkungan hilang pada rilis terbaru, atau apakah kunci mengandung spasi dan karakter baris. Menyimpan kunci yang aktif hanya di satu tempat dapat menghilangkan sebagian besar masalah pelacakan ini.

Apa yang perlu diperhatikan jika beberapa layanan berbagi satu kunci?

Batas laju dihitung secara agregat berdasarkan kunci, sehingga total permintaan dari semua layanan tidak boleh melebihi 300 per menit. Jika satu tugas batch menghabiskan kuota, layanan online juga akan menerima 429. Disarankan untuk membatasi laju batch secara terpisah, memberikan prioritas lebih tinggi pada permintaan online, dan jika perlu menjadwalkan tugas batch pada waktu sepi di malam hari.

Bagaimana cara menghindari biaya yang melebihi ekspektasi?

Harga token output adalah empat kali lipat dari input, sehingga utamakan untuk mengontrol max_tokens dan panjang teks yang diminta dalam prompt. Hitung usage berdasarkan fitur; jika rata-rata output tiba-tiba berlipat ganda, periksa apakah perubahan prompt menjadi penyebabnya. Keuntungan mode saldo prabayar adalah layanan akan berhenti saat saldo habis, sehingga tidak akan ada tagihan berlebih yang tidak terduga.

Konten dan Privasi

Konten apa saja yang diizinkan?

Konten dewasa yang legal, karya fiksi, dan topik kontroversial tidak akan langsung ditolak; layanan ini ditujukan untuk pengguna dewasa berusia di atas 18 tahun. Konten seksual yang melibatkan anak di bawah umur akan selalu diblokir. Untuk mengetahui biaya dan pertimbangan terkait layanan ini, Anda dapat membaca Biaya dan Pertimbangan API AI Tanpa Sensor.

Apakah prompt saya akan digunakan untuk pelatihan?

Tidak, prompt tidak akan digunakan untuk pelatihan. Selain itu, halaman ini tidak memberikan penjelasan lebih lanjut mengenai detail penyimpanan atau log lainnya; silakan merujuk pada dokumentasi resmi.

Apa perbedaan layanan ini dengan agregator atau proxy?

Situs ini hanya menyediakan satu model, sehingga tidak ada banyak nama model yang perlu dipetakan, dan daftar model dapat Anda verifikasi sendiri melalui /v1/models. Untuk memahami prinsip umum dan risiko dari agregator, Anda dapat membaca artikel Prinsip Agregator terlebih dahulu.

Pertanyaan Umum

Bagaimana cara memulai penggunaannya?

Daftar menggunakan email dan kata sandi, kunci akan langsung ditampilkan tanpa perlu mengisi informasi pembayaran. Akun baru mendapatkan kredit uji coba senilai 0,50 USD yang berlaku selama 7 hari.

Bagaimana jika muncul kode 402?

Kode kesalahan 402 adalah no_credit, yang menandakan saldo telah habis atau uji coba telah berakhir. Anda perlu mengisi ulang saldo prabayar dan tidak perlu melakukan percobaan ulang.

Berapa batas laju-nya?

Setiap kunci dibatasi 300 permintaan per menit. Permintaan yang melebihi batas akan mengembalikan 429; disarankan untuk menggunakan batas konkurensi dan mekanisme backoff agar pengiriman lebih mulus.

Berapa panjang maksimum konteks dan output?

Jumlah token konteks total adalah 100.000 token, max_tokens default adalah 2048 dengan maksimum 32.000, dan ukuran request body tidak boleh melebihi 8 MB.

Apakah prompt akan digunakan untuk pelatihan?

Tidak, prompt tidak akan digunakan untuk pelatihan.

Isi formulir untuk mendapatkan kunci

Buat akun, salin kunci, dan ubah Base URL. Konfigurasinya sangat sederhana.

Dapatkan Kunci API