VI ▾

FAQ API trung chuyển: từ lấy khóa đến xử lý lỗi

Tổng hợp các câu hỏi bạn thường hỏi khi tích hợp và sử dụng, chia thành 5 nhóm: bắt đầu sử dụng, tín dụng và tính phí, lỗi, giới hạn năng lực, nội dung và quyền riêng tư. Mỗi câu trả lời đều có số liệu và hành động cụ thể để bạn đối chiếu; nếu không tìm thấy, hãy quay lại trang tài liệu xem chi tiết API.

Cập nhật vào

Tóm tắt

  1. Đăng ký chỉ cần email và mật khẩu, khóa hiển thị ngay; tài khoản mới có 0,50 USD tín dụng dùng thử trong 7 ngày, không cần thông tin thanh toán.
  2. 402 nghĩa là hết dư lượng, 429 nghĩa là gửi quá nhanh, 503 nghĩa là thử lại sau. Ba lỗi này có cách xử lý hoàn toàn khác nhau.
  3. Ngữ cảnh 100.000 token, đầu ra tối đa 32.000, thân yêu cầu không quá 8 MB, chỉ hỗ trợ văn bản.
  4. Prompt không được dùng để huấn luyện.

Bắt đầu sử dụng

Làm sao để lấy khóa đầu tiên?

Mở trang lấy khóa, đăng ký bằng email và mật khẩu; khóa sẽ hiện ngay trên trang sau khi đăng ký xong. Bạn không cần điền bất kỳ thông tin thanh toán nào, chỉ cần sao chép khóa vào biến môi trường là có thể gọi API.

Một tài khoản có được bao nhiêu khóa?

Mỗi tài khoản một khóa. Bạn có thể tạo lại nếu cần đổi, nhưng lưu ý: khóa cũ sẽ mất hiệu lực ngay lập tức sau khi tạo mới, các dịch vụ đang dùng khóa cũ sẽ nhận 401. Hãy chuẩn bị quy trình phân phối khóa mới trước khi thực hiện.

Địa chỉ endpoint và tên mô hình là gì?

URL là https://api.llmzhongzhuan.com/v1,对话请求发往 /v1/chat/completions, danh sách mô hình dùng GET /v1/models. Tên mô hình chỉ có một, là uncensored.

Mã nguồn OpenAI cũ cần sửa thế nào?

Bạn chỉ cần thay đổi hai chỗ: đổi base_url thành địa chỉ trên, đổi khóa API thành khóa của trang này, và đổi trường model thành uncensored. Cấu trúc request và response giữ nguyên định dạng OpenAI chat completion nên hầu hết code không cần sửa. Xem cấu hình framework để biết chi tiết.

Hạn mức và tính phí

Tín dụng dùng thử có bao nhiêu và tính thế nào?

Tài khoản mới được tặng 0.50 USD, hiệu lực 7 ngày. Giá tính theo mỗi triệu token đầu vào là 0.25 USD, mỗi triệu token đầu ra là 1.00 USD. Giả sử mỗi yêu cầu có 800 token đầu vào và 400 token đầu ra, mỗi lần tốn khoảng 0.0006 USD, tín dụng dùng thử có thể gửi hơn 800 yêu cầu như vậy. Đây chỉ là ước tính dựa trên giả định, thực tế phụ thuộc vào độ dài prompt của bạn.

Dư lượng sau khi nạp tiền có hết hạn không?

Không. Bạn nạp tiền vào tín dụng trả trước, không có gói đăng ký và không có quy tắc làm sạch khi hết hạn. Chỉ có tín dụng dùng thử là hết hạn sau 7 ngày.

Làm sao biết một yêu cầu tốn bao nhiêu?

Response chứa usage, bao gồm số token đầu vào và đầu ra. Với streaming, chunk cuối sẽ tự động chứa usage. Nhân hai số này với đơn giá để ra chi phí cho yêu cầu đó. Cách theo dõi khi ghi vào file tham khảo thực hành ổn định.

Xem giá đầy đủ ở đâu?

Giá tham chiếu theo trang định giá. Trang web liệt kê rõ đơn giá cho đầu vào và đầu ra, không có phí ẩn theo từng lần gọi.

Lỗi và giới hạn tốc độ

Phản hồi 402 nghĩa là gì?

Mã lỗi là no_credit, nghĩa là số dư tài khoản đã hết hoặc tín dụng dùng thử đã hết hạn. Cách khắc phục duy nhất là nạp tiền vào số dư trả trước. Không nên thử lại lỗi này vì sẽ không thành công mà chỉ tạo ra các yêu cầu thừa.

Phản hồi 429 thì xử lý thế nào?

Mỗi khóa API có giới hạn tốc độ tối đa 300 yêu cầu mỗi phút; vượt quá sẽ trả về 429. Bạn hãy giảm tốc độ gửi và thêm cơ chế thử lại với độ trễ tăng dần có nhiễu ngẫu nhiên. Với xử lý hàng loạt, bạn nên dùng giới hạn độ đồng thời cộng bộ điều tiết để làm mượt việc gửi, mã ví dụ có trong bài về độ ổn định.

503 upstream_busy có phải là lỗi không?

Không, đây không phải lỗi vĩnh viễn, nghĩa là dịch vụ đang bận tạm thời. Thử lại sau vài giây thường sẽ thành công. Bạn nên dùng cơ chế thử lại với độ trễ tăng dần và giới hạn số lần thử tối đa.

403 content_blocked là lỗi gì?

Giải thích việc yêu cầu này kích hoạt bộ lọc nội dung. Nội dung liên quan đến người vị thành niên dưới 18 tuổi, dù là hư cấu hay nhập vai, đều sẽ trả về 403. Khi gặp 403, bạn không nên thử lại, hãy kiểm tra và sửa đổi nội dung yêu cầu.

Giới hạn năng lực

Ngữ cảnh dài bao nhiêu và đầu ra có thể viết dài đến mức nào?

Cửa sổ ngữ cảnh tổng cộng là 100,000 token, tổng độ dài đầu vào và đầu ra không thể vượt quá con số này. max_tokens mặc định là 2048, tối đa có thể đặt là 32,000. Nếu đầu vào cộng max_tokens vượt quá giới hạn, hệ thống sẽ trả về 400. Khi viết văn dài, bạn nhớ dành không gian cho đầu vào.

Hỗ trợ truyền phát (streaming) và gọi hàm không?

Đều hỗ trợ. Đặt stream thành true để nhận đầu ra dạng stream SSE. Gọi hàm dùng định dạng tools của OpenAI. Các tham số lấy mẫu như temperature, top_p, stop sẽ được truyền thẳng.

Có thể tạo vector, vẽ ảnh hoặc giọng nói không?

Không. Trang web chỉ cung cấp hội thoại văn bản, không có vector, hình ảnh, âm thanh, video hay tinh chỉnh, và chỉ có một mô hình. Nếu cần các khả năng này, bạn phải kết hợp với các giải pháp khác.

Thân yêu cầu có giới hạn kích thước không?

Có, thân yêu cầu đơn lẻ không được vượt quá 8 MB. Khi đưa tài liệu dài vào prompt, bạn cần chú ý cả số byte tổng thể chứ không chỉ số token.

Triển khai và vận hành thường nhật

Trước khi đưa vào sử dụng chính thức, bạn nên làm những việc gì nhất?

Trước tiên, hãy dùng /v1/models để xác nhận danh sách mô hình, sau đó chạy lại bài kiểm tra bao gồm đầu vào dài, truyền phát (streaming) và các đường dẫn lỗi. Sau đó, hãy viết các nhánh xử lý riêng cho 402, 429 và 503, đồng thời lưu thông tin usage vào đĩa. Cuối cùng, hãy đặt một ngưỡng cảnh báo cho số dư để tránh việc chỉ phát hiện hết hạn mức vào giờ cao điểm. Đừng quên đưa các mục kiểm tra này vào quy trình phát hành, để đồng nghiệp trực ca xác nhận từng mục một.

Nếu toàn bộ dịch vụ trả về 401, bạn nên kiểm tra gì trước?

Trước tiên, hãy xác nhận xem có ai đã tạo lại khóa trong bảng điều khiển hay không, vì khóa cũ sẽ mất hiệu lực ngay lập tức sau khi tạo lại khóa mới. Thứ hai, hãy kiểm tra xem các biến môi trường có bị mất trong lần phát hành gần nhất hay không, hoặc xem khóa có bị lẫn khoảng trắng và ký tự xuống dòng hay không. Việc chỉ lưu giữ khóa đang hoạt động ở một nơi duy nhất có thể giúp bạn tiết kiệm phần lớn thời gian cho việc khắc phục sự cố này.

Khi nhiều dịch vụ dùng chung một khóa, bạn cần lưu ý điều gì?

Giới hạn tốc độ được tính gộp theo khóa, tổng số yêu cầu từ tất cả các dịch vụ không được vượt quá 300 lần mỗi phút. Nếu một tác vụ xử lý hàng loạt chiếm hết giới hạn này, các dịch vụ trực tuyến cũng sẽ nhận được mã 429. Bạn nên đặt giới hạn tốc độ riêng cho tác vụ xử lý hàng loạt, ưu tiên các yêu cầu trực tuyến và, nếu cần thiết, hãy để tác vụ xử lý hàng loạt chạy vào ban đêm để tránh giờ cao điểm.

Làm thế nào để tránh việc chi phí vượt quá dự tính?

Đơn giá cho token đầu ra cao gấp bốn lần token đầu vào, vì vậy bạn nên ưu tiên kiểm soát max_tokens và độ dài yêu cầu trong prompt. Hãy thống kê usage theo từng tính năng; nếu chi phí đầu ra trung bình của một tính năng đột ngột tăng gấp đôi, hãy kiểm tra xem nguyên nhân có phải do thay đổi prompt hay không. Ưu điểm của chế độ tín dụng trả trước là dịch vụ sẽ dừng lại khi hết số dư, giúp bạn tránh các hóa đơn vượt quá dự phòng bất ngờ.

Nội dung và quyền riêng tư

Những nội dung nào được cho phép?

Nội dung người trưởng thành hợp pháp, các tác phẩm hư cấu và các chủ đề gây tranh cãi sẽ không bị từ chối ngay lập tức; dịch vụ dành cho người dùng từ 18 tuổi trở lên. Nội dung liên quan đến tình dục với trẻ vị thành niên sẽ luôn bị chặn. Để tìm hiểu về chi phí và các sự đánh đổi khi sử dụng dịch vụ này, bạn có thể đọc Chi phí và sự đánh đổi của API AI không kiểm duyệt.

Prompt của tôi có được dùng để huấn luyện không?

Không, prompt sẽ không được dùng để huấn luyện. Ngoài ra, trang này không cung cấp thêm chi tiết về các vấn đề lưu trữ hoặc nhật ký khác; vui lòng tham khảo tài liệu chính thức.

Dịch vụ này khác biệt như thế nào so với dịch vụ trung gian tổng hợp?

Trang web này chỉ cung cấp một mô hình, không cần ánh xạ nhiều tên mô hình, và bạn có thể tự mình kiểm tra danh sách mô hình thông qua /v1/models. Nếu muốn tìm hiểu về nguyên lý chung và các rủi ro của dịch vụ trung chuyển, bạn có thể đọc trước bài Nguyên lý trung chuyển.

Câu hỏi thường gặp

Làm thế nào để bắt đầu sử dụng?

Đăng ký bằng email và mật khẩu, khóa sẽ hiển thị ngay lập tức mà không cần điền thông tin thanh toán. Tài khoản mới sẽ có 0,50 USD tín dụng dùng thử, có hiệu lực trong 7 ngày.

Phải làm gì nếu nhận mã 402?

Mã lỗi 402 là no_credit, biểu thị rằng số dư đã hết hoặc thời gian dùng thử đã hết hạn. Bạn cần nạp tiền vào tín dụng trả trước và không nên thử lại.

Giới hạn tốc độ là bao nhiêu?

Mỗi khóa được giới hạn 300 yêu cầu mỗi phút, vượt quá sẽ trả về 429. Bạn nên sử dụng giới hạn độ đồng thời kết hợp với cơ chế thử lại có lùi lại (backoff) để làm mượt quá trình gửi yêu cầu.

Cửa sổ ngữ cảnh và độ dài đầu ra tối đa là bao nhiêu?

Tổng chiều dài ngữ cảnh là 100.000 token, max_tokens mặc định là 2048 và tối đa là 32.000, kích thước yêu cầu không vượt quá 8 MB.

Prompt có được dùng để huấn luyện không?

Không, prompt sẽ không được dùng để huấn luyện.

Chỉ cần điền biểu mẫu để lấy khóa

Tạo tài khoản, sao chép khóa và sửa đổi Base URL. Việc cấu hình rất đơn giản như vậy.

Lấy khóa API