Yêu cầu tiên quyết và Cấu hình
Để sử dụng proxy api openai của chúng tôi, bạn cần SDK chính thức cho ngôn ngữ của mình và một khóa API hợp lệ. Đăng ký trên bảng điều khiển để nhận khóa của bạn ngay lập tức. Bạn không cần thẻ tín dụng cho bản dùng thử. Đặt hai biến môi trường: OPENAI_API_KEY với khóa của bạn, và OPENAI_BASE_URL trỏ đến endpoint của chúng tôi. Cách tiếp cận này đảm bảo mã hiện có của bạn hoạt động mà không cần sửa đổi, đóng vai trò là một proxy llm minh bạch cho các ứng dụng của bạn.
Dịch vụ của chúng tôi sử dụng ID mô hình uncensored tiêu chuẩn. Vì chúng tôi là một proxy đơn mô hình, bạn không cần quản lý logic định tuyến phức tạp. URL cơ sở là https://api.openaiapiproxy.com/v1. Sau khi định cấu hình, client của bạn xử lý dịch vụ của chúng tôi chính xác như bất kỳ endpoint tương thích OpenAI nào khác.
Yêu cầu đầu tiên và Thiết lập Python
Bắt đầu bằng cách gửi một yêu cầu hoàn thành trò chuyện đơn giản. Điều này xác nhận xác thực và khả năng kết nối của bạn. Ví dụ sau sử dụng một prompt văn bản cơ bản để xác minh hành vi không kiểm duyệt. Thay thế các giá trị giữ chỗ bằng thông tin xác thực thực tế của bạn.
Đối với nhà phát triển Python, thư viện openai chính thức xử lý độ phức tạp. Bạn chỉ cần trỏ client vào URL cơ sở của chúng tôi. Mã bên dưới minh họa một yêu cầu đồng bộ tiêu chuẩn. Nó gửi một prompt và trả về phản hồi của mô hình. Đây là cách nhanh nhất để xác minh tích hợp của bạn.
Đảm bảo các biến môi trường của bạn được tải trước khi tạo phiên bản khách hàng. SDK tự động sử dụng định dạng OpenAI tiêu chuẩn cho các yêu cầu và phản hồi.
Tích hợp Node.js
Nếu bạn đang xây dựng với Node.js, quy trình giống hệt Python. Sử dụng @ai-sdk/openai hoặc gói npm openai chính thức. Trỏ client vào URL cơ sở của chúng tôi và cung cấp khóa API của bạn. SDK xử lý việc tuần tự hóa JSON và các yêu cầu HTTP thay bạn.
Thiết lập này hoạt động với bất kỳ thư viện khách hàng tương thích OpenAI nào. Bạn có thể tái sử dụng các mẫu prompt và cấu trúc thông báo hiện có. Định dạng phản hồi khớp với lược đồ OpenAI tiêu chuẩn, giúp dễ dàng chuyển đổi giữa các nhà cung cấp nếu cần sau này.
Hãy nhớ xử lý lỗi một cách khéo léo. Các vấn đề về mạng hoặc khóa không hợp lệ sẽ trả về các mã lỗi HTTP tiêu chuẩn. Kiểm tra tài liệu cho phiên bản SDK cụ thể của bạn để biết chi tiết xử lý lỗi.
Phản hồi truyền phát (streaming)
Đối với các ứng dụng thời gian thực, hãy bật chế độ truyền phát (streaming) để nhận token khi chúng được tạo. Điều này giảm độ trễ cảm nhận đối với người dùng cuối. SDK hỗ trợ Sự kiện được gửi qua Máy chủ (SSE) một cách tự nhiên. Bạn lặp qua luồng phản hồi để xử lý từng token.
Truyền phát (streaming) rất lý tưởng cho các giao diện trò chuyện nơi người dùng mong đợi phản hồi ngay lập tức. Mô hình tạo văn bản liên tục và bạn có thể nối từng token vào giao diện người dùng. Điều này mang lại trải nghiệm người dùng mượt mà hơn so với việc chờ phản hồi đầy đủ.
Endpoint truyền phát (streaming) sử dụng cùng URL cơ sở và xác thực. Bạn chỉ cần bật cờ stream trong các tham số yêu cầu của mình. SDK xử lý vòng đời kết nối và khôi phục lỗi.
Giới hạn tốc độ và Ràng buộc
API của chúng tôi áp dụng các giới hạn nghiêm ngặt để đảm bảo độ tin cậy. Bạn được phép 300 yêu cầu mỗi phút trên mỗi khóa API. Kích thước tối đa của thân yêu cầu là 8 MB. Nếu bạn vượt quá giới hạn tốc độ, bạn sẽ nhận mã trạng thái 429. Hãy triển khai cơ chế backoff theo cấp số nhân trong ứng dụng của bạn để xử lý các lỗi này một cách duyên dáng.
Lỗi xác thực trả về mã trạng thái 401 nếu khóa không hợp lệ hoặc bị thu hồi. Lỗi thanh toán trả về mã trạng thái 402 khi tín dụng trả trước của bạn đã cạn kiệt. Nạp tiền có sẵn ngay lập tức thông qua tiền điện tử (USDT hoặc USDC). Tín dụng trả trước của bạn không bao giờ hết hạn, vì vậy bạn có thể trả tiền theo nhu cầu.
Cửa sổ ngữ cảnh là 100.000 token cho cả đầu vào và đầu ra kết hợp. Hãy lập kế hoạch cho các prompt của bạn để tránh bị cắt ngắn. Mô hình sẽ dừng tạo nếu nó đạt đến giới hạn.
Mô hình và Chính sách nội dung
Mô hình có sẵn duy nhất là uncensored, một mô hình trọng số mở được tối ưu hóa cho nội dung người lớn hợp pháp và viết sáng tạo. Nó không từ chối các chủ đề gây tranh cãi hoặc rõ ràng theo mặc định. Điều này khiến nó lý tưởng cho các trường hợp sử dụng nơi các mô hình tiêu chuẩn có thể quá hạn chế.
Chúng tôi không cung cấp nhúng, tạo hình ảnh hoặc xử lý âm thanh. Đây là một API chỉ dành cho văn bản. Mô hình không phải là GPT, Claude hoặc bất kỳ mô hình của nhà cung cấp nào khác. Nó được tinh chỉnh cụ thể cho cơ sở hạ tầng của chúng tôi.
Nội dung tình dục liên quan đến trẻ vị thành niên luôn bị chặn. Tất cả các nội dung hợp pháp khác đều được phép. Chúng tôi không sử dụng các prompt của bạn để huấn luyện. Dữ liệu của bạn vẫn riêng tư và chỉ được sử dụng để tạo phản hồi cho yêu cầu của bạn.
cURL
curl https://api.openaiapiproxy.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.openaiapiproxy.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaiapiproxy.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Truyền phát (streaming)
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)