사전 준비 및 구성
openai api proxy를 사용하려면 언어별 공식 SDK와 유효한 API 키가 필요합니다. 대시보드에서 가입하면 즉시 키를 받을 수 있습니다. 체험용에는 신용카드가 필요하지 않습니다. 환경 변수 OPENAI_API_KEY에 키를, OPENAI_BASE_URL에 엔드포인트 URL을 설정하세요. 이 방식은 기존 코드를 수정하지 않고 작동하게 하며, 애플리케이션에 투명하게 llm proxy로 동작합니다.
당사 서비스는 표준 uncensored 모델 ID를 사용합니다. 단일 모델 프록시이므로 복잡한 라우팅 로직을 관리할 필요가 없습니다. 기본 URL은 https://api.openaiapiproxy.com/v1입니다. 구성이 완료되면 클라이언트는 당사 서비스를 다른 모든 OpenAI 호환 엔드포인트와 동일하게 처리합니다.
첫 번째 요청 및 Python 설정
간단한 채팅 완료 요청을 보내 시작하세요. 이는 인증 및 연결성을 확인합니다. 다음 예시는 무검열 동작을 검증하기 위해 기본 텍스트 프롬프트를 사용합니다. 자리 표시자 값을 실제 자격 증명으로 바꾸세요.
Python 개발자를 위해 공식 openai 라이브러리가 복잡함을 관리합니다. 클라이언트를 기본 URL로 지정하기만 하면 됩니다. 아래 코드는 표준 동기식 요청을 보여줍니다. 프롬프트를 보내고 모델의 응답을 받습니다. 이는 통합을 검증하는 가장 빠른 방법입니다.
클라이언트 인스턴스를 생성하기 전에 환경 변수가 로드되었는지 확인하세요. SDK는 요청 및 응답에 표준 OpenAI 형식을 자동으로 사용합니다.
Node.js 통합
Node.js로 빌드하는 경우 프로세스는 Python과 동일합니다. @ai-sdk/openai 또는 공식 openai npm 패키지를 사용하세요. 클라이언트를 기본 URL로 지정하고 API 키를 제공하세요. SDK가 JSON 직렬화 및 HTTP 요청을 대신 처리합니다.
이 설정은 모든 OpenAI 호환 클라이언트 라이브러리와 함께 작동합니다. 기존 프롬프트 템플릿과 메시지 구조를 재사용할 수 있습니다. 응답 형식은 표준 OpenAI 스키마와 일치하므로 나중에 필요 시 공급자 간 전환이 쉽습니다.
오류를 적절히 처리하는 것을 잊지 마세요. 네트워크 문제나 잘못된 키는 표준 HTTP 오류 코드를 반환합니다. 자세한 오류 처리 방법은 특정 SDK 버전의 문서를 참조하세요.
스트리밍 응답
실시간 애플리케이션의 경우 스트리밍을 활성화하여 생성되는 토큰을 받으세요. 이는 최종 사용자에게 지각된 지연 시간을 줄입니다. SDK는 서버 전송 이벤트(SSE)를 기본적으로 지원합니다. 응답 스트림을 반복하여 각 토큰을 처리합니다.
스트리밍은 사용자가 즉각적인 피드백을 기대하는 채팅 인터페이스에 이상적입니다. 모델이 텍스트를 지속적으로 생성하고 각 토큰을 UI에 추가할 수 있습니다. 이는 전체 응답을 기다리는 것보다 더 매끄러운 사용자 경험을 제공합니다.
스트리밍 엔드포인트는 동일한 기본 URL과 인증을 사용합니다. 요청 매개변수에서 스트림 플래그만 활성화하면 됩니다. SDK가 연결 수명 주기 및 오류 복구를 처리합니다.
속도 제한 및 제약 사항
당사 API는 신뢰성을 위해 엄격한 제한을 적용합니다. API 키당 분당 300개의 요청이 허용됩니다. 최대 요청 본문 크기는 8 MB입니다. 속도 제한을 초과하면 429 상태 코드를 받게 됩니다. 클라이언트에서 지수 백오프를 구현하여 이러한 오류를 적절히 처리하세요.
인증 오류는 키가 유효하지 않거나 취소된 경우 401 상태 코드를 반환합니다. 결제 문제는 선불 크레딧이 고갈되면 402 상태 코드를 반환합니다. USDT 또는 USDC와 같은 암호화폐로 즉시 충전할 수 있습니다. 선불 크레딧은 만료되지 않으므로 사용한 만큼 지불하세요.
컨텍스트 창은 입력과 출력을 합쳐 100,000 토큰입니다. 잘림을 피하기 위해 프롬프트를 적절히 계획하세요. 모델은 제한에 도달하면 생성을 중단합니다.
모델 및 콘텐츠 정책
사용 가능한 유일한 모델은 uncensored로, 합법적인 성인 콘텐츠 및 창작 글쓰기에 최적화된 오픈 웨이트 모델입니다. 기본적으로 논쟁적이거나 노골적인 주제를 거부하지 않습니다. 이는 표준 모델이 너무 제한적일 수 있는 사용 사례에 이상적입니다.
임베딩, 이미지 생성 또는 오디오 처리를 제공하지 않습니다. 이는 텍스트 전용 API입니다. 모델은 GPT, Claude 또는 기타 벤더의 모델이 아닙니다. 당사 인프라에 특별히 조정되었습니다.
미성년자가 포함된 성적 콘텐츠는 항상 차단됩니다. 기타 모든 합법적인 콘텐츠가 허용됩니다. 프롬프트를 학습에 사용하지 않습니다. 데이터는 비공개로 유지되며 요청에 대한 응답을 생성하는 데만 사용됩니다.
cURL
curl https://api.openaiapiproxy.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.openaiapiproxy.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaiapiproxy.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);스트리밍
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)