KO ▾

openaiapiproxy.comOpenAI API 프록시: 클라이언트를 세 줄로 전환

OpenAI API 프록시: 세 줄로 클라이언트 전환

환경 변수 두 개만 변경하면 기존 OpenAI 클라이언트를 무검열 엔드포인트에 연결할 수 있습니다. 이 가이드는 Python, Node.js 및 스트리밍 요청의 필수 설정을 다룹니다.

uncensoredhttps://api.openaiapiproxy.com/v1

사전 준비 및 구성

openai api proxy를 사용하려면 언어별 공식 SDK와 유효한 API 키가 필요합니다. 대시보드에서 가입하면 즉시 키를 받을 수 있습니다. 체험용에는 신용카드가 필요하지 않습니다. 환경 변수 OPENAI_API_KEY에 키를, OPENAI_BASE_URL에 엔드포인트 URL을 설정하세요. 이 방식은 기존 코드를 수정하지 않고 작동하게 하며, 애플리케이션에 투명하게 llm proxy로 동작합니다.

당사 서비스는 표준 uncensored 모델 ID를 사용합니다. 단일 모델 프록시이므로 복잡한 라우팅 로직을 관리할 필요가 없습니다. 기본 URL은 https://api.openaiapiproxy.com/v1입니다. 구성이 완료되면 클라이언트는 당사 서비스를 다른 모든 OpenAI 호환 엔드포인트와 동일하게 처리합니다.

첫 번째 요청 및 Python 설정

간단한 채팅 완료 요청을 보내 시작하세요. 이는 인증 및 연결성을 확인합니다. 다음 예시는 무검열 동작을 검증하기 위해 기본 텍스트 프롬프트를 사용합니다. 자리 표시자 값을 실제 자격 증명으로 바꾸세요.

Python 개발자를 위해 공식 openai 라이브러리가 복잡함을 관리합니다. 클라이언트를 기본 URL로 지정하기만 하면 됩니다. 아래 코드는 표준 동기식 요청을 보여줍니다. 프롬프트를 보내고 모델의 응답을 받습니다. 이는 통합을 검증하는 가장 빠른 방법입니다.

클라이언트 인스턴스를 생성하기 전에 환경 변수가 로드되었는지 확인하세요. SDK는 요청 및 응답에 표준 OpenAI 형식을 자동으로 사용합니다.

Node.js 통합

Node.js로 빌드하는 경우 프로세스는 Python과 동일합니다. @ai-sdk/openai 또는 공식 openai npm 패키지를 사용하세요. 클라이언트를 기본 URL로 지정하고 API 키를 제공하세요. SDK가 JSON 직렬화 및 HTTP 요청을 대신 처리합니다.

이 설정은 모든 OpenAI 호환 클라이언트 라이브러리와 함께 작동합니다. 기존 프롬프트 템플릿과 메시지 구조를 재사용할 수 있습니다. 응답 형식은 표준 OpenAI 스키마와 일치하므로 나중에 필요 시 공급자 간 전환이 쉽습니다.

오류를 적절히 처리하는 것을 잊지 마세요. 네트워크 문제나 잘못된 키는 표준 HTTP 오류 코드를 반환합니다. 자세한 오류 처리 방법은 특정 SDK 버전의 문서를 참조하세요.

스트리밍 응답

실시간 애플리케이션의 경우 스트리밍을 활성화하여 생성되는 토큰을 받으세요. 이는 최종 사용자에게 지각된 지연 시간을 줄입니다. SDK는 서버 전송 이벤트(SSE)를 기본적으로 지원합니다. 응답 스트림을 반복하여 각 토큰을 처리합니다.

스트리밍은 사용자가 즉각적인 피드백을 기대하는 채팅 인터페이스에 이상적입니다. 모델이 텍스트를 지속적으로 생성하고 각 토큰을 UI에 추가할 수 있습니다. 이는 전체 응답을 기다리는 것보다 더 매끄러운 사용자 경험을 제공합니다.

스트리밍 엔드포인트는 동일한 기본 URL과 인증을 사용합니다. 요청 매개변수에서 스트림 플래그만 활성화하면 됩니다. SDK가 연결 수명 주기 및 오류 복구를 처리합니다.

속도 제한 및 제약 사항

당사 API는 신뢰성을 위해 엄격한 제한을 적용합니다. API 키당 분당 300개의 요청이 허용됩니다. 최대 요청 본문 크기는 8 MB입니다. 속도 제한을 초과하면 429 상태 코드를 받게 됩니다. 클라이언트에서 지수 백오프를 구현하여 이러한 오류를 적절히 처리하세요.

인증 오류는 키가 유효하지 않거나 취소된 경우 401 상태 코드를 반환합니다. 결제 문제는 선불 크레딧이 고갈되면 402 상태 코드를 반환합니다. USDT 또는 USDC와 같은 암호화폐로 즉시 충전할 수 있습니다. 선불 크레딧은 만료되지 않으므로 사용한 만큼 지불하세요.

컨텍스트 창은 입력과 출력을 합쳐 100,000 토큰입니다. 잘림을 피하기 위해 프롬프트를 적절히 계획하세요. 모델은 제한에 도달하면 생성을 중단합니다.

모델 및 콘텐츠 정책

사용 가능한 유일한 모델은 uncensored로, 합법적인 성인 콘텐츠 및 창작 글쓰기에 최적화된 오픈 웨이트 모델입니다. 기본적으로 논쟁적이거나 노골적인 주제를 거부하지 않습니다. 이는 표준 모델이 너무 제한적일 수 있는 사용 사례에 이상적입니다.

임베딩, 이미지 생성 또는 오디오 처리를 제공하지 않습니다. 이는 텍스트 전용 API입니다. 모델은 GPT, Claude 또는 기타 벤더의 모델이 아닙니다. 당사 인프라에 특별히 조정되었습니다.

미성년자가 포함된 성적 콘텐츠는 항상 차단됩니다. 기타 모든 합법적인 콘텐츠가 허용됩니다. 프롬프트를 학습에 사용하지 않습니다. 데이터는 비공개로 유지되며 요청에 대한 응답을 생성하는 데만 사용됩니다.

cURL

curl https://api.openaiapiproxy.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.openaiapiproxy.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.openaiapiproxy.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

스트리밍

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

API 사양

크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.

항목내용
형식OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작
Base URLhttps://api.openaiapiproxy.com/v1
인증Authorization: Bearer YOUR_KEY
엔드포인트POST /v1/chat/completions · GET /v1/models
모델 IDuncensored
함수 호출지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송
파라미터temperature, top_p, stop, seed, presence_penalty, frequency_penalty
스트리밍지원 — SSE, 마지막 청크에 토큰 사용량 포함
컨텍스트 창64,000 토큰 (입력 + 출력)
최대 출력64,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음)
JSON 모드response_format: {"type": "json_object"}
속도 제한키당 분당 300회
응답 헤더X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
요청 크기최대 8 MB
동시 요청키당 동시 8개
보너스$50 이상 +5%, $100 이상 +10%
무료 체험$0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용
과금선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료
충전USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액
가격입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00
유효기간유료 크레딧은 만료되지 않으며 구독 없음
로그인Google 또는 이메일과 비밀번호
콘텐츠성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부
키계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효

오류 코드

오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.

코드유형의미
400bad_request잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과
401missing_key · invalid_key · key_revoked키 없음·잘못됨·새 키로 교체됨
402no_credit잔액 없음 — 충전하면 즉시 재개
403content_blocked미성년자 관련 성적 콘텐츠 — 거부, 과금 없음
404not_found알 수 없는 엔드포인트
413request_too_large본문 8 MB 초과
429rate_limited · concurrency분당 300회 또는 동시 8개 초과 — 잠시 후 재시도
503upstream_busy모델 혼잡 — 몇 초 후 재시도

질문과 답변

이 API를 사용하려면 내 코드를 변경해야 하나요?

아니요. 표준 OpenAI SDK를 사용하는 경우 기본 URL과 API 키 환경 변수만 업데이트하면 됩니다. 요청 및 응답 형식은 동일합니다.

크레딧이 고갈되면 어떻게 되나요?

요청 시 402 상태 코드가 반환됩니다. 암호화폐(USDT 또는 USDC)로 계정을 즉시 충전할 수 있습니다. 기존 선불 크레딧은 만료되지 않습니다.

무검열 모델이 GPT-4와 동일한가요?

아니요. 이는 자체 GPU 서버에서 실행되는 오픈 웨이트 모델입니다. 콘텐츠 거절이 적도록 조정되었지만 GPT나 Claude와는 다른 아키텍처와 학습 데이터를 사용합니다.

키는 양식 하나만 작성하면 받을 수 있습니다

계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 이것이 전체 설정입니다.

API 키 받기