FR ▾

openaiapiproxy.comProxy API OpenAI : changez de client en trois lignes

Proxy API OpenAI : Changez de client en trois lignes

Intégrez votre client OpenAI existant à notre endpoint sans censure en modifiant deux variables d'environnement. Ce guide couvre la configuration essentielle pour Python, Node et les requêtes en streaming.

uncensoredhttps://api.openaiapiproxy.com/v1

Prérequis et configuration

Pour utiliser notre proxy API OpenAI, vous avez besoin du SDK officiel pour votre langage et d'une clé API valide. Inscrivez-vous sur le tableau de bord pour recevoir votre clé immédiatement. Aucune carte bancaire n'est nécessaire pour l'essai. Définissez deux variables d'environnement : OPENAI_API_KEY avec votre clé, et OPENAI_BASE_URL pointant vers notre endpoint. Cette approche garantit que votre code existant fonctionne sans modification, agissant comme un proxy LLM transparent pour vos applications.

Notre service utilise l'ID de modèle standard uncensored. En tant que proxy mono-modèle, vous n'avez pas besoin de gérer une logique de routage complexe. L'URL de base est https://api.openaiapiproxy.com/v1. Une fois configuré, votre client traite notre service comme n'importe quel endpoint compatible OpenAI.

Première requête et configuration Python

Commencez par envoyer une requête simple de complétion de chat. Cela confirme votre authentification et votre connectivité. L'exemple suivant utilise un prompt textuel basique pour vérifier le comportement sans censure. Remplacez les valeurs par défaut par vos identifiants réels.

Pour les développeurs Python, la bibliothèque officielle openai gère la complexité. Vous devez simplement pointer le client vers notre URL de base. Le code ci-dessous illustre une requête synchrone standard. Il envoie un prompt et retourne la réponse du modèle. C'est le moyen le plus rapide de vérifier votre intégration.

Assurez-vous que vos variables d'environnement sont chargées avant de créer l'instance du client. Le SDK utilise automatiquement le format standard OpenAI pour les requêtes et les réponses.

Intégration Node.js

Si vous développez avec Node.js, le processus est identique à celui de Python. Utilisez le package npm @ai-sdk/openai ou le package officiel openai. Pointez le client vers notre URL de base et fournissez votre clé API. Le SDK gère la sérialisation JSON et les requêtes HTTP pour vous.

Cette configuration fonctionne avec n'importe quelle bibliothèque cliente compatible OpenAI. Vous pouvez réutiliser vos modèles de prompt et vos structures de messages existants. Le format de réponse correspond au schéma standard OpenAI, ce qui facilite le changement de fournisseur si nécessaire plus tard.

Pensez à gérer les erreurs de manière appropriée. Les problèmes réseau ou les clés invalides renvoient des codes d'erreur HTTP standards. Consultez la documentation de votre version de SDK spécifique pour la gestion détaillée des erreurs.

Réponses en streaming

Pour les applications en temps réel, activez le streaming pour recevoir les tokens au fur et à mesure de leur génération. Cela réduit la latence perçue pour les utilisateurs finaux. Le SDK prend en charge nativement les Server-Sent Events (SSE). Vous itérez sur le flux de réponse pour traiter chaque token.

Le streaming est idéal pour les interfaces de chat où les utilisateurs attendent une réponse immédiate. Le modèle génère du texte en continu et vous pouvez ajouter chaque token à l'interface utilisateur. Cela offre une expérience utilisateur plus fluide par rapport à l'attente de la réponse complète.

L'endpoint de streaming utilise la même URL de base et la même authentification. Vous devez uniquement activer le drapeau stream dans les paramètres de votre requête. Le SDK gère le cycle de vie de la connexion et la récupération des erreurs.

Limites de débit et contraintes

Notre API impose des limites strictes pour garantir la fiabilité. Vous avez droit à 300 requêtes par minute par clé API. La taille maximale du corps de la requête est de 8 Mo. Si vous dépassez la limite de débit, vous recevrez un code d'état 429. Implémentez un backoff exponentiel dans votre client pour gérer ces erreurs de manière appropriée.

Les erreurs d'authentification retournent un code 401 si la clé est invalide ou révoquée. Les problèmes de paiement retournent un code 402 lorsque votre crédit prépayé est épuisé. Les recharges sont disponibles instantanément via les cryptomonnaies (USDT ou USDC). Votre crédit prépayé n'expire jamais, vous pouvez ainsi payer à l'usage.

La fenêtre de contexte est de 100 000 tokens pour l'entrée et la sortie combinées. Planifiez vos prompts en conséquence pour éviter le troncage. Le modèle arrêtera de générer s'il atteint la limite.

Modèles et politique de contenu

Le seul modèle disponible est uncensored, un modèle à poids ouverts optimisé pour le contenu adulte légal et l'écriture créative. Il ne rejette pas par défaut les sujets controversés ou explicites. Cela le rend idéal pour des cas d'usage où les modèles standards pourraient être trop restrictifs.

Nous ne proposons pas d'embeddings, de génération d'images ni de traitement audio. Il s'agit d'une API textuelle uniquement. Le modèle n'est pas GPT, Claude ou tout autre modèle d'un autre fournisseur. Il est spécifiquement optimisé pour notre infrastructure.

Le contenu sexuel impliquant des mineurs est toujours bloqué. Tout autre contenu légal est autorisé. Nous n'utilisons pas vos prompts pour l'entraînement. Vos données restent privées et sont uniquement utilisées pour générer la réponse à votre requête.

cURL

curl https://api.openaiapiproxy.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.openaiapiproxy.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.openaiapiproxy.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Fonctions et limites

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
Base URLhttps://api.openaiapiproxy.com/v1
AuthentificationAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
ID du modèleuncensored
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Fenêtre de contexte64 000 tokens (entrée + sortie)
Sortie max.jusqu'au reste de la fenêtre de 64 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Mode JSONresponse_format: {"type": "json_object"}
Limite de débit300 requêtes par minute et par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Taillejusqu'à 8 Mo par requête
Concurrence8 requêtes simultanées par clé
Bonus+5 % dès 50 $, +10 % dès 100 $
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Validitéle crédit payé n'expire jamais, sans abonnement
ConnexionGoogle ou e-mail et mot de passe
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé
Clésune clé active par compte ; une nouvelle remplace l'ancienne

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Dois-je modifier mon code pour utiliser cette API ?

Non. Si votre code utilise le SDK OpenAI standard, vous devez uniquement mettre à jour les variables d'environnement de l'URL de base et de la clé API. Les formats de requête et de réponse sont identiques.

Que se passe-t-il si je n'ai plus de crédit ?

Les requêtes retourneront un code d'état 402. Vous pouvez recharger votre compte instantanément en utilisant des cryptomonnaies (USDT ou USDC). Votre crédit prépayé existant n'expire jamais.

Le modèle sans censure est-il identique à GPT-4 ?

Non. Il s'agit d'un modèle à poids ouverts exécuté sur nos propres serveurs GPU. Il est optimisé pour réduire les refus de contenu, mais possède une architecture et un jeu d'entraînement différents de ceux de GPT ou Claude.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API