Alternative à l'API OpenAI : Changez de client en trois lignes
Alternative d'API OpenAI sans censure prêt à l’emploi
Connectez votre client compatible OpenAI existant à notre API LLM sans censure en mettant à jour l'URL de base et la clé API. Ce guide rapide vous accompagne dans l'authentification, les complétions de base, le streaming et l'appel de fonctions avec notre unique modèle à poids ouverts.
Authentification et URL de base
Notre API suit l'interface standard chat-completions d'OpenAI. Vous n'avez besoin de modifier que deux éléments dans la configuration de votre client : l'URL de base et la clé API. Inscrivez-vous sur la page Obtenir une clé API pour recevoir votre clé immédiatement. Aucune carte bancaire n'est requise pour l'essai.
L'URL de base pour toutes les requêtes est https://api.openaiapialternative.com/v1. Cet endpoint sert un seul grand modèle de langage sans censure. Contrairement aux routeurs multi-modèles, nous n'effectuons pas de routage entre fournisseurs ; nous exécutons notre propre modèle à poids ouverts sur nos propres serveurs GPU. Cela simplifie votre stack car vous interagissez avec un seul comportement de modèle cohérent plutôt que de naviguer dans les particularités des API GPT, Claude ou des variantes Gemini.
Première requête
Effectuez une requête POST vers /v1/chat/completions. La structure de l'objet réponse correspond à la spécification standard d'OpenAI pour la complétion de texte, mais alimentée par notre modèle sans censure. Vous pouvez passer des messages, des outils et des paramètres de température dans le même format que pour n'importe quel endpoint compatible OpenAI.
Cette structure garantit que si votre client prend déjà en charge le protocole d'OpenAI, vous pouvez changer de fournisseur en modifiant l'URL de base et la clé. L'identifiant de modèle que vous devez envoyer est « uncensored ». Notez que nous ne proposons pas d'embeddings, d'images ni d'audio, donc concentrez votre payload sur le texte.
curl https://api.openaiapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Utilisez le SDK Python officiel d'OpenAI ou toute bibliothèque cliente compatible. Initialisez le client avec votre clé et la nouvelle URL de base. Appelez ensuite chat.completions.create avec l'identifiant de modèle « uncensored ». Cette approche préserve votre base de code existante tout en vous donnant accès à un modèle sans censure sans refus de contenu pour les sujets adultes licites ou controversés.
Le SDK Python gère automatiquement la sérialisation de vos messages et outils. Assurez-vous de passer la bonne URL de base pour que les requêtes n'atteignent pas les serveurs d'OpenAI. Cette méthode est idéale pour les développeurs qui souhaitent tester le comportement du modèle avec leurs gabarits de prompt et instructions système existants.
from openai import OpenAI
client = OpenAI(base_url="https://api.openaiapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node.js
Pour les développeurs JavaScript et TypeScript, le SDK Node.js fonctionne de manière identique. Configurez la clé API et l'URL de base dans votre instance de client. L'identifiant de modèle reste « uncensored ». Cela vous permet d'intégrer notre API LLM sans censure dans vos applications Node.js sans réécrire votre logique de prompt.
Le SDK Node.js prend en charge le même endpoint chat-completions. Vous pouvez l'utiliser pour des fonctions serverless, des services backend ou des applications client-side nécessitant une génération de texte directe. Comme nous ne proposons pas de routage de modèles, vous bénéficiez d'un comportement prévisible avec ce seul modèle à poids ouverts. Consultez la page des tarifs pour les coûts en tokens.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaiapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses en streaming (SSE)
Nous prenons en charge les Server-Sent Events (SSE) pour les réponses en streaming. C'est essentiel pour les applications en temps réel où vous souhaitez afficher les tokens au fur et à mesure de leur génération. Définissez le paramètre stream sur true dans votre requête. Le client recevra une série d'événements contenant du texte partiel.
Le streaming réduit la latence perçue pour les utilisateurs. Notre API gère le protocole SSE exactement comme le définit la spécification OpenAI. Vous pouvez l'intégrer dans des interfaces de chat, des générateurs de code ou toute application bénéficiant de la livraison incrémentale de texte. Le modèle traite le prompt et restitue les tokens en continu jusqu'à la fin.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, erreurs et fenêtre de contexte
Notre fenêtre de contexte est de 100 000 tokens pour le prompt et la complétion combinés. Cela permet de traiter de longs documents ou des historiques de conversation étendus. Soyez conscient de la limite de débit : 300 requêtes par minute par clé. Si vous dépassez cette limite, vous recevrez une erreur 429 Too Many Requests.
Les erreurs courantes incluent 401 Unauthorized si votre clé est invalide, et 402 Payment Required si votre crédit prépayé est épuisé. Chaque compte possède une clé qui peut être régénérée à tout moment. La limite du corps de la requête est de 8 Mo. Si vous avez besoin d'embeddings ou de génération d'images, cette API n'est pas le bon choix ; nous nous concentrons uniquement sur l'achèvement de texte.
Caractéristiques techniques
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Base URL | https://api.openaiapialternative.com/v1 |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Mode JSON | response_format: {"type": "json_object"} |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Taille | jusqu'à 8 Mo par requête |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
S'agit-il d'un proxy pour les modèles d'OpenAI ?
Non. Nous servons un seul grand modèle de langage à poids ouverts et sans censure, exécuté sur nos propres serveurs. Il ne s'agit pas de GPT, Claude, Gemini ou de tout autre modèle d'un autre fournisseur. L'interface API est compatible, mais le modèle sous-jacent est indépendant.
Que se passe-t-il si je manque de crédit ?
Vous recevrez une erreur 402 Payment Required. Nous utilisons un système de crédit prépayé en paiement à l'usage. Vous pouvez recharger à partir de 10 $ en crypto (USDT ou USDC). Le crédit n'expire jamais, et vous obtenez du crédit bonus pour les achats plus importants.
Le modèle refuse-t-il du contenu ?
Le modèle est sans censure pour les sujets adultes licites, la fiction, la recherche en sécurité et les sujets controversés. La seule limite stricte est que le contenu sexuel impliquant des mineurs est toujours bloqué. Nous n'appliquons pas de refus subjectifs au contenu adulte standard.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.