OpenAI API-alternatief: Wissel je client in drie regels
Drop-in ongecensureerd OpenAI API-alternatief
Verbind je bestaande OpenAI-compatibele client met onze ongecensureerde LLM API door de base URL en API-sleutel aan te passen. Deze quickstart leidt je door authenticatie, basis completions, streaming en function calling met ons enkele open-weight model.
Authenticatie & Base URL
Onze API volgt de standaard OpenAI chat-completions interface. Je hoeft maar twee dingen aan te passen in je clientconfiguratie: de base URL en de API-sleutel. Meld je aan op de pagina API-sleutel ophalen om je sleutel direct te ontvangen. Er is geen creditcard nodig voor de proefversie.
De base URL voor alle verzoeken is https://api.openaiapialternative.com/v1. Dit endpoint serveert een enkel ongecensureerd groot taalmodel. In tegenstelling tot multi-model routers, routeren we niet tussen leveranciers; we draaien ons eigen open-weight model op onze eigen GPU-servers. Dit vereenvoudigt je stack omdat je communiceert met één consistente modelgedrag in plaats van verschillende API-karakteristieken van GPT, Claude of Gemini te navigeren.
Eerste verzoek
Maak een POST-verzoek naar /v1/chat/completions. De structuur van het response-object komt overeen met de standaard OpenAI-specificatie voor text completion, maar aangedreven door ons ongecensureerde model. Je kunt berichten, tools en temperature-instellingen doorgeven in hetzelfde formaat dat je voor elk OpenAI-compatibel endpoint zou gebruiken.
Deze structuur zorgt ervoor dat als je client al het OpenAI-protocol ondersteunt, je van provider kunt wisselen door de base URL en sleutel aan te passen. De model id die je moet verzenden is "uncensored". Let op: we bieden geen embeddings, afbeeldingen of audio aan, dus houd je payload gericht op tekst.
curl https://api.openaiapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
Gebruik de officiële OpenAI Python SDK of een compatibele clientbibliotheek. Initialiseer de client met je sleutel en de nieuwe base URL. Roep vervolgens chat.completions.create aan met de model id "uncensored". Deze aanpak houdt je bestaande codebase intact terwijl je toegang krijgt tot een ongecensureerd model zonder inhoudsweigeringen voor wettelijke volwassen of controversiële onderwerpen.
De Python SDK serialiseert je berichten en tools automatisch. Zorg dat je de juiste base URL doorgeeft, zodat verzoeken niet naar de servers van OpenAI gaan. Deze methode is ideaal voor ontwikkelaars die het gedrag van het model willen testen met hun bestaande prompt templates en system instructions.
from openai import OpenAI
client = OpenAI(base_url="https://api.openaiapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
Voor JavaScript- en TypeScript-ontwikkelaars werkt de Node SDK identiek. Configureer de API-sleutel en Basis-URL in je client-instantie. De model-id blijft "ongecensureerd". Hiermee kun je onze ongecensureerde LLM API integreren in je Node.js-applicaties zonder je prompt-logica te herschrijven.
De Node SDK ondersteunt hetzelfde chat-completions endpoint. Je kunt het gebruiken voor serverlessfuncties, backend-diensten of client-applicaties die directe tekstgeneratie nodig hebben. Omdat we geen model routing aanbieden, heb je voorspelbaar gedrag van dit enkele open-weight model. Bekijk de prijslijst voor de tokenkosten.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaiapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming responses (SSE)
We ondersteunen Server-Sent Events (SSE) voor streaming responses. Dit is essentieel voor realtime applicaties waarin je tokens wilt weergeven terwijl ze worden gegenereerd. Stel de stream parameter in op true in je verzoek. De client ontvangt een reeks gebeurtenissen met gedeeltelijke tekst.
Streaming vermindert de waargenomen latentie voor gebruikers. Onze API verwerkt het SSE-protocol exact zoals de OpenAI-specificatie voorschrijft. Je kunt dit integreren in chatinterfaces, codegenerators of elke applicatie die baat heeft bij incrementele tekstlevering. Het model verwerkt de prompt en levert tokens continu tot voltooiing.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limieten, fouten & contextvenster
Ons contextvenster is 100.000 tokens voor de gecombineerde prompt en completion. Dit maakt lange documenten of uitgebreide gespreksgeschiedenissen mogelijk. Houd rekening met de rate limit: 300 verzoeken per minuut per sleutel. Als je dit overschrijdt, ontvang je een 429 Too Many Requests fout.
Veelvoorkomende fouten zijn 401 Unauthorized als je sleutel ongeldig is, en 402 Payment Required als je prepaid tegoed op is. Elke account heeft één sleutel die op elk moment kan worden geregistreerd. De limiet van de request body is 8 MB. Als je embeddings of image generatie nodig hebt, is deze API niet de juiste keuze; we focussen uitsluitend op tekstvoltooiing.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Model-ID | uncensored |
| Base URL | https://api.openaiapialternative.com/v1 |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| JSON-modus | response_format: {"type": "json_object"} |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Verzoekgrootte | tot 8 MB |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is dit een proxy voor de modellen van OpenAI?
Nee. We serveren een enkel open-weight ongecensureerd large language model dat op onze eigen servers draait. Het is geen GPT, Claude, Gemini of een model van een andere leverancier. De API-interface is compatibel, maar het onderliggende model is onafhankelijk.
Wat gebeurt er als ik mijn tegoed op heb?
Je ontvangt een 402 Payment Required-fout. We gebruiken een prepaid tegoedsysteem op basis van verbruik. Je kunt opwaarderen vanaf $10 met crypto (USDT of USDC). Dit tegoed vervalt nooit, en je krijgt bonus tegoed voor grotere aankopen.
Weigert het model inhoud?
Het model is ongecensureerd voor wettelijke volwassen, fictieve, beveiligingsonderzoek- en controversiële onderwerpen. De enige harde limiet is dat seksuele inhoud met minderjarigen altijd wordt geblokkeerd. We passen geen subjectieve weigeringen toe op standaard volwassen inhoud.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele configuratie.