OpenAI-API-Alternative: Wechsle deinen Client in drei Zeilen
Sofort einsetzbare unzensierte OpenAI-API-Alternative
Verbinde deinen bestehenden OpenAI-kompatiblen Client mit unserer unzensierten LLM-API, indem du die Base URL und den API-Schlüssel aktualisierst. Dieser Schnellstart führt dich durch Authentifizierung, grundlegende Vervollständigungen, Streaming und Function Calling mit unserem einzelnen Open-Weight-Modell.
Authentifizierung & Base URL
Unsere API folgt der Standard-OpenAI-Chat-Vervollständigungs-Schnittstelle. Du musst nur zwei Dinge in deiner Client-Konfiguration ändern: die Base URL und den API-Schlüssel. Registriere dich auf der Seite API-Schlüssel erhalten, um deinen Schlüssel sofort zu erhalten. Keine Kreditkarte für die Testversion erforderlich.
Die Basis-URL für alle Anfragen ist https://api.openaiapialternative.com/v1. Dieser Endpunkt stellt ein einzelnes unzensiertes Large-Language-Modell bereit. Im Gegensatz zu Multi-Modell-Routern leiten wir nicht zwischen Anbietern weiter; wir betreiben unser eigenes Open-Weight-Modell auf unseren eigenen GPU-Servern. Dies vereinfacht deine Stack-Architektur, da du mit einem konsistenten Modellverhalten interagierst, anstatt dich durch die unterschiedlichen API-Besonderheiten von GPT-, Claude- oder Gemini-Varianten zu kämpfen.
Erste Anfrage
Mache eine POST-Anfrage an /v1/chat/completions. Die Antwortobjektstruktur entspricht der Standard-OpenAI-Spezifikation für Textvervollständigung, wird jedoch von unserem unzensierten Modell angetrieben. Du kannst Nachrichten, Tools und Temperature-Einstellungen im gleichen Format übergeben, das du für jeden OpenAI-kompatiblen Endpunkt verwenden würdest.
Diese Struktur stellt sicher, dass du, wenn dein Client bereits das OpenAI-Protokoll unterstützt, den Anbieter wechseln kannst, indem du die Base URL und den Schlüssel änderst. Die Modell-ID, die du senden musst, ist "uncensored". Beachte, dass wir keine Embeddings, Bilder oder Audio anbieten, also halte deinen Payload auf Text fokussiert.
curl https://api.openaiapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
Verwende das offizielle OpenAI Python SDK oder eine beliebige kompatible Client-Bibliothek. Initialisiere den Client mit deinem Schlüssel und der neuen Base URL. Rufe dann chat.completions.create mit der Modell-ID "uncensored" auf. Dieser Ansatz behält deine bestehende Codebasis bei und gibt dir gleichzeitig Zugriff auf ein unzensiertes Modell ohne Inhaltsablehnungen für legale erwachsene oder kontroverse Themen.
Das Python SDK serialisiert deine Nachrichten und Tools automatisch. Stelle sicher, dass du die korrekte Base URL übergibst, damit Anfragen nicht an die OpenAI-Server gesendet werden. Diese Methode ist ideal für Entwickler, die das Verhalten des Modells mit ihren bestehenden Prompt-Vorlagen und Systemanweisungen testen möchten.
from openai import OpenAI
client = OpenAI(base_url="https://api.openaiapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
Für JavaScript- und TypeScript-Entwickler funktioniert das Node SDK identisch. Konfiguriere den API-Schlüssel und die Base URL in deiner Client-Instanz. Die Modell-ID bleibt "uncensored". Dies ermöglicht es dir, unsere unzensierte LLM-API in deine Node.js-Anwendungen zu integrieren, ohne deine Prompt-Logik neu schreiben zu müssen.
Das Node SDK unterstützt denselben Chat-Vervollständigungs-Endpunkt. Du kannst es für serverlose Funktionen, Backend-Dienste oder Client-seitige Anwendungen verwenden, die direkte Textgenerierung benötigen. Da wir kein Modell-Routing anbieten, erhältst du vorhersehbares Verhalten von diesem einzelnen Open-Weight-Modell. Siehe die Preisseite für Token-Kosten.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaiapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-Antworten (SSE)
Wir unterstützen Server-Sent Events (SSE) für Streaming-Antworten. Dies ist essenziell für Echtzeitanwendungen, in denen du Token anzeigen möchtest, während sie generiert werden. Setze den stream-Parameter auf true in deiner Anfrage. Der Client erhält eine Reihe von Ereignissen mit teilweise generiertem Text.
Streaming reduziert die wahrgenommene Latenz für Benutzer. Unsere API behandelt das SSE-Protokoll genau so, wie die OpenAI-Spezifikation es definiert. Du kannst dies in Chat-Schnittstellen, Code-Generatoren oder jede Anwendung integrieren, die von inkrementativer Textauslieferung profitiert. Das Modell verarbeitet den Prompt und liefert kontinuierlich Token bis zur Fertigstellung.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limits, Fehler & Kontextfenster
Unser Kontextfenster umfasst 100.000 Token für den kombinierten Prompt und die Completion. Dies ermöglicht lange Dokumente oder umfangreiche Gesprächsverläufe. Beachte das Ratenlimit: 300 Anfragen pro Minute pro Schlüssel. Wenn du dieses überschreitest, erhältst du einen 429 Too Many Requests-Fehler.
Häufige Fehler sind 401 Unauthorized, wenn dein Schlüssel ungültig ist, und 402 Payment Required, wenn dein Prepaid-Guthaben aufgebraucht ist. Jedes Konto hat einen Schlüssel, der jederzeit regeneriert werden kann. Die Begrenzung des Request-Body beträgt 8 MB. Wenn du Embeddings oder Bildgenerierung benötigst, ist diese API nicht die richtige Wahl; wir konzentrieren uns ausschließlich auf Textvervollständigung.
Technische Daten
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Modell-ID | uncensored |
| Base-URL | https://api.openaiapialternative.com/v1 |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| JSON-Modus | response_format: {"type": "json_object"} |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Anfragegröße | bis 8 MB |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dies ein Proxy für OpenAI-Modelle?
Nein. Wir bieten ein einzelnes Open-Weight-Unzensiertes-LLM auf unseren eigenen Servern an. Es ist kein GPT, Claude, Gemini oder ein Modell eines anderen Anbieters. Die API-Schnittstelle ist kompatibel, das zugrunde liegende Modell ist jedoch unabhängig.
Was passiert, wenn mein Guthaben aufgebraucht ist?
Du erhältst einen 402 Payment Required-Fehler. Wir nutzen ein Pay as you go Prepaid-Guthaben-System. Du kannst ab 10 $ per Krypto (USDT oder USDC) aufladen. Das Guthaben verfällt nie, und bei größeren Käufen erhältst du Bonusguthaben.
Verweigert das Modell Inhalte?
Das Modell ist unzensiert für legale erwachsene, fiktive, sicherheitsrelevante und kontroverse Themen. Die einzige harte Grenze ist, dass sexuelle Inhalte mit Minderjährigen immer blockiert werden. Wir wenden keine subjektiven Ablehnungen für Standard-Erwachseneninhalte an.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.