Alternativa API OpenAI: Cambia il tuo client in tre righe
Alternativa API OpenAI senza censura pronta all'uso
Collega il tuo client OpenAI esistente alla nostra API LLM senza censura aggiornando l'URL di base e la chiave API. Questa guida rapida ti guida attraverso l'autenticazione, le completazioni di base, lo streaming e la chiamata di funzioni con il nostro singolo modello a pesi aperti.
Autenticazione e URL di base
La nostra API segue l'interfaccia standard chat-completions di OpenAI. Devi solo modificare due cose nella configurazione del tuo client: l'URL di base e la chiave API. Iscriviti alla pagina Ottieni chiave API per ricevere la tua chiave immediatamente. Non è richiesta la carta di credito per la prova.
L'URL di base per tutte le richieste è https://api.openaiapialternative.com/v1. Questo endpoint serve un singolo modello linguistico grande senza censura. A differenza dei router multi-modello, non reindirizziamo tra fornitori; eseguiamo il nostro modello a pesi aperti sui nostri server GPU. Questo semplifica il tuo stack perché interagisci con un comportamento del modello coerente invece di navigare tra le stranezze delle API tra varianti GPT, Claude o Gemini.
Prima richiesta
Esegui una richiesta POST a /v1/chat/completions. La struttura dell'oggetto di risposta corrisponde alla specifica standard OpenAI per il completamento del testo, ma alimentata dal nostro modello senza censura. Puoi passare messaggi, strumenti e impostazioni di temperatura nello stesso formato che useresti per qualsiasi endpoint compatibile con OpenAI.
Questa struttura garantisce che se il tuo client supporta già il protocollo OpenAI, puoi cambiare fornitore modificando l'URL di base e la chiave. L'ID del modello che devi inviare è "uncensored". Nota che non offriamo embedding, immagini o audio, quindi mantieni il payload focalizzato sul testo.
curl https://api.openaiapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Utilizza l'SDK Python ufficiale di OpenAI o qualsiasi libreria client compatibile. Inizializza il client con la tua chiave e il nuovo URL di base. Poi chiama chat.completions.create con l'ID del modello "uncensored". Questo approccio mantiene intatto il tuo codice esistente mentre ottieni l'accesso a un modello senza censura senza rifiuti di contenuti per argomenti adulti leciti o controversi.
L'SDK Python gestisce automaticamente la serializzazione dei tuoi messaggi e strumenti. Assicurati di passare l'URL di base corretto affinché le richieste non vengano inviate ai server di OpenAI. Questo metodo è ideale per gli sviluppatori che vogliono testare il comportamento del modello con i loro template di prompt e istruzioni di sistema esistenti.
from openai import OpenAI
client = OpenAI(base_url="https://api.openaiapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node.js
Per gli sviluppatori JavaScript e TypeScript, l'SDK Node funziona allo stesso modo. Configura la chiave API e l'URL di base nell'istanza del tuo client. L'ID del modello rimane "senza censura". Questo ti permette di integrare la nostra API LLM senza censura nelle tue applicazioni Node.js senza riscrivere la logica del prompt.
L'SDK Node supporta lo stesso endpoint chat-completions. Puoi usarlo per funzioni serverless, servizi backend o applicazioni client-side che necessitano di generazione di testo diretta. Poiché non offriamo routing del modello, ottieni un comportamento prevedibile da questo singolo modello a pesi aperti. Controlla la pagina dei prezzi per i costi dei token.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaiapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Risposte in streaming (SSE)
Supportiamo gli eventi inviati dal server (SSE) per le risposte in streaming. Questo è essenziale per le applicazioni in tempo reale in cui desideri visualizzare i token man mano che vengono generati. Imposta il parametro stream su true nella tua richiesta. Il client riceverà una serie di eventi contenenti testo parziale.
Lo streaming riduce la latenza percepita per gli utenti. La nostra API gestisce il protocollo SSE esattamente come definito dalla specifica OpenAI. Puoi integrarlo nelle interfacce chat, nei generatori di codice o in qualsiasi applicazione che beneficia della consegna incrementale del testo. Il modello elabora il prompt e restituisce i token in modo continuo fino al completamento.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti, errori e finestra di contesto
La nostra finestra di contesto è di 100.000 token per il prompt e il completamento combinati. Questo permette documenti lunghi o cronologie di conversazione estese. Tieni presente il limite di richieste: 300 richieste al minuto per chiave. Se lo superi, riceverai un errore 429 Too Many Requests.
Gli errori comuni includono 401 Unauthorized se la tua chiave non è valida, e 402 Payment Required se il tuo credito prepagato è esaurito. Ogni account ha una chiave che può essere rigenerata in qualsiasi momento. Il limite del corpo della richiesta è 8 MB. Se hai bisogno di embedding o generazione di immagini, questa API non è la scelta giusta; ci concentriamo esclusivamente sul completamento del testo.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID modello | uncensored |
| Base URL | https://api.openaiapialternative.com/v1 |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Finestra di contesto | 100.000 token (input + output) |
| Dimensione | fino a 8 MB per richiesta |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Bonus | +5% da $50, +10% da $100 |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
È un proxy per i modelli di OpenAI?
No. Serviamo un singolo modello linguistico di grandi dimensioni a pesi aperti e senza censura, eseguito sui nostri server. Non è GPT, Claude, Gemini o il modello di alcun altro fornitore. L'interfaccia API è compatibile, ma il modello sottostante è indipendente.
Cosa succede se rimango senza credito?
Riceverai un errore 402 Payment Required. Utilizziamo un sistema di credito prepagato a consumo. Puoi ricaricare da $10 con criptovalute (USDT o USDC). Il credito non scade mai e ottieni credito bonus per acquisti più grandi.
Il modello rifiuta contenuti?
Il modello è senza censura per argomenti adulti leciti, di finzione, di ricerca sulla sicurezza e controversi. L'unico limite rigido è che i contenuti sessuali che coinvolgono minori sono sempre bloccati. Non applichiamo rifiuti soggettivi ai contenuti adulti standard.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.