ES ▾
Obtener clave de API

Alternativa a la API de OpenAI: Cambia tu cliente en tres líneas

Alternativa a la API de OpenAI sin censura, lista para usar

Conecta tu cliente compatible con OpenAI a nuestra API de LLM sin censura actualizando la URL base y la clave de API. Esta guía rápida te guía por la autenticación, completados básicos, streaming y llamadas a funciones con nuestro único modelo de pesos abiertos.

Autenticación y URL base

Nuestra API sigue la interfaz estándar de chat-completions de OpenAI. Solo necesitas cambiar dos cosas en la configuración de tu cliente: la URL base y la clave de API. Regístrate en la página Obtener clave de API para recibir tu clave inmediatamente. No se requiere tarjeta de crédito para la prueba.

La URL base para todas las peticiones es https://api.openaiapialternative.com/v1. Este endpoint sirve un único modelo de lenguaje grande sin censura. A diferencia de los enrutadores multi-modelo, no enrutamos entre proveedores; ejecutamos nuestro propio modelo de pesos abiertos en nuestros propios servidores GPU. Esto simplifica tu infraestructura porque interactúas con un comportamiento de modelo consistente en lugar de navegar por las peculiaridades de las API de GPT, Claude o Gemini.

Primera petición

Haz una petición POST a /v1/chat/completions. La estructura del objeto de respuesta coincide con la especificación estándar de OpenAI para la generación de texto, pero impulsada por nuestro modelo sin censura. Puedes pasar mensajes, herramientas y configuraciones de temperatura en el mismo formato que usarías para cualquier endpoint compatible con OpenAI.

Esta estructura asegura que si tu cliente ya soporta el protocolo de OpenAI, puedes cambiar de proveedor cambiando la URL base y la clave. El ID de modelo que debes enviar es "uncensored". Ten en cuenta que no ofrecemos incrustaciones, imágenes ni audio, así que mantén el cuerpo de la petición centrado en texto.

curl https://api.openaiapialternative.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

SDK de Python

Usa el SDK oficial de Python de OpenAI o cualquier biblioteca de cliente compatible. Inicializa el cliente con tu clave y la nueva URL base. Luego llama a chat.completions.create con el id de modelo "uncensored". Este enfoque mantiene tu base de código existente intacta mientras obtienes acceso a un modelo sin censura sin rechazos de contenido para contenido adulto lícito o temas controversiales.

El SDK de Python maneja la serialización de tus mensajes y herramientas automáticamente. Asegúrate de pasar la URL base correcta para que las peticiones no vayan a los servidores de OpenAI. Este método es ideal para desarrolladores que quieren probar el comportamiento del modelo con sus plantillas de prompt e instrucciones de sistema existentes.

from openai import OpenAI

client = OpenAI(base_url="https://api.openaiapialternative.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK de Node.js

Para desarrolladores de JavaScript y TypeScript, el SDK de Node funciona de la misma manera. Configura la clave de API y la URL base en tu instancia de cliente. El ID de modelo sigue siendo "uncensored". Esto te permite integrar nuestra API de LLM sin censura en tus aplicaciones de Node.js sin reescribir la lógica de tus prompts.

El SDK de Node soporta el mismo endpoint de chat-completions. Puedes usarlo para funciones serverless, servicios backend o aplicaciones cliente que necesiten generación de texto directa. Como no ofrecemos enrutamiento de modelos, obtienes un comportamiento predecible de este único modelo de pesos abiertos. Consulta la página de precios para los costos de token.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.openaiapialternative.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Respuestas en streaming (SSE)

Admitimos streaming de respuestas mediante Server-Sent Events (SSE). Esto es esencial para aplicaciones en tiempo real donde deseas mostrar los tokens a medida que se generan. Establece el parámetro stream en true en tu petición. El cliente recibirá una serie de eventos que contienen texto parcial.

El streaming reduce la latencia percibida para los usuarios. Nuestra API maneja el protocolo SSE exactamente como lo define la especificación de OpenAI. Puedes integrarlo en interfaces de chat, generadores de código o cualquier aplicación que se beneficie de la entrega incremental de texto. El modelo procesa el prompt y cede tokens continuamente hasta la finalización.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Límites, errores y ventana de contexto

Nuestra ventana de contexto es de 100.000 tokens para el prompt y la respuesta combinados. Esto permite documentos largos o historiales de conversación extensos. Ten en cuenta el límite de peticiones: 300 peticiones por minuto por clave. Si lo superas, recibirás un error 429 Too Many Requests.

Los errores comunes incluyen 401 No autorizado si tu clave es inválida, y 402 Pago requerido si tu crédito prepago se agota. Cada cuenta tiene una clave que se puede regenerar en cualquier momento. El límite del cuerpo de la petición es de 8 MB. Si necesitas incrustaciones o generación de imágenes, esta API no es la opción adecuada; nos centramos únicamente en la generación de texto.

Especificaciones técnicas

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
AutenticaciónAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
ID del modelouncensored
Base URLhttps://api.openaiapialternative.com/v1
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Modo JSONresponse_format: {"type": "json_object"}
Ventana de contexto100.000 tokens (entrada + salida)
Tamaño de peticiónhasta 8 MB
Límite de peticiones300 por minuto por clave
Concurrencia8 peticiones a la vez por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Caducidadel crédito pagado no caduca, sin suscripción
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Bono+5 % desde $50, +10 % desde $100
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
AccesoGoogle o correo y contraseña
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Es esto un proxy para los modelos de OpenAI?

No. Servimos un único modelo de lenguaje grande de pesos abiertos y sin censura ejecutado en nuestros propios servidores. No es GPT, Claude, Gemini ni ningún otro modelo de proveedor. La interfaz de API es compatible, pero el modelo subyacente es independiente.

¿Qué sucede si me quedo sin crédito?

Recibirás un error 402 Pago requerido. Usamos un sistema de crédito prepago de pago por uso. Puedes recargar desde $10 con criptomonedas (USDT o USDC). El crédito no caduca y obtienes crédito adicional por compras mayores.

¿El modelo rechaza contenido?

El modelo es sin censura para contenido adulto lícito, ficción, investigación de seguridad y temas controversiales. La única limitación estricta es que el contenido sexual que involucra a menores siempre está bloqueado. No aplicamos rechazos subjetivos al contenido adulto estándar.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de APILeer la documentación