Alternativa à API OpenAI: Troque seu cliente em três linhas
Alternativa à API OpenAI sem censura, pronta para usar
Conecte seu cliente OpenAI existente à nossa API LLM sem censura atualizando a URL base e a chave de API. Este guia rápido orienta você pela autenticação, conclusões básicas, streaming e chamada de funções com nosso único modelo de pesos abertos.
Autenticação e URL Base
Nossa API segue a interface padrão de chat-completions da OpenAI. Você só precisa alterar duas coisas na configuração do seu cliente: a URL base e a chave de API. Cadastre-se na página Obter chave de API para receber sua chave imediatamente. Não é necessário cartão de crédito para o teste.
A URL base para todas as requisições é https://api.openaiapialternative.com/v1.. Este endpoint serve um único modelo de linguagem grande sem censura. Diferente de roteadores multi-modelo, não fazemos roteamento entre fornecedores; executamos nosso próprio modelo de pesos abertos em nossos próprios servidores GPU. Isso simplifica sua pilha porque você interage com um único comportamento de modelo consistente, em vez de navegar pelas particularidades diferentes das APIs das variantes GPT, Claude ou Gemini.
Primeira Solicitação
Faça uma solicitação POST para /v1/chat/completions. A estrutura do objeto de resposta corresponde à especificação padrão da OpenAI para conclusão de texto, mas alimentada pelo nosso modelo sem censura. Você pode passar mensagens, ferramentas e configurações de temperatura no mesmo formato que usaria para qualquer endpoint compatível com OpenAI.
Esta estrutura garante que, se seu cliente já suporta o protocolo da OpenAI, você pode trocar de provedor alterando a URL base e a chave. O ID do modelo que você deve enviar é "uncensored". Observe que não oferecemos embeddings, imagens ou áudio, então mantenha seus dados enviados focados em texto.
curl https://api.openaiapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Use o SDK Python oficial da OpenAI ou qualquer biblioteca de cliente compatível. Inicialize o cliente com sua chave e a nova URL base. Em seguida, chame chat.completions.create com o id do modelo "uncensored". Esta abordagem mantém seu código existente intacto enquanto ganha acesso a um modelo sem censura sem recusas de conteúdo para adultos legais ou tópicos controversos.
O SDK Python lida com a serialização de suas mensagens e ferramentas automaticamente. Certifique-se de passar a URL base correta para que as requisições não sejam enviadas para os servidores da OpenAI. Este método é ideal para desenvolvedores que desejam testar o comportamento do modelo com seus próprios templates de prompt e instruções de sistema.
from openai import OpenAI
client = OpenAI(base_url="https://api.openaiapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node.js
Para desenvolvedores JavaScript e TypeScript, o SDK Node.js funciona de forma idêntica. Configure a chave de API e a URL base em sua instância de cliente. O id do modelo permanece "uncensored". Isso permite que você integre nossa API LLM sem censura em suas aplicações Node.js sem reescrever sua lógica de prompt.
O SDK Node.js suporta o mesmo endpoint de chat-completions. Você pode usá-lo para funções serverless, serviços backend ou aplicações client-side que precisam de geração de texto direta. Como não oferecemos roteamento de modelos, você obtém comportamento previsível deste único modelo de pesos abertos. Consulte a página de preços para os custos de token.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaiapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respostas em Streaming (SSE)
Suportamos Server-Sent Events (SSE) para respostas em streaming. Isso é essencial para aplicativos em tempo real onde você deseja exibir tokens conforme são gerados. Defina o parâmetro stream como true em sua solicitação. O cliente receberá uma série de eventos contendo texto parcial.
O streaming reduz a latência percebida para os usuários. Nossa API lida com o protocolo SSE exatamente conforme definido pela especificação da OpenAI. Você pode integrar isso em interfaces de chat, geradores de código ou qualquer aplicativo que se beneficie do entrega incremental de texto. O modelo processa o prompt e gera tokens continuamente até a conclusão.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, Erros e Janela de Contexto
Nossa janela de contexto é de 100.000 tokens para o prompt e a conclusão combinados. Isso permite documentos longos ou históricos de conversas extensos. Esteja ciente do limite de requisições: 300 requisições por minuto por chave. Se você exceder isso, receberá um erro 429 Too Many Requests.
Erros comuns incluem 401 Unauthorized se sua chave for inválida, e 402 Payment Required se seu crédito pré-pago estiver esgotado. Cada conta possui uma chave que pode ser regenerada a qualquer momento. O limite do corpo da requisição é 8 MB. Se você precisa de embeddings ou geração de imagens, esta API não é a escolha certa; focamos exclusivamente em conclusão de texto.
Especificações técnicas
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID do modelo | uncensored |
| Base URL | https://api.openaiapialternative.com/v1 |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Modo JSON | response_format: {"type": "json_object"} |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Tamanho | até 8 MB por requisição |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Validade | crédito pago não expira, sem assinatura |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Isso é um proxy para os modelos da OpenAI?
Não. Servimos um único modelo de linguagem grande de pesos abertos e sem censura executado em nossos próprios servidores. Não é GPT, Claude, Gemini ou qualquer outro modelo de fornecedor. A interface da API é compatível, mas o modelo subjacente é independente.
O que acontece se eu ficar sem crédito?
Você receberá um erro 402 Payment Required. Usamos um sistema de crédito pré-pago pagamento por uso. Você pode recarregar a partir de $10 via criptomoeda (USDT ou USDC). O crédito nunca expira e você recebe crédito bônus para compras maiores.
O modelo recusa conteúdo?
O modelo é sem censura para adultos legais, ficção, pesquisa de segurança e tópicos controversos. O único limite rígido é que o conteúdo sexual envolvendo menores é sempre bloqueado. Não aplicamos recusas subjetivas ao conteúdo adulto padrão.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.