PT ▾
Obter chave de API

Alternativa à API OpenAI: Troque seu cliente em três linhas

Alternativa à API OpenAI sem censura, pronta para usar

Conecte seu cliente OpenAI existente à nossa API LLM sem censura atualizando a URL base e a chave de API. Este guia rápido orienta você pela autenticação, conclusões básicas, streaming e chamada de funções com nosso único modelo de pesos abertos.

Autenticação e URL Base

Nossa API segue a interface padrão de chat-completions da OpenAI. Você só precisa alterar duas coisas na configuração do seu cliente: a URL base e a chave de API. Cadastre-se na página Obter chave de API para receber sua chave imediatamente. Não é necessário cartão de crédito para o teste.

A URL base para todas as requisições é https://api.openaiapialternative.com/v1.. Este endpoint serve um único modelo de linguagem grande sem censura. Diferente de roteadores multi-modelo, não fazemos roteamento entre fornecedores; executamos nosso próprio modelo de pesos abertos em nossos próprios servidores GPU. Isso simplifica sua pilha porque você interage com um único comportamento de modelo consistente, em vez de navegar pelas particularidades diferentes das APIs das variantes GPT, Claude ou Gemini.

Primeira Solicitação

Faça uma solicitação POST para /v1/chat/completions. A estrutura do objeto de resposta corresponde à especificação padrão da OpenAI para conclusão de texto, mas alimentada pelo nosso modelo sem censura. Você pode passar mensagens, ferramentas e configurações de temperatura no mesmo formato que usaria para qualquer endpoint compatível com OpenAI.

Esta estrutura garante que, se seu cliente já suporta o protocolo da OpenAI, você pode trocar de provedor alterando a URL base e a chave. O ID do modelo que você deve enviar é "uncensored". Observe que não oferecemos embeddings, imagens ou áudio, então mantenha seus dados enviados focados em texto.

curl https://api.openaiapialternative.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

SDK Python

Use o SDK Python oficial da OpenAI ou qualquer biblioteca de cliente compatível. Inicialize o cliente com sua chave e a nova URL base. Em seguida, chame chat.completions.create com o id do modelo "uncensored". Esta abordagem mantém seu código existente intacto enquanto ganha acesso a um modelo sem censura sem recusas de conteúdo para adultos legais ou tópicos controversos.

O SDK Python lida com a serialização de suas mensagens e ferramentas automaticamente. Certifique-se de passar a URL base correta para que as requisições não sejam enviadas para os servidores da OpenAI. Este método é ideal para desenvolvedores que desejam testar o comportamento do modelo com seus próprios templates de prompt e instruções de sistema.

from openai import OpenAI

client = OpenAI(base_url="https://api.openaiapialternative.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK Node.js

Para desenvolvedores JavaScript e TypeScript, o SDK Node.js funciona de forma idêntica. Configure a chave de API e a URL base em sua instância de cliente. O id do modelo permanece "uncensored". Isso permite que você integre nossa API LLM sem censura em suas aplicações Node.js sem reescrever sua lógica de prompt.

O SDK Node.js suporta o mesmo endpoint de chat-completions. Você pode usá-lo para funções serverless, serviços backend ou aplicações client-side que precisam de geração de texto direta. Como não oferecemos roteamento de modelos, você obtém comportamento previsível deste único modelo de pesos abertos. Consulte a página de preços para os custos de token.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.openaiapialternative.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Respostas em Streaming (SSE)

Suportamos Server-Sent Events (SSE) para respostas em streaming. Isso é essencial para aplicativos em tempo real onde você deseja exibir tokens conforme são gerados. Defina o parâmetro stream como true em sua solicitação. O cliente receberá uma série de eventos contendo texto parcial.

O streaming reduz a latência percebida para os usuários. Nossa API lida com o protocolo SSE exatamente conforme definido pela especificação da OpenAI. Você pode integrar isso em interfaces de chat, geradores de código ou qualquer aplicativo que se beneficie do entrega incremental de texto. O modelo processa o prompt e gera tokens continuamente até a conclusão.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites, Erros e Janela de Contexto

Nossa janela de contexto é de 100.000 tokens para o prompt e a conclusão combinados. Isso permite documentos longos ou históricos de conversas extensos. Esteja ciente do limite de requisições: 300 requisições por minuto por chave. Se você exceder isso, receberá um erro 429 Too Many Requests.

Erros comuns incluem 401 Unauthorized se sua chave for inválida, e 402 Payment Required se seu crédito pré-pago estiver esgotado. Cada conta possui uma chave que pode ser regenerada a qualquer momento. O limite do corpo da requisição é 8 MB. Se você precisa de embeddings ou geração de imagens, esta API não é a escolha certa; focamos exclusivamente em conclusão de texto.

Especificações técnicas

Uma tabela com cada limite, recurso e preço.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
AutenticaçãoAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
ID do modelouncensored
Base URLhttps://api.openaiapialternative.com/v1
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Modo JSONresponse_format: {"type": "json_object"}
Janela de contexto100.000 tokens (entrada + saída)
Tamanhoaté 8 MB por requisição
Limite de taxa300 requisições por minuto por chave
Concorrência8 requisições ao mesmo tempo por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Validadecrédito pago não expira, sem assinatura
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Bônus+5% a partir de $50, +10% a partir de $100
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha
Chavesuma chave ativa por conta; uma nova substitui a anterior

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Isso é um proxy para os modelos da OpenAI?

Não. Servimos um único modelo de linguagem grande de pesos abertos e sem censura executado em nossos próprios servidores. Não é GPT, Claude, Gemini ou qualquer outro modelo de fornecedor. A interface da API é compatível, mas o modelo subjacente é independente.

O que acontece se eu ficar sem crédito?

Você receberá um erro 402 Payment Required. Usamos um sistema de crédito pré-pago pagamento por uso. Você pode recarregar a partir de $10 via criptomoeda (USDT ou USDC). O crédito nunca expira e você recebe crédito bônus para compras maiores.

O modelo recusa conteúdo?

O modelo é sem censura para adultos legais, ficção, pesquisa de segurança e tópicos controversos. O único limite rígido é que o conteúdo sexual envolvendo menores é sempre bloqueado. Não aplicamos recusas subjetivas ao conteúdo adulto padrão.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de APILer os docs