OpenAI API 대체: 세 줄로 클라이언트 전환
무검열 OpenAI API 대체재
기존 OpenAI 호환 클라이언트를 업데이트된 base URL과 API 키를 통해 우리의 무검열 LLM API에 연결하세요. 이 빠른 시작 가이드는 인증, 텍스트 완성, 스트리밍 및 함수 호출 방법을 안내합니다.
인증 및 베이스 URL
당사의 API는 표준 OpenAI chat-completions 인터페이스를 따릅니다. 클라이언트 구성에서 변경해야 할 것은 두 가지뿐입니다: base URL과 API 키입니다. API 키 받기 페이지에서 가입하면 즉시 키를 받을 수 있습니다. 체험용에는 신용카드가 필요하지 않습니다.
모든 요청의 base URL은 https://api.openaiapialternative.com/v1.입니다. 이 엔드포인트는 단일 무검열 대형 언어 모델을 제공합니다. 다중 모델 라우터와 달리 당사는 벤더 간 라우팅을 수행하지 않으며, 자체 GPU 서버에서 오픈 웨이트 모델을 실행합니다. 이는 GPT, Claude, Gemini 변형 간 다양한 API 특이점을 탐색하는 대신 일관된 모델 동작과 상호작용하므로 스택이 단순화됩니다.
첫 번째 요청
/v1/chat/completions으로 POST 요청을 보냅니다. 응답 객체 구조는 텍스트 완성을 위한 표준 OpenAI 사양과 일치하지만, 우리의 무검열 모델로 구동됩니다. 모든 OpenAI 호환 엔드포인트에 전달하는 것과 동일한 형식으로 메시지, 도구 및 temperature 설정을 전달할 수 있습니다.
이 구조는 클라이언트가 이미 OpenAI 프로토콜을 지원할 경우 베이스 URL과 키를 변경하여 공급자를 전환할 수 있음을 보장합니다. 전송해야 하는 모델 ID는 "uncensored"입니다. 당사는 임베딩, 이미지 또는 오디오를 제공하지 않으므로 페이로드를 텍스트에 집중하십시오.
curl https://api.openaiapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
공식 OpenAI Python SDK 또는 호환되는 클라이언트 라이브러리를 사용하십시오. 키와 새 베이스 URL로 클라이언트를 초기화한 후, 모델 ID "uncensored"로 chat.completions.create를 호출하십시오. 이 접근 방식은 기존 코드베이스를 유지하면서 합법적인 성인 또는 논쟁적인 주제에 대한 콘텐츠 거부 없이 무검열 모델에 대한 접근 권한을 얻습니다.
Python SDK는 메시지 및 도구의 직렬화를 자동으로 처리합니다. 요청이 OpenAI 서버로 전송되지 않도록 올바른 베이스 URL을 전달하십시오. 이 방법은 기존 프롬프트 템플릿과 시스템 지시문으로 모델 동작을 테스트하려는 개발자에게 이상적입니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.openaiapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
JavaScript 및 TypeScript 개발자의 경우 Node SDK도 동일하게 작동합니다. 클라이언트 인스턴스에서 API 키와 베이스 URL을 구성하십시오. 모델 ID는 "uncensored"로 유지됩니다. 이를 통해 프롬프트 로직을 다시 작성하지 않고도 Node.js 애플리케이션에 무검열 LLM API를 통합할 수 있습니다.
Node SDK는 동일한 chat-completions 엔드포인트를 지원합니다. 서버리스 함수, 백엔드 서비스 또는 직접 텍스트 생성이 필요한 클라이언측 애플리케이션에 사용할 수 있습니다. 모델 라우팅을 제공하지 않으므로 단일 오픈 웨이트 모델에서 예측 가능한 동작을 얻습니다. 토큰 비용은 가격 페이지를 참조하십시오.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaiapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
스트리밍 응답 (SSE)
당사는 스트리밍 응답을 위한 Server-Sent Events(SSE)를 지원합니다. 이는 토큰이 생성되는 대로 표시하려는 실시간 애플리케이션에 필수적입니다. 요청에서 stream 매개변수를 true로 설정하십시오. 클라이언트는 부분 텍스트를 포함하는 일련의 이벤트를 수신합니다.
스트리밍은 사용자에게 인지된 지연 시간을 줄입니다. 당사 API는 OpenAI 사양이 정의하는 대로 정확히 SSE 프로토콜을 처리합니다. 채팅 인터페이스, 코드 생성기 또는 증분 텍스트 전달의 이점을 얻는 모든 애플리케이션에 이를 통합할 수 있습니다. 모델은 프롬프트를 처리하고 완료될 때까지 토큰을 지속적으로 생성합니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
제한, 오류 및 컨텍스트 창
당사의 컨텍스트 창은 프롬프트와 완성을 합산하여 100,000 토큰입니다. 이는 긴 문서나 광범위한 대화 기록을 허용합니다. 속도 제한에 유의하십시오: 키당 분당 300 요청. 이를 초과하면 429 Too Many Requests 오류가 발생합니다.
일반적인 오류로는 키가 유효하지 않을 경우 401 Unauthorized, 선불 크레딧이 고갈된 경우 402 Payment Required가 있습니다. 각 계정에는 언제든지 재생성할 수 있는 키가 하나 있습니다. 요청 본문 제한은 8 MB입니다. 임베딩이나 이미지 생성이 필요한 경우 이 API는 적합하지 않습니다. 당사는 텍스트 완성에만 집중합니다.
기술 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 인증 | Authorization: Bearer YOUR_KEY |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 모델 ID | uncensored |
| Base URL | https://api.openaiapialternative.com/v1 |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| JSON 모드 | response_format: {"type": "json_object"} |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 요청 크기 | 최대 8 MB |
| 속도 제한 | 키당 분당 300회 |
| 동시 요청 | 키당 동시 8개 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
이것은 OpenAI 모델의 프록시입니까?
아니요. 당사는 자체 서버에서 실행되는 단일 오픈 웨이트 무검열 대형 언어 모델을 제공합니다. GPT, Claude, Gemini 또는 기타 벤더의 모델이 아닙니다. API 인터페이스는 호환되지만, underlying 모델은 독립적입니다.
크레딧이 부족하면 어떻게 됩니까?
402 Payment Required 오류가 발생합니다. 당사는 선불 크레딧 선불 시스템을 사용합니다. USDT 또는 USDC와 같은 암호화폐로 $10부터 충전할 수 있습니다. 크레딧은 만료되지 않으며, 대량 구매 시 보너스 크레딧을 제공합니다.
모델이 콘텐츠를 거부합니까?
모델은 합법적인 성인, 픽션, 보안 연구, 논쟁적인 주제에 대해 무검열입니다. 유일한 하드 제한은 미성년자가 관련된 성적 콘텐츠는 항상 차단된다는 것입니다. 당사는 표준 성인 콘텐츠에 주관적인 거부를 적용하지 않습니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 베이스 URL을 변경하십시오. 설정은 이것뿐입니다.