VI ▾
Lấy khóa API

Thay thế API OpenAI: Chuyển đổi client của bạn chỉ với ba dòng

Thay thế API OpenAI không kiểm duyệt trực tiếp

Kết nối client tương thích OpenAI hiện có của bạn với API LLM không kiểm duyệt của chúng tôi bằng cách cập nhật base URL và khóa API. Hướng dẫn nhanh này hướng dẫn bạn qua xác thực, hoàn thiện văn bản cơ bản, truyền phát (streaming) và gọi hàm với mô hình trọng số mở duy nhất của chúng tôi.

Xác thực & Base URL

API của chúng tôi tuân theo giao diện chat-completions tiêu chuẩn của OpenAI. Bạn chỉ cần thay đổi hai thứ trong cấu hình client của mình: base URL và khóa API. Đăng ký tại trang Nhận khóa API để nhận khóa ngay lập tức. Không cần thẻ tín dụng cho bản dùng thử.

Base URL cho tất cả các yêu cầu là https://api.openaiapialternative.com/v1. Endpoint này cung cấp một mô hình ngôn ngữ lớn không kiểm duyệt duy nhất. Không giống như các bộ định tuyến đa mô hình, chúng tôi không định tuyến giữa các nhà cung cấp; chúng tôi chạy mô hình trọng số mở của riêng mình trên các máy chủ GPU của chúng tôi. Điều này đơn giản hóa stack của bạn vì bạn tương tác với một hành vi mô hình nhất quán thay vì phải xử lý các điểm khác biệt API khác nhau giữa các biến thể GPT, Claude hoặc Gemini.

Yêu cầu đầu tiên

Thực hiện yêu cầu POST đến /v1/chat/completions. Cấu trúc đối tượng phản hồi khớp với thông số kỹ thuật hoàn thiện văn bản tiêu chuẩn của OpenAI, nhưng được cung cấp bởi mô hình không kiểm duyệt của chúng tôi. Bạn có thể truyền tin nhắn, công cụ và cài đặt nhiệt độ theo cùng định dạng bạn sẽ dùng cho bất kỳ endpoint tương thích OpenAI nào.

Cấu trúc này đảm bảo rằng nếu client của bạn đã hỗ trợ giao thức OpenAI, bạn có thể thay đổi nhà cung cấp bằng cách thay đổi base URL và khóa. ID mô hình bạn phải gửi là "uncensored". Lưu ý rằng chúng tôi không cung cấp embedding, hình ảnh hoặc âm thanh, vì vậy hãy giữ trọng tâm tải trọng của bạn vào văn bản.

curl https://api.openaiapialternative.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

SDK Python

Sử dụng SDK Python chính thức của OpenAI hoặc bất kỳ thư viện client tương thích nào. Khởi tạo client với khóa và base URL mới của bạn. Sau đó gọi chat.completions.create với ID mô hình "uncensored". Cách tiếp cận này giữ nguyên cơ sở mã hiện có của bạn trong khi truy cập vào một mô hình không kiểm duyệt mà không có từ chối nội dung đối với các chủ đề người trưởng thành hợp pháp hoặc gây tranh cãi.

SDK Python xử lý tự động việc tuần tự hóa tin nhắn và công cụ của bạn. Đảm bảo bạn truyền base URL chính xác để các yêu cầu không gửi đến máy chủ của OpenAI. Phương pháp này lý tưởng cho các nhà phát triển muốn kiểm tra hành vi của mô hình với các mẫu prompt và hướng dẫn hệ thống hiện có của họ.

from openai import OpenAI

client = OpenAI(base_url="https://api.openaiapialternative.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK Node.js

Đối với các nhà phát triển JavaScript và TypeScript, SDK Node.js hoạt động giống hệt. Cấu hình khóa API và base URL trong phiên bản client của bạn. ID mô hình vẫn là "uncensored". Điều này cho phép bạn tích hợp API LLM không kiểm duyệt của chúng tôi vào các ứng dụng Node.js của bạn mà không cần viết lại logic prompt của bạn.

SDK Node.js hỗ trợ endpoint chat-completions tương tự. Bạn có thể sử dụng nó cho các hàm không máy chủ, dịch vụ backend hoặc các ứng dụng client cần tạo văn bản trực tiếp. Vì chúng tôi không cung cấp định tuyến mô hình, bạn có hành vi dự đoán được từ mô hình trọng số mở duy nhất này. Kiểm tra trang giá để biết chi phí token.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.openaiapialternative.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát (SSE)

Chúng tôi hỗ trợ Sự kiện gửi qua máy chủ (SSE) cho phản hồi truyền phát. Điều này rất cần thiết cho các ứng dụng thời gian thực nơi bạn muốn hiển thị token khi chúng được tạo. Đặt tham số stream thành true trong yêu cầu của bạn. Client sẽ nhận được một chuỗi sự kiện chứa văn bản từng phần.

Truyền phát giảm độ trễ cảm nhận đối với người dùng. API của chúng tôi xử lý giao thức SSE chính xác như thông số kỹ thuật OpenAI định nghĩa. Bạn có thể tích hợp điều này vào các giao diện trò chuyện, trình tạo mã hoặc bất kỳ ứng dụng nào được hưởng lợi từ việc phân phối văn bản tăng dần. Mô hình xử lý prompt và liên tục tạo token cho đến khi hoàn tất.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Giới hạn, Lỗi & Cửa sổ ngữ cảnh

Cửa sổ ngữ cảnh của chúng tôi là 100.000 token cho prompt và phần hoàn thiện kết hợp. Điều này cho phép các tài liệu dài hoặc lịch sử hội thoại rộng rãi. Hãy lưu ý giới hạn tốc độ: 300 yêu cầu mỗi phút mỗi khóa. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được lỗi 429 Too Many Requests.

Các lỗi phổ biến bao gồm 401 Unauthorized nếu khóa của bạn không hợp lệ, và 402 Payment Required nếu tín dụng trả trước của bạn đã cạn kiệt. Mỗi tài khoản có một khóa có thể được tạo lại bất cứ lúc nào. Giới hạn thân yêu cầu là 8 MB. Nếu bạn cần embedding hoặc tạo hình ảnh, API này không phải là lựa chọn phù hợp; chúng tôi tập trung hoàn toàn vào hoàn thiện văn bản.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Xác thựcAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
ID mô hìnhuncensored
Base URLhttps://api.openaiapialternative.com/v1
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Chế độ JSONresponse_format: {"type": "json_object"}
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Đây có phải là proxy cho các mô hình của OpenAI không?

Không. Chúng tôi cung cấp một mô hình ngôn ngữ lớn (LLM) trọng số mở, không kiểm duyệt duy nhất chạy trên máy chủ của chúng tôi. Đây không phải là GPT, Claude, Gemini hay bất kỳ mô hình của nhà cung cấp nào khác. Giao diện API tương thích, nhưng mô hình nền độc lập.

Điều gì xảy ra nếu tôi hết tín dụng?

Bạn sẽ nhận được lỗi 402 Payment Required. Chúng tôi sử dụng hệ thống tín dụng trả trước trả theo nhu cầu. Bạn có thể nạp tiền từ $10 bằng tiền điện tử (USDT hoặc USDC). Tín dụng không bao giờ hết hạn và bạn nhận được tín dụng bổ sung cho các giao dịch lớn hơn.

Mô hình có từ chối nội dung không?

Mô hình không kiểm duyệt đối với các chủ đề người trưởng thành hợp pháp, hư cấu, nghiên cứu bảo mật và gây tranh cãi. Giới hạn cứng duy nhất là nội dung tình dục liên quan đến trẻ vị thành niên luôn bị chặn. Chúng tôi không áp dụng việc từ chối chủ quan đối với nội dung người trưởng thành tiêu chuẩn.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.

Nhận khóa APIĐọc tài liệu