OpenAI API代替: クライアントを3行で切り替え
そのまま置き換え可能な無検閲OpenAI API代替
ベースURLとAPIキーを更新するだけで、既存のOpenAI互換クライアントを当社の無検閲LLM APIに接続できます。このクイックスタートでは、認証、基本的なテキスト生成、ストリーミング、関数呼び出しを単一のオープンウェイトモデルで実行する方法を解説します。
認証とベースURL
当社のAPIは標準的なOpenAIのchat-completionsインターフェースに従っています。クライアント設定で変更する必要があるのは2つのことだけです:ベースURLとAPIキーです。APIキーページでサインアップすると、すぐにキーを受け取ることができます。トライアルにはクレジットカードは必要ありません。
すべてのリクエストのベースURLはhttps://api.openaiapialternative.com/v1.です。このエンドポイントは単一の無検閲大規模言語モデルを提供します。マルチモデルルーターとは異なり、当社はベンダー間でルーティングせず、自前のGPUサーバーで自前のオープンウェイトモデルを動作させています。これにより、GPT、Claude、Geminiの各バリエーション間で異なるAPIの癖を処理するのではなく、一貫したモデル挙動と対話することになり、あなたのスタックが簡素化されます。
最初のリクエスト
/v1/chat/completionsにPOSTリクエストを送信します。レスポンスオブジェクトの構造は、当社の無検閲モデルによって駆動される標準的なOpenAIのテキスト生成仕様と一致しますが、OpenAI互換のエンドポイントに渡すのと同じ形式でメッセージ、ツール、温度設定を渡すことができます。
この構造により、クライアントがすでにOpenAIのプロトコルをサポートしている場合、ベースURLとキーを変更するだけでプロバイダーを切り替えることができます。送信する必要があるモデルIDは「uncensored」です。埋め込み、画像、音声は提供していないため、ペイロードをテキストに集中させてください。
curl https://api.openaiapialternative.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
公式のOpenAI Python SDKまたは互換性のあるクライアントライブラリを使用します。キーと新しいベースURLでクライアントを初期化し、モデルID「uncensored」でchat.completions.createを呼び出します。このアプローチにより、既存のコードベースを維持したまま、法的な成人向けや論争的なトピックに対するコンテンツ拒否のない無検閲モデルにアクセスできます。
Python SDKはメッセージとツールのシリアライズを自動的に処理します。リクエストがOpenAIのサーバーに送信されないよう、正しいベースURLを渡してください。この方法は、既存のプロンプトテンプレートとシステム指示でモデルの動作をテストしたい開発者に最適です。
from openai import OpenAI
client = OpenAI(base_url="https://api.openaiapialternative.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
JavaScriptおよびTypeScript開発者向けに、Node SDKも同じように動作します。クライアントインスタンスでAPIキーとベースURLを設定します。モデルIDは「uncensored」のままです。これにより、プロンプトロジックを書き換えることなく、Node.jsアプリケーションに当社の無検閲LLM APIを統合できます。
Node SDKは同じchat-completionsエンドポイントをサポートしています。サーバーレス関数、バックエンドサービス、または直接のテキスト生成が必要なクライアントサイドアプリケーションで使用できます。モデルルーティングを提供していないため、この単一のオープンウェイトモデルから予測可能な動作が得られます。トークンコストについては価格ページをご覧ください。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.openaiapialternative.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
ストリーミングレスポンス(SSE)
ストリーミングレスポンスにはServer-Sent Events (SSE)をサポートしています。これは、トークンが生成されるリアルタイムに表示したいアプリケーションに不可欠です。リクエストでstreamパラメータをtrueに設定してください。クライアントは部分テキストを含む一連のイベントを受信します。
ストリーミングはユーザーにとっての知覚遅延を軽減します。当社のAPIは、OpenAIの仕様で定義されているとおりにSSEプロトコルを処理します。チャットインターフェース、コードジェネレーター、または増分的なテキスト配信の恩恵を受けるあらゆるアプリケーションにこれを統合できます。モデルはプロンプトを処理し、完了するまでトークンを継続的に生成します。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
制限、エラー、コンテキストウィンドウ
結合されたプロンプトと完了のコンテキストウィンドウは100,000トークンです。これにより、長いドキュメントや広範な会話履歴が可能になります。レート制限にご注意ください:キーごとに1分あたり300リクエストまでです。これを超えると、429 Too Many Requestsエラーが発生します。
よくあるエラーには、キーが無効な場合の401 Unauthorizedや、前払いクレジットが枯渇した場合の402 Payment Requiredが含まれます。各アカウントには、いつでも再生成できるキーが1つあります。リクエストボディの制限は8 MBです。埋め込みや画像生成が必要な場合、このAPIは適切な選択ではありません。当社はテキスト補完に特化しています。
技術仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| 認証 | Authorization: Bearer YOUR_KEY |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| モデル ID | uncensored |
| Base URL | https://api.openaiapialternative.com/v1 |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| JSON モード | response_format: {"type": "json_object"} |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| リクエストサイズ | 最大 8 MB |
| レート制限 | キーごとに毎分 300 リクエスト |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
| ログイン | Google またはメール+パスワード |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
これはOpenAIモデルのプロキシですか?
いいえ。当社の独自サーバーで動作する単一のオープンウェイト無検閲大規模言語モデルを提供しています。GPT、Claude、Gemini、またはその他のベンダーのモデルではありません。APIインターフェースは互換性がありますが、基盤となるモデルは独立しています。
クレジットが枯渇するとどうなりますか?
402 Payment Requiredエラーが発生します。従量制の前払いクレジットシステムを採用しています。暗号通貨(USDTまたはUSDC)で$10からチャージできます。クレジットは期限切れにならず、大口購入にはボーナスクレジットが付与されます。
モデルはコンテンツを拒否しますか?
モデルは法的な成人向け、フィクション、セキュリティ研究、論争的なトピックに対して無検閲です。唯一のハード制限は、未成年者を含む性的コンテンツが常にブロックされることです。標準的な成人コンテンツには主観的な拒否を適用しません。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベースURLを変更します。セットアップはこれだけです。