https://api.serverlessllmapi.com/v1
API ドキュメント:クイックスタート
数分でサーバーレス LLM API を使い始めましょう。このクイックスタートガイドでは、認証、チャットリクエスト、ストリーミング、および OpenAI 互換インターフェースを用いた関数呼び出しについて解説します。
ベース URL と認証
サーバーレス LLM API は、標準的な OpenAI 互換のエンドポイント構造を使用します。始めるには、ベース URL と API キーという 2 つの情報が必要です。
すべてのリクエストには以下のベース URL を使用してください:
https://api.serverlessllmapi.com/v1
認証は Authorization ヘッダーによって処理されます。API キーの取得ページでアカウントを作成し、キーを受け取ってください。このキーはいつでも再生成でき、古いキーは即座に無効になります。キーは前払いクレジットに直接アクセスできるため、安全に保管してください。
最初のリクエスト:チャット補完
/v1/chat/completions エンドポイントに標準的なチャット補完リクエストを送信します。API はモデル名、メッセージのリスト、およびオプションのパラメータを受け入れます。デフォルトのモデル ID は uncensored で、高品質で制限のないレスポンスに最適化されています。
curl を使用してレスポンスを生成する基本的な例を以下に示します:
curl https://api.serverlessllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'レスポンスは標準的な OpenAI JSON 形式に従います。リクエストが成功した場合、生成されたテキストを含む補完オブジェクトが返されます。このシンプルさにより、ベース URL とキーを変更するだけで、既存の OpenAI SDK 設定に当社のエンドポイントをそのまま置き換えることができます。
Python SDK 統合
公式の OpenAI Python SDK を使用するのが最も迅速な統合方法です。当社の API は OpenAI 互換であるため、ベース URL と API キーを上書きするだけで済みます。これにより、既存のコードを変更せずに動作させることができます。
from openai import OpenAI
client = OpenAI(base_url="https://api.serverlessllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)このアプローチにより、おなじみの Python ライブラリを活用しながら、当社の無検閲モデルの恩恵を受けることができます。コンテキストウィンドウは最大 100,000 トークンをサポートするため、単一のリクエスト内で大幅な入力と出力の長さを処理できます。モデルを効果的に誘導するために、メッセージ配列に必要なシステムプロンプトとユーザープロンプトを含めてください。
Node.js SDK 統合
JavaScript および TypeScript 開発者向けに、OpenAI Node SDK は容易な統合パスを提供します。ベース URL と API キーでクライアントを設定し、すぐにリクエストを開始できます。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.serverlessllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);この設定は、リアルタイムの LLM 連携を必要とするサーバーレス関数やバックエンドサービスに最適です。従量課金制のため、使用した分のみを支払うだけで月額サブスクリプションはありません。クレジットは期限切れにならないため、プロジェクト間の利用休止中も残高を失うことはありません。
ストリーミングレスポンス (SSE)
リクエストに stream: true を設定してストリーミングを有効にします。API は Server-Sent Events (SSE) ストリームを返し、生成されたトークンを表示できます。これによりエンドユーザーの知覚レイテンシが削減され、チャットアプリケーションの体験が向上します。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)クライアントコードでストリームイベントを処理して最終的なレスポンスを累積します。正しく構成されていれば、ストリーミングは Python と Node SDK の両方で機能します。この機能は、即時フィードバックが価値のある長文コンテンツ生成に特に有用です。
レート制限と制約
円滑な統合のために制約を理解してください。API は API キーあたり 1分あたり300リクエスト のレート制限を適用します。各リクエストボディは 8 MB を超えてはいけません。レート制限を超えると、429 ステータスコードが返されます。
認証エラーは 401 ステータスを返し、無効または取り消されたキーを示します。前払いクレジットが尽きた場合、リクエストは 402 ステータスを返します。モデル ID uncensored は埋め込み、画像生成、ファインチューニングをサポートしません。最適なパフォーマンスのためにテキストベースのチャット補完に限定してください。
API 仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| モデル ID | uncensored |
| 認証 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.serverlessllmapi.com/v1 |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| JSON モード | response_format: {"type": "json_object"} |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| リクエストサイズ | 最大 8 MB |
| レート制限 | キーごとに毎分 300 リクエスト |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
| ログイン | Google またはメール+パスワード |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
ドキュメントを読むコンテキストウィンドウのサイズは?
コンテキストウィンドウは、入力プロンプトと出力補完を合計して最大 100,000 トークンをサポートします。これにより、単一のリクエストで長時間の会話や大規模なドキュメント処理が可能です。
Python でストリーミングを処理するには?
API 呼び出しで <code>stream</code> パラメータを <code>true</code> に設定します。SDK は生成されるたびにテキストチャンクを返す反復可能オブジェクトを返すため、レスポンスをリアルタイムで表示できます。
この API を他の OpenAI SDK と一緒に使えますか?
はい、API は OpenAI 互換です。OpenAI API 形式をサポートするクライアントは、ベース URL と API キーを更新するだけで接続できます。これには Node.js、Go、その他の言語のライブラリが含まれます。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベース URL を変更します。これですべてのセットアップは完了です。