RU ▾

Готовая замена: API без цензуры для LLM

Получить API-ключ
за 1M входных токенов
$0,25
Выходные токены / 1M
$1,00
контекст токенов
100 000
пробный кредит
$0,50
запросов в минуту
300

Serverless LLM APIДокументация API: Быстрый старт

https://api.serverlessllmapi.com/v1

https://api.serverlessllmapi.com/v1

Документация API: Быстрый старт

Начните использовать бессерверную LLM API за считанные минуты. Это руководство охватывает аутентификацию, запросы на чат, потоковую передачу и вызов функций через наш интерфейс, совместимый с OpenAI.

Базовый URL и аутентификация

бессерверная LLM API использует стандартную структуру эндпоинтов, совместимую с OpenAI. Чтобы начать работу, вам понадобятся две вещи: базовый URL и ваш API-ключ.

Используйте следующий базовый URL для всех запросов:

https://api.serverlessllmapi.com/v1

Аутентификация осуществляется через заголовок Authorization. Зарегистрируйтесь на странице получения API-ключа, чтобы получить ключ. Вы можете перегенерировать этот ключ в любое время, что мгновенно аннулирует старый. Храните ключ в безопасности, так как он обеспечивает прямой доступ к вашему предоплаченному балансу.

Первый запрос: Завершение чата

Отправьте стандартный запрос на завершение чата на эндпоинт /v1/chat/completions. API принимает имя модели, список сообщений и необязательные параметры. Наш идентификатор модели по умолчанию — uncensored, который оптимизирован для высококачественных, неограниченных ответов.

Вот базовый пример с использованием curl для генерации ответа:

curl https://api.serverlessllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Ответ следует стандартному формату JSON OpenAI. Если запрос успешен, вы получите объект завершения, содержащий сгенерированный текст. Эта простота позволяет вам заменить наш эндпоинт в существующих конфигурациях SDK OpenAI, просто изменив базовый URL и ключ.

Интеграция SDK Python

Использование официального Python SDK от OpenAI — самый быстрый способ интеграции. Поскольку наш API совместим с OpenAI, вам нужно только переопределить базовый URL и API-ключ. Это гарантирует, что ваш существующий код будет работать без изменений.

from openai import OpenAI

client = OpenAI(base_url="https://api.serverlessllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Этот подход позволяет вам использовать знакомые библиотеки Python, одновременно пользуясь нашей безцензурной моделью. Контекстное окно поддерживает до 100 000 токенов, что позволяет иметь значительную длину ввода и вывода в одном запросе. Убедитесь, что ваш массив сообщений включает необходимые системные и пользовательские промпты для эффективного руководства моделью.

Интеграция SDK Node.js

Для разработчиков JavaScript и TypeScript SDK Node.js от OpenAI предоставляет простой путь интеграции. Настройте клиент с нашим базовым URL и вашим API-ключом, чтобы сразу начать отправку запросов.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.serverlessllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Эта настройка идеально подходит для бессерверных функций или бэкенд-сервисов, которым требуется взаимодействие с LLM в реальном времени. Тарификация по факту использования означает, что вы платите только за то, что используете, без ежемесячных подписок. Баланс не сгорает, поэтому вы можете приостановить использование между проектами без потери средств.

Потоковые ответы (SSE)

Включите потоковую передачу, установив stream: true в вашем запросе. API вернет поток Server-Sent Events (SSE), позволяя вам отображать токены по мере их генерации. Это снижает воспринимаемую задержку для конечных пользователей и улучшает опыт для приложений чата.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Обработайте события потока в коде вашего клиента, чтобы накопить окончательный ответ. Потоковая передача работает как с Python, так и с Node SDK при правильной настройке. Эта функция особенно полезна для генерации контента в длинном формате, где важна немедленная обратная связь.

Лимиты запросов и ограничения

Поймите ограничения, чтобы обеспечить плавную интеграцию. API накладывает лимит запросов в 300 запросов в минуту на каждый API-ключ. Тело каждого запроса не должно превышать 8 МБ. Если вы превысите лимит запросов, вы получите код статуса 429.

Ошибки аутентификации возвращают статус 401, указывающий на недействительный или аннулированный ключ. Если ваш предоплаченный кредит исчерпан, запросы вернут статус 402. Идентификатор модели uncensored не поддерживает эмбеддинги, генерацию изображений или дообучение. Придерживайтесь текстовых завершений чата для оптимальной производительности.

Характеристики API

Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.

ПараметрЗначение
Формат APIсовместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ
ID моделиuncensored
АвторизацияAuthorization: Bearer YOUR_KEY
Base URLhttps://api.serverlessllmapi.com/v1
ЭндпоинтыPOST /v1/chat/completions · GET /v1/models
Вызов функцийда — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool
Потоковая передачада — server-sent events, последний фрагмент содержит расход токенов
Контекстное окно100 000 токенов (вход и ответ вместе)
Параметрыtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Максимум ответадо остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет)
JSON-режимresponse_format: {"type": "json_object"}
Параллельные запросыдо 8 одновременно на ключ
Заголовки ответаX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Размер запросадо 8 МБ
Лимит запросов300 запросов в минуту на ключ
Срок действияоплаченный баланс не сгорает, без подписки
Оплатапредоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны
Пробный баланс$0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения
Цена$0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных
Бонус+5% от $50, +10% от $100
ПополнениеUSDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500
Контентконтент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён
Ключиодин активный ключ на аккаунт; новый заменяет старый
ВходGoogle или e-mail и пароль

Коды ошибок

Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.

КодТипЧто значит
400bad_requestневерный JSON, пустые сообщения, неверный параметр или превышено окно контекста
401missing_key · invalid_key · key_revokedнет ключа, ключ неверный или заменён новым
402no_creditбаланс пуст — пополните, работа продолжится сразу
403content_blockedсексуальный контент с несовершеннолетними — отказ, без оплаты
404not_foundнеизвестный эндпоинт
413request_too_largeтело запроса больше 8 МБ
429rate_limited · concurrencyбольше 300/мин или 8 параллельно — подождите и повторите
503upstream_busyмодель занята — повторите через несколько секунд

Вопросы и ответы

Читать документацию
Какой размер контекстного окна?

Контекстное окно поддерживает до 100 000 токенов для объединенного входного промпта и выходного завершения. Это позволяет вести обширные разговоры или обрабатывать большие документы в одном запросе.

Как обрабатывать потоковую передачу в Python?

Установите параметр <code>stream</code> в <code>true</code> в вашем вызове API. SDK вернет итерируемый объект, который выдает фрагменты текста по мере их генерации, позволяя отображать ответы в реальном времени.

Могу ли я использовать этот API с другими SDK OpenAI?

Да, API совместим с OpenAI. Любой клиент, поддерживающий формат API OpenAI, может подключиться, изменив базовый URL и API-ключ. Это включает библиотеки для Node.js, Go и других языков.

Ваш ключ — в одной форме от вас

Создайте учетную запись, скопируйте ключ, измените базовый URL. Вот и вся настройка.