PL ▾

Gotowe API LLM bez cenzury

Pobierz klucz API
za 1 mln tokenów wejściowych
$0,25
Tokeny wyjściowe / 1 mln
$1,00
okno kontekstu tokenów
100 000
darmowy kredyt próbny
$0,50
zapytania na minutę
300

Serverless LLM APIDokumentacja API: Szybki start

https://api.serverlessllmapi.com/v1

https://api.serverlessllmapi.com/v1

Dokumentacja API: Szybki start

Zacznij korzystać z bezserwerowego API LLM w kilka minut. Ten przewodnik szybkiego startu obejmuje uwierzytelnianie, zapytania czatu, strumieniowanie i wywoływanie funkcji w naszym interfejsie kompatybilnym z OpenAI.

Bazowy URL i uwierzytelnianie

API serverless llm używa standardowej struktury endpointu kompatybilnej z OpenAI. Aby rozpocząć, potrzebujesz dwóch informacji: bazowego URL i swojego klucza API.

Użyj następującego bazowego URL dla wszystkich zapytań:

https://api.serverlessllmapi.com/v1

Uwierzytelnianie jest obsługiwane za pomocą nagłówka Authorization. Załóż konto na stronie Uzyskanie klucza API, aby otrzymać swój klucz. Możesz go wygenerować ponownie w dowolnym momencie, co natychmiast unieważnia poprzedni. Chroń swój klucz, ponieważ zapewnia bezpośredni dostęp do przedpłaconego kredytu.

Pierwsze zapytanie: Uzupełnienia czatu

Wyślij standardowe zapytanie o uzupełnienie czatu do endpointu /v1/chat/completions. API przyjmuje nazwę modelu, listę wiadomości i parametry opcjonalne. Naszym domyślnym ID modelu jest uncensored, zoptymalizowany pod kątem wysokiej jakości, nieograniczonych odpowiedzi.

Oto podstawowy przykład użycia curl do wygenerowania odpowiedzi:

curl https://api.serverlessllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Odpowiedź ma standardowy format JSON OpenAI. Jeśli zapytanie powiedzie się, otrzymasz obiekt uzupełnienia zawierający wygenerowany tekst. Ta prostota pozwala na podmianę naszego endpointu w istniejących konfiguracjach SDK OpenAI poprzez prostą zmianę bazowego URL i klucza.

Integracja z SDK Pythona

Użycie oficjalnego SDK Pythona OpenAI to najszybszy sposób na integrację. Ponieważ nasze API jest kompatybilne z OpenAI, musisz tylko nadpisać bazowy URL i klucz API. Dzięki temu istniejący kod działa bez modyfikacji.

from openai import OpenAI

client = OpenAI(base_url="https://api.serverlessllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

To podejście pozwala wykorzystać znane biblioteki Pythona, czerpiąc korzyści z naszego modelu bez cenzury. Okno kontekstu obsługuje do 100 000 tokenów, co pozwala na dużą długość danych wejściowych i wyjściowych w jednym zapytaniu. Upewnij się, że tablica wiadomości zawiera niezbędne prompty systemowe i użytkownika, aby skutecznie kierować modelem.

Integracja z SDK Node.js

Dla programistów JavaScript i TypeScript SDK Node.js OpenAI zapewnia prostą ścieżkę integracji. Skonfiguruj klienta z naszym bazowym URL i kluczem API, aby rozpocząć wysyłanie zapytań.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.serverlessllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

To rozwiązanie jest idealne dla funkcji bezserwerowych lub usług backendowych wymagających interakcji LLM w czasie rzeczywistym. Model cenowy pay-as-you-go oznacza, że płacisz tylko za to, czego używasz, bez miesięcznych subskrypcji. Kredyty nie wygasają, więc możesz wstrzymać użytkowanie między projektami bez utraty salda.

Odpowiedzi strumieniowe (SSE)

Włącz strumieniowanie, ustawiając stream: true w swoim zapytaniu. API zwróci strumień Server-Sent Events (SSE), pozwalający wyświetlać tokeny w miarę ich generowania. Zmniejsza to postrzeganą latencję dla użytkowników końcowych i poprawia doświadczenie w aplikacjach czatu.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Obsłuż zdarzenia strumienia w kodzie klienta, aby zebrać ostateczną odpowiedź. Strumieniowanie działa zarówno z SDK Pythona, jak i Node.js przy poprawnej konfiguracji. Funkcja ta jest szczególnie przydatna przy generowaniu treści długich, gdzie natychmiastowa informacja zwrotna jest cenna.

Limity zapytań i ograniczenia

Zrozum ograniczenia, aby zapewnić płynną integrację. API narzuca limit zapytań na poziomie 300 zapytań na minutę na klucz API. Ciało każdego zapytania nie może przekraczać 8 MB. Jeśli przekroczysz limit zapytań, otrzymasz kod statusu 429.

Błędy uwierzytelniania zwracają status 401, wskazując na nieprawidłowy lub unieważniony klucz. Jeśli przedpłacony kredyt zostanie wyczerpany, zapytania zwrócą status 402. ID modelu uncensored nie obsługuje osadzania (embeddings), generowania obrazów ani dostrajania (fine-tuning). Trzymaj się uzupełnień czatu opartych na tekście dla optymalnej wydajności.

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
ID modeluuncensored
UwierzytelnianieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.serverlessllmapi.com/v1
EndpointyPOST /v1/chat/completions · GET /v1/models
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Tryb JSONresponse_format: {"type": "json_object"}
Równoległe zapytaniado 8 jednocześnie na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozmiar zapytaniado 8 MB
Limit zapytań300 zapytań na minutę na klucz
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Bonus+5% od $50, +10% od $100
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
LogowanieGoogle albo e-mail i hasło

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Czytaj dokumentację
Jaki jest rozmiar okna kontekstu?

Okno kontekstu obsługuje do 100 000 tokenów dla połączonego promptu wejściowego i uzupełnienia wyjściowego. Pozwala to na prowadzenie długich rozmów lub przetwarzanie dużych dokumentów w jednym zapytaniu.

Jak obsłużyć strumieniowanie w Pythonie?

Ustaw parametr <code>stream</code> na <code>true</code> w swoim wywołaniu API. SDK zwróci obiekt iterowalny, który zwraca fragmenty tekstu w miarę ich generowania, umożliwiając wyświetlanie odpowiedzi w czasie rzeczywistym.

Czy mogę używać tego API z innymi SDK OpenAI?

Tak, API jest kompatybilne z OpenAI. Każdy klient obsługujący format API OpenAI może się połączyć, zmieniając bazowy URL i klucz API. Dotyczy to bibliotek dla Node.js, Go i innych języków.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.