https://api.serverlessllmapi.com/v1
Dokumentacja API: Szybki start
Zacznij korzystać z bezserwerowego API LLM w kilka minut. Ten przewodnik szybkiego startu obejmuje uwierzytelnianie, zapytania czatu, strumieniowanie i wywoływanie funkcji w naszym interfejsie kompatybilnym z OpenAI.
Bazowy URL i uwierzytelnianie
API serverless llm używa standardowej struktury endpointu kompatybilnej z OpenAI. Aby rozpocząć, potrzebujesz dwóch informacji: bazowego URL i swojego klucza API.
Użyj następującego bazowego URL dla wszystkich zapytań:
https://api.serverlessllmapi.com/v1
Uwierzytelnianie jest obsługiwane za pomocą nagłówka Authorization. Załóż konto na stronie Uzyskanie klucza API, aby otrzymać swój klucz. Możesz go wygenerować ponownie w dowolnym momencie, co natychmiast unieważnia poprzedni. Chroń swój klucz, ponieważ zapewnia bezpośredni dostęp do przedpłaconego kredytu.
Pierwsze zapytanie: Uzupełnienia czatu
Wyślij standardowe zapytanie o uzupełnienie czatu do endpointu /v1/chat/completions. API przyjmuje nazwę modelu, listę wiadomości i parametry opcjonalne. Naszym domyślnym ID modelu jest uncensored, zoptymalizowany pod kątem wysokiej jakości, nieograniczonych odpowiedzi.
Oto podstawowy przykład użycia curl do wygenerowania odpowiedzi:
curl https://api.serverlessllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Odpowiedź ma standardowy format JSON OpenAI. Jeśli zapytanie powiedzie się, otrzymasz obiekt uzupełnienia zawierający wygenerowany tekst. Ta prostota pozwala na podmianę naszego endpointu w istniejących konfiguracjach SDK OpenAI poprzez prostą zmianę bazowego URL i klucza.
Integracja z SDK Pythona
Użycie oficjalnego SDK Pythona OpenAI to najszybszy sposób na integrację. Ponieważ nasze API jest kompatybilne z OpenAI, musisz tylko nadpisać bazowy URL i klucz API. Dzięki temu istniejący kod działa bez modyfikacji.
from openai import OpenAI
client = OpenAI(base_url="https://api.serverlessllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)To podejście pozwala wykorzystać znane biblioteki Pythona, czerpiąc korzyści z naszego modelu bez cenzury. Okno kontekstu obsługuje do 100 000 tokenów, co pozwala na dużą długość danych wejściowych i wyjściowych w jednym zapytaniu. Upewnij się, że tablica wiadomości zawiera niezbędne prompty systemowe i użytkownika, aby skutecznie kierować modelem.
Integracja z SDK Node.js
Dla programistów JavaScript i TypeScript SDK Node.js OpenAI zapewnia prostą ścieżkę integracji. Skonfiguruj klienta z naszym bazowym URL i kluczem API, aby rozpocząć wysyłanie zapytań.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.serverlessllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);To rozwiązanie jest idealne dla funkcji bezserwerowych lub usług backendowych wymagających interakcji LLM w czasie rzeczywistym. Model cenowy pay-as-you-go oznacza, że płacisz tylko za to, czego używasz, bez miesięcznych subskrypcji. Kredyty nie wygasają, więc możesz wstrzymać użytkowanie między projektami bez utraty salda.
Odpowiedzi strumieniowe (SSE)
Włącz strumieniowanie, ustawiając stream: true w swoim zapytaniu. API zwróci strumień Server-Sent Events (SSE), pozwalający wyświetlać tokeny w miarę ich generowania. Zmniejsza to postrzeganą latencję dla użytkowników końcowych i poprawia doświadczenie w aplikacjach czatu.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Obsłuż zdarzenia strumienia w kodzie klienta, aby zebrać ostateczną odpowiedź. Strumieniowanie działa zarówno z SDK Pythona, jak i Node.js przy poprawnej konfiguracji. Funkcja ta jest szczególnie przydatna przy generowaniu treści długich, gdzie natychmiastowa informacja zwrotna jest cenna.
Limity zapytań i ograniczenia
Zrozum ograniczenia, aby zapewnić płynną integrację. API narzuca limit zapytań na poziomie 300 zapytań na minutę na klucz API. Ciało każdego zapytania nie może przekraczać 8 MB. Jeśli przekroczysz limit zapytań, otrzymasz kod statusu 429.
Błędy uwierzytelniania zwracają status 401, wskazując na nieprawidłowy lub unieważniony klucz. Jeśli przedpłacony kredyt zostanie wyczerpany, zapytania zwrócą status 402. ID modelu uncensored nie obsługuje osadzania (embeddings), generowania obrazów ani dostrajania (fine-tuning). Trzymaj się uzupełnień czatu opartych na tekście dla optymalnej wydajności.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| ID modelu | uncensored |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.serverlessllmapi.com/v1 |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozmiar zapytania | do 8 MB |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Bonus | +5% od $50, +10% od $100 |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czytaj dokumentacjęJaki jest rozmiar okna kontekstu?
Okno kontekstu obsługuje do 100 000 tokenów dla połączonego promptu wejściowego i uzupełnienia wyjściowego. Pozwala to na prowadzenie długich rozmów lub przetwarzanie dużych dokumentów w jednym zapytaniu.
Jak obsłużyć strumieniowanie w Pythonie?
Ustaw parametr <code>stream</code> na <code>true</code> w swoim wywołaniu API. SDK zwróci obiekt iterowalny, który zwraca fragmenty tekstu w miarę ich generowania, umożliwiając wyświetlanie odpowiedzi w czasie rzeczywistym.
Czy mogę używać tego API z innymi SDK OpenAI?
Tak, API jest kompatybilne z OpenAI. Każdy klient obsługujący format API OpenAI może się połączyć, zmieniając bazowy URL i klucz API. Dotyczy to bibliotek dla Node.js, Go i innych języków.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.