https://api.serverlessllmapi.com/v1
API 문서: 빠른 시작
수 분 만에 서버리스 LLM API를 시작하세요. 이 빠른 시작 가이드는 인증, 채팅 요청, 스트리밍 및 도구 호출을 다룹니다.
Base URL 및 인증
서버리스 LLM API는 표준 OpenAI 호환 엔드포인트 구조를 사용합니다. 시작하려면 Base URL과 API 키라는 두 가지 정보가 필요합니다.
모든 요청에는 다음 Base URL을 사용하세요:
https://api.serverlessllmapi.com/v1
인증은 Authorization 헤더를 통해 처리됩니다. API 키 발급 페이지에서 계정을 생성하여 키를 받으세요. 이 키는 언제든지 재생성할 수 있으며, 기존 키는 즉시 무효화됩니다. 키를 안전하게 보관하세요. 선불 크레딧에 직접 접근할 수 있기 때문입니다.
첫 번째 요청: 채팅 완료
표준 채팅 완성 요청을 /v1/chat/completions 엔드포인트로 전송하세요. API는 모델 이름, 메시지 목록 및 선택적 매개변수를 받습니다. 기본 모델 ID는 uncensored이며, 고품질 무제한 응답에 최적화되어 있습니다.
curl을 사용하여 응답을 생성하는 기본 예제는 다음과 같습니다:
curl https://api.serverlessllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'응답은 표준 OpenAI JSON 형식을 따릅니다. 요청이 성공하면 생성된 텍스트를 포함하는 완료 객체를 받게 됩니다. 이 단순함으로 인해 Base URL과 키를 변경하여 기존 OpenAI SDK 구성에 엔드포인트를 쉽게 교체할 수 있습니다.
Python SDK 통합
공식 OpenAI Python SDK를 사용하는 것이 통합을 가장 빠르게 수행하는 방법입니다. API가 OpenAI 호환 API이므로 기본 URL과 API 키만 재정의하면 됩니다. 기존 코드를 수정하지 않고도 작동합니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.serverlessllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)이 방법은 익숙한 Python 라이브러리를 활용할 수 있게 해주면서 무검열 모델의 이점을 제공합니다. 컨텍스트 창은 최대 100,000 토큰을 지원하며, 단일 요청 내에서 상당한 입력 및 출력 길이를 허용합니다. 모델을 효과적으로 안내하기 위해 메시지 배열에 필요한 시스템 및 사용자 프롬프트가 포함되어 있는지 확인하세요.
Node.js SDK 통합
JavaScript 및 TypeScript 개발자의 경우 OpenAI Node SDK는 간단한 통합 경로를 제공합니다. Base URL과 API 키로 클라이언트를 구성하여 즉시 요청을 시작하세요.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.serverlessllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);이 설정은 실시간 LLM 상호 작용이 필요한 서버리스 함수나 백엔드 서비스에 이상적입니다. 사용량 기반 가격 책정이므로 월 구독료 없이 사용한 만큼만 지불합니다. 크레딧은 만료되지 않으므로 프로젝트 간 사용 중단을 해도 잔액이 손실되지 않습니다.
스트리밍 응답 (SSE)
요청 시 stream: true를 설정하여 스트리밍을 활성화하세요. API는 Server-Sent Events (SSE) 스트림을 반환하여 생성되는 토큰을 표시할 수 있습니다. 이는 최종 사용자의 지각된 지연 시간을 줄이고 채팅 애플리케이션의 경험을 향상시킵니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)클라이언트 코드에서 스트림 이벤트를 처리하여 최종 응답을 누적하세요. 올바르게 구성되면 Python 및 Node SDK 모두에서 스트리밍이 작동합니다. 이 기능은 즉각적인 피드백이 중요한 장문 콘텐츠 생성에 특히 유용합니다.
속도 제한 및 제약 사항
원활한 통합을 위해 제약 사항을 이해하세요. API는 API 키당 분당 300개 요청의 속도 제한을 적용합니다. 각 요청 본문은 8 MB를 초과할 수 없습니다. 속도 제한을 초과하면 429 상태 코드를 받게 됩니다.
인증 오류는 401 상태를 반환하며, 이는 키가 무효화되었거나 취소되었음을 나타냅니다. 선불 크레딧이 고갈되면 요청은 402 상태를 반환합니다. 모델 ID uncensored는 임베딩, 이미지 생성 또는 파인튜닝을 지원하지 않습니다. 최적의 성능을 위해 텍스트 기반 채팅 완성에 집중하세요.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 모델 ID | uncensored |
| 인증 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.serverlessllmapi.com/v1 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| JSON 모드 | response_format: {"type": "json_object"} |
| 동시 요청 | 키당 동시 8개 |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 요청 크기 | 최대 8 MB |
| 속도 제한 | 키당 분당 300회 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
| 로그인 | Google 또는 이메일과 비밀번호 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
문서 읽기컨텍스트 창 크기는 얼마인가요?
컨텍스트 창은 입력 프롬프트와 출력 결과의 합계로 최대 100,000개의 토큰을 지원합니다. 이를 통해 단일 요청으로 광범위한 대화나 대규모 문서 처리가 가능합니다.
Python에서 스트리밍을 어떻게 처리하나요?
API 호출 시 <code>stream</code> 매개변수를 <code>true</code>로 설정하세요. SDK는 생성되는 대로 텍스트 청크를 반환하는 반복 가능 객체를 반환하여 응답의 실시간 표시를 가능하게 합니다.
이 API를 다른 OpenAI SDK와 함께 사용할 수 있나요?
네, 이 API는 OpenAI 호환 API입니다. OpenAI API 형식을 지원하는 모든 클라이언트는 기본 URL과 API 키를 업데이트하여 연결할 수 있습니다. 여기에는 Node.js, Go 및 기타 언어용 라이브러리가 포함됩니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 Base URL을 변경하세요. 설정은 이것뿐입니다.