https://api.serverlessllmapi.com/v1
เอกสาร API: เริ่มต้นอย่างรวดเร็ว
เริ่มใช้ API LLM แบบไร้เซิร์ฟเวอร์ในไม่กี่นาที คู่มือเริ่มต้นอย่างรวดเร็วนี้ครอบคลุมการตรวจสอบสิทธิ์ คำขอแชท การสตรีมมิง และการเรียกใช้ฟังก์ชันด้วยอินเทอร์เฟซที่เข้ากันได้กับ OpenAI
Base URL และการตรวจสอบสิทธิ์
API ของ serverless llm ใช้โครงสร้างเอนด์พอยต์ที่เข้ากันได้กับมาตรฐาน OpenAI เริ่มต้นใช้งานโดยต้องมีข้อมูลสองส่วน: Base URL และคีย์ API ของคุณ
ใช้ Base URL ต่อไปนี้สำหรับคำขอทั้งหมด:
https://api.serverlessllmapi.com/v1
การตรวจสอบสิทธิ์ดำเนินการผ่าน Authorization header สร้างบัญชีในหน้ารับคีย์ API เพื่อรับคีย์ของคุณ คุณสามารถสร้างคีย์ใหม่ได้ตลอดเวลา ซึ่งจะยกเลิกคีย์เก่าทันที เก็บคีย์ของคุณให้ปลอดภัยเนื่องจากคีย์นี้ให้สิทธิ์เข้าถึงเครดิตแบบเติมเงินล่วงหน้าของคุณโดยตรง
คำขอแรก: การเติมเต็มแชท
ส่งคำขอเติมเต็มแชทมาตรฐานไปยังเอนด์พอยต์ /v1/chat/completions API รับชื่อโมเดล รายการข้อความ และพารามิเตอร์เพิ่มเติม ID โมเดลเริ่มต้นของเราคือ uncensored ซึ่งปรับแต่งสำหรับการตอบกลับที่มีคุณภาพสูงและไม่มีข้อจำกัด
นี่คือตัวอย่างพื้นฐานโดยใช้ curl เพื่อสร้างการตอบกลับ:
curl https://api.serverlessllmapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'การตอบกลับจะปฏิบัติตามรูปแบบ JSON มาตรฐานของ OpenAI หากคำขอสำเร็จ คุณจะรับวัตถุการเติมเต็มที่มีข้อความที่สร้าง ความเรียบง่ายนี้ทำให้คุณสามารถเปลี่ยนเอนด์พอยต์ของเราเป็นการกำหนดค่า Python SDK ที่มีอยู่ได้โดยการเปลี่ยน Base URL และคีย์
การผสานรวม Python SDK
การใช้ Python SDK ทางการของ OpenAI เป็นวิธีที่เร็วที่สุดในการผสานรวม เนื่องจาก API ของเราเป็น openai compatible api คุณเพียงแค่ต้องแทนที่ Base URL และคีย์ API เพื่อให้โค้ดที่มีอยู่ทำงานได้โดยไม่ต้องแก้ไข
from openai import OpenAI
client = OpenAI(base_url="https://api.serverlessllmapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)แนวทางนี้ช่วยให้คุณใช้ไลบรารี Python ที่คุ้นเคยในขณะที่ได้รับประโยชน์จากโมเดลที่ไม่มีการเซ็นเซอร์ของเรา หน้าต่างบริบทรองรับโทเคนได้สูงสุด 100,000 โทเคน ทำให้มีความยาวอินพุตและเอาต์พุตจำนวนมากภายในคำขอเดียว ตรวจสอบให้แน่ใจว่าอาร์เรย์ข้อความของคุณมีพรอมต์ระบบและผู้ใช้ที่จำเป็นเพื่อแนะนำโมเดลได้อย่างมีประสิทธิภาพ
การผสานรวม Node.js SDK
สำหรับนักพัฒนา JavaScript และ TypeScript OpenAI Node SDK ให้เส้นทางการผสานรวมที่เรียบง่าย กำหนดค่าไคลเอนต์ด้วย Base URL และคีย์ API ของคุณเพื่อเริ่มส่งคำขอได้ทันที
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.serverlessllmapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);การตั้งค่านี้เหมาะสำหรับฟังก์ชันไร้เซิร์ฟเวอร์หรือบริการแบ็กเอนด์ที่ต้องการการโต้ตอบ LLM แบบเรียลไทม์ ราคาแบบจ่ายตามการใช้งานหมายความว่าคุณจ่ายเฉพาะสิ่งที่ใช้โดยไม่มีการสมัครรายเดือน เครดิตไม่หมดอายุ ดังนั้นคุณสามารถหยุดใช้งานระหว่างโครงการได้โดยไม่สูญเสียยอดเงินคงเหลือ
การตอบกลับแบบสตรีมมิง (SSE)
เปิดใช้งานสตรีมมิงโดยการตั้งค่า stream: true ในคำขอของคุณ API จะส่งคืนสตรีม Server-Sent Events (SSE) ทำให้คุณสามารถแสดงโทเคนเมื่อสร้างเสร็จ สิ่งนี้ลดความล่าช้าที่รับรู้สำหรับผู้ใช้ปลายทางและปรับปรุงประสบการณ์สำหรับแอปพลิเคชันแชท
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)จัดการเหตุการณ์สตรีมในโค้ดไคลเอนต์ของคุณเพื่อสะสมการตอบกลับสุดท้าย สตรีมมิงทำงานได้ทั้งกับ Python และ Node SDK เมื่อกำหนดค่าถูกต้อง คุณสมบัตินี้มีประโยชน์เป็นพิเศษสำหรับการสร้างเนื้อหาแบบยาวซึ่งการตอบกลับทันทีมีค่า
ขีดจำกัดอัตราและข้อจำกัด
ทำความเข้าใจข้อจำกัดเพื่อให้การผสานรวมราบรื่น API กำหนดขีดจำกัดอัตราของ 300 คำขอต่อนาที ต่อคีย์ API แต่ละคำขอต้องมีขนาดไม่เกิน 8 MB หากคุณเกินขีดจำกัดอัตรา คุณจะรับสถานะ 429
ข้อผิดพลาดในการตรวจสอบสิทธิ์จะคืนสถานะ 401 ซึ่งบ่งชี้ว่าคีย์ไม่ถูกต้องหรือถูกยกเลิก หากเครดิตแบบเติมเงินล่วงหน้าของคุณหมด คำขอจะคืนสถานะ 402 ID โมเดล uncensored ไม่รองรับการฝังตัว การสร้างภาพ หรือการปรับแต่งเฉพาะ ใช้การเติมเต็มแชบแบบข้อความเท่านั้นเพื่อให้ได้ประสิทธิภาพสูงสุด
ข้อมูลจำเพาะ API
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| ID โมเดล | uncensored |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.serverlessllmapi.com/v1 |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| โหมด JSON | response_format: {"type": "json_object"} |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
อ่านเอกสารขนาดหน้าต่างบริบทคือเท่าใด?
หน้าต่างบริบทรองรับโทเคนได้สูงสุด 100,000 โทเคนสำหรับพรอมต์อินพุตและการเติมเต็มเอาต์พุตที่รวมกัน สิ่งนี้ทำให้สามารถสนทนาที่ยาวนานหรือประมวลผลเอกสารขนาดใหญ่ได้ในคำขอเดียว
ฉันจัดการสตรีมมิงใน Python ได้อย่างไร?
ตั้งค่าพารามิเตอร์ <code>stream</code> เป็น <code>true</code> ในการเรียก API ของคุณ SDK จะส่งคืนวัตถุแบบวนซ้ำที่ส่งชิ้นส่วนข้อความเมื่อสร้างเสร็จ ช่วยแสดงการตอบกลับแบบเรียลไทม์
ฉันสามารถใช้ API นี้กับ SDK อื่นๆ ของ OpenAI ได้หรือไม่?
ใช่ API นี้รองรับรูปแบบ API ของ OpenAI ไคลเอนต์ใดๆ ที่รองรับรูปแบบ API ของ OpenAI สามารถเชื่อมต่อได้โดยการอัปเดต Base URL และคีย์ API ซึ่งรวมถึงไลบรารีสำหรับ Node.js, Go และภาษาอื่นๆ
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน Base URL นั่นคือการตั้งค่าทั้งหมด