PT ▾

API de LLM sem censura pronta para usar

Obter chave de API
por 1M de tokens de entrada
$0.25
Tokens de saída / 1M
$1.00
contexto de tokens
100,000
crédito de teste grátis
$0.50
requisições por minuto
300

Serverless LLM APIDocumentação da API: Início Rápido

https://api.serverlessllmapi.com/v1

https://api.serverlessllmapi.com/v1

Documentação da API: Início Rápido

Comece a usar a API de LLM sem servidor em minutos. Este guia de início rápido cobre autenticação, requisições de chat, streaming e chamada de ferramentas com nossa interface compatível com OpenAI.

URL Base e Autenticação

A API serverless llm usa a estrutura padrão de endpoint compatível com OpenAI. Para começar, você precisa de duas informações: sua URL base e sua chave de API.

Use a seguinte URL base para todas as requisições:

https://api.serverlessllmapi.com/v1

A autenticação é feita via cabeçalho Authorization. Crie uma conta na página Obter chave de API para receber sua chave. Você pode regenerar esta chave a qualquer momento, o que revoga instantaneamente a antiga. Mantenha sua chave segura, pois ela fornece acesso direto aos seus créditos pré-pagos.

Primeira Requisição: Chat Completions

Envie uma solicitação de conclusão de chat padrão para o endpoint /v1/chat/completions. A API aceita um nome de modelo, uma lista de mensagens e parâmetros opcionais. O ID do nosso modelo padrão é uncensored, otimizado para respostas de alta qualidade e sem filtros.

Aqui está um exemplo básico usando curl para gerar uma resposta:

curl https://api.serverlessllmapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

A resposta segue o formato JSON padrão da OpenAI. Se a requisição for bem-sucedida, você receberá um objeto de conclusão contendo o texto gerado. Essa simplicidade permite que você substitua nosso endpoint em configurações existentes de SDKs da OpenAI, simplesmente alterando a URL base e a chave.

Integração com SDK Python

Usar o SDK oficial da OpenAI para Python é a maneira mais rápida de integrar. Como nossa API é compatível com OpenAI, você só precisa substituir a URL base e a chave de API. Isso garante que seu código existente funcione sem modificações.

from openai import OpenAI

client = OpenAI(base_url="https://api.serverlessllmapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Essa abordagem permite que você aproveite bibliotecas Python familiares enquanto se beneficia do nosso modelo sem censura. A janela de contexto suporta até 100.000 tokens, permitindo comprimentos substanciais de entrada e saída em uma única requisição. Certifique-se de que sua matriz de mensagens inclua os prompts de sistema e usuário necessários para orientar o modelo eficazmente.

Integração com SDK Node.js

Para desenvolvedores JavaScript e TypeScript, o SDK Node da OpenAI oferece um caminho de integração direto. Configure o cliente com nossa URL base e sua chave de API para começar a fazer requisições imediatamente.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.serverlessllmapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Esta configuração é ideal para funções sem servidor ou serviços de backend que exigem interações LLM em tempo real. O preço pagamento por uso significa que você paga apenas pelo que usa, sem assinaturas mensais. Os créditos nunca expiram, então você pode pausar o uso entre projetos sem perder seu saldo.

Respostas em Streaming (SSE)

Ative o streaming definindo stream: true na sua solicitação. A API retornará um stream de Server-Sent Events (SSE), permitindo que você exiba tokens conforme são gerados. Isso reduz a latência percebida para usuários finais e melhora a experiência para aplicativos de chat.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Manipule os eventos de stream no código do cliente para acumular a resposta final. O streaming funciona tanto com os SDKs Python quanto Node.js quando configurados corretamente. Este recurso é particularmente útil para geração de conteúdo de longo prazo, onde o feedback imediato é valioso.

Limites de Taxa e Restrições

Entenda as restrições para garantir uma integração suave. A API impõe um limite de requisições de 300 requisições por minuto por chave de API. O corpo de cada solicitação não deve exceder 8 MB. Se você exceder o limite de requisições, receberá o código de status 429.

Erros de autenticação retornam o status 401, indicando uma chave inválida ou revogada. Se seu crédito pré-pago for esgotado, as solicitações retornarão o status 402. O ID do modelo uncensored não suporta embeddings, geração de imagens ou ajuste fino. Mantenha-se em conclusões de chat baseadas em texto para desempenho ideal.

Recursos e limites

Uma tabela com cada limite, recurso e preço.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
ID do modelouncensored
AutenticaçãoAuthorization: Bearer YOUR_KEY
Base URLhttps://api.serverlessllmapi.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Janela de contexto100.000 tokens (entrada + saída)
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Modo JSONresponse_format: {"type": "json_object"}
Concorrência8 requisições ao mesmo tempo por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamanhoaté 8 MB por requisição
Limite de taxa300 requisições por minuto por chave
Validadecrédito pago não expira, sem assinatura
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Bônus+5% a partir de $50, +10% a partir de $100
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
Chavesuma chave ativa por conta; uma nova substitui a anterior
LoginGoogle ou e-mail e senha

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Ler a documentação
Qual é o tamanho da janela de contexto?

A janela de contexto suporta até 100.000 tokens para o prompt de entrada combinado e a conclusão de saída. Isso permite conversas extensas ou processamento de documentos grandes em uma única requisição.

Como lidar com o streaming em Python?

Defina o parâmetro <code>stream</code> como <code>true</code> na sua chamada de API. O SDK retornará um objeto iterável que produz blocos de texto conforme são gerados, permitindo a exibição em tempo real das respostas.

Posso usar esta API com outros SDKs da OpenAI?

Sim, a API é compatível com OpenAI. Qualquer cliente que suporte o formato da API OpenAI pode se conectar atualizando a URL base e a chave de API. Isso inclui bibliotecas para Node.js, Go e outros idiomas.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.