EmbeddingApis/Documentação
API de texto sem censura para seu pipeline
Guia de Início Rápido da API de Embeddings
Use este guia para integrar nossa API de chat sem censura em seus pipelines de processamento de texto. O endpoint aceita formatos padrão da OpenAI, permitindo gerar texto, resumir documentos ou extrair dados sem recusas de conteúdo.
Autenticação
Acesse a API usando uma chave de API exclusiva gerada no painel da sua conta. Inclua esta chave no cabeçalho Authorization de cada requisição usando o esquema Bearer. A URL base para todos os endpoints é https://api.embeddingapis.com/v1. Esta URL funciona com os SDKs oficiais da OpenAI e qualquer cliente configurado para serviços compatíveis com OpenAI. Mantenha sua chave segura, pois ela concede acesso aos seus créditos pré-pagos.
Cada conta está limitada a uma chave ativa, que pode ser regenerada a qualquer momento. Regenerar a chave revoga imediatamente a anterior, então atualize sua configuração prontamente.
O Endpoint de Chat Completions
Envie prompts de texto para o endpoint POST /v1/chat/completions. A API oferece um único modelo sem censura identificado pelo ID uncensored. Este modelo é um LLM de pesos abertos ajustado para responder sem recusas de conteúdo para tópicos adultos lícitos, fictícios ou de pesquisa de segurança. Ele processa texto e gera texto, sendo ideal para etapas de pós-processamento, resumo ou extração em seu pipeline.
Estruture sua solicitação com uma matriz messages contendo seus prompts de sistema e usuário. A API retorna uma resposta JSON contendo o texto gerado.
curl https://api.embeddingapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integração com SDK Python
Use a biblioteca oficial OpenAI Python para interagir com a API. Defina o base_url para nosso endpoint e forneça sua chave de API. Esta abordagem permite aproveitar o código de cliente existente com alterações mínimas. O cliente gerencia a serialização e as solicitações de rede, retornando respostas estruturadas que você pode analisar para a lógica do seu aplicativo.
Certifique-se de estar usando uma versão recente do SDK para suportar todos os recursos, incluindo streaming e chamada de ferramentas. O ID do modelo permanece uncensored ao invocar as conclusões.
from openai import OpenAI
client = OpenAI(base_url="https://api.embeddingapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integração com SDK Node.js
Para ambientes JavaScript ou TypeScript, use o SDK Node.js da OpenAI. Configure o cliente com a URL base e a chave de API corretas. Esta configuração garante compatibilidade com seus pipelines existentes baseados em Node. O SDK gerencia a conexão com o endpoint POST /v1/chat/completions, permitindo enviar prompts e receber conclusões de texto de forma eficiente.
Esta integração é adequada para processamento de texto no lado do servidor, como geração de legendas, roteiros ou extração de dados de grandes blocos de texto.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.embeddingapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Respostas em Streaming
Para aplicativos de baixa latência, ative o streaming definindo stream: true em sua solicitação. A API retorna um stream de Server-Sent Events (SSE), entregando tokens conforme são gerados. Isso é particularmente útil para interfaces de usuário em tempo real ou ao processar textos longos onde o feedback imediato é valioso.
Analise o stream SSE para lidar com respostas parciais. O modelo sem censura suporta este modo, permitindo que você reaja ao conteúdo conforme é produzido sem aguardar a conclusão inteira.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, Erros e Janela de Contexto
A janela de contexto suporta 100.000 tokens para prompt e conclusão combinados. Requisições que excedam o limite de corpo de 8 MB ou o limite de requisições de 300 requisições por minuto falharão. Erros de autenticação retornam status 401 se a chave for inválida. Quando o crédito pré-pago é esgotado, as requisições falham porque não há créditos restantes para cobrir o uso de tokens. Um status 429 indica esgotamento do limite de requisições.
Um limite rígido de conteúdo sempre se aplica: solicitações contendo conteúdo sexual envolvendo menores são bloqueadas, independentemente de outras configurações. Todo o outro conteúdo adulto lícito é processado sem recusa.
Especificações técnicas
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID do modelo | uncensored |
| Base URL | https://api.embeddingapis.com/v1 |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Modo JSON | response_format: {"type": "json_object"} |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamanho | até 8 MB por requisição |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Limite de taxa | 300 requisições por minuto por chave |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Validade | crédito pago não expira, sem assinatura |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Esta API suporta geração de embeddings?
Não. Esta API é um endpoint de chat de conclusão de texto. Ela não gera embeddings, imagens, áudio ou vídeo. Use-a para tarefas de geração de texto, como resumo ou extração.
Como o preço é calculado?
A precificação é baseada em crédito pré-pago pagamento por uso. Tokens de entrada custam $0,25 por 1M de tokens, e tokens de saída custam $1,00 por 1M de tokens. Os créditos não expiram.
O modelo é sem censura?
Sim, o modelo não recusa tópicos adultos lícitos, fictícios ou controversos. No entanto, conteúdo sexual envolvendo menores é sempre bloqueado.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.