PT ▾
Obter chave de API

EmbeddingApisDocumentação

API de texto sem censura para seu pipeline

Guia de Início Rápido da API de Embeddings

Use este guia para integrar nossa API de chat sem censura em seus pipelines de processamento de texto. O endpoint aceita formatos padrão da OpenAI, permitindo gerar texto, resumir documentos ou extrair dados sem recusas de conteúdo.

Autenticação

Acesse a API usando uma chave de API exclusiva gerada no painel da sua conta. Inclua esta chave no cabeçalho Authorization de cada requisição usando o esquema Bearer. A URL base para todos os endpoints é https://api.embeddingapis.com/v1. Esta URL funciona com os SDKs oficiais da OpenAI e qualquer cliente configurado para serviços compatíveis com OpenAI. Mantenha sua chave segura, pois ela concede acesso aos seus créditos pré-pagos.

Cada conta está limitada a uma chave ativa, que pode ser regenerada a qualquer momento. Regenerar a chave revoga imediatamente a anterior, então atualize sua configuração prontamente.

O Endpoint de Chat Completions

Envie prompts de texto para o endpoint POST /v1/chat/completions. A API oferece um único modelo sem censura identificado pelo ID uncensored. Este modelo é um LLM de pesos abertos ajustado para responder sem recusas de conteúdo para tópicos adultos lícitos, fictícios ou de pesquisa de segurança. Ele processa texto e gera texto, sendo ideal para etapas de pós-processamento, resumo ou extração em seu pipeline.

Estruture sua solicitação com uma matriz messages contendo seus prompts de sistema e usuário. A API retorna uma resposta JSON contendo o texto gerado.

curl https://api.embeddingapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integração com SDK Python

Use a biblioteca oficial OpenAI Python para interagir com a API. Defina o base_url para nosso endpoint e forneça sua chave de API. Esta abordagem permite aproveitar o código de cliente existente com alterações mínimas. O cliente gerencia a serialização e as solicitações de rede, retornando respostas estruturadas que você pode analisar para a lógica do seu aplicativo.

Certifique-se de estar usando uma versão recente do SDK para suportar todos os recursos, incluindo streaming e chamada de ferramentas. O ID do modelo permanece uncensored ao invocar as conclusões.

from openai import OpenAI

client = OpenAI(base_url="https://api.embeddingapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integração com SDK Node.js

Para ambientes JavaScript ou TypeScript, use o SDK Node.js da OpenAI. Configure o cliente com a URL base e a chave de API corretas. Esta configuração garante compatibilidade com seus pipelines existentes baseados em Node. O SDK gerencia a conexão com o endpoint POST /v1/chat/completions, permitindo enviar prompts e receber conclusões de texto de forma eficiente.

Esta integração é adequada para processamento de texto no lado do servidor, como geração de legendas, roteiros ou extração de dados de grandes blocos de texto.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.embeddingapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Respostas em Streaming

Para aplicativos de baixa latência, ative o streaming definindo stream: true em sua solicitação. A API retorna um stream de Server-Sent Events (SSE), entregando tokens conforme são gerados. Isso é particularmente útil para interfaces de usuário em tempo real ou ao processar textos longos onde o feedback imediato é valioso.

Analise o stream SSE para lidar com respostas parciais. O modelo sem censura suporta este modo, permitindo que você reaja ao conteúdo conforme é produzido sem aguardar a conclusão inteira.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites, Erros e Janela de Contexto

A janela de contexto suporta 100.000 tokens para prompt e conclusão combinados. Requisições que excedam o limite de corpo de 8 MB ou o limite de requisições de 300 requisições por minuto falharão. Erros de autenticação retornam status 401 se a chave for inválida. Quando o crédito pré-pago é esgotado, as requisições falham porque não há créditos restantes para cobrir o uso de tokens. Um status 429 indica esgotamento do limite de requisições.

Um limite rígido de conteúdo sempre se aplica: solicitações contendo conteúdo sexual envolvendo menores são bloqueadas, independentemente de outras configurações. Todo o outro conteúdo adulto lícito é processado sem recusa.

Especificações técnicas

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
AutenticaçãoAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
ID do modelouncensored
Base URLhttps://api.embeddingapis.com/v1
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Janela de contexto100.000 tokens (entrada + saída)
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Modo JSONresponse_format: {"type": "json_object"}
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamanhoaté 8 MB por requisição
Concorrência8 requisições ao mesmo tempo por chave
Limite de taxa300 requisições por minuto por chave
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Validadecrédito pago não expira, sem assinatura
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Bônus+5% a partir de $50, +10% a partir de $100
LoginGoogle ou e-mail e senha
Chavesuma chave ativa por conta; uma nova substitui a anterior
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Esta API suporta geração de embeddings?

Não. Esta API é um endpoint de chat de conclusão de texto. Ela não gera embeddings, imagens, áudio ou vídeo. Use-a para tarefas de geração de texto, como resumo ou extração.

Como o preço é calculado?

A precificação é baseada em crédito pré-pago pagamento por uso. Tokens de entrada custam $0,25 por 1M de tokens, e tokens de saída custam $1,00 por 1M de tokens. Os créditos não expiram.

O modelo é sem censura?

Sim, o modelo não recusa tópicos adultos lícitos, fictícios ou controversos. No entanto, conteúdo sexual envolvendo menores é sempre bloqueado.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de APILer a documentação