ES ▾
Obtener clave de API

EmbeddingApisDocs

API de texto sin censura para tu pipeline

Guía de inicio rápido de la API de embeddings

Usa esta guía para integrar nuestra API de chat sin censura en tus pipelines de procesamiento de texto. El endpoint acepta formatos estándar de OpenAI, lo que te permite generar texto, resumir documentos o extraer datos sin rechazos por contenido.

Autenticación

Accede a la API con una clave de API única generada en tu panel de cuenta. Incluye esta clave en el encabezado Authorization de cada petición usando el esquema Bearer. La URL base para todos los endpoints es https://api.embeddingapis.com/v1. Esta URL funciona con los SDK oficiales de OpenAI y cualquier cliente configurado para servicios compatibles con OpenAI. Asegúrate de mantener tu clave segura, ya que otorga acceso a tus créditos prepago.

Cada cuenta está limitada a una clave activa, la cual se puede regenerar en cualquier momento. Regenerar la clave revoca inmediatamente la anterior, así que actualiza tu configuración rápidamente.

El endpoint de Chat Completions

Envía prompts de texto al endpoint POST /v1/chat/completions. La API sirve un único modelo sin censura identificado por el ID uncensored. Este modelo es un LLM de pesos abiertos ajustado para responder sin rechazos de contenido para temas adultos, ficticios o de investigación de seguridad. Procesa texto y genera texto, lo que lo hace ideal para pasos de postprocesamiento, resumen o extracción en tu pipeline.

Estructura tu petición con un array messages que contenga tus prompts de sistema y usuario. La API devuelve una respuesta JSON que contiene el texto generado.

curl https://api.embeddingapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Integración con SDK de Python

Usa la biblioteca oficial de OpenAI para Python para interactuar con la API. Establece el base_url a nuestro endpoint y proporciona tu clave de API. Este enfoque te permite aprovechar el código de cliente existente con cambios mínimos. El cliente maneja la serialización y las peticiones de red, devolviendo respuestas estructuradas que puedes analizar para la lógica de tu aplicación.

Asegúrate de usar una versión reciente del SDK para admitir todas las funciones, incluido el streaming y las llamadas a funciones. El ID del modelo sigue siendo uncensored al invocar completions.

from openai import OpenAI

client = OpenAI(base_url="https://api.embeddingapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Integración con SDK de Node.js

Para entornos JavaScript o TypeScript, usa el SDK de Node.js de OpenAI. Configura el cliente con la URL base y la clave de API correctas. Esta configuración garantiza la compatibilidad con tus pipelines existentes basados en Node. El SDK gestiona la conexión al endpoint POST /v1/chat/completions, permitiéndote enviar prompts y recibir completions de texto de manera eficiente.

Esta integración es adecuada para el procesamiento de texto en el lado del servidor, como generar subtítulos, guiones o extraer datos de bloques grandes de texto.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.embeddingapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Respuestas en streaming

Para aplicaciones de baja latencia, habilita el streaming estableciendo stream: true en tu petición. La API devuelve un flujo de Server-Sent Events (SSE), entregando tokens a medida que se generan. Esto es especialmente útil para interfaces de usuario en tiempo real o al procesar textos largos donde el feedback inmediato es valioso.

Analiza el flujo SSE para manejar respuestas parciales. El modelo sin censura admite este modo, permitiéndote reaccionar al contenido a medida que se produce sin esperar a la finalización completa.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Límites, errores y ventana de contexto

La ventana de contexto admite 100.000 tokens para prompt y completion combinados. Las peticiones que excedan el límite de cuerpo de 8 MB o el límite de peticiones de 300 por minuto fallarán. Los errores de autenticación devuelven un estado 401 si la clave no es válida. Cuando se agota el crédito prepago, las peticiones fallan porque no quedan créditos para cubrir el uso de tokens. Un estado 429 indica agotamiento del límite de peticiones.

Se aplica siempre un límite estricto de contenido: las peticiones que contengan contenido sexual que involucre a menores se bloquean, independientemente de otra configuración. Todo el contenido adulto legal se procesa sin rechazos.

Especificaciones técnicas

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
AutenticaciónAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
ID del modelouncensored
Base URLhttps://api.embeddingapis.com/v1
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Ventana de contexto100.000 tokens (entrada + salida)
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Modo JSONresponse_format: {"type": "json_object"}
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamaño de peticiónhasta 8 MB
Concurrencia8 peticiones a la vez por clave
Límite de peticiones300 por minuto por clave
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Caducidadel crédito pagado no caduca, sin suscripción
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Bono+5 % desde $50, +10 % desde $100
AccesoGoogle o correo y contraseña
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Esta API admite la generación de embeddings?

No. Esta API es un endpoint de chat-completions de texto. No genera embeddings, imágenes, audio ni video. Úsalo para tareas de generación de texto como resumen o extracción.

¿Cómo se calcula la tarifa?

La tarifa es de pago por uso con crédito prepago. Los tokens de entrada cuestan $0.25 por 1M de tokens y los de salida $1.00 por 1M. Los créditos no caducan.

¿El modelo es sin censura?

Sí, el modelo no rechaza temas adultos legales, ficticios o controvertidos. Sin embargo, el contenido sexual que involucre a menores siempre se bloquea.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave y cambia la URL base. Esa es toda la configuración.

Obtener clave de APILeer los docs