ES ▾
Obtener clave de API

EmbeddingApisPrecios

API de texto sin censura para tu pipeline

API de embeddings: Precios de pago por uso

Precios transparentes basados en el uso para nuestra API de texto sin censura. Carga créditos prepago y paga solo por los tokens que procese tu pipeline, sin suscripciones ni tarifas ocultas.

Sin suscripción. El crédito prepago no caduca.

$0,25por 1M tokens de entrada
$1,00Tokens de salida / 1M
100.000ventana de contexto
$0,50crédito de prueba
300peticiones por minuto

Calculadora de costes

$0.00

Ejemplos prácticos

  1. Resumen por lotes de 500 documentos cortos

    Procesar 500 documentos con un promedio de 4.000 tokens de entrada cada uno (2.000.000 de tokens de entrada en total) y generar resúmenes de 200 tokens (100.000 tokens de salida en total). Costo: (2.000.000 / 1.000.000) × $0,25 + (100.000 / 1.000.000) × $1,00 = $0,50 + $0,10 = $0,60 en total.

  2. Extracción en tiempo real desde un contexto largo

    Enviar un documento de 30.000 tokens para extracción de clave-valor, lo que genera una salida de 500 tokens. Costo: (30.000 / 1.000.000) × $0,25 + (500 / 1.000.000) × $1,00 = $0,0075 + $0,0005 = $0,008 (menos de un centavo).

  3. Completados de chat de alto volumen

    Gestionar 10.000 peticiones de chat, cada una con 2.000 tokens de entrada y 150 tokens de salida. Total de entrada: 20.000.000 tokens. Total de salida: 1.500.000 tokens. Costo: (20.000.000 / 1.000.000) × $0,25 + (1.500.000 / 1.000.000) × $1,00 = $5,00 + $1,50 = $6,50.

Tarifas por token

Nuestros precios son estrictamente por token, reflejando los recursos de cómputo reales consumidos por nuestro modelo de lenguaje grande sin censura. Los tokens de entrada se cobran a $0,25 por cada 1 millón de tokens, mientras que los tokens de salida se cobran a $1,00 por cada 1 millón de tokens. Esta estructura de tarifas se aplica a todas las peticiones realizadas al endpoint /v1/chat/completions, incluyendo aquellas que usan streaming (SSE) o modos de llamadas a funciones/herramientas. Como no cobramos por embeddings, audio o generación de video, solo pagas por el procesamiento de texto que requiera tu pipeline. La ventana de contexto de 100.000 tokens permite datos de entrada sustanciales sin incurrir en costos desproporcionados, haciendo este modelo adecuado tanto para tareas de extracción ligeras como para cargas de trabajo de resumen intensivas.

Créditos prepago

Operamos con un sistema de créditos prepago sin suscripciones mensuales ni tarifas recurrentes. Recargas el saldo de tu cuenta usando criptomonedas (USDT o USDC) y esos fondos cubren el uso de tokens. Este modelo asegura que tu gasto esté estrictamente acotado por el crédito que cargas; el uso nunca puede exceder tu saldo disponible, proporcionando un control de costos predecible para tus pipelines RAG o agentes de IA. No hay expiración en tus créditos pagados, por lo que puedes recargar cuando sea conveniente y usar los créditos durante cualquier período. Este enfoque elimina el riesgo de facturas sorpresa por picos de tráfico inesperados, ya que cada petición deduce el costo exacto de tokens de tu saldo en tiempo real.

Créditos bonus

Para recompensar a los usuarios de alto volumen, ofrecemos créditos bonus en recargas mayores. Cuando cargas $50 o más, recibes un bonus del 5% añadido a tu saldo. Para recargas de $100 o más, el bonus aumenta a 10%. Estos créditos bonus se aplican inmediatamente a tu cuenta y pueden usarse para el consumo de tokens igual que tus créditos base. Esto reduce efectivamente tu costo por token para proyectos más grandes, proporcionando mejor valor para pipelines de procesamiento de texto intensivos. Los créditos bonus no caducan, permitiéndote aprovechar volúmenes más altos durante picos de desarrollo o producción sin un compromiso inicial adicional.

Qué incluye tu crédito

Mismo precio para todo: las llamadas a funciones y el modo JSON no cuestan más.

ElementoValor
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Ventana de contexto100.000 tokens (entrada + salida)
Modo JSONresponse_format: {"type": "json_object"}
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Concurrencia8 peticiones a la vez por clave
Límite de peticiones300 por minuto por clave
Caducidadel crédito pagado no caduca, sin suscripción
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Bono+5 % desde $50, +10 % desde $100
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga

Las especificaciones completas y los códigos de error están en la documentación.

Preguntas y respuestas

¿Necesito una tarjeta de crédito para empezar?

No. Cada cuenta nueva recibe $0,50 de crédito de prueba válido por 7 días, requiriendo solo un correo y contraseña. Puedes usar este crédito para probar la API sin añadir un método de pago ni pasar por verificación.

¿Cuáles son los límites de peticiones?

Tienes un límite de 300 peticiones por minuto por clave de API y un cuerpo de petición de 8 MB. Estos límites se aplican al endpoint <code>/v1/chat/completions</code> y ayudan a garantizar un rendimiento estable en nuestros servidores GPU.

¿En qué difiere el precio del modelo sin censura?

El precio es idéntico para todos los tipos de contenido, ya sea generando texto estándar, resumiendo documentos o usando el modelo para temas adultos legales o controversiales. No hay recargos por categorías de contenido o modos de uso específicos.

¿Caducan los créditos prepago?

Los créditos pagados nunca caducan. Solo el crédito de prueba de $0,50 tiene un período de validez de 7 días. Puedes recargar tu cuenta en cualquier momento y los créditos permanecen disponibles hasta que se consuman.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de APILeer la documentación