EmbeddingApis/Precios
API de texto sin censura para tu pipeline
API de embeddings: Precios de pago por uso
Precios transparentes basados en el uso para nuestra API de texto sin censura. Carga créditos prepago y paga solo por los tokens que procese tu pipeline, sin suscripciones ni tarifas ocultas.
Sin suscripción. El crédito prepago no caduca.
Calculadora de costes
Ejemplos prácticos
Resumen por lotes de 500 documentos cortos
Procesar 500 documentos con un promedio de 4.000 tokens de entrada cada uno (2.000.000 de tokens de entrada en total) y generar resúmenes de 200 tokens (100.000 tokens de salida en total). Costo: (2.000.000 / 1.000.000) × $0,25 + (100.000 / 1.000.000) × $1,00 = $0,50 + $0,10 = $0,60 en total.
Extracción en tiempo real desde un contexto largo
Enviar un documento de 30.000 tokens para extracción de clave-valor, lo que genera una salida de 500 tokens. Costo: (30.000 / 1.000.000) × $0,25 + (500 / 1.000.000) × $1,00 = $0,0075 + $0,0005 = $0,008 (menos de un centavo).
Completados de chat de alto volumen
Gestionar 10.000 peticiones de chat, cada una con 2.000 tokens de entrada y 150 tokens de salida. Total de entrada: 20.000.000 tokens. Total de salida: 1.500.000 tokens. Costo: (20.000.000 / 1.000.000) × $0,25 + (1.500.000 / 1.000.000) × $1,00 = $5,00 + $1,50 = $6,50.
Tarifas por token
Nuestros precios son estrictamente por token, reflejando los recursos de cómputo reales consumidos por nuestro modelo de lenguaje grande sin censura. Los tokens de entrada se cobran a $0,25 por cada 1 millón de tokens, mientras que los tokens de salida se cobran a $1,00 por cada 1 millón de tokens. Esta estructura de tarifas se aplica a todas las peticiones realizadas al endpoint /v1/chat/completions, incluyendo aquellas que usan streaming (SSE) o modos de llamadas a funciones/herramientas. Como no cobramos por embeddings, audio o generación de video, solo pagas por el procesamiento de texto que requiera tu pipeline. La ventana de contexto de 100.000 tokens permite datos de entrada sustanciales sin incurrir en costos desproporcionados, haciendo este modelo adecuado tanto para tareas de extracción ligeras como para cargas de trabajo de resumen intensivas.
Créditos prepago
Operamos con un sistema de créditos prepago sin suscripciones mensuales ni tarifas recurrentes. Recargas el saldo de tu cuenta usando criptomonedas (USDT o USDC) y esos fondos cubren el uso de tokens. Este modelo asegura que tu gasto esté estrictamente acotado por el crédito que cargas; el uso nunca puede exceder tu saldo disponible, proporcionando un control de costos predecible para tus pipelines RAG o agentes de IA. No hay expiración en tus créditos pagados, por lo que puedes recargar cuando sea conveniente y usar los créditos durante cualquier período. Este enfoque elimina el riesgo de facturas sorpresa por picos de tráfico inesperados, ya que cada petición deduce el costo exacto de tokens de tu saldo en tiempo real.
Créditos bonus
Para recompensar a los usuarios de alto volumen, ofrecemos créditos bonus en recargas mayores. Cuando cargas $50 o más, recibes un bonus del 5% añadido a tu saldo. Para recargas de $100 o más, el bonus aumenta a 10%. Estos créditos bonus se aplican inmediatamente a tu cuenta y pueden usarse para el consumo de tokens igual que tus créditos base. Esto reduce efectivamente tu costo por token para proyectos más grandes, proporcionando mejor valor para pipelines de procesamiento de texto intensivos. Los créditos bonus no caducan, permitiéndote aprovechar volúmenes más altos durante picos de desarrollo o producción sin un compromiso inicial adicional.
Qué incluye tu crédito
Mismo precio para todo: las llamadas a funciones y el modo JSON no cuestan más.
| Elemento | Valor |
|---|---|
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Modo JSON | response_format: {"type": "json_object"} |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Concurrencia | 8 peticiones a la vez por clave |
| Límite de peticiones | 300 por minuto por clave |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Bono | +5 % desde $50, +10 % desde $100 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
Las especificaciones completas y los códigos de error están en la documentación.
Preguntas y respuestas
¿Necesito una tarjeta de crédito para empezar?
No. Cada cuenta nueva recibe $0,50 de crédito de prueba válido por 7 días, requiriendo solo un correo y contraseña. Puedes usar este crédito para probar la API sin añadir un método de pago ni pasar por verificación.
¿Cuáles son los límites de peticiones?
Tienes un límite de 300 peticiones por minuto por clave de API y un cuerpo de petición de 8 MB. Estos límites se aplican al endpoint <code>/v1/chat/completions</code> y ayudan a garantizar un rendimiento estable en nuestros servidores GPU.
¿En qué difiere el precio del modelo sin censura?
El precio es idéntico para todos los tipos de contenido, ya sea generando texto estándar, resumiendo documentos o usando el modelo para temas adultos legales o controversiales. No hay recargos por categorías de contenido o modos de uso específicos.
¿Caducan los créditos prepago?
Los créditos pagados nunca caducan. Solo el crédito de prueba de $0,50 tiene un período de validez de 7 días. Puedes recargar tu cuenta en cualquier momento y los créditos permanecen disponibles hasta que se consuman.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.