EmbeddingApis/Pricing
API testo senza censura per la tua pipeline
API Embeddings: Prezzi trasparenti a consumo
Prezzi trasparenti e basati sull'uso per la nostra API testo senza censura. Carica crediti prepagati e paga solo per i token elaborati dalla tua pipeline, senza abbonamenti o costi nascosti.
Nessun abbonamento. Il credito prepagato non scade mai.
Calcolatore dei costi
Esempi di calcolo
Riepilogo in batch di 500 documenti brevi
Elaborazione di 500 documenti con una media di 4.000 token di input ciascuno (2.000.000 token di input totali) e generazione di riepiloghi da 200 token (100.000 token di output totali). Costo: (2.000.000 / 1.000.000) × $0,25 + (100.000 / 1.000.000) × $1,00 = $0,50 + $0,10 = $0,60 totali.
Estrazione in tempo reale da un unico contesto lungo
Invio di un documento da 30.000 token per l'estrazione di coppie chiave-valore che produce un output da 500 token. Costo: (30.000 / 1.000.000) × $0,25 + (500 / 1.000.000) × $1,00 = $0,0075 + $0,0005 = $0,008 (meno di un centesimo).
Completamenti chat ad alto volume
Gestione di 10.000 richieste chat, ciascuna con 2.000 token in input e 150 token in output. Input totale: 20.000.000 token. Output totale: 1.500.000 token. Costo: (20.000.000 / 1.000.000) × $0,25 + (1.500.000 / 1.000.000) × $1,00 = $5,00 + $1,50 = $6,50.
Tariffe per token
I nostri prezzi sono strettamente per token, riflettendo le effettive risorse di calcolo consumate dal nostro modello linguistico di grandi dimensioni senza censura. I token in input sono fatturati a $0,25 per 1 milione di token, mentre i token in output sono fatturati a $1,00 per 1 milione di token. Questa struttura tariffaria si applica a tutte le richieste effettuate all'endpoint /v1/chat/completions, incluse quelle che utilizzano modalità streaming (SSE) o chiamata di funzioni/tool. Poiché non addebitiamo per embeddings, audio o generazione video, paghi solo per l'elaborazione del testo che la tua pipeline richiede. La finestra di contesto da 100.000 token consente input di dati sostanziosi senza costi sproporzionati, rendendo questo modello adatto sia per attività di estrazione leggere che per carichi di lavoro di riassunto intensivi.
Crediti prepagati
Operiamo con un sistema di credito prepagato senza abbonamenti mensili o costi ricorrenti. Ricarichi il saldo del tuo account utilizzando criptovalute (USDT o USDC) e questi fondi coprono l'utilizzo dei tuoi token. Questo modello garantisce che la tua spesa sia strettamente limitata dal credito che carichi; l'utilizzo non può mai superare il tuo saldo disponibile, offrendo un controllo dei costi prevedibile per le tue pipeline RAG o agenti AI. Il tuo credito pagato non scade mai, quindi puoi ricaricare quando è più comodo e utilizzare il credito in qualsiasi arco temporale. Questo approccio elimina il rischio di bollette inaspettate dovute a picchi di traffico imprevisti, poiché ogni richiesta detrarre il costo esatto dei token dal tuo saldo in tempo reale.
Crediti bonus
Per premiare gli utenti con volumi elevati, offriamo crediti bonus per ricariche di importo superiore. Quando ricarichi 50 $ o più, ricevi un bonus del 5% aggiunto al tuo saldo. Per ricariche di 100 $ o più, il bonus aumenta al 10%. Questi crediti bonus vengono applicati immediatamente al tuo account e possono essere utilizzati per il consumo di token proprio come i crediti base. Questo abbassa efficacemente il costo per token per progetti di maggiori dimensioni, offrendo un valore migliore per pipeline di elaborazione del testo intensive. I crediti bonus non scadono, consentendoti di sfruttare volumi più elevati durante i picchi di sviluppo o produzione senza ulteriori impegni anticipati.
Limiti e cosa è incluso
Stesso prezzo per tutto: function calling e modalità JSON senza costi extra.
| Voce | Valore |
|---|---|
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Finestra di contesto | 100.000 token (input + output) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Bonus | +5% da $50, +10% da $100 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
Specifiche complete e codici di errore nella documentazione.
Domande e risposte
Serve una carta di credito per iniziare?
No. Ogni nuovo account riceve $0,50 di credito di prova valido per 7 giorni, richiedendo solo un'email e una password. Puoi utilizzare questo credito di prova per testare l'API senza aggiungere un metodo di pagamento o sottoporsi alla verifica.
Quali sono i limiti di richiesta?
Il limite è di 300 richieste al minuto per chiave API e un corpo della richiesta di 8 MB. Questi limiti si applicano all'endpoint <code>/v1/chat/completions</code> e aiutano a garantire prestazioni stabili sui nostri server GPU.
Come differisce il prezzo del modello senza censura?
Il prezzo è identico per tutti i tipi di contenuto, che tu stia generando testo standard, riassumendo documenti o utilizzando il modello per argomenti adulti leciti o controversi. Non ci sono sovrapprezzi per categorie di contenuto o modalità di utilizzo specifiche.
I crediti prepagati scadono?
I crediti pagati non scadono mai. Solo il credito di prova da $0,50 ha un periodo di validità di 7 giorni. Puoi ricaricare il tuo account in qualsiasi momento e i crediti rimangono disponibili per l'uso fino al consumo.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.