EmbeddingApis/Docs
API di testo senza censura per la tua pipeline
Guida rapida API Embeddings
Usa questa guida per integrare la nostra API per chat senza censura nelle tue pipeline di elaborazione del testo. L'endpoint accetta formati standard OpenAI, permettendoti di generare testo, riassumere documenti o estrarre dati senza rifiuti sui contenuti.
Autenticazione
Accedi all'API utilizzando una chiave API unica generata dal tuo cruscotto account. Inserisci questa chiave nell'intestazione Authorization di ogni richiesta utilizzando lo schema Bearer. L'URL di base per tutti gli endpoint è https://api.embeddingapis.com/v1. Questo URL funziona con gli SDK ufficiali OpenAI e qualsiasi client configurato per servizi compatibili con OpenAI. Assicurati di mantenere la chiave al sicuro, poiché garantisce l'accesso ai tuoi crediti prepagati.
Ogni account è limitato a una chiave attiva, che può essere rigenerata in qualsiasi momento. La rigenerazione della chiave revoca immediatamente quella precedente, quindi aggiorna la tua configurazione tempestivamente.
L'endpoint Chat Completions
Invia prompt di testo all'endpoint POST /v1/chat/completions. L'API serve un singolo modello senza censura identificato dall'ID uncensored. Questo modello è un LLM a pesi aperti ottimizzato per rispondere senza rifiuti sui contenuti per argomenti adulti leciti, di fantasia o di ricerca sulla sicurezza. Elabora testo in input ed emette testo, rendendolo ideale per fasi di post-elaborazione, riassunto o estrazione nella tua pipeline.
Struttura la tua richiesta con un array messages contenente i tuoi prompt di sistema e utente. L'API restituisce una risposta JSON contenente il testo generato.
curl https://api.embeddingapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integrazione SDK Python
Usa la libreria ufficiale OpenAI Python per interagire con l'API. Imposta base_url sul nostro endpoint e fornisci la tua chiave API. Questo approccio ti permette di sfruttare il codice client esistente con modifiche minime. Il client gestisce la serializzazione e le richieste di rete, restituendo risposte strutturate che puoi analizzare per la logica della tua applicazione.
Assicurati di utilizzare una versione recente dell'SDK per supportare tutte le funzionalità, incluso lo streaming e la chiamata di funzioni. L'ID del modello rimane uncensored quando si invocano le completions.
from openai import OpenAI
client = OpenAI(base_url="https://api.embeddingapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integrazione SDK Node.js
Per ambienti JavaScript o TypeScript, usa l'SDK Node.js OpenAI. Configura il client con l'URL di base corretto e la chiave API. Questa configurazione garantisce la compatibilità con le tue pipeline Node esistenti. L'SDK gestisce la connessione all'endpoint POST /v1/chat/completions, permettendoti di inviare prompt e ricevere completamenti di testo in modo efficiente.
Questa integrazione è adatta per l'elaborazione del testo lato server, come la generazione di didascalie, script o l'estrazione di dati da grandi blocchi di testo.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.embeddingapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Risposte in streaming
Per applicazioni a bassa latenza, abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce uno stream Server-Sent Events (SSE), consegnando i token man mano che vengono generati. Questo è particolarmente utile per interfacce utente in tempo reale o quando si elaborano testi lunghi dove il feedback immediato è prezioso.
Analizza lo stream SSE per gestire le risposte parziali. Il modello senza censura supporta questa modalità, permettendoti di reagire ai contenuti man mano che vengono prodotti senza attendere il completamento intero.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti, errori e finestra di contesto
La finestra di contesto supporta 100.000 token per prompt e completazione combinati. Le richieste che superano il limite del corpo di 8 MB o il limite di richieste di 300 richieste al minuto falliranno. Gli errori di autenticazione restituiscono uno stato 401 se la chiave non è valida. Quando il credito prepagato è esaurito, le richieste falliscono perché non rimangono crediti per coprire l'utilizzo dei token. Uno stato 429 indica l'esaurimento del limite di richieste.
Si applica sempre un limite rigido sui contenuti: le richieste contenenti contenuti sessuali che coinvolgono minori sono bloccate, indipendentemente dalle altre impostazioni. Tutti gli altri contenuti adulti leciti vengono elaborati senza rifiuti.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID modello | uncensored |
| Base URL | https://api.embeddingapis.com/v1 |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Finestra di contesto | 100.000 token (input + output) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Modalità JSON | response_format: {"type": "json_object"} |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Bonus | +5% da $50, +10% da $100 |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Questa API supporta la generazione di embeddings?
No. Questa API è un endpoint per chat di testo. Non genera embeddings, immagini, audio o video. Usala per attività di generazione di testo come riassunti o estrazione.
Come viene calcolato il prezzo?
I prezzi si basano su credito prepagato con pagamento a consumo. I token di input costano $0,25 per 1M token, mentre i token di output costano $1,00 per 1M token. I crediti non scadono mai.
Il modello è senza censura?
Sì, il modello non rifiuta argomenti adulti leciti, di fantasia o controversi. Tuttavia, i contenuti sessuali che coinvolgono minori sono sempre bloccati.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, modifica l'URL di base. È tutta la configurazione.