EmbeddingApis/Docs
API de texte sans censure pour votre pipeline
Guide de démarrage rapide de l'API Embeddings
Utilisez ce guide pour intégrer notre API de chat sans censure dans vos pipelines de traitement de texte. L'endpoint accepte les formats OpenAI standards, vous permettant de générer du texte, de résumer des documents ou d'extraire des données sans refus de contenu.
Authentification
Accédez à l'API en utilisant une clé API unique générée depuis votre tableau de bord. Incluez cette clé dans l'en-tête Authorization de chaque requête en utilisant le schéma Bearer. L'URL de base pour tous les endpoints est https://api.embeddingapis.com/v1. Cette URL fonctionne avec les SDK officiels OpenAI et tout client configuré pour des services compatibles OpenAI. Assurez-vous de conserver votre clé en sécurité, car elle donne accès à vos crédits prépayés.
Chaque compte est limité à une clé active, qui peut être régénérée à tout moment. La régénération de la clé révoque immédiatement l'ancienne, donc mettez à jour votre configuration rapidement.
L'endpoint Chat Completions
Envoyez des prompts texte à l’endpoint POST /v1/chat/completions. L’API sert un seul modèle sans censure identifié par l’ID uncensored. Ce modèle est un LLM à poids ouverts ajusté pour répondre sans refus de contenu pour les sujets adultes légaux, fictifs ou liés à la recherche en sécurité. Il traite du texte en entrée et produit du texte en sortie, ce qui le rend idéal pour le post-traitement, le résumé ou l’extraction dans votre pipeline.
Structurez votre requête avec un tableau messages contenant vos prompts système et utilisateur. L'API retourne une réponse JSON contenant le texte généré.
curl https://api.embeddingapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Intégration SDK Python
Utilisez la bibliothèque Python officielle OpenAI pour interagir avec l'API. Définissez le base_url sur notre endpoint et fournissez votre clé API. Cette approche vous permet de tirer parti du code client existant avec des modifications minimales. Le client gère la sérialisation et les requêtes réseau, retournant des réponses structurées que vous pouvez analyser pour la logique de votre application.
Assurez-vous d’utiliser une version récente du SDK pour prendre en charge toutes les fonctionnalités, y compris le streaming et l’appel de fonctions. L’ID du modèle reste uncensored lors de l’appel des complétions.
from openai import OpenAI
client = OpenAI(base_url="https://api.embeddingapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Intégration SDK Node.js
Pour les environnements JavaScript ou TypeScript, utilisez le SDK Node.js OpenAI. Configurez le client avec la bonne URL de base et la clé API. Cette configuration assure la compatibilité avec vos pipelines existants basés sur Node. Le SDK gère la connexion à l'endpoint POST /v1/chat/completions, vous permettant d'envoyer des prompts et de recevoir des complétions textuelles efficacement.
Cette intégration convient au traitement de texte côté serveur, comme la génération de légendes, de scripts ou l'extraction de données à partir de gros blocs de texte.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.embeddingapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Réponses en streaming
Pour les applications à faible latence, activez le streaming en définissant stream: true dans votre requête. L'API retourne un flux Server-Sent Events (SSE), délivrant les tokens au fur et à mesure de leur génération. Ceci est particulièrement utile pour les interfaces utilisateur en temps réel ou lors du traitement de longs textes où un retour immédiat est précieux.
Analysez le flux SSE pour gérer les réponses partielles. Le modèle sans censure supporte ce mode, vous permettant de réagir au contenu au fur et à mesure de sa production sans attendre la complétion entière.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limites, erreurs et fenêtre de contexte
La fenêtre de contexte prend en charge 100 000 tokens pour le prompt et la complétion combinés. Les requêtes dépassant la limite de corps de 8 Mo ou la limite de débit de 300 requêtes par minute échoueront. Les erreurs d’authentification renverront un statut 401 si la clé est invalide. Lorsque le crédit prépayé est épuisé, les requêtes échouent car il ne reste plus de crédits pour couvrir l’utilisation des tokens. Un statut 429 indique l’épuisement de la limite de débit.
Une limite de contenu stricte s'applique toujours : les requêtes contenant du contenu sexuel impliquant des mineurs sont bloquées, indépendamment des autres paramètres. Tout autre contenu adulte légal est traité sans refus.
Caractéristiques techniques
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Base URL | https://api.embeddingapis.com/v1 |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Taille | jusqu'à 8 Mo par requête |
| Concurrence | 8 requêtes simultanées par clé |
| Limite de débit | 300 requêtes par minute et par clé |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Cette API prend-elle en charge la génération d'embeddings ?
Non. Cette API est un endpoint de chat completions textuel. Elle ne génère pas d'embeddings, d'images, d'audio ou de vidéo. Utilisez-la pour des tâches de génération de texte comme la résumation ou l'extraction.
Comment est calculé le prix ?
La tarification est basée sur le crédit prépayé paiement à l'usage. Les tokens d’entrée coûtent $0,25 par 1M tokens, et les tokens de sortie coûtent $1,00 par 1M tokens. Les crédits n’expirent jamais.
Le modèle est-il sans censure ?
Oui, le modèle n’accepte pas les refus pour les sujets adultes légaux, fictifs ou controversés. Cependant, le contenu sexuel impliquant des mineurs est toujours bloqué.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.