FR ▾
Obtenir une clé API

EmbeddingApisDocs

API de texte sans censure pour votre pipeline

Guide de démarrage rapide de l'API Embeddings

Utilisez ce guide pour intégrer notre API de chat sans censure dans vos pipelines de traitement de texte. L'endpoint accepte les formats OpenAI standards, vous permettant de générer du texte, de résumer des documents ou d'extraire des données sans refus de contenu.

Authentification

Accédez à l'API en utilisant une clé API unique générée depuis votre tableau de bord. Incluez cette clé dans l'en-tête Authorization de chaque requête en utilisant le schéma Bearer. L'URL de base pour tous les endpoints est https://api.embeddingapis.com/v1. Cette URL fonctionne avec les SDK officiels OpenAI et tout client configuré pour des services compatibles OpenAI. Assurez-vous de conserver votre clé en sécurité, car elle donne accès à vos crédits prépayés.

Chaque compte est limité à une clé active, qui peut être régénérée à tout moment. La régénération de la clé révoque immédiatement l'ancienne, donc mettez à jour votre configuration rapidement.

L'endpoint Chat Completions

Envoyez des prompts texte à l’endpoint POST /v1/chat/completions. L’API sert un seul modèle sans censure identifié par l’ID uncensored. Ce modèle est un LLM à poids ouverts ajusté pour répondre sans refus de contenu pour les sujets adultes légaux, fictifs ou liés à la recherche en sécurité. Il traite du texte en entrée et produit du texte en sortie, ce qui le rend idéal pour le post-traitement, le résumé ou l’extraction dans votre pipeline.

Structurez votre requête avec un tableau messages contenant vos prompts système et utilisateur. L'API retourne une réponse JSON contenant le texte généré.

curl https://api.embeddingapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Intégration SDK Python

Utilisez la bibliothèque Python officielle OpenAI pour interagir avec l'API. Définissez le base_url sur notre endpoint et fournissez votre clé API. Cette approche vous permet de tirer parti du code client existant avec des modifications minimales. Le client gère la sérialisation et les requêtes réseau, retournant des réponses structurées que vous pouvez analyser pour la logique de votre application.

Assurez-vous d’utiliser une version récente du SDK pour prendre en charge toutes les fonctionnalités, y compris le streaming et l’appel de fonctions. L’ID du modèle reste uncensored lors de l’appel des complétions.

from openai import OpenAI

client = OpenAI(base_url="https://api.embeddingapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Intégration SDK Node.js

Pour les environnements JavaScript ou TypeScript, utilisez le SDK Node.js OpenAI. Configurez le client avec la bonne URL de base et la clé API. Cette configuration assure la compatibilité avec vos pipelines existants basés sur Node. Le SDK gère la connexion à l'endpoint POST /v1/chat/completions, vous permettant d'envoyer des prompts et de recevoir des complétions textuelles efficacement.

Cette intégration convient au traitement de texte côté serveur, comme la génération de légendes, de scripts ou l'extraction de données à partir de gros blocs de texte.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.embeddingapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Réponses en streaming

Pour les applications à faible latence, activez le streaming en définissant stream: true dans votre requête. L'API retourne un flux Server-Sent Events (SSE), délivrant les tokens au fur et à mesure de leur génération. Ceci est particulièrement utile pour les interfaces utilisateur en temps réel ou lors du traitement de longs textes où un retour immédiat est précieux.

Analysez le flux SSE pour gérer les réponses partielles. Le modèle sans censure supporte ce mode, vous permettant de réagir au contenu au fur et à mesure de sa production sans attendre la complétion entière.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites, erreurs et fenêtre de contexte

La fenêtre de contexte prend en charge 100 000 tokens pour le prompt et la complétion combinés. Les requêtes dépassant la limite de corps de 8 Mo ou la limite de débit de 300 requêtes par minute échoueront. Les erreurs d’authentification renverront un statut 401 si la clé est invalide. Lorsque le crédit prépayé est épuisé, les requêtes échouent car il ne reste plus de crédits pour couvrir l’utilisation des tokens. Un statut 429 indique l’épuisement de la limite de débit.

Une limite de contenu stricte s'applique toujours : les requêtes contenant du contenu sexuel impliquant des mineurs sont bloquées, indépendamment des autres paramètres. Tout autre contenu adulte légal est traité sans refus.

Caractéristiques techniques

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
AuthentificationAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
ID du modèleuncensored
Base URLhttps://api.embeddingapis.com/v1
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Fenêtre de contexte100 000 tokens (entrée + sortie)
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Mode JSONresponse_format: {"type": "json_object"}
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Taillejusqu'à 8 Mo par requête
Concurrence8 requêtes simultanées par clé
Limite de débit300 requêtes par minute et par clé
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Validitéle crédit payé n'expire jamais, sans abonnement
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Bonus+5 % dès 50 $, +10 % dès 100 $
ConnexionGoogle ou e-mail et mot de passe
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Cette API prend-elle en charge la génération d'embeddings ?

Non. Cette API est un endpoint de chat completions textuel. Elle ne génère pas d'embeddings, d'images, d'audio ou de vidéo. Utilisez-la pour des tâches de génération de texte comme la résumation ou l'extraction.

Comment est calculé le prix ?

La tarification est basée sur le crédit prépayé paiement à l'usage. Les tokens d’entrée coûtent $0,25 par 1M tokens, et les tokens de sortie coûtent $1,00 par 1M tokens. Les crédits n’expirent jamais.

Le modèle est-il sans censure ?

Oui, le modèle n’accepte pas les refus pour les sujets adultes légaux, fictifs ou controversés. Cependant, le contenu sexuel impliquant des mineurs est toujours bloqué.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir clé APILire la documentation