DE ▾
API-Schlüssel erhalten

EmbeddingApisDokumentation

Unzensierte Text-API für deine Pipeline

Schnellstart-Guide für Embeddings-API

Nutze diese Anleitung, um unsere unzensierte Chat-Completions-API in deine Textverarbeitungs-Pipelines zu integrieren. Der Endpunkt akzeptiert Standard-OpenAI-Formate, sodass du Text generieren, Dokumente zusammenfassen oder Daten extrahieren kannst, ohne dass Inhalte abgelehnt werden.

Authentifizierung

Greife auf die API über einen eindeutigen API-Schlüssel zu, den du in deinem Kontodashboard generierst. Füge diesen Schlüssel in den Authorization-Header jeder Anfrage mit dem Bearer-Schema ein. Die Basis-URL für alle Endpunkte ist https://api.embeddingapis.com/v1. Diese URL funktioniert mit den offiziellen OpenAI-SDKs und jedem Client, der für OpenAI-kompatible Dienste konfiguriert ist. Halte deinen Schlüssel sicher aufbewahrt, da er Zugriff auf dein Prepaid-Guthaben gewährt.

Jedes Konto ist auf einen aktiven Schlüssel beschränkt, der jederzeit neu generiert werden kann. Durch das Neuerstellen wird der vorherige Schlüssel sofort ungültig, aktualisieren Sie daher Ihre Konfiguration zeitnah.

Der Chat-Vervollständigungs-Endpunkt

Sende Text-Prompts an den POST /v1/chat/completions-Endpunkt. Die API bietet ein einzelnes unzensiertes Modell an, das durch die ID uncensored identifiziert wird. Dieses Modell ist ein Open-Weight-LLM, das darauf abgestimmt ist, auf legale erwachsene, fiktive oder sicherheitsrelevante Themen ohne Inhaltsablehnung zu antworten. Es verarbeitet Text und gibt Text aus, was es ideal für Nachbearbeitungs-, Zusammenfassungs- oder Extraktionsschritte in deiner Pipeline macht.

Strukturiere deine Anfrage mit einem messages-Array, das deine System- und User-Prompts enthält. Die API gibt eine JSON-Antwort mit dem generierten Text zurück.

curl https://api.embeddingapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK-Integration

Nutze die offizielle OpenAI Python-Bibliothek, um mit der API zu interagieren. Setze die base_url auf unseren Endpunkt und gib deinen API-Schlüssel an. Dieser Ansatz ermöglicht es dir, bestehenden Client-Code mit minimalen Änderungen zu nutzen. Der Client übernimmt Serialisierung und Netzwerk-Anfragen und gibt strukturierte Antworten zurück, die du für deine Anwendungslogik parsen kannst.

Stelle sicher, dass du eine aktuelle Version des SDK verwendest, um alle Funktionen zu unterstützen, einschließlich Streaming und Function Calling. Die Modell-ID bleibt beim Aufruf von Completions uncensored.

from openai import OpenAI

client = OpenAI(base_url="https://api.embeddingapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK-Integration

Verwenden Sie für JavaScript- oder TypeScript-Umgebungen das OpenAI Node.js SDK. Konfigurieren Sie den Client mit der richtigen Basis-URL und dem API-Schlüssel. Diese Einrichtung gewährleistet die Kompatibilität mit Ihren bestehenden Node-basierten Pipelines. Das SDK verwaltet die Verbindung zum POST /v1/chat/completions-Endpunkt und ermöglicht es Ihnen, Prompts zu senden und Text-Vervollständigungen effizient zu empfangen.

Diese Integration eignet sich für serverseitige Textverarbeitung, z. B. das Generieren von Untertiteln, Skripten oder das Extrahieren von Daten aus großen Textblöcken.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.embeddingapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming-Antworten

Aktivieren Sie für Anwendungen mit niedriger Latenz das Streaming, indem Sie stream: true in Ihrer Anfrage festlegen. Die API gibt einen Server-Sent Events (SSE)-Stream zurück, der Token bereitstellt, sobald sie generiert werden. Dies ist besonders nützlich für Echtzeit-Benutzeroberflächen oder bei der Verarbeitung langer Texte, bei denen sofortiges Feedback wertvoll ist.

Analysieren Sie den SSE-Stream, um Teilantworten zu verarbeiten. Das unzensierte Modell unterstützt diesen Modus und ermöglicht es Ihnen, auf Inhalte zu reagieren, während sie erzeugt werden, ohne auf die gesamte Vervollständigung zu warten.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Grenzwerte, Fehler und Kontextfenster

Das Kontextfenster unterstützt 100.000 Token für Prompt und Vervollständigung zusammen. Anfragen, die das 8-MB-Körperlimit oder das Ratenlimit von 300 Anfragen pro Minute überschreiten, schlagen fehl. Authentifizierungsfehler geben einen 401-Status zurück, wenn der Schlüssel ungültig ist. Wenn das Prepaid-Guthaben aufgebraucht ist, schlagen Anfragen fehl, da keine Guthaben mehr für die Token-Nutzung vorhanden sind. Ein 429-Status zeigt ein erschöpftes Ratenlimit an.

Es gilt immer eine harte Inhaltsgrenze: Anfragen, die sexuelle Inhalte mit Minderjährigen enthalten, werden blockiert, unabhängig von anderen Einstellungen. Alle anderen rechtlichen Erwachseneninhalte werden ohne Verweigerung verarbeitet.

Technische Daten

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
AuthentifizierungAuthorization: Bearer YOUR_KEY
EndpunktePOST /v1/chat/completions · GET /v1/models
Modell-IDuncensored
Base-URLhttps://api.embeddingapis.com/v1
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
JSON-Modusresponse_format: {"type": "json_object"}
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Anfragegrößebis 8 MB
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Ratenlimit300 Anfragen pro Minute und Schlüssel
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Bonus+5 % ab $50, +10 % ab $100
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehler und Lösungen

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Unterstützt diese API die Generierung von Embeddings?

Nein. Dieser Endpunkt dient der Text-Chat-Vervollständigung. Er generiert keine Embeddings, Bilder, Audio oder Video. Nutzen Sie ihn für Textgenerierungsaufgaben wie Zusammenfassung oder Extraktion.

Wie wird der Preis berechnet?

Die Abrechnung erfolgt über Prepaid-Guthaben im Pay-as-you-go-Modus. Input-Token kosten $0,25 pro 1M Token, Output-Token kosten $1,00 pro 1M Token. Guthaben verfällt nie.

Ist das Modell unzensiert?

Ja, das Modell lehnt rechtliche erwachsene, fiktive oder kontroverse Themen nicht ab. Sexuelle Inhalte mit Minderjährigen werden jedoch immer blockiert.

Dein Schlüssel ist nur ein Formular entfernt

Erstellen Sie ein Konto, kopieren Sie den Schlüssel, ändern Sie die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhaltenDokumentation lesen