EmbeddingApis/Docs
Ongecensureerde tekst-API voor je pipeline
Snelstartgids Embeddings API
Gebruik deze gids om onze ongecensureerde chat-completies API te integreren in je tekstverwerkingspipelines. Het endpoint accepteert standaard OpenAI-formaten, zodat je tekst kunt genereren, documenten kunt samenvatten of data kunt extraheren zonder inhoudsweigeringen.
Authenticatie
Toegang tot de API via een unieke API-sleutel die je in je accountdashboard genereert. Voeg deze sleutel toe aan de Authorization header van elk verzoek met het Bearer-schema. De basis-URL voor alle endpoints is https://api.embeddingapis.com/v1. Deze URL werkt met de officiële OpenAI SDKs en elke client die is geconfigureerd voor OpenAI-compatibele diensten. Zorg dat je sleutel veilig blijft, omdat deze toegang geeft tot je prepaid tegoed.
Elk account is beperkt tot één actieve sleutel, die op elk moment kan worden gegenereerd. Het opnieuw genereren van de sleutel intrekt de vorige onmiddellijk, dus werk je configuratie snel bij.
Het Chat Completions Endpoint
Stuur tekstprompts naar de POST /v1/chat/completions endpoint. De API bedient een enkel ongecensureerd model geïdentificeerd met de ID uncensored. Dit model is een open-weight LLM die is afgestemd op het geven van antwoorden zonder inhoudelijke weigeringen voor wettelijke volwassen, fictieve of security-onderzoeksonderwerpen. Het verwerkt tekst en retourneert tekst, wat het ideaal maakt voor post-processing, samenvatting of extractiestappen in je pipeline.
Structureer je verzoek met een messages array met je system- en userprompts. De API retourneert een JSON-respons met de gegenereerde tekst.
curl https://api.embeddingapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK Integratie
Gebruik de officiële OpenAI Python-bibliotheek om met de API te communiceren. Stel de base_url in op ons endpoint en geef je API-sleutel op. Deze aanpak stelt je in bestaande clientcode te gebruiken met minimale wijzigingen. De client behandelt serialisatie en netwerkverzoeken, en retourneert gestructureerde responsen die je kunt parseren voor je applicatielogica.
Zorg dat je een recente versie van de SDK gebruikt om alle functies te ondersteunen, waaronder streaming en tool calling. De model-ID blijft uncensored bij het aanroepen van de endpoint.
from openai import OpenAI
client = OpenAI(base_url="https://api.embeddingapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK Integratie
Voor JavaScript- of TypeScript-omgevingen gebruik je de OpenAI Node.js SDK. Configureer de client met de juiste basis-URL en API-sleutel. Deze opstelling zorgt voor compatibiliteit met je bestaande Node-gebaseerde pipelines. De SDK beheert de verbinding met het POST /v1/chat/completions endpoint, zodat je prompts kunt versturen en efficiënt tekstcompleties kunt ontvangen.
Deze integratie is geschikt voor serverzijds tekstverwerken, zoals het genereren van bijschriften, scripts of het extraheren van gegevens uit grote tekstblokken.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.embeddingapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming antwoorden
Schakel streaming in voor applicaties met lage latentie door stream: true in te stellen in je verzoek. De API retourneert een Server-Sent Events (SSE) stream, die tokens levert zodra ze gegenereerd zijn. Dit is vooral nuttig voor realtime gebruikersinterfaces of bij het verwerken van lange teksten waarbij directe feedback waardevol is.
Parser de SSE-stream om gedeeltelijke antwoorden te verwerken. Het ongecensureerde model ondersteunt deze modus, zodat je kunt reageren op inhoud terwijl deze wordt geproduceerd zonder te wachten op de volledige voltooiing.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limieten, Fouten en Contextvenster
Het contextvenster ondersteunt 100.000 tokens voor zowel prompt als completion samen. Verzoeken die de limiet van 8 MB voor de request body overschrijden of de rate limit van 300 verzoeken per minuut, zullen falen. Authenticatiefouten retourneren een 401-status als de sleutel ongeldig is. Wanneer prepaid credit opgebruakt is, falen verzoeken omdat er geen credits meer zijn om het tokenverbruik te dekken. Een 429-status geeft aan dat de rate limit is bereikt.
Er geldt altijd een harde inhoudslimiet: verzoeken met seksueel materiaal met minderjarigen worden geblokkeerd, ongeacht andere instellingen. Alle andere wettelijke volwassen inhoud wordt verwerkt zonder weigering.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Model-ID | uncensored |
| Base URL | https://api.embeddingapis.com/v1 |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| JSON-modus | response_format: {"type": "json_object"} |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Verzoekgrootte | tot 8 MB |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Ondersteunt deze API embeddings generatie?
Nee. Deze API is een endpoint voor tekst-chatcompleties. Het genereert geen embeddings, afbeeldingen, audio of video. Gebruik het voor tekstgeneratietaken zoals samenvatting of extractie.
Hoe wordt de prijsstelling berekend?
Prijzen zijn prepaid tegoed op basis van verbruik. Input-tokens kosten $0,25 per 1M tokens, en output-tokens kosten $1,00 per 1M tokens. Credits vervallen nooit.
Is het model ongecensureerd?
Ja, het model weigert wettelijke volwassen, fictieve of controversiële onderwerpen niet. Seksueel materiaal met minderjarigen wordt echter altijd geblokkeerd.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, verander de base URL. Dat is de hele configuratie.