EmbeddingApis/Tài liệu
API văn bản không kiểm duyệt cho pipeline của bạn
Hướng dẫn nhanh API Embeddings
Sử dụng hướng dẫn này để tích hợp API chat-completions không kiểm duyệt của chúng tôi vào các pipeline xử lý văn bản của bạn. Endpoint chấp nhận định dạng OpenAI tiêu chuẩn, cho phép bạn tạo văn bản, tóm tắt tài liệu hoặc trích xuất dữ liệu mà không bị từ chối nội dung.
Xác thực
Truy cập API bằng khóa API duy nhất được tạo từ bảng điều khiển tài khoản của bạn. Bao gồm khóa này trong tiêu đề Authorization của mọi yêu cầu bằng lược đồ Bearer. URL gốc cho tất cả các endpoint là https://api.embeddingapis.com/v1. URL này hoạt động với các SDK chính thức của OpenAI và bất kỳ client nào được cấu hình cho các dịch vụ tương thích OpenAI. Đảm bảo giữ khóa của bạn an toàn vì nó cấp quyền truy cập vào tín dụng trả trước của bạn.
Mỗi tài khoản chỉ giới hạn một khóa hoạt động, khóa này có thể được tạo lại bất cứ lúc nào. Việc tạo lại khóa sẽ thu hồi ngay lập tức khóa trước đó, vì vậy hãy cập nhật cấu hình của bạn kịp thời.
Endpoint Chat Completions
Gửi prompt văn bản đến endpoint POST /v1/chat/completions. API cung cấp một mô hình không kiểm duyệt duy nhất được xác định bởi ID uncensored. Mô hình này là một LLM trọng số mở được tinh chỉnh để trả lời mà không từ chối nội dung đối với các chủ đề hợp pháp dành cho người trưởng thành, hư cấu hoặc nghiên cứu bảo mật. Mô hình xử lý văn bản đầu vào và xuất ra văn bản, khiến nó lý tưởng cho các bước xử lý sau, tóm tắt hoặc trích xuất trong pipeline của bạn.
Cấu trúc yêu cầu của bạn với mảng messages chứa các prompt hệ thống và người dùng của bạn. API trả về phản hồi JSON chứa văn bản được tạo.
curl https://api.embeddingapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Tích hợp Python SDK
Sử dụng thư viện Python chính thức của OpenAI để tương tác với API. Đặt base_url thành endpoint của chúng tôi và cung cấp khóa API của bạn. Cách tiếp cận này cho phép bạn tận dụng mã client hiện có với ít thay đổi nhất. Client xử lý việc tuần tự hóa và các yêu cầu mạng, trả về các phản hồi có cấu trúc mà bạn có thể phân tích cú pháp cho logic ứng dụng của mình.
Đảm bảo bạn đang sử dụng phiên bản SDK mới nhất để hỗ trợ tất cả các tính năng, bao gồm truyền phát (streaming) và gọi hàm (tool calling). ID mô hình vẫn là uncensored khi gọi completions.
from openai import OpenAI
client = OpenAI(base_url="https://api.embeddingapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Tích hợp Node SDK
Đối với môi trường JavaScript hoặc TypeScript, hãy sử dụng SDK Node.js của OpenAI. Cấu hình client với URL gốc và khóa API chính xác. Cấu hình này đảm bảo tương thích với các pipeline dựa trên Node hiện có của bạn. SDK quản lý kết nối với endpoint POST /v1/chat/completions, cho phép bạn gửi prompt và nhận các phần hoàn tất văn bản một cách hiệu quả.
Tích hợp này phù hợp cho việc xử lý văn bản phía máy chủ, chẳng hạn như tạo chú thích, kịch bản hoặc trích xuất dữ liệu từ các khối văn bản lớn.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.embeddingapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Phản hồi truyền phát (Streaming)
Đối với các ứng dụng độ trễ thấp, hãy bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về luồng Sự kiện được gửi bởi máy chủ (SSE), cung cấp token khi chúng được tạo. Điều này đặc biệt hữu ích cho các giao diện người dùng thời gian thực hoặc khi xử lý văn bản dài nơi phản hồi ngay lập tức có giá trị.
Phân tích cú pháp luồng SSE để xử lý các phản hồi từng phần. Mô hình không kiểm duyệt hỗ trợ chế độ này, cho phép bạn phản ứng với nội dung khi nó được tạo mà không cần chờ phần hoàn tất toàn bộ.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Giới hạn, Lỗi và Cửa sổ ngữ cảnh
Cửa sổ ngữ cảnh hỗ trợ 100.000 token cho cả prompt và completion kết hợp. Các yêu cầu vượt quá giới hạn thân 8 MB hoặc giới hạn tốc độ 300 yêu cầu mỗi phút sẽ bị lỗi. Lỗi xác thực trả về mã trạng thái 401 nếu khóa không hợp lệ. Khi tín dụng trả trước cạn kiệt, các yêu cầu sẽ bị lỗi vì không còn tín dụng nào để trang trải việc sử dụng token. Mã trạng thái 429 cho biết đã đạt giới hạn tốc độ.
Luôn áp dụng một giới hạn nội dung cứng: các yêu cầu chứa nội dung khiêu dâm liên quan đến trẻ vị thành niên sẽ bị chặn, bất kể các cài đặt khác. Tất cả các nội dung người trưởng thành hợp pháp khác đều được xử lý mà không từ chối.
Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID mô hình | uncensored |
| Base URL | https://api.embeddingapis.com/v1 |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Kích thước yêu cầu | tối đa 8 MB |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Thưởng | +5% từ $50, +10% từ $100 |
| Đăng nhập | Google hoặc email và mật khẩu |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
API này có hỗ trợ tạo embeddings không?
Không. API này là một endpoint chat-completions văn bản. API không tạo ra embeddings, hình ảnh, âm thanh hay video. Hãy sử dụng nó cho các tác vụ tạo văn bản như tóm tắt hoặc trích xuất dữ liệu.
Giá được tính như thế nào?
Giá cả theo hình thức tín dụng trả trước trả theo nhu cầu. Token đầu vào có giá $0,25 cho mỗi 1 triệu token, và token đầu ra có giá $1,00 cho mỗi 1 triệu token. Tín dụng không hết hạn.
Mô hình có không kiểm duyệt không?
Có, mô hình không từ chối các chủ đề người trưởng thành hợp pháp, hư cấu hoặc gây tranh cãi. Tuy nhiên, nội dung khiêu dâm liên quan đến trẻ vị thành niên luôn bị chặn.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL gốc. Đó là toàn bộ thiết lập.