API cho các mô hình AI không kiểm duyệt
Tài liệu KiApi: Tích hợp trong 5 phút
Nhận quyền truy cập ngay lập tức vào LLM không kiểm duyệt mạnh mẽ với KiApi qua giao diện tương thích OpenAI. Bắt đầu với vài dòng mã và tích hợp mô hình liền mạch vào ứng dụng của bạn.
https://api.kiapis.com/v1uncensored
Bắt đầu: Base URL và xác thực
KiApi hoàn toàn tương thích với API OpenAI. Bạn có thể sử dụng hệ sinh thái SDK và client hiện có bằng cách điều chỉnh base_url. Base URL cho tất cả yêu cầu là https://api.kiapis.com/v1. Xác thực chỉ sử dụng khóa API, bạn nhận được sau khi đăng ký trên trang dashboard. Khóa này phải được truyền trong tiêu đề HTTP Authorization: Bearer <IHR_API_SCHLÜSSEL>. Bạn có thể tạo khóa mới bất cứ lúc nào, khóa cũ sẽ mất hiệu lực.
Khác với các dịch vụ khác, chúng tôi không cung cấp các endpoint phức tạp cho embedding hoặc fine-tuning. Trọng tâm của chúng tôi là tạo văn bản thuần túy. KiApi là kết nối trực tiếp của bạn với một mô hình được tối ưu hóa cho phản hồi không kiểm duyệt. Hãy đảm bảo cấu hình môi trường của bạn đúng trước khi gửi yêu cầu đầu tiên.
POST /v1/chat/completions: Tạo văn bản
Trọng tâm của API là endpoint POST /v1/chat/completions. Tại đây, bạn gửi danh sách tin nhắn (hệ thống, người dùng, trợ lý) và nhận phản hồi văn bản. Tham số model-id phải được đặt thành uncensored. Phản hồi là đồng bộ và bao gồm ngay lập tức đoạn văn bản được tạo cùng với siêu dữ liệu về việc sử dụng token.
Cấu trúc yêu cầu tuân theo định dạng tiêu chuẩn. Bạn có thể xác định các vai trò để cấu trúc ngữ cảnh rõ ràng. Hệ thống xử lý đầu vào và tạo phản hồi dựa trên hành vi đã học của mô hình. Đây là phương pháp chính cho hầu hết các ứng dụng văn bản, từ chatbot đến phân tích văn bản.
curl https://api.kiapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Phản hồi chứa một đối tượng JSON với nội dung được tạo. Hãy đảm bảo trích xuất phần content từ phản hồi để sử dụng tiếp trong ứng dụng của bạn. Không có siêu dữ liệu bổ sung như chi phí cho mỗi yêu cầu được trả về trong phản hồi tiêu chuẩn; thông tin này có trong dashboard.
Truyền phát với Sự kiện gửi bởi máy chủ (SSE)
Đối với các ứng dụng cần đầu ra ngay lập tức, KiApi hỗ trợ streaming qua Server-Sent Events (SSE). Kích hoạt bằng cách đặt "stream": true trong thân yêu cầu. Thay vì chờ phản hồi đầy đủ, bạn nhận được luồng các bản vá JSON chứa dần dần đoạn văn bản được tạo.
Điều này đặc biệt hữu ích cho giao diện chat, nơi phản hồi ngay lập tức cải thiện trải nghiệm người dùng. KiApi với khả năng streaming api cho phép bạn giảm độ trễ và tạo cảm giác trò chuyện thời gian thực. Client phải phân tích cú pháp luồng và ghép các mảnh lại cho đến khi kết thúc luồng được báo hiệu.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Khi streaming, thống kê sử dụng token thường được trả về ở cuối luồng trong sự kiện cuối cùng. Điều này cho phép tính toán chính xác dựa trên độ dài tạo thực tế. Hãy đảm bảo mã client của bạn xử lý kết thúc luồng để giải phóng tài nguyên đúng cách.
Gọi công cụ và gọi hàm
Mô hình hỗ trợ gọi công cụ (tool calling), còn được gọi là gọi hàm. Điều này cho phép LLM trả về dữ liệu JSON có cấu trúc đại diện cho các chức năng hoặc hành động cụ thể trong ứng dụng của bạn. Bạn xác định các công cụ có sẵn trong thân yêu cầu, và mô hình quyết định khi nào gọi công cụ dựa trên đầu vào của người dùng.
Cấu trúc định nghĩa công cụ tuân theo tiêu chuẩn OpenAI. Bạn có thể chỉ định nhiều công cụ, và mô hình sẽ chọn công cụ phù hợp nhất. Phản hồi chứa danh sách các lệnh gọi công cụ mà bạn có thể thực hiện trong logic backend của mình. Điều này mở rộng đáng kể khả năng của KiApi vượt ra ngoài việc tạo văn bản thuần túy.
from openai import OpenAI
client = OpenAI(base_url="https://api.kiapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Sử dụng gọi công cụ để tự động hóa các quy trình làm việc phức tạp. Mô hình cung cấp các tham số cho công cụ trực tiếp dưới dạng JSON. Bạn không cần sử dụng trình phân tích cú pháp bên ngoài cho phản hồi vì cấu trúc đến trực tiếp từ mô hình. Điều này làm cho việc tích hợp vào các hệ thống hiện có trở nên đơn giản và đáng tin cậy hơn nhiều.
GET /v1/models: Mô hình khả dụng
Endpoint GET /v1/models liệt kê các mô hình có sẵn có thể truy cập qua API. Điều này hữu ích để kiểm tra động các mô hình có sẵn hoặc xác nhận ID mô hình. Thông thường, bạn sẽ nhận được danh sách với mô hình uncensored.
Phản hồi chứa siêu dữ liệu về mô hình, như ID, chủ sở hữu và ngày tạo. Khác với một số API khác, phản hồi tiêu chuẩn không chứa trực tiếp độ dài ngữ cảnh tối đa hoặc giá cụ thể. Thông tin này phải được lấy từ tài liệu hoặc dashboard. Tuy nhiên, endpoint này không thể thiếu để cấu hình tự động client.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kiapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Sử dụng endpoint này để thích ứng ứng dụng của bạn với các thay đổi trong tương lai. Khi các mô hình mới được thêm vào, chúng sẽ tự động xuất hiện trong danh sách này. Mô hình hiện tại uncensored là mô hình khả dụng duy nhất và được đặc trưng bởi mô tả là mô hình ngôn ngữ lớn được tối ưu hóa cho nội dung không kiểm duyệt.
Giới hạn tốc độ và mã lỗi
Để đảm bảo sự ổn định của dịch vụ, có các giới hạn nhất định. Mỗi khóa API được phép 300 yêu cầu mỗi phút. Thân yêu cầu tối đa là 8 MB. Nếu vượt quá giới hạn này, bạn sẽ nhận được mã trạng thái HTTP 429 Too Many Requests. Hãy lập kế hoạch ứng dụng của bạn để triển khai các yêu cầu thử lại với backoff theo cấp số nhân.
Các mã lỗi phổ biến khác là 401 Unauthorized khi khóa API không hợp lệ và 402 Payment Required khi tín dụng của bạn đã hết. KiApi sử dụng mô hình trả trước, vì vậy các yêu cầu không có tín dụng sẽ bị từ chối ngay lập tức. Hãy đảm bảo kiểm tra số dư tài khoản của bạn thường xuyên.
Cửa sổ ngữ cảnh là 100.000 token cho cả đầu vào và đầu ra cộng lại. Vượt quá giới hạn này sẽ trả về thông báo lỗi. KiApi là giải pháp đáng tin cậy cho các nhà phát triển đánh giá cao các quy tắc rõ ràng và giới hạn minh bạch.
Thông số API
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Xác thực | Authorization: Bearer YOUR_KEY |
| ID mô hình | uncensored |
| Base URL | https://api.kiapis.com/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Thưởng | +5% từ $50, +10% từ $100 |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Đăng nhập | Google hoặc email và mật khẩu |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Câu hỏi thường gặp
KiApi có phải là API tương thích OpenAI không?
Đúng vậy, KiApi tuân theo định dạng API OpenAI cho chat-completions. Bạn có thể sử dụng các SDK chính thức của OpenAI bằng cách chỉ cần điều chỉnh base_url và khóa API. Cấu trúc yêu cầu và phản hồi giống hệt với OpenAI.
Mô hình trả trước hoạt động như thế nào và khi nào tín dụng hết hạn?
Bạn nạp tiền vào tài khoản để sử dụng ngay cho các yêu cầu. Không có phí hàng tháng hoặc đăng ký. Tín dụng trả trước không bao giờ hết hạn. Bạn có thể nạp từ 10 USD trở lên, số tiền cao hơn sẽ nhận được tín dụng bổ sung.
KiApi có mức kiểm duyệt nào không?
Mô hình được huấn luyện để không từ chối ngay cả với các chủ đề gây tranh cãi hoặc người lớn. Tuy nhiên, luôn có một giới hạn cứng: nội dung tình dục liên quan đến trẻ vị thành niên sẽ bị chặn. Đây là hạn chế duy nhất trên toàn hệ thống đối với nội dung.
Khóa của bạn chỉ cách một cú nhấp chuột
Tạo tài khoản, sao chép khóa, điều chỉnh base URL. Thế là xong.