VI ▾
API không kiểm duyệt, tương thích OpenAI dành cho nhà phát triểnhttps://api.apertus.cc/v1
Lấy khóa API

Hướng dẫn nhanh cho người dùng Apertus

Tích hợp API không kiểm duyệt Apertus bằng các máy khách tương thích OpenAI tiêu chuẩn. Cấu hình base URL và khóa API của bạn để gửi yêu cầu văn bản đến mô hình trọng số mở đơn lẻ của chúng tôi.

Yêu cầu tiên quyết

Để sử dụng API của apertus, bạn cần một tài khoản và một khóa API. Đăng ký qua Google hoặc email trên trang Lấy khóa API. Bạn nhận được khóa ngay lập tức; không cần số điện thoại. Nếu bạn muốn thử trước, mỗi tài khoản mới đều nhận được $0.50 tín dụng dùng thử có hiệu lực trong 7 ngày. Không cần thẻ cho bản dùng thử. Để sản xuất, bạn có thể nạp tiền bằng crypto (USDT trên TRC20 hoặc USDC trên Base). Tín dụng không bao giờ hết hạn và lỗi không tiêu tốn số dư. Bạn chỉ có một khóa hoạt động mỗi tài khoản; tạo khóa mới sẽ thay thế khóa cũ. Hãy giữ khóa của bạn an toàn và truyền nó trong tiêu đề Authorization dưới dạng token bearer. API hoạt động hoàn toàn trên văn bản, cung cấp một mô hình không kiểm duyệt được tối ưu hóa để trả lời mà không từ chối nội dung.

Base URL và Xác thực

Gửi tất cả yêu cầu đến https://api.apertus.cc/v1. Base URL này hoạt động với các SDK OpenAI chính thức và bất kỳ máy khách tương thích nào bằng cách chỉ thay đổi endpoint. Bao gồm khóa API của bạn trong tiêu đề: Authorization: Bearer YOUR_API_KEY. Endpoint được hỗ trợ duy nhất là POST /v1/chat/completions. Một endpoint GET /v1/models cũng có sẵn để xác minh kết nối. ID mô hình để sử dụng là uncensored. Đây là một mô hình trọng số mở chạy trên máy chủ của chúng tôi, khác biệt với GPT, Claude hoặc các nhà cung cấp khác. Nó xử lý đầu vào văn bản và trả về đầu ra văn bản. Đừng mong đợi embedding, hình ảnh hoặc âm thanh. API được thiết kế cho các nhà phát triển muốn tích hợp đơn giản mà không có độ phức tạp của việc định tuyến mô hình.

Yêu cầu đầu tiên

Gửi một yêu cầu hoàn tất cơ bản để xác minh cài đặt của bạn. Sử dụng lệnh curl để POST đến endpoint hoàn tất trò chuyện. Đặt mô hình thành uncensored và bao gồm một tin nhắn đơn giản. Điều này xác nhận khóa API của bạn hoạt động và base URL là chính xác. Bạn có thể điều chỉnh các tham số như temperature hoặc max_tokens khi cần. Phản hồi sẽ chứa đầu ra văn bản của mô hình. Nếu bạn nhận được lỗi 401, hãy kiểm tra khóa của bạn. Lỗi 402 cho biết không đủ tín dụng. Lỗi 429 có nghĩa là bạn đã đạt giới hạn tốc độ. Yêu cầu đơn giản này minh họa quyền truy cập API thô mà không có middleware nào. Đây là cách nhanh nhất để xác thực tích hợp của bạn trước khi xây dựng logic phức tạp hơn.

Tích hợp Python

Sử dụng SDK Python openai chính thức để tương tác với API. Khởi tạo máy khách với base URL https://api.apertus.cc/v1 và khóa API của bạn. Đặt mô hình thành uncensored. Gửi tin nhắn dưới dạng danh sách các từ điển. SDK xử lý tự động việc tuần tự hóa và phân tích lỗi. Cách tiếp cận này rất lý tưởng cho các dịch vụ backend hoặc tập lệnh xử lý dữ liệu. Bạn có thể truyền phát phản hồi hoặc nhận các khối đầy đủ. Mã máy khách giống hệt những gì bạn sẽ sử dụng cho OpenAI, chỉ khác base URL. Điều này giảm ma sát khi chuyển từ các nhà cung cấp khác. Đảm bảo bạn có phiên bản SDK mới nhất để tương thích tốt nhất. Việc tích hợp rất tối thiểu, chỉ yêu cầu thay đổi cấu hình trong cài đặt máy khách hiện có của bạn.

Tích hợp Node.js

Đối với môi trường JavaScript hoặc TypeScript, hãy sử dụng gói npm openai. Định cấu hình client với cùng URL cơ sở và khóa như trong Python. Gọi chat.completions.create() với mô hình uncensored. Truyền tin nhắn của bạn theo định dạng tiêu chuẩn. Điều này hoạt động tốt cho các hàm serverless hoặc backend Node.js. SDK quản lý các yêu cầu HTTP và phân tích phản hồi. Bạn có thể xử lý lỗi một cách khéo léo bằng cách kiểm tra trạng thái phản hồi. Mã nguồn vẫn di động giữa các dịch vụ tương thích OpenAI khác nhau. Điều này giúp dễ dàng thay đổi nhà cung cấp nếu cần. Tích hợp Node.js hỗ trợ cả mô hình đồng bộ và bất đồng bộ. Hãy sử dụng nó để xây dựng API, bot hoặc các quy trình tự động hóa yêu cầu tạo văn bản không kiểm duyệt.

Phản hồi truyền phát

Bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về các đoạn văn bản khi chúng được tạo. Điều này cải thiện độ trễ cảm nhận được cho các phản hồi dài. Mỗi đoạn chứa một phần của kết quả hoàn tất. Đoạn cuối cùng bao gồm thống kê sử dụng token. Truyền phát được hỗ trợ qua Server-Sent Events (SSE). Sử dụng các tiện ích truyền phát của SDK để xử lý các đoạn dữ liệu một cách hiệu quả. Điều này hữu ích cho các giao diện trò chuyện hoặc ứng dụng thời gian thực. Lưu ý rằng truyền phát tiêu tốn cùng token với không truyền phát. Lỗi có thể xảy ra giữa chừng, vì vậy hãy xử lý các lần ngắt. Mô hình không kiểm duyệt hỗ trợ truyền phát theo mặc định. Tính năng này cho phép bạn hiển thị văn bản từng phần. Đây là một tính năng tiêu chuẩn trong các API LLM hiện đại. Đảm bảo mã máy khách của bạn xử lý các phản hồi một phần đúng cách.

Giới hạn, Lỗi và Ngữ cảnh

Cửa sổ ngữ cảnh có tổng cộng 100.000 token, bao gồm prompt và phản hồi. Đầu ra tối đa là 32.000 token mỗi yêu cầu, hoặc 2.048 nếu max_tokens không được đặt. Giới hạn tốc độ là 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời mỗi khóa. Thân yêu cầu phải dưới 8 MB. Các lỗi phổ biến bao gồm 401 cho khóa không hợp lệ, 402 cho không có tín dụng và 429 cho giới hạn tốc độ. Mô hình từ chối nội dung tình dục liên quan đến trẻ vị thành niên. Nó không từ chối các chủ đề người trưởng thành hợp pháp, hư cấu hoặc gây tranh cãi khác. Giá cả minh bạch: $0.25 cho mỗi 1M token đầu vào và $1.00 cho mỗi 1M token đầu ra. Lỗi miễn phí. Tín dụng là tín dụng trả trước và không bao giờ hết hạn. Hãy sử dụng các giới hạn này để lập kế hoạch quy mô ứng dụng của bạn. API được thiết kế cho việc tạo văn bản khối lượng lớn và hiệu quả về chi phí.

cURL

curl https://api.apertus.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.apertus.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.apertus.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Truyền phát

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.apertus.cc/v1
Xác thựcAuthorization: Bearer YOUR_KEY
ID mô hìnhuncensored
Cửa sổ ngữ cảnh64.000 token (đầu vào + đầu ra)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Đầu ra tối đatối đa phần còn lại của cửa sổ 64.000 token; max_tokens tùy chọn (không giới hạn riêng)
Chế độ JSONresponse_format: {"type": "json_object"}
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Thưởng+5% từ $50, +10% từ $100
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Đăng nhậpGoogle hoặc email và mật khẩu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Đây có phải là API GPT hoặc Claude chính thức không?

Không, đây là dịch vụ độc lập chạy mô hình không kiểm duyệt trọng số mở. Nó tương thích với định dạng API OpenAI nhưng sử dụng mô hình khác. Nó không phải là GPT, Claude, Gemini hay bất kỳ mô hình của nhà cung cấp nào khác. Vui lòng kiểm tra tài liệu chính thức của nhà cung cấp để biết chi tiết mô hình cụ thể.

Tôi nạp tiền tín dụng như thế nào?

Nạp tiền bằng crypto: USDT trên TRC20 hoặc USDC trên Base. Nạp tối thiểu $10, tối đa $500. Bạn được tặng thêm 5% khi nạp $50 và 10% khi nạp $100. Không chấp nhận thẻ hoặc PayPal. Tín dụng không bao giờ hết hạn và được tính theo token thực tế sử dụng.

API có hỗ trợ gọi hàm không?

Có, API hỗ trợ gọi hàm với công cụ và tool_choice. Bạn cũng có thể sử dụng chế độ JSON bằng cách đặt <code>response_format</code> thành <code>json_object</code>. Các tham số như temperature, top_p và stop được hỗ trợ đầy đủ. Điều này cho phép đầu ra có cấu trúc và tích hợp công cụ trong ứng dụng của bạn.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.

Lấy khóa API