ข้อกำหนดเบื้องต้น
เพื่อใช้ API ของ apertus คุณต้องมีบัญชีและคีย์ API ลงทะเบียนผ่าน Google หรืออีเมลที่หน้ารับคีย์ API คุณจะได้รับคีย์ทันที ไม่ต้องใช้เบอร์โทรศัพท์ หากต้องการทดสอบก่อน ทุกบัญชีใหม่จะได้รับเครดิตทดลองใช้ $0.50 ใช้ได้ใน 7 วัน ไม่ต้องใช้บัตรเครดิตสำหรับการทดลองใช้ สำหรับการใช้งานจริง ให้เติมเงินด้วยคริปโต (USDT บน TRC20 หรือ USDC บน Base) เครดิตไม่หมดอายุ และข้อผิดพลาดไม่ใช้ยอดเงิน คุณสามารถมีคีย์ที่ใช้งานได้นับต่อหนึ่งบัญชี การสร้างคีย์ใหม่จะแทนที่คีย์เก่า เก็บคีย์ของคุณให้ปลอดภัยและส่งใน Authorization header เป็น bearer token API ทำงานกับข้อความเท่านั้น รองรับโมเดลที่ไม่เซ็นเซอร์หนึ่งตัวที่ปรับให้เหมาะสมกับการตอบคำถามโดยไม่ปฏิเสธเนื้อหา
Base URL และการตรวจสอบสิทธิ์
ส่งคำขอทั้งหมดไปยัง https://api.apertus.cc/v1 base URL นี้ทำงานกับ SDK ทางการของ OpenAI และไคลเอนต์ที่เข้ากันได้ทุกตัวโดยการเปลี่ยนเพียงเอนด์พอยต์ รวมคีย์ API ของคุณในหัวข้อความ: Authorization: Bearer YOUR_API_KEY เอนด์พอยต์ที่รองรับเพียงอย่างเดียวคือ POST /v1/chat/completions มีเอนด์พอยต์ GET /v1/models ให้ด้วยเพื่อตรวจสอบการเชื่อมต่อ รหัสโมเดลที่ต้องใช้คือ uncensored นี่คือโมเดลแบบเปิดน้ำหนักที่รันบนเซิร์ฟเวอร์ของเรา ซึ่งแตกต่างจาก GPT, Claude หรือผู้ขายรายอื่น รองรับข้อความเข้าและส่งข้อความออก ไม่คาดหวัง embeddings รูปภาพ หรือเสียง API ออกแบบมาสำหรับนักพัฒนาที่ต้องการการผสานที่ตรงไปตรงมาโดยไม่มีความซับซ้อนในการเปลี่ยนโมเดล
คำขอแรก
ส่งคำขอ completion พื้นฐานเพื่อตรวจสอบการตั้งค่าของคุณ ใช้คำสั่ง curl เพื่อ POST ไปยังเอนด์พอยต์ chat completions ตั้งค่าโมเดลเป็น uncensored และรวมข้อความง่ายๆ สิ่งนี้ยืนยันว่าคีย์ API ของคุณใช้งานได้และ base URL ถูกต้อง คุณสามารถปรับพารามิเตอร์เช่น temperature หรือ max_tokens ตามต้องการ การตอบสนองจะประกอบด้วยข้อความของโมเดล หากคุณได้รับข้อผิดพลาด 401 ให้ตรวจสอบคีย์ของคุณ ข้อผิดพลาด 402 หมายถึงยอดเงินไม่เพียงพอ ข้อผิดพลาด 429 หมายถึงคุณถึงขีดจำกัดอัตรา คำของ่ายๆ นี้แสดงให้เห็นการเข้าถึง API ดิบโดยไม่ใช้ middleware เป็นวิธีที่เร็วที่สุดในการตรวจสอบการผสานของคุณก่อนสร้างตรรกะที่ซับซ้อน
การผสาน Python
ใช้ SDK Python openai ทางการเพื่อโต้ตอบกับ API เริ่มต้นไคลเอนต์ด้วย base URL https://api.apertus.cc/v1 และคีย์ API ของคุณ ตั้งค่าโมเดลเป็น uncensored ส่งข้อความเป็นรายการของดิกชันนารี SDK จัดการการแปลงข้อมูลและการวิเคราะห์ข้อผิดพลาดโดยอัตโนมัติ วิธีนี้เหมาะสำหรับบริการแบ็กเอนด์หรือสคริปต์ประมวลผลข้อมูล คุณสามารถสตรีมการตอบสนองหรือรับบล็อกเต็ม โค้ดไคลเอนต์เหมือนกันกับที่คุณใช้สำหรับ OpenAI เพียงเปลี่ยน base URL เท่านั้น ซึ่งลดแรงเสียดทานเมื่อเปลี่ยนจากผู้ให้บริการรายอื่น ตรวจสอบให้แน่ใจว่าคุณมีเวอร์ชัน SDK ล่าสุดสำหรับการเข้ากันได้ที่ดีที่สุด การผสานมีความเรียบง่าย ต้องการเพียงการเปลี่ยนแปลงการกำหนดค่าในการตั้งค่าไคลเอนต์ที่มีอยู่ของคุณ
การผสาน Node.js
สำหรับสภาพแวดล้อม JavaScript หรือ TypeScript ให้ใช้แพ็คเกจ npm openai กำหนดค่าไคลเอนต์ด้วย base URL และคีย์เดียวกันกับใน Python เรียกใช้ chat.completions.create() พร้อมโมเดล uncensored ส่งข้อความของคุณในรูปแบบมาตรฐาน สิ่งนี้ทำงานได้ดีสำหรับฟังก์ชันไร้เซิร์ฟเวอร์หรือแบ็กเอนด์ Node.js SDK จัดการคำขอ HTTP และการวิเคราะห์การตอบสนอง คุณสามารถจัดการข้อผิดพลาดได้อย่างสง่างามโดยการตรวจสอบสถานะการตอบสนอง โค้ดยังคงสามารถพกพาได้ระหว่างบริการที่เข้ากันได้กับ OpenAI ทำให้เปลี่ยนผู้ให้บริการได้ง่ายหากจำเป็น การผสาน Node.js รองรับทั้งรูปแบบซิงโครนัสและอะซิงโครนัส ใช้มันสำหรับการสร้าง API บอท หรือเวิร์กโฟลว์อัตโนมัติที่ต้องการการสร้างข้อความที่ไม่เซ็นเซอร์
การตอบสนองแบบสตรีมมิง
เปิดใช้งานสตรีมมิงโดยตั้งค่า stream: true ในคำขอของคุณ API จะส่งข้อความทีละส่วนเมื่อสร้างเสร็จ สิ่งนี้ปรับปรุงความล่าช้าที่รับรู้สำหรับการตอบสนองที่ยาว แต่ละชิ้นมีข้อความบางส่วน ชิ้นสุดท้ายมีสถิติการใช้โทเคน สตรีมมิงรองรับผ่าน Server-Sent Events (SSE) ใช้ตัวช่วยสตรีมมิงของ SDK เพื่อประมวลผลชิ้นส่วนอย่างมีประสิทธิภาพ มีประโยชน์สำหรับอินเทอร์เฟซแชทหรือแอปพลิเคชันแบบเรียลไทม์ โปรดทราบว่าสตรีมมิงใช้โทเคนเท่ากับการไม่สตรีม ข้อผิดพลาดอาจเกิดขึ้นระหว่างสตรีม ดังนั้นจึงจัดการการหยุดทำงาน โมเดลที่ไม่เซ็นเซอร์รองรับสตรีมมิงโดยคุณสมบัตินี้ช่วยให้คุณแสดงข้อความทีละส่วน เป็นฟีเจอร์มาตรฐานใน API LLM สมัยใหม่ ตรวจสอบให้แน่ใจว่าโค้ดไคลเอนต์ของคุณจัดการการตอบสนองบางส่วนได้ถูกต้อง
ขีดจำกัด ข้อผิดพลาด และบริบท
หน้าต่างบริบทมีขนาด 100,000 โทเคน รวมทั้งพรอมต์และการสร้างข้อความ ผลลัพธ์สูงสุดคือ 32,000 โทเคนต่อคำขอ หรือ 2,048 หากไม่กำหนด max_tokens ขีดจำกัดอัตราคือ 300 คำขอต่อนาที และ 8 คำขอพร้อมกันต่อคีย์ ขนาดคำขอต้องไม่เกิน 8 MB ข้อผิดพลาดทั่วไปรวมถึง 401 สำหรับคีย์ไม่ถูกต้อง 402 สำหรับไม่มีเครดิต และ 429 สำหรับขีดจำกัดอัตรา โมเดลปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับเด็ก แต่ไม่ปฏิเสธหัวข้อผู้ใหญ่ที่ถูกกฎหมาย เรื่องแต่ง หรือหัวข้อที่ถกเถียงได้ ราคาโปร่งใส: $0.25 ต่อ 1M โทเคนอินพุต และ $1.00 ต่อ 1M โทเคนเอาต์พุต ข้อผิดพลาดฟรี เครดิตแบบเติมเงินล่วงหน้าและไม่หมดอายุ ใช้ขีดจำกัดเหล่านี้เพื่อวางแผนขนาดแอปพลิเคชันของคุณ API ออกแบบมาสำหรับการสร้างข้อความปริมาณสูงที่มีประสิทธิภาพด้านต้นทุน
cURL
curl https://api.apertus.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.apertus.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.apertus.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);สตรีมมิง
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)