ES ▾
API sin censura, compatible con OpenAI, pensada para desarrolladoreshttps://api.apertus.cc/v1
Obtener clave de API

Inicio rápido para usuarios de Apertus

Integra la API sin censura de Apertus con clientes estándar compatibles con OpenAI. Configura tu URL base y clave de API para enviar peticiones de texto a nuestro único modelo de pesos abiertos.

Requisitos previos

Para usar la API apertus, necesitas una cuenta y una clave de API. Regístrate con Google o correo electrónico en la página Obtener clave de API. Recibes una clave de inmediato; no se requiere número de teléfono. Si quieres probar primero, cada cuenta nueva recibe $0,50 en crédito de prueba válido por 7 días. No se necesita tarjeta para la prueba. Para producción, recarga con criptomonedas (USDT en TRC20 o USDC en Base). El crédito no caduca y los errores no consumen saldo. Tienes una clave activa por cuenta; generar una nueva reemplaza a la anterior. Mantén tu clave segura y pásala en el encabezado Authorization como token bearer. La API es estrictamente de texto y sirve un único modelo sin censura optimizado para responder sin rechazos por contenido.

URL base y autenticación

Envía todas las peticiones a https://api.apertus.cc/v1. Esta URL base funciona con los SDK oficiales de OpenAI y cualquier cliente compatible simplemente cambiando el endpoint. Incluye tu clave de API en el encabezado: Authorization: Bearer YOUR_API_KEY. El único endpoint admitido es POST /v1/chat/completions. También está disponible el endpoint GET /v1/models para verificar la conectividad. El ID del modelo a usar es uncensored. Este es un modelo de pesos abiertos que se ejecuta en nuestros servidores, distinto de GPT, Claude u otros proveedores. Maneja entrada de texto y devuelve salida de texto. No esperes embeddings, imágenes ni audio. La API está diseñada para desarrolladores que buscan una integración directa sin la complejidad del enrutamiento de modelos.

Primera petición

Envía una petición básica de generación para verificar tu configuración. Usa el comando curl para hacer un POST al endpoint de chat completions. Establece el modelo en uncensored e incluye un mensaje simple. Esto confirma que tu clave de API funciona y que la URL base es correcta. Puedes ajustar parámetros como temperature o max_tokens según sea necesario. La respuesta contendrá el texto generado por el modelo. Si recibes un error 401, verifica tu clave. Un error 402 indica que tienes crédito insuficiente. Un error 429 significa que has alcanzado el límite de peticiones. Esta petición simple demuestra el acceso directo a la API sin middleware. Es la forma más rápida de validar tu integración antes de construir lógica más compleja.

Integración con Python

Usa el SDK oficial de Python openai para interactuar con la API. Inicializa el cliente con la URL base https://api.apertus.cc/v1 y tu clave de API. Establece el modelo en uncensored. Envía mensajes como una lista de diccionarios. El SDK maneja la serialización y el análisis de errores automáticamente. Este enfoque es ideal para servicios backend o scripts de procesamiento de datos. Puedes transmitir respuestas o obtener bloques completos. El código del cliente es idéntico al que usarías para OpenAI, solo que con una URL base diferente. Esto reduce la fricción al cambiar de otros proveedores. Asegúrate de tener la versión más reciente del SDK para la mejor compatibilidad. La integración es mínima, requiriendo solo cambios de configuración en tu configuración de cliente existente.

Integración con Node.js

Para entornos JavaScript o TypeScript, usa el paquete npm openai. Configura el cliente con la misma URL base y clave que en Python. Llama a chat.completions.create() con el modelo uncensored. Pasa tus mensajes en el formato estándar. Esto funciona bien para funciones serverless o backends de Node.js. El SDK gestiona las peticiones HTTP y el análisis de respuestas. Puedes manejar errores de forma elegante verificando el estado de la respuesta. El código sigue siendo portátil entre diferentes servicios compatibles con OpenAI. Esto facilita cambiar de proveedor si es necesario. La integración con Node.js admite patrones tanto sincrónicos como asíncronos. Úsalo para construir APIs, bots o flujos de trabajo automatizados que requieran generación de texto sin censura.

Respuestas en streaming

Habilita el streaming estableciendo stream: true en tu petición. La API devuelve fragmentos de texto a medida que se generan. Esto mejora la latencia percibida para respuestas largas. Cada fragmento contiene parte de la finalización. El fragmento final incluye estadísticas de uso de tokens. El streaming es compatible mediante Server-Sent Events (SSE). Usa las utilidades de streaming del SDK para procesar fragmentos de manera eficiente. Esto es útil para interfaces de chat o aplicaciones en tiempo real. Ten en cuenta que el streaming consume los mismos tokens que el no streaming. Los errores pueden ocurrir durante el streaming, así que gestiona las interrupciones. El modelo sin censura admite streaming de forma predeterminada. Esta función te permite mostrar texto de forma incremental. Es una función estándar en las APIs de LLM modernas. Asegúrate de que el código de tu cliente maneje correctamente las respuestas parciales.

Límites, errores y contexto

La ventana de contexto es de 100.000 tokens en total, incluyendo prompt y finalización. La salida máxima es de 32.000 tokens por petición, o 2.048 si max_tokens no está establecido. Los límites de velocidad son de 300 peticiones por minuto y 8 peticiones simultáneas por clave. Los cuerpos de las peticiones deben ser inferiores a 8 MB. Los errores comunes incluyen 401 para claves no válidas, 402 por falta de crédito y 429 por límites de velocidad. El modelo rechaza contenido sexual que involucre menores. No rechaza otros temas adultos, ficticios o controversos legales. La tarificación es transparente: $0,25 por 1M de tokens de entrada y $1,00 por 1M de tokens de salida. Los errores son gratuitos. El crédito es prepago y no caduca. Usa estos límites para planificar la escala de tu aplicación. La API está diseñada para generación de texto de alto volumen y rentable.

cURL

curl https://api.apertus.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.apertus.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.apertus.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Ficha técnica de la API

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.apertus.cc/v1
AutenticaciónAuthorization: Bearer YOUR_KEY
ID del modelouncensored
Ventana de contexto64.000 tokens (entrada + salida)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Salida máximahasta el resto de la ventana de 64.000 tokens; max_tokens opcional (sin límite aparte)
Modo JSONresponse_format: {"type": "json_object"}
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Límite de peticiones300 por minuto por clave
Tamaño de peticiónhasta 8 MB
Concurrencia8 peticiones a la vez por clave
Bono+5 % desde $50, +10 % desde $100
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Caducidadel crédito pagado no caduca, sin suscripción
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
AccesoGoogle o correo y contraseña
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Es esta la API oficial de GPT o Claude?

No, es un servicio independiente que ejecuta un modelo de pesos abiertos sin censura. Es compatible con el formato de la API de OpenAI, pero usa un modelo distinto. No es GPT, Claude, Gemini ni ningún otro modelo de otro proveedor. Consulta la documentación oficial del proveedor para los detalles específicos de su modelo.

¿Cómo recargo mi crédito?

Recarga con criptomonedas: USDT en TRC20 o USDC en Base. La recarga mínima es de $10 y la máxima de $500. Obtienes un bono del 5 % para $50 y del 10 % para $100. No aceptamos tarjetas ni PayPal. El crédito no caduca y se cobra por el uso real de tokens.

¿La API admite llamadas a funciones?

Sí, la API admite llamadas a funciones con herramientas y tool_choice. También puedes usar el modo JSON estableciendo <code>response_format</code> en <code>json_object</code>. Los parámetros como temperature, top_p y stop son totalmente compatibles. Esto permite salidas estructuradas e integración de herramientas en tus aplicaciones.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API