ES ▾
Obtener clave de API

Abliterated: Integra la API de LLM sin censura

Comienza a usar la API de abliterated en minutos. Esta guía cubre la URL base, autenticación y los endpoints principales para completados de chat, streaming y salida estructurada.

URL base y autenticación

Nuestra API sigue la interfaz estándar de chat-completions de OpenAI. Esto significa que puedes reutilizar clientes, SDKs y fragmentos de código existentes simplemente actualizando la URL base y la clave de API. No necesitas encabezados personalizados ni flujos de autenticación complejos.

Usa https://api.abliterated.cc/v1 como tu URL base. Puedes generar una única clave de API en la página Obtener clave de API. Inicia sesión con Google o con un correo electrónico y contraseña para crear una cuenta. La clave se muestra inmediatamente después de la creación. Mantén esta clave segura, ya que proporciona acceso directo a tu crédito prepago. No se requiere número de teléfono para el registro.

El servicio ofrece un único modelo de lenguaje grande sin censura optimizado para tareas de programación sin censura y razonamiento de propósito general. No necesitas seleccionar una versión del modelo; el endpoint enruta automáticamente al modelo abliterated.

Endpoint de completados de chat

El punto de interacción principal es el endpoint POST /v1/chat/completions. Envía tu historial de conversaciones como un array JSON de mensajes. El modelo procesará la entrada y devolverá una finalización de texto. Esta es una interfaz de entrada de texto y salida de texto pura.

Asegúrate de que tus peticiones se mantengan dentro del límite de cuerpo de 8 MB. La ventana de contexto admite hasta 100.000 tokens para el prompt y la finalización combinados. Si no especificas un valor max_tokens, el modelo genera por defecto 2.048 tokens.

curl https://api.abliterated.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Consulta la página de precios para los costos de tokens. Los errores y rechazos no consumen tu crédito prepago.

Respuestas en streaming

Para una menor latencia y experiencias de usuario en tiempo real, habilita el streaming estableciendo el parámetro stream en true. La API devuelve un flujo de Eventos enviados por el servidor (SSE). Cada fragmento contiene actualizaciones de texto parciales.

El último fragmento del flujo incluye las estadísticas completas de uso de tokens para la petición. Esto te permite rastrear los costos con precisión en tiempo real. El streaming es ideal para interfaces de chat o al procesar salidas largas de modelos de IA sin censura.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Maneja los errores del flujo de manera elegante. Pueden ocurrir interrupciones de red, así que implementa lógica de reintento si tu aplicación requiere la finalización completa.

Llamadas a funciones y herramientas

El modelo abliterated admite el uso estructurado de herramientas. Define tus herramientas en el parámetro tools y especifica una estrategia de tool_choice. El modelo puede devolver objetos JSON que se ajusten a los esquemas de tus herramientas.

Esta función es esencial para construir agentes o aplicaciones que necesiten interactuar con APIs externas. El LLM de codificación sin censura maneja estructuras JSON complejas de forma fiable. Puedes controlar el comportamiento del modelo usando parámetros como temperature y top_p para equilibrar la creatividad y la determinismo.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Asegúrate de que tus definiciones de herramientas sean JSON válidos. Los esquemas inválidos pueden provocar errores de análisis en la respuesta.

Modo JSON

Para salidas estructurales estrictas, establece response_format en {"type": "json_object"}. El modelo forzará que su salida sea JSON válido. Esto es útil para integraciones de API donde necesitas analizar el resultado programáticamente.

El modo JSON funciona junto con las llamadas a funciones y el streaming. Garantiza que tus analizadores posteriores no fallen debido a texto mal formado. Esto es particularmente valioso para aplicaciones de LLM sin censura en línea que requieren extracción de datos fiable.

from openai import OpenAI

client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Ten en cuenta que forzar el modo JSON puede aumentar ligeramente la latencia o reducir la libertad creativa en el razonamiento del modelo. Úsalo solo cuando se requiera un formato estricto.

Parámetros y límites

Los parámetros admitidos incluyen temperature, top_p, stop, seed, presence_penalty y frequency_penalty. Ajusta estos para afinar el estilo de salida del modelo.

Los límites de peticiones están establecidos en 300 peticiones por minuto y 8 peticiones simultáneas por clave de API. El cuerpo de la petición no debe exceder 8 MB. Si excedes estos límites, la API devuelve un error 429. Un error 401 indica una clave de API inválida o faltante. El crédito prepago se cobra solo por el uso de tokens exitoso; los errores y las denegaciones son gratuitos.

Un límite de contenido estricto bloquea el contenido sexual que involucra a menores. Las peticiones que violen esta regla se rechazarán sin cargo. El crédito no caduca y puedes recargar usando USDT (TRC20) o USDC (Base). Comienza con un crédito de prueba de $0,50 válido por 7 días.

Ficha técnica de la API

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.abliterated.cc/v1
AutenticaciónAuthorization: Bearer YOUR_KEY
ID del modelouncensored
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Ventana de contexto100.000 tokens (entrada + salida)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Modo JSONresponse_format: {"type": "json_object"}
Concurrencia8 peticiones a la vez por clave
Tamaño de peticiónhasta 8 MB
Límite de peticiones300 por minuto por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Bono+5 % desde $50, +10 % desde $100
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Caducidadel crédito pagado no caduca, sin suscripción
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
AccesoGoogle o correo y contraseña

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Cómo manejo la autenticación?

Incluye tu clave de API en el encabezado <code>Authorization</code> como <code>Bearer YOUR_API_KEY</code>. Genera tu clave en la página de clave de API usando Google o correo electrónico. Cada cuenta tiene una clave activa; generar una nueva reemplaza la anterior.

¿Qué sucede si me quedo sin crédito?

Las peticiones fallan, pero los errores y rechazos no consumen tu saldo. Puedes recargar usando criptomonedas (USDT o USDC) en cualquier momento. El crédito prepago no caduca, así que puedes usarlo cuando estés listo.

¿Es el modelo adecuado para programación?

Sí. El modelo de lenguaje sin censura para programación está optimizado para tareas técnicas, incluyendo generación de código, depuración y explicación. Maneja JSON complejo y definiciones de herramientas de manera confiable sin rechazos innecesarios por contenido adulto lícito.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.