FR ▾
Obtenir une clé API

Abliterated : Intégrer l'API LLM sans censure

Commencez à utiliser l'API abliterated en quelques minutes. Ce guide couvre l'URL de base, l'authentification et les endpoints principaux pour les complétions de chat, le streaming et les sorties structurées.

URL de base et authentification

Notre API suit l'interface standard de complétion de chat OpenAI. Cela signifie que vous pouvez réutiliser vos clients, SDK et extraits de code existants en mettant simplement à jour l'URL de base et la clé API. Aucune en-tête personnalisée ni flux d'authentification complexe n'est nécessaire.

Utilisez https://api.abliterated.cc/v1 comme URL de base. Vous pouvez générer une seule clé API sur la page Obtenir la clé API. Connectez-vous avec Google ou avec une adresse e-mail et un mot de passe pour créer un compte. La clé s'affiche immédiatement après sa création. Conservez cette clé en toute sécurité, car elle donne un accès direct à votre crédit prépayé. Aucun numéro de téléphone n'est requis pour l'inscription.

Le service propose un seul modèle de langage large sans censure, optimisé pour les tâches de codage sans censure et le raisonnement à usage général. Vous n'avez pas besoin de sélectionner une version de modèle ; l'endpoint redirige automatiquement vers le modèle abliterated.

Endpoint de complétion de chat

Le point d'interaction principal est l'endpoint POST /v1/chat/completions. Envoyez votre historique de conversation sous forme de tableau JSON de messages. Le modèle traitera l'entrée et retournera une complétion de texte. Il s'agit d'une interface purement texte en entrée, texte en sortie.

Assurez-vous que vos requêtes restent dans la limite de corps de 8 Mo. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens pour le prompt et la complétion combinés. Si vous ne spécifiez pas de valeur max_tokens, le modèle génère par défaut 2 048 tokens.

curl https://api.abliterated.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Consultez la page des tarifs pour les coûts des tokens. Les erreurs et les refus ne consomment pas votre crédit prépayé.

Réponses en streaming

Pour une latence plus faible et des expériences utilisateur en temps réel, activez le streaming en définissant le paramètre stream sur true. L'API retourne un flux Server-Sent Events (SSE). Chaque chunk contient des mises à jour de texte partielles.

Le dernier chunk du flux inclut les statistiques complètes d'utilisation des tokens pour la requête. Cela vous permet de suivre les coûts avec précision en temps réel. Le streaming est idéal pour les interfaces de chat ou lors du traitement de longues sorties de modèles IA sans censure.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Gérez les erreurs de streaming de manière gracieuse. Des interruptions réseau peuvent survenir, implémentez donc une logique de réessai si votre application nécessite la complétion complète.

Appel de fonctions et outils

Le modèle abliterated prend en charge l'utilisation structurée des outils. Définissez vos outils dans le paramètre tools et spécifiez une stratégie tool_choice. Le modèle peut retourner des objets JSON conformes à vos schémas d'outils.

Cette fonctionnalité est essentielle pour créer des agents ou des applications qui doivent interagir avec des API externes. Le LLM de codage sans censure gère de manière fiable des structures JSON complexes. Vous pouvez contrôler le comportement du modèle à l'aide de paramètres tels que temperature et top_p pour équilibrer créativité et déterminisme.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Assurez-vous que vos définitions d'outils sont des JSON valides. Des schémas invalides peuvent entraîner des erreurs d'analyse dans la réponse.

Mode JSON

Pour des sorties structurelles strictes, définissez response_format sur {"type": "json_object"}. Le modèle forcera sa sortie à être un JSON valide. Cela est utile pour les intégrations API où vous devez analyser le résultat programmatiquement.

Le mode JSON fonctionne conjointement avec l'appel de fonctions et le streaming. Il garantit que vos analyseurs en aval ne cassent pas en raison de texte mal formé. Cela est particulièrement précieux pour les applications LLM sans censure en ligne nécessitant une extraction de données fiable.

from openai import OpenAI

client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Sachez que forcer le mode JSON peut légèrement augmenter la latence ou réduire la liberté créative dans le raisonnement du modèle. Utilisez-le uniquement lorsque un formatage strict est requis.

Paramètres et limites

Les paramètres pris en charge incluent temperature, top_p, stop, seed, presence_penalty et frequency_penalty. Ajustez-les pour affiner le style de sortie du modèle.

Les limites de débit sont fixées à 300 requêtes par minute et 8 requêtes simultanées par clé API. Le corps de la requête ne doit pas dépasser 8 Mo. Si vous dépassez ces limites, l'API retourne une erreur 429. Une erreur 401 indique une clé API invalide ou manquante. Le crédit prépayé est facturé uniquement pour l'utilisation réussie des tokens ; les erreurs et les refus sont gratuits.

Une limite stricte bloque le contenu sexuel impliquant des mineurs. Les requêtes qui enfreignent cette règle sont refusées sans frais. Le crédit n'expire jamais et vous pouvez le recharger en utilisant USDT (TRC20) ou USDC (Base). Commencez avec un crédit d'essai gratuit de 0,50 $ valable 7 jours.

Fiche technique de l'API

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.abliterated.cc/v1
AuthentificationAuthorization: Bearer YOUR_KEY
ID du modèleuncensored
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Fenêtre de contexte100 000 tokens (entrée + sortie)
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Mode JSONresponse_format: {"type": "json_object"}
Concurrence8 requêtes simultanées par clé
Taillejusqu'à 8 Mo par requête
Limite de débit300 requêtes par minute et par clé
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Bonus+5 % dès 50 $, +10 % dès 100 $
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Validitéle crédit payé n'expire jamais, sans abonnement
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé
Clésune clé active par compte ; une nouvelle remplace l'ancienne
ConnexionGoogle ou e-mail et mot de passe

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Comment gérer l'authentification ?

Incluez votre clé API dans l'en-tête <code>Authorization</code> sous la forme <code>Bearer YOUR_API_KEY</code>. Générez votre clé sur la page Clé API en utilisant Google ou l'e-mail. Chaque compte dispose d'une clé active ; la génération d'une nouvelle clé remplace l'ancienne.

Que se passe-t-il si je manque de crédit ?

Les requêtes échouent, mais les erreurs et les refus ne consomment pas votre solde. Vous pouvez recharger en utilisant des cryptomonnaies (USDT ou USDC) à tout moment. Le crédit prépayé n'expire jamais, vous pouvez donc l'utiliser quand vous le souhaitez.

Le modèle est-il adapté au codage ?

Oui. Le LLM de codage sans censure est optimisé pour les tâches techniques, y compris la génération de code, le débogage et l'explication. Il gère les JSON complexes et les définitions d'outils de manière fiable sans refus inutile pour le contenu adulte légal.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.