Abliterated : Intégrer l'API LLM sans censure
Commencez à utiliser l'API abliterated en quelques minutes. Ce guide couvre l'URL de base, l'authentification et les endpoints principaux pour les complétions de chat, le streaming et les sorties structurées.
URL de base et authentification
Notre API suit l'interface standard de complétion de chat OpenAI. Cela signifie que vous pouvez réutiliser vos clients, SDK et extraits de code existants en mettant simplement à jour l'URL de base et la clé API. Aucune en-tête personnalisée ni flux d'authentification complexe n'est nécessaire.
Utilisez https://api.abliterated.cc/v1 comme URL de base. Vous pouvez générer une seule clé API sur la page Obtenir la clé API. Connectez-vous avec Google ou avec une adresse e-mail et un mot de passe pour créer un compte. La clé s'affiche immédiatement après sa création. Conservez cette clé en toute sécurité, car elle donne un accès direct à votre crédit prépayé. Aucun numéro de téléphone n'est requis pour l'inscription.
Le service propose un seul modèle de langage large sans censure, optimisé pour les tâches de codage sans censure et le raisonnement à usage général. Vous n'avez pas besoin de sélectionner une version de modèle ; l'endpoint redirige automatiquement vers le modèle abliterated.
Endpoint de complétion de chat
Le point d'interaction principal est l'endpoint POST /v1/chat/completions. Envoyez votre historique de conversation sous forme de tableau JSON de messages. Le modèle traitera l'entrée et retournera une complétion de texte. Il s'agit d'une interface purement texte en entrée, texte en sortie.
Assurez-vous que vos requêtes restent dans la limite de corps de 8 Mo. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens pour le prompt et la complétion combinés. Si vous ne spécifiez pas de valeur max_tokens, le modèle génère par défaut 2 048 tokens.
curl https://api.abliterated.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Consultez la page des tarifs pour les coûts des tokens. Les erreurs et les refus ne consomment pas votre crédit prépayé.
Réponses en streaming
Pour une latence plus faible et des expériences utilisateur en temps réel, activez le streaming en définissant le paramètre stream sur true. L'API retourne un flux Server-Sent Events (SSE). Chaque chunk contient des mises à jour de texte partielles.
Le dernier chunk du flux inclut les statistiques complètes d'utilisation des tokens pour la requête. Cela vous permet de suivre les coûts avec précision en temps réel. Le streaming est idéal pour les interfaces de chat ou lors du traitement de longues sorties de modèles IA sans censure.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Gérez les erreurs de streaming de manière gracieuse. Des interruptions réseau peuvent survenir, implémentez donc une logique de réessai si votre application nécessite la complétion complète.
Appel de fonctions et outils
Le modèle abliterated prend en charge l'utilisation structurée des outils. Définissez vos outils dans le paramètre tools et spécifiez une stratégie tool_choice. Le modèle peut retourner des objets JSON conformes à vos schémas d'outils.
Cette fonctionnalité est essentielle pour créer des agents ou des applications qui doivent interagir avec des API externes. Le LLM de codage sans censure gère de manière fiable des structures JSON complexes. Vous pouvez contrôler le comportement du modèle à l'aide de paramètres tels que temperature et top_p pour équilibrer créativité et déterminisme.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Assurez-vous que vos définitions d'outils sont des JSON valides. Des schémas invalides peuvent entraîner des erreurs d'analyse dans la réponse.
Mode JSON
Pour des sorties structurelles strictes, définissez response_format sur {"type": "json_object"}. Le modèle forcera sa sortie à être un JSON valide. Cela est utile pour les intégrations API où vous devez analyser le résultat programmatiquement.
Le mode JSON fonctionne conjointement avec l'appel de fonctions et le streaming. Il garantit que vos analyseurs en aval ne cassent pas en raison de texte mal formé. Cela est particulièrement précieux pour les applications LLM sans censure en ligne nécessitant une extraction de données fiable.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Sachez que forcer le mode JSON peut légèrement augmenter la latence ou réduire la liberté créative dans le raisonnement du modèle. Utilisez-le uniquement lorsque un formatage strict est requis.
Paramètres et limites
Les paramètres pris en charge incluent temperature, top_p, stop, seed, presence_penalty et frequency_penalty. Ajustez-les pour affiner le style de sortie du modèle.
Les limites de débit sont fixées à 300 requêtes par minute et 8 requêtes simultanées par clé API. Le corps de la requête ne doit pas dépasser 8 Mo. Si vous dépassez ces limites, l'API retourne une erreur 429. Une erreur 401 indique une clé API invalide ou manquante. Le crédit prépayé est facturé uniquement pour l'utilisation réussie des tokens ; les erreurs et les refus sont gratuits.
Une limite stricte bloque le contenu sexuel impliquant des mineurs. Les requêtes qui enfreignent cette règle sont refusées sans frais. Le crédit n'expire jamais et vous pouvez le recharger en utilisant USDT (TRC20) ou USDC (Base). Commencez avec un crédit d'essai gratuit de 0,50 $ valable 7 jours.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.abliterated.cc/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| Limite de débit | 300 requêtes par minute et par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Connexion | Google ou e-mail et mot de passe |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Comment gérer l'authentification ?
Incluez votre clé API dans l'en-tête <code>Authorization</code> sous la forme <code>Bearer YOUR_API_KEY</code>. Générez votre clé sur la page Clé API en utilisant Google ou l'e-mail. Chaque compte dispose d'une clé active ; la génération d'une nouvelle clé remplace l'ancienne.
Que se passe-t-il si je manque de crédit ?
Les requêtes échouent, mais les erreurs et les refus ne consomment pas votre solde. Vous pouvez recharger en utilisant des cryptomonnaies (USDT ou USDC) à tout moment. Le crédit prépayé n'expire jamais, vous pouvez donc l'utiliser quand vous le souhaitez.
Le modèle est-il adapté au codage ?
Oui. Le LLM de codage sans censure est optimisé pour les tâches techniques, y compris la génération de code, le débogage et l'explication. Il gère les JSON complexes et les définitions d'outils de manière fiable sans refus inutile pour le contenu adulte légal.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.