FR ▾
Obtenir une clé API

API orientée code

API LLM sans login pour les développeurs

Une API hébergée compatible OpenAI pour un modèle ablitré qui répond sans garde-fous. Intégrez un raisonnement sans censure dans vos pipelines avec un prix prévisible par token.

  • Endpoints compatibles OpenAI
  • 0,25 $ par 1M de tokens d'entrée
  • Streaming et outils pris en charge

Essayez avec une seule requête

curl https://api.abliterated.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
par 1M de tokens d'entrée
$0.25
Tokens de sortie / 1M
$1.00
contexte de tokens
100,000
crédit d'essai
$0.50
requêtes par minute
300

Ce que vous obtenez

Tarification prévisible

Payez uniquement pour les tokens utilisés. Les erreurs et les refus coûtent rien, et le crédit prépayé n'expire jamais.

Support du streaming

Recevez l'utilisation des tokens dans le dernier chunk via Server-Sent Events pour des réponses en temps réel.

Appel de fonctions

Définissez des fonctions et laissez le modèle les appeler avec une sortie JSON structurée.

Mode JSON

Forcez le modèle à retourner strictement des objets JSON valides en utilisant le paramètre response_format.

Fenêtre de contexte de 100k

Traitez de grands prompts avec une limite de 100 000 tokens pour le prompt et la complétion combinés.

Authentification simple

Inscrivez-vous avec Google ou e-mail pour obtenir une clé API instantanément. Aucun numéro de téléphone requis.

Comment ça marche

  1. Obtenez votre clé

    Inscrivez-vous via Google ou e-mail et recevez immédiatement votre clé API unique.

  2. Recharger le crédit

    Ajoutez du crédit prépayé en utilisant USDT ou USDC, ou commencez avec le solde d'essai gratuit.

  3. Intégrer et construire

    Pointez votre SDK vers notre URL de base et commencez à streamer des réponses ou à appeler des outils.

Ce que les gens créent avec

Pipelines de génération de contenu

Alimentez le modèle ablitré avec de grands lots de prompts sans heurter les filtres de contenu standard. Parfait pour l'écriture créative ou la synthèse de données où les garde-fous vous ralentissent.

Assistants développeurs

Intégrez la complétion de code sans censure dans votre IDE ou vos outils CLI. Le modèle répond aux questions techniques sans refuser la syntaxe de cas limites ou les choix de bibliothèques controversés.

Recherche et analyse

Utilisez l'API pour la recherche en sécurité ou l'analyse de sujets controversés où les modèles standard pourraient trop affiner ou refuser de répondre. Analysez la sortie brute directement dans votre base de données.

Préparation des données d'ajustement fin

Générez de grands volumes de données d'entraînement diverses sans que le modèle refuse de discuter de sujets de niche ou pour adultes. Utilisez la fenêtre de contexte de 100k pour traiter de longs documents.

Pourquoi Abliterated ?

La plupart des fournisseurs d'API proposent une interface de chat ou une liste de modèles sélectionnés. Nous proposons une expérience API pure, orientée code. Lorsque vous recherchez un LLM sans censure ou un modèle ablitré, vous devez généralement gérer l'infrastructure GPU ou faire face à des obligations de connexion. Notre API propose un seul modèle à poids ouverts spécifique, ajusté pour répondre sans refus de contenu pour un usage adulte légal.

Ce n'est pas un site de chat. C'est un endpoint texte-entrée, texte-sortie conçu pour les développeurs. Vous bénéficiez d'une compatibilité SDK complète, du support du streaming et de l'appel de fonctions. Nous gérons le matériel ; vous gérez l'intégration.

API compatible OpenAI

Nous implémentons les endpoints standard POST /v1/chat/completions et GET /v1/models. Cela signifie que vous pouvez utiliser les SDK officiels OpenAI ou n'importe quel client compatible en changeant simplement l'URL de base vers https://api.abliterated.cc/v1 et en fournissant votre clé API.

L'ID du modèle est uncensored. C'est un modèle à poids ouverts exécuté sur nos propres serveurs. Ce n'est pas GPT, Claude ou le modèle d'un autre fournisseur. Il est conçu pour être direct et sans filtre, fournissant une sortie de texte brut pour vos applications.

Pour qui c'est (et pour qui ce n'est pas)

Cette API est destinée aux développeurs qui ont besoin d'une génération de texte fiable et sans censure sans gérer de GPU. Elle est idéale pour les pipelines nécessitant un haut volume, le streaming ou l'intégration d'outils.

Ce n'est pas pour vous si : vous avez besoin de génération d'images, d'audio ou de vidéo. Nous ne proposons pas d'embeddings, de fine-tuning ou d'OCR. Vous ne cherchez pas une interface de chat ou une liste de modèles sélectionnés. Si vous avez besoin d'une garantie SLA, d'une certification SOC2 ou d'un déploiement on-prem, cette API hébergée n'est pas adaptée. Nous ne proposons pas non plus de routage de modèles entre différents fournisseurs.

Tarification transparente

Nous facturons 0,25 $ par 1M de tokens d'entrée et 1,00 $ par 1M de tokens de sortie. Vous payez pour l'utilisation réelle des tokens ; les erreurs et les refus sont gratuits. Le crédit prépayé n'expire jamais, et il n'y a pas de frais mensuels. Vous pouvez recharger avec USDT (TRC20) ou USDC (Base) en montants entiers de 10 $ à 500 $. Vous bénéficiez d'un bonus de +5 % à partir de 50 $ et de +10 % à partir de 100 $. Pas de cartes, pas de PayPal. Les nouveaux comptes reçoivent 0,50 $ de crédit d'essai pendant 7 jours, sans carte nécessaire.

Questions et réponses

Quelle est la taille de la fenêtre de contexte ?

Le modèle prend en charge une fenêtre de contexte de 100 000 tokens pour le prompt et la complétion combinés. La sortie maximale par requête est de 32 000 tokens, ou 2 048 tokens si vous ne définissez pas le paramètre max_tokens.

L'API prend-elle en charge le streaming ?

Oui. Vous pouvez activer le streaming en définissant le paramètre stream sur true. Les détails d'utilisation des tokens sont inclus dans le dernier chunk de la réponse.

Puis-je utiliser cela pour l'appel de fonctions ?

Oui. L'API prend en charge l'appel de fonctions avec tool_choice et le format standard des outils. Vous pouvez également forcer la sortie JSON en utilisant le paramètre response_format.

Comment recharger mon crédit ?

Nous acceptons USDT (TRC20) et USDC (Base). Les paiements sont traités par transfert crypto. Vous pouvez recharger n'importe quel montant entier entre 10 $ et 500 $.

Existe-t-il une limite sur les requêtes concurrentes ?

Chaque clé API est limitée à 300 requêtes par minute et 8 requêtes concurrentes. Le corps de la requête doit faire moins de 8 Mo. Si vous dépassez ces limites, vous recevrez une erreur.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.