NL ▾
API-sleutel aanvragen

Abliterated: Integreer de Uncensored LLM API

Begin binnen enkele minuten met de ongecensureerde API. Deze gids behandelt de basis-URL, authenticatie en de kern-endpoints voor chat-completies, streaming en gestructureerde output.

Basis-URL & Authenticatie

Onze API volgt de standaard OpenAI chat-completies interface. Dit betekent dat je bestaande clients, SDK's en codevoorbeelden kunt hergebruiken door simpelweg de basis-URL en API-sleutel aan te passen. Er is geen behoefte aan aangepaste headers of complexe authenticatieflows.

Gebruik https://api.abliterated.cc/v1 als je basis-URL. Je kunt een enkele API-sleutel genereren op de pagina API-sleutel ophalen. Gebruik Google inloggen of e-mail en wachtwoord om een account aan te maken. De sleutel wordt direct na het aanmaken weergegeven. Bewaar deze sleutel veilig, omdat deze directe toegang geeft tot je prepaid tegoed. Er is geen telefoonnummer nodig voor de registratie.

De dienst levert één ongecensureerd groot taalmodel dat is geoptimaliseerd voor ongecensureerde coderingstaken en algemeen redeneren. Je hoeft geen modelversie te selecteren; het endpoint routeert automatisch naar het ongecensureerde model.

Chat Completies Endpoint

Het primaire interactiepunt is het POST /v1/chat/completions endpoint. Stuur je gespreksgeschiedenis als een JSON-array van berichten. Het model verwerkt de invoer en retourneert een tekstuitvoer. Dit is een pure tekst-in, tekst-uit interface.

Zorg ervoor dat je verzoeken binnen de 8 MB body-limiet blijven. Het contextvenster ondersteunt tot 100.000 tokens voor de gecombineerde prompt en voltooiing. Als je geen max_tokens waarde opgeeft, genereert het model standaard 2.048 tokens.

curl https://api.abliterated.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Raadpleeg de prijspagina voor de kosten per token. Fouten en weigeringen verbruiken niet je prepaid tegoed.

Streamingresponsen

Voor lagere latentie en real-time gebruikerservaringen, schakel streaming in door de stream parameter in te stellen op true. De API retourneert een Server-Sent Events (SSE) stream. Elke chunk bevat gedeeltelijke tekstupdates.

Het laatste blok in de stream bevat de volledige tokenverbruiksstatistieken voor het verzoek. Hiermee kun je de kosten nauwkeurig in realtime bijhouden. Streaming is ideaal voor chatinterfaces of bij het verwerken van lange outputs van ongecensureerde AI-modellen.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Verwerk streamfouten op een beheersbare manier. Netwerkonderbrekingen kunnen voorkomen, dus implementeer retry-logica als je applicatie de volledige voltooiing vereist.

Function Calling & Tools

Het ongecensureerde model ondersteunt gestructureerd toolgebruik. Definieer je tools in de parameter tools en geef een tool_choice strategie op. Het model kan JSON-objecten retourneren die voldoen aan je toolschemas.

Deze functie is essentieel voor het bouwen van agents of applicaties die externe API's moeten aanroepen. De ongecensureerde coderings-LLM verwerkt complexe JSON-structuren betrouwbaar. Je kunt het gedrag van het model beheren met parameters zoals temperature en top_p om creativiteit en determinisme in evenwicht te brengen.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Zorg ervoor dat je tooldefinities geldig JSON-formaat zijn. Ongeldige schemas kunnen leiden tot parserfouten in de respons.

JSON-modus

Stel voor strikte structurele outputs response_format in op {"type": "json_object"}. Het model forceert de output om geldige JSON te zijn. Dit is handig voor API-integraties waarbij je het resultaat programmatisch moet parseren.

JSON-modus werkt samen met function calling en streaming. Het zorgt ervoor dat je nageschakelde parsers niet kapotgaan door slecht gevormde tekst. Dit is bijzonder waardevol voor online toepassingen van ongecensureerde LLM's die betrouwbare gegevensextractie vereisen.

from openai import OpenAI

client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Wees ervan bewust dat het afdwingen van JSON-modus de latentie licht kan verhogen of de creatieve vrijheid in het redeneren van het model kan verminderen. Gebruik het alleen wanneer strikte opmaak vereist is.

Parameters & Limieten

Ondersteunde parameters zijn temperature, top_p, stop, seed, presence_penalty en frequency_penalty. Pas deze aan om de outputstijl van het model te verfijnen.

Rate limits zijn ingesteld op 300 verzoeken per minuut en 8 gelijktijdige verzoeken per API-sleutel. Het verzoeklichaam mag niet groter zijn dan 8 MB. Als je deze limieten overschrijdt, retourneert de API een 429-fout. Een 401-fout geeft een ongeldige of ontbrekende API-sleutel aan. Prepaid tegoed wordt alleen in rekening gebracht voor succesvol tokengebruik; fouten en weigeringen zijn gratis.

Een harde inhoudslimiet blokkeert seksuele inhoud met minderjarigen. Verzoeken die deze regel schenden worden geweigerd zonder kosten. tegoed verloopt nooit en je kunt opwaarderen met USDT (TRC20) of USDC (Base). Begin met een trial credit van $0.50 geldig voor 7 dagen.

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.abliterated.cc/v1
AuthenticatieAuthorization: Bearer YOUR_KEY
Model-IDuncensored
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Contextvenster100.000 tokens (invoer + uitvoer)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
JSON-modusresponse_format: {"type": "json_object"}
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Verzoekgroottetot 8 MB
Rate limit300 verzoeken per minuut per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Bonus+5% vanaf $50, +10% vanaf $100
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Hoe ga ik om met authenticatie?

Voeg je API-sleutel toe aan de <code>Authorization</code>-header als <code>Bearer YOUR_API_KEY</code>. Genereer je sleutel op de API-sleutelpagina met Google of e-mail. Elk account heeft één actieve sleutel; het genereren van een nieuwe vervangt de oude.

Wat gebeurt er als ik mijn tegoed op heb?

Verzoeken falen, maar fouten en weigeringen verbruiken niet je saldo. Je kunt op elk moment opwaarderen met crypto (USDT of USDC). Prepaid tegoed vervalt nooit, dus je kunt het gebruiken wanneer je klaar bent.

Is het model geschikt voor coderen?

Ja. De ongecensureerde coderings-LLM is geoptimaliseerd voor technische taken, waaronder codegeneratie, foutopsporing en uitleg. Het verwerkt complexe JSON en tooldefinities betrouwbaar zonder onnodige weigeringen voor wettelijke volwassen inhoud.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, wijzig de basis-URL. Dat is de hele configuratie.