DE ▾
API-Schlüssel erhalten

Abliterated: Integriere die unzensierte LLM-API

Nutze die unzensierte API in wenigen Minuten. Diese Anleitung behandelt die Basis-URL, Authentifizierung und die Kern-Endpunkte für Chat-Vervollständigungen, Streaming und strukturierte Ausgaben.

Basis-URL & Authentifizierung

Unsere API folgt der Standard-OpenAI-Chat-Vervollständigungsschnittstelle. Das bedeutet, dass du bestehende Clients, SDKs und Code-Snippets wiederverwenden kannst, indem du einfach die Basis-URL und den API-Schlüssel aktualisierst. Es sind keine benutzerdefinierten Header oder komplexen Authentifizierungsabläufe erforderlich.

Verwende https://api.abliterated.cc/v1 als Basis-URL. Du kannst einen einzelnen API-Schlüssel auf der Seite API-Schlüssel abrufen. Verwende Google-Anmeldung oder E-Mail und Passwort, um ein Konto zu erstellen. Der Schlüssel wird sofort nach der Erstellung angezeigt. Bewahre diesen Schlüssel sicher auf, da er direkten Zugriff auf dein Prepaid-Guthaben gewährt. Für die Anmeldung ist keine Telefonnummer erforderlich.

Der Dienst bietet ein unzensiertes Large-Language-Modell, das für unzensierte Coding-LLM-Aufgaben und allgemeines Reasoning optimiert ist. Du musst keine Modellversion auswählen; der Endpunkt leitet automatisch zum abladierten Modell weiter.

Chat-Vervollständigungs-Endpunkt

Der primäre Interaktionspunkt ist der Endpunkt POST /v1/chat/completions. Sende deinen Konversationsverlauf als JSON-Array von Nachrichten. Das Modell verarbeitet die Eingabe und gibt eine Textvervollständigung zurück. Dies ist eine reine Text-in, Text-out-Schnittstelle.

Stelle sicher, dass deine Anfragen innerhalb der 8-MB-Körpergrenze bleiben. Das Kontextfenster unterstützt bis zu 100.000 Token für die kombinierte Prompt- und Vervollständigung. Wenn du keinen max_tokens-Wert angibst, generiert das Modell standardmäßig 2.048 Token.

curl https://api.abliterated.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Siehe die Preisseite für Token-Kosten. Fehler und Ablehnungen verbrauchen nicht dein Prepaid-Guthaben.

Streaming-Antworten

Für geringere Latenz und Echtzeit-Benutzererfahrungen aktiviere Streaming, indem du den Parameter stream auf true setzt. Die API gibt einen Server-Sent Events (SSE)-Stream zurück. Jeder Chunk enthält teilweise Textaktualisierungen.

Der letzte Chunk im Stream enthält die vollständigen Token-Nutzungsstatistiken für die Anfrage. Dies ermöglicht dir, Kosten in Echtzeit genau zu verfolgen. Streaming ist ideal für Chat-Schnittstellen oder bei der Verarbeitung langer Ausgaben unzensierter KI-Modelle.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Behandle Stream-Fehler angemessen. Netzwerkunterbrechungen können auftreten, implementiere daher Retry-Logik, wenn deine Anwendung die vollständige Vervollständigung benötigt.

Function Calling & Tools

Das unzensierte Modell unterstützt strukturierte Tool-Nutzung. Definiere deine Tools im Parameter tools und gib eine tool_choice-Strategie an. Das Modell kann JSON-Objekte zurückgeben, die deinen Tool-Schemas entsprechen.

Diese Funktion ist entscheidend für den Aufbau von Agenten oder Anwendungen, die mit externen APIs interagieren müssen. Das unzensierte Coding-LLM verarbeitet komplexe JSON-Strukturen zuverlässig. Du kannst das Verhalten des Modells über Parameter wie temperature und top_p steuern, um Kreativität und Determinismus auszubalancieren.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Stelle sicher, dass deine Tool-Definitionen gültiges JSON sind. Ungültige Schemas können zu Parsing-Fehlern in der Antwort führen.

JSON-Modus

Für strenge strukturelle Ausgaben setze response_format auf {"type": "json_object"}. Das Modell zwingt seine Ausgabe zu gültigem JSON. Dies ist nützlich für API-Integrationen, bei denen du das Ergebnis programmatisch analysieren musst.

Der JSON-Modus funktioniert neben Function Calling und Streaming. Er stellt sicher, dass deine Downstream-Parser nicht aufgrund fehlerhaften Texts fehlschlagen. Dies ist besonders wertvoll für unzensierte LLM-Online-Anwendungen, die zuverlässige Datenextraktion erfordern.

from openai import OpenAI

client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Sei dir bewusst, dass das Erzwingen des JSON-Modus die Latenz leicht erhöhen oder die Kreativität im reasoning des Modells etwas einschränken kann. Verwende ihn nur, wenn strenge Formatierung erforderlich ist.

Parameter & Limits

Unterstützte Parameter sind temperature, top_p, stop, seed, presence_penalty und frequency_penalty. Passe diese an, um den Ausgabestil des Modells fein abzustimmen.

Die Ratenlimits liegen bei 300 Anfragen pro Minute und 8 parallelen Anfragen pro API-Schlüssel. Der Anfragetext darf 8 MB nicht überschreiten. Wenn du diese Limits überschreitest, gibt die API einen 429-Fehler zurück. Ein 401-Fehler zeigt einen ungültigen oder fehlenden API-Schlüssel an. Prepaid-Guthaben wird nur für erfolgreiche Token-Nutzung belastet; Fehler und Ablehnungen sind kostenlos.

Eine harte Inhaltsgrenze blockiert sexuelle Inhalte mit Minderjährigen. Anfragen, die diese Regel verletzen, werden abgelehnt und nicht belastet. Guthaben verfällt nie, und du kannst es mit USDT (TRC20) oder USDC (Base) aufladen. Starte mit einem Testguthaben von $0,50, das 7 Tage gültig ist.

API-Spezifikation

Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
EndpunktePOST /v1/chat/completions · GET /v1/models
Base-URLhttps://api.abliterated.cc/v1
AuthentifizierungAuthorization: Bearer YOUR_KEY
Modell-IDuncensored
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
JSON-Modusresponse_format: {"type": "json_object"}
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Anfragegrößebis 8 MB
Ratenlimit300 Anfragen pro Minute und Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
AnmeldungGoogle oder E-Mail und Passwort

Fehler und Lösungen

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Wie handle ich die Authentifizierung?

Füge deinen API-Schlüssel in den <code>Authorization</code>-Header als <code>Bearer YOUR_API_KEY</code> ein. Generiere deinen Schlüssel auf der API-Schlüssel-Seite über Google oder E-Mail. Jedes Konto hat einen aktiven Schlüssel; das Generieren eines neuen ersetzt den alten.

Was passiert, wenn mein Guthaben aufgebraucht ist?

Anfragen schlagen fehl, aber Fehler und Ablehnungen verbrauchen nicht dein Guthaben. Du kannst jederzeit per Krypto (USDT oder USDC) aufladen. Prepaid-Guthaben verfällt nie, sodass du es nutzen kannst, wann immer du bereit bist.

Ist das Modell für Coding geeignet?

Ja. Das unzensierte Coding-LLM ist für technische Aufgaben optimiert, einschließlich Codegenerierung, Debugging und Erklärung. Es verarbeitet komplexes JSON und Tool-Definitionen zuverlässig, ohne unnötige Ablehnungen für legale Erwachseneninhalte.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.