Abliterated: Integriere die unzensierte LLM-API
Nutze die unzensierte API in wenigen Minuten. Diese Anleitung behandelt die Basis-URL, Authentifizierung und die Kern-Endpunkte für Chat-Vervollständigungen, Streaming und strukturierte Ausgaben.
Basis-URL & Authentifizierung
Unsere API folgt der Standard-OpenAI-Chat-Vervollständigungsschnittstelle. Das bedeutet, dass du bestehende Clients, SDKs und Code-Snippets wiederverwenden kannst, indem du einfach die Basis-URL und den API-Schlüssel aktualisierst. Es sind keine benutzerdefinierten Header oder komplexen Authentifizierungsabläufe erforderlich.
Verwende https://api.abliterated.cc/v1 als Basis-URL. Du kannst einen einzelnen API-Schlüssel auf der Seite API-Schlüssel abrufen. Verwende Google-Anmeldung oder E-Mail und Passwort, um ein Konto zu erstellen. Der Schlüssel wird sofort nach der Erstellung angezeigt. Bewahre diesen Schlüssel sicher auf, da er direkten Zugriff auf dein Prepaid-Guthaben gewährt. Für die Anmeldung ist keine Telefonnummer erforderlich.
Der Dienst bietet ein unzensiertes Large-Language-Modell, das für unzensierte Coding-LLM-Aufgaben und allgemeines Reasoning optimiert ist. Du musst keine Modellversion auswählen; der Endpunkt leitet automatisch zum abladierten Modell weiter.
Chat-Vervollständigungs-Endpunkt
Der primäre Interaktionspunkt ist der Endpunkt POST /v1/chat/completions. Sende deinen Konversationsverlauf als JSON-Array von Nachrichten. Das Modell verarbeitet die Eingabe und gibt eine Textvervollständigung zurück. Dies ist eine reine Text-in, Text-out-Schnittstelle.
Stelle sicher, dass deine Anfragen innerhalb der 8-MB-Körpergrenze bleiben. Das Kontextfenster unterstützt bis zu 100.000 Token für die kombinierte Prompt- und Vervollständigung. Wenn du keinen max_tokens-Wert angibst, generiert das Modell standardmäßig 2.048 Token.
curl https://api.abliterated.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Siehe die Preisseite für Token-Kosten. Fehler und Ablehnungen verbrauchen nicht dein Prepaid-Guthaben.
Streaming-Antworten
Für geringere Latenz und Echtzeit-Benutzererfahrungen aktiviere Streaming, indem du den Parameter stream auf true setzt. Die API gibt einen Server-Sent Events (SSE)-Stream zurück. Jeder Chunk enthält teilweise Textaktualisierungen.
Der letzte Chunk im Stream enthält die vollständigen Token-Nutzungsstatistiken für die Anfrage. Dies ermöglicht dir, Kosten in Echtzeit genau zu verfolgen. Streaming ist ideal für Chat-Schnittstellen oder bei der Verarbeitung langer Ausgaben unzensierter KI-Modelle.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Behandle Stream-Fehler angemessen. Netzwerkunterbrechungen können auftreten, implementiere daher Retry-Logik, wenn deine Anwendung die vollständige Vervollständigung benötigt.
Function Calling & Tools
Das unzensierte Modell unterstützt strukturierte Tool-Nutzung. Definiere deine Tools im Parameter tools und gib eine tool_choice-Strategie an. Das Modell kann JSON-Objekte zurückgeben, die deinen Tool-Schemas entsprechen.
Diese Funktion ist entscheidend für den Aufbau von Agenten oder Anwendungen, die mit externen APIs interagieren müssen. Das unzensierte Coding-LLM verarbeitet komplexe JSON-Strukturen zuverlässig. Du kannst das Verhalten des Modells über Parameter wie temperature und top_p steuern, um Kreativität und Determinismus auszubalancieren.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Stelle sicher, dass deine Tool-Definitionen gültiges JSON sind. Ungültige Schemas können zu Parsing-Fehlern in der Antwort führen.
JSON-Modus
Für strenge strukturelle Ausgaben setze response_format auf {"type": "json_object"}. Das Modell zwingt seine Ausgabe zu gültigem JSON. Dies ist nützlich für API-Integrationen, bei denen du das Ergebnis programmatisch analysieren musst.
Der JSON-Modus funktioniert neben Function Calling und Streaming. Er stellt sicher, dass deine Downstream-Parser nicht aufgrund fehlerhaften Texts fehlschlagen. Dies ist besonders wertvoll für unzensierte LLM-Online-Anwendungen, die zuverlässige Datenextraktion erfordern.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Sei dir bewusst, dass das Erzwingen des JSON-Modus die Latenz leicht erhöhen oder die Kreativität im reasoning des Modells etwas einschränken kann. Verwende ihn nur, wenn strenge Formatierung erforderlich ist.
Parameter & Limits
Unterstützte Parameter sind temperature, top_p, stop, seed, presence_penalty und frequency_penalty. Passe diese an, um den Ausgabestil des Modells fein abzustimmen.
Die Ratenlimits liegen bei 300 Anfragen pro Minute und 8 parallelen Anfragen pro API-Schlüssel. Der Anfragetext darf 8 MB nicht überschreiten. Wenn du diese Limits überschreitest, gibt die API einen 429-Fehler zurück. Ein 401-Fehler zeigt einen ungültigen oder fehlenden API-Schlüssel an. Prepaid-Guthaben wird nur für erfolgreiche Token-Nutzung belastet; Fehler und Ablehnungen sind kostenlos.
Eine harte Inhaltsgrenze blockiert sexuelle Inhalte mit Minderjährigen. Anfragen, die diese Regel verletzen, werden abgelehnt und nicht belastet. Guthaben verfällt nie, und du kannst es mit USDT (TRC20) oder USDC (Base) aufladen. Starte mit einem Testguthaben von $0,50, das 7 Tage gültig ist.
API-Spezifikation
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.abliterated.cc/v1 |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Anfragegröße | bis 8 MB |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Wie handle ich die Authentifizierung?
Füge deinen API-Schlüssel in den <code>Authorization</code>-Header als <code>Bearer YOUR_API_KEY</code> ein. Generiere deinen Schlüssel auf der API-Schlüssel-Seite über Google oder E-Mail. Jedes Konto hat einen aktiven Schlüssel; das Generieren eines neuen ersetzt den alten.
Was passiert, wenn mein Guthaben aufgebraucht ist?
Anfragen schlagen fehl, aber Fehler und Ablehnungen verbrauchen nicht dein Guthaben. Du kannst jederzeit per Krypto (USDT oder USDC) aufladen. Prepaid-Guthaben verfällt nie, sodass du es nutzen kannst, wann immer du bereit bist.
Ist das Modell für Coding geeignet?
Ja. Das unzensierte Coding-LLM ist für technische Aufgaben optimiert, einschließlich Codegenerierung, Debugging und Erklärung. Es verarbeitet komplexes JSON und Tool-Definitionen zuverlässig, ohne unnötige Ablehnungen für legale Erwachseneninhalte.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.