Abliterated: Zintegruj API LLM bez cenzury
Zacznij korzystać z API abliterated w kilka minut. Przewodnik obejmuje bazowy URL, uwierzytelnianie i podstawowe endpointy dla uzupełnień czatu, strumieniowania i danych strukturalnych.
Bazowy URL i uwierzytelnianie
Nasze API podąża za standardowym interfejsem chat-completions OpenAI. Oznacza to, że możesz ponownie wykorzystać istniejących klientów, SDK i fragmenty kodu, po prostu aktualizując bazowy URL i klucz API. Nie ma potrzeby customowych nagłówków ani złożonych przepływów uwierzytelniania.
Użyj https://api.abliterated.cc/v1 jako bazowego URL. Możesz wygenerować pojedynczy klucz API na stronie Pobierz klucz API. Zaloguj się za pomocą Google lub podając adres e-mail i hasło, aby utworzyć konto. Klucz jest wyświetlany natychmiast po utworzeniu. Przechowuj ten klucz bezpiecznie, ponieważ zapewnia bezpośredni dostęp do Twojego przedpłaconego kredytu. Nie jest wymagany numer telefonu podczas rejestracji.
Usługa obsługuje jeden bez cenzury duży model językowy zoptymalizowany pod kątem zadań bez cenzury model LLM do kodowania i ogólnego rozumowania. Nie musisz wybierać wersji modelu; endpoint automatycznie kieruje do modelu abliterated.
Endpoint uzupełnień czatu
Podstawowym punktem interakcji jest endpoint POST /v1/chat/completions. Wyślij historię rozmowy jako tablicę JSON wiadomości. Model przetworzy dane wejściowe i zwróci uzupełnienie tekstu. Jest to czysty interfejs tekst-wejście, tekst-wyjście.
Upewnij się, że Twoje zapytania mieszczą się w limicie ciała 8 MB. Okno kontekstu obsługuje do 100 000 tokenów dla połączonego promptu i uzupełnienia. Jeśli nie określisz wartości max_tokens, model domyślnie generuje 2048 tokenów.
curl https://api.abliterated.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Odnoś się do strony cennika w sprawie kosztów tokenów. Błędy i odmowy nie zużywają Twojego przedpłaconego kredytu.
Odpowiedzi strumieniowe
Aby zmniejszyć opóźnienia i zapewnić doświadczenia użytkownika w czasie rzeczywistym, włącz strumieniowanie, ustawiając parametr stream na true. API zwraca strumień zdarzeń wysłanych przez serwer (SSE). Każdy fragment zawiera częściowe aktualizacje tekstu.
Ostateczny fragment strumienia zawiera pełne statystyki użycia tokenów dla zapytania. Pozwala to na dokładne śledzenie kosztów w czasie rzeczywistym. Strumieniowanie jest idealne dla interfejsów czatu lub podczas przetwarzania długich wyników modeli AI bez cenzury.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Obsłuż błędy strumieniowania poprawnie. Mogą wystąpić przerwy w sieci, dlatego zaimplementuj logikę ponownych prób, jeśli Twoja aplikacja wymaga pełnego ukończenia generowania.
Wywoływanie funkcji i narzędzia
Model bez cenzury obsługuje strukturalne użycie narzędzi. Zdefiniuj swoje narzędzia w parametrze tools i określ strategię tool_choice. Model może zwracać obiekty JSON, które są zgodne ze schematami Twoich narzędzi.
Ta funkcja jest niezbędna do tworzenia agentów lub aplikacji, które muszą interagować z zewnętrznymi API. Bez cenzury model do kodowania obsługuje złożone struktury JSON niezawodnie. Możesz kontrolować zachowanie modelu za pomocą parametrów takich jak temperature i top_p, aby zbalansować kreatywność i determinizm.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Upewnij się, że definicje Twoich narzędzi są poprawnym JSON. Nieprawidłowe schematy mogą prowadzić do błędów parsowania w odpowiedzi.
Tryb JSON
Dla ścisłych wyjść strukturalnych ustaw response_format na {"type": "json_object"}. Model wymusi, aby jego wynik był poprawnym JSON. Jest to przydatne w integracjach API, gdzie musisz przeanalizować wynik programistycznie.
Tryb JSON działa wraz z wywoływaniem funkcji i strumieniowaniem. Zapewnia, że Twoje kolejne parsery nie ulegną awarii z powodu niepoprawnego tekstu. Jest to szczególnie cenne dla aplikacji online LLM bez cenzury, które wymagają niezawodnego wyodrębniania danych.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Pamiętaj, że wymuszenie trybu JSON może nieznacznie zwiększyć opóźnienia lub ograniczyć swobodę twórczą w rozumowaniu modelu. Używaj go tylko wtedy, gdy wymagany jest ścisły format.
Parametry i limity
Obsługiwane parametry obejmują temperature, top_p, stop, seed, presence_penalty oraz frequency_penalty. Dostosuj je, aby precyzyjnie dostosować styl wyniku modelu.
Limity zapytań wynoszą 300 zapytań na minutę i 8 równoległych zapytań na klucz API. Ciało zapytania nie może przekraczać 8 MB. Jeśli przekroczysz te limity, API zwróci błąd 429. Błąd 401 oznacza nieprawidłowy lub brakujący klucz API. Przedpłacony kredyt jest naliczany tylko za pomyślne użycie tokenów; błędy i odrzucenia są darmowe.
Sztywne ograniczenie treści blokuje treści seksualne z udziałem osób niepełnoletnich. Żądania naruszające tę zasadę są odrzucane bez naliczenia opłaty. Kredyt nie wygasa, a doładować go możesz za pomocą USDT (TRC20) lub USDC (Base). Zacznij od darmowego kredytu próbnego w wysokości $0.50 ważnego przez 7 dni.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.abliterated.cc/v1 |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| ID modelu | uncensored |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Tryb JSON | response_format: {"type": "json_object"} |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Rozmiar zapytania | do 8 MB |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Bonus | +5% od $50, +10% od $100 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Jak obsłużyć uwierzytelnianie?
Dołącz swój klucz API w nagłówku <code>Authorization</code> jako <code>Bearer YOUR_API_KEY</code>. Wygeneruj klucz na stronie klucza API za pomocą Google lub e-mail. Każde konto ma jeden aktywny klucz; wygenerowanie nowego zastępuje poprzedni.
Co się stanie, gdy zabraknie kredytu?
Zapytania nie powiedzą się, ale błędy i odmowy nie zużywają Twojego salda. Możesz doładować saldo używając kryptowalut (USDT lub USDC) w dowolnym momencie. Przedpłacony kredyt nigdy nie wygasa, więc możesz go użyć, gdy będziesz gotowy.
Czy model nadaje się do kodowania?
Tak. Bez cenzury model do kodowania jest zoptymalizowany pod kątem zadań technicznych, w tym generowania kodu, debugowania i wyjaśniania. Obsługuje złożone JSON i definicje narzędzi niezawodnie, bez niepotrzebnych odrzuceń dla legalnej treści dla dorosłych.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.