PL ▾
Pobierz klucz API

Abliterated: Zintegruj API LLM bez cenzury

Zacznij korzystać z API abliterated w kilka minut. Przewodnik obejmuje bazowy URL, uwierzytelnianie i podstawowe endpointy dla uzupełnień czatu, strumieniowania i danych strukturalnych.

Bazowy URL i uwierzytelnianie

Nasze API podąża za standardowym interfejsem chat-completions OpenAI. Oznacza to, że możesz ponownie wykorzystać istniejących klientów, SDK i fragmenty kodu, po prostu aktualizując bazowy URL i klucz API. Nie ma potrzeby customowych nagłówków ani złożonych przepływów uwierzytelniania.

Użyj https://api.abliterated.cc/v1 jako bazowego URL. Możesz wygenerować pojedynczy klucz API na stronie Pobierz klucz API. Zaloguj się za pomocą Google lub podając adres e-mail i hasło, aby utworzyć konto. Klucz jest wyświetlany natychmiast po utworzeniu. Przechowuj ten klucz bezpiecznie, ponieważ zapewnia bezpośredni dostęp do Twojego przedpłaconego kredytu. Nie jest wymagany numer telefonu podczas rejestracji.

Usługa obsługuje jeden bez cenzury duży model językowy zoptymalizowany pod kątem zadań bez cenzury model LLM do kodowania i ogólnego rozumowania. Nie musisz wybierać wersji modelu; endpoint automatycznie kieruje do modelu abliterated.

Endpoint uzupełnień czatu

Podstawowym punktem interakcji jest endpoint POST /v1/chat/completions. Wyślij historię rozmowy jako tablicę JSON wiadomości. Model przetworzy dane wejściowe i zwróci uzupełnienie tekstu. Jest to czysty interfejs tekst-wejście, tekst-wyjście.

Upewnij się, że Twoje zapytania mieszczą się w limicie ciała 8 MB. Okno kontekstu obsługuje do 100 000 tokenów dla połączonego promptu i uzupełnienia. Jeśli nie określisz wartości max_tokens, model domyślnie generuje 2048 tokenów.

curl https://api.abliterated.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Odnoś się do strony cennika w sprawie kosztów tokenów. Błędy i odmowy nie zużywają Twojego przedpłaconego kredytu.

Odpowiedzi strumieniowe

Aby zmniejszyć opóźnienia i zapewnić doświadczenia użytkownika w czasie rzeczywistym, włącz strumieniowanie, ustawiając parametr stream na true. API zwraca strumień zdarzeń wysłanych przez serwer (SSE). Każdy fragment zawiera częściowe aktualizacje tekstu.

Ostateczny fragment strumienia zawiera pełne statystyki użycia tokenów dla zapytania. Pozwala to na dokładne śledzenie kosztów w czasie rzeczywistym. Strumieniowanie jest idealne dla interfejsów czatu lub podczas przetwarzania długich wyników modeli AI bez cenzury.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Obsłuż błędy strumieniowania poprawnie. Mogą wystąpić przerwy w sieci, dlatego zaimplementuj logikę ponownych prób, jeśli Twoja aplikacja wymaga pełnego ukończenia generowania.

Wywoływanie funkcji i narzędzia

Model bez cenzury obsługuje strukturalne użycie narzędzi. Zdefiniuj swoje narzędzia w parametrze tools i określ strategię tool_choice. Model może zwracać obiekty JSON, które są zgodne ze schematami Twoich narzędzi.

Ta funkcja jest niezbędna do tworzenia agentów lub aplikacji, które muszą interagować z zewnętrznymi API. Bez cenzury model do kodowania obsługuje złożone struktury JSON niezawodnie. Możesz kontrolować zachowanie modelu za pomocą parametrów takich jak temperature i top_p, aby zbalansować kreatywność i determinizm.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Upewnij się, że definicje Twoich narzędzi są poprawnym JSON. Nieprawidłowe schematy mogą prowadzić do błędów parsowania w odpowiedzi.

Tryb JSON

Dla ścisłych wyjść strukturalnych ustaw response_format na {"type": "json_object"}. Model wymusi, aby jego wynik był poprawnym JSON. Jest to przydatne w integracjach API, gdzie musisz przeanalizować wynik programistycznie.

Tryb JSON działa wraz z wywoływaniem funkcji i strumieniowaniem. Zapewnia, że Twoje kolejne parsery nie ulegną awarii z powodu niepoprawnego tekstu. Jest to szczególnie cenne dla aplikacji online LLM bez cenzury, które wymagają niezawodnego wyodrębniania danych.

from openai import OpenAI

client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Pamiętaj, że wymuszenie trybu JSON może nieznacznie zwiększyć opóźnienia lub ograniczyć swobodę twórczą w rozumowaniu modelu. Używaj go tylko wtedy, gdy wymagany jest ścisły format.

Parametry i limity

Obsługiwane parametry obejmują temperature, top_p, stop, seed, presence_penalty oraz frequency_penalty. Dostosuj je, aby precyzyjnie dostosować styl wyniku modelu.

Limity zapytań wynoszą 300 zapytań na minutę i 8 równoległych zapytań na klucz API. Ciało zapytania nie może przekraczać 8 MB. Jeśli przekroczysz te limity, API zwróci błąd 429. Błąd 401 oznacza nieprawidłowy lub brakujący klucz API. Przedpłacony kredyt jest naliczany tylko za pomyślne użycie tokenów; błędy i odrzucenia są darmowe.

Sztywne ograniczenie treści blokuje treści seksualne z udziałem osób niepełnoletnich. Żądania naruszające tę zasadę są odrzucane bez naliczenia opłaty. Kredyt nie wygasa, a doładować go możesz za pomocą USDT (TRC20) lub USDC (Base). Zacznij od darmowego kredytu próbnego w wysokości $0.50 ważnego przez 7 dni.

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
EndpointyPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.abliterated.cc/v1
UwierzytelnianieAuthorization: Bearer YOUR_KEY
ID modeluuncensored
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Tryb JSONresponse_format: {"type": "json_object"}
Równoległe zapytaniado 8 jednocześnie na klucz
Rozmiar zapytaniado 8 MB
Limit zapytań300 zapytań na minutę na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Bonus+5% od $50, +10% od $100
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
LogowanieGoogle albo e-mail i hasło

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Jak obsłużyć uwierzytelnianie?

Dołącz swój klucz API w nagłówku <code>Authorization</code> jako <code>Bearer YOUR_API_KEY</code>. Wygeneruj klucz na stronie klucza API za pomocą Google lub e-mail. Każde konto ma jeden aktywny klucz; wygenerowanie nowego zastępuje poprzedni.

Co się stanie, gdy zabraknie kredytu?

Zapytania nie powiedzą się, ale błędy i odmowy nie zużywają Twojego salda. Możesz doładować saldo używając kryptowalut (USDT lub USDC) w dowolnym momencie. Przedpłacony kredyt nigdy nie wygasa, więc możesz go użyć, gdy będziesz gotowy.

Czy model nadaje się do kodowania?

Tak. Bez cenzury model do kodowania jest zoptymalizowany pod kątem zadań technicznych, w tym generowania kodu, debugowania i wyjaśniania. Obsługuje złożone JSON i definicje narzędzi niezawodnie, bez niepotrzebnych odrzuceń dla legalnej treści dla dorosłych.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.