Abliterated: Интеграция API LLM без цензуры
Начните использовать API abliterated за считанные минуты. В этом руководстве описаны базовый URL, аутентификация и основные эндпоинты для завершения чата, потоковой передачи и структурированного вывода.
Базовый URL и аутентификация
Наш API следует стандартному интерфейсу OpenAI chat-completions. Это позволяет вам использовать существующих клиентов, SDK и сниппеты кода, просто обновив базовый URL и API-ключ. Не нужны кастомные заголовки или сложные потоки аутентификации.
Используйте https://api.abliterated.cc/v1 в качестве базового URL. Вы можете создать один API-ключ на странице получения API-ключа. Для создания учётной записи используйте вход через Google или адрес электронной почты и пароль. Ключ отображается сразу после создания. Храните его в безопасности, так как он обеспечивает прямой доступ к вашему предоплаченному балансу. Для регистрации не требуется номер телефона.
Сервис предоставляет одну uncensored large language model, оптимизированную для задач uncensored coding llm и общего рассуждения. Вам не нужно выбирать версию модели; эндпоинт автоматически маршрутизирует запросы к модели abliterated.
Эндпоинт завершения чата
Основная точка взаимодействия — эндпоинт POST /v1/chat/completions. Отправляйте историю переписки в виде JSON-массива сообщений. Модель обработает ввод и вернет текстовое завершение. Это интерфейс «чистый текст на входе — текст на выходе».
Убедитесь, что ваши запросы укладываются в лимит тела 8 МБ. Контекстное окно поддерживает до 100 000 токенов для объединенного промпта и завершения. Если вы не укажете значение max_tokens, модель по умолчанию сгенерирует 2 048 токенов.
curl https://api.abliterated.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Ознакомьтесь со страницей тарифов для стоимости токенов. Ошибки и отказы не списывают ваш предоплаченный баланс.
Потоковые ответы
Для снижения задержки и работы в реальном времени включите потоковую передачу, установив параметр stream в значение true. API возвращает поток Server-Sent Events (SSE). Каждый чанк содержит частичные обновления текста.
Последний фрагмент потока содержит полную статистику использования токенов для запроса. Это позволяет точно отслеживать расходы в реальном времени. Потоковая передача идеально подходит для интерфейсов чата или при обработке длинных выходов моделей ИИ без цензуры.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Обработка ошибок потока должна быть корректной. Возможны разрывы сети, поэтому реализуйте логику повторных попыток, если вашему приложению требуется полное завершение.
Вызов функций и инструменты
Модель abliterated поддерживает структурированное использование инструментов. Определите свои инструменты в параметре tools и укажите стратегию tool_choice. Модель может возвращать JSON-объекты, соответствующие вашим схемам инструментов.
Эта функция необходима для создания агентов или приложений, которым нужно взаимодействовать с внешними API. uncensored coding llm надежно обрабатывает сложные структуры JSON. Вы можете управлять поведением модели с помощью параметров temperature и top_p, чтобы сбалансировать креативность и детерминизм.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Убедитесь, что определения ваших инструментов являются валидным JSON. Неверные схемы могут привести к ошибкам парсинга в ответе.
JSON-режим
Для строгого структурного вывода установите response_format в значение {"type": "json_object"}. Модель принудительно сделает свой вывод валидным JSON. Это полезно для интеграций API, где необходимо программно парсить результат.
JSON-режим работает вместе с вызовом функций и потоковой передачей. Он гарантирует, что ваши последующие парсеры не сломаются из-за некорректного текста. Это особенно ценно для онлайн-приложений LLM без цензуры, которым требуется надёжное извлечение данных.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Имейте в виду, что принудительный JSON-режим может немного увеличить задержку или снизить креативность в рассуждениях модели. Используйте его только при необходимости строгого форматирования.
Параметры и лимиты
Поддерживаемые параметры включают temperature, top_p, stop, seed, presence_penalty и frequency_penalty. Настройте их для тонкой настройки стиля вывода модели.
Лимит запросов — 300 запросов в минуту и 8 параллельных запросов на API-ключ. Тело запроса не должно превышать 8 МБ. При превышении лимитов API возвращает ошибку 429. Ошибка 401 указывает на недействительный или отсутствующий API-ключ. Предоплаченный баланс списывается только за успешное использование токенов; ошибки и отказы бесплатны.
Жёсткое ограничение контента блокирует сексуальный контент с участием несовершеннолетних. Запросы, нарушающие это правило, отклоняются без списания средств. Баланс не сгорает, и вы можете пополнить его с помощью USDT (TRC20) или USDC (Base). Начните с пробного баланса в размере $0.50, действительного в течение 7 дней.
Характеристики API
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.abliterated.cc/v1 |
| Авторизация | Authorization: Bearer YOUR_KEY |
| ID модели | uncensored |
| Максимум ответа | до остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Контекстное окно | 100 000 токенов (вход и ответ вместе) |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| JSON-режим | response_format: {"type": "json_object"} |
| Параллельные запросы | до 8 одновременно на ключ |
| Размер запроса | до 8 МБ |
| Лимит запросов | 300 запросов в минуту на ключ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Бонус | +5% от $50, +10% от $100 |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
| Вход | Google или e-mail и пароль |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Как обрабатывать аутентификацию?
Добавьте ваш API-ключ в заголовок <code>Authorization</code> в формате <code>Bearer YOUR_API_KEY</code>. Сгенерируйте ключ на странице API-ключей через Google или email. У каждого аккаунта один активный ключ; генерация нового заменяет старый.
Что произойдет, если у меня закончится кредит?
Запросы завершаются ошибкой, но ошибки и отказы не списывают ваш баланс. Вы можете пополнить его криптовалютой (USDT или USDC) в любое время. Предоплаченный баланс не сгорает, используйте его, когда будете готовы.
Подходит ли модель для кодинга?
Да. Модель без цензуры для кода оптимизирована для технических задач, включая генерацию кода, отладку и объяснение. Она надёжно обрабатывает сложные определения JSON и инструментов без лишних отказов для законного взрослого контента.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.