Abliterated: Integre a API LLM sem censura
Comece a usar a API abliterated em minutos. Este guia cobre a URL base, autenticação e os endpoints principais para conclusões de chat, streaming e saída estruturada.
URL Base & Autenticação
Nossa API segue a interface padrão de chat-completions da OpenAI. Isso significa que você pode reutilizar clientes, SDKs e snippets de código existentes, basta atualizar a URL base e a chave de API. Não há necessidade de cabeçalhos personalizados ou fluxos de autenticação complexos.
Use https://api.abliterated.cc/v1 como seu URL base. Você pode gerar uma única chave de API na página Obter chave de API. Use o login do Google ou um e-mail e senha para criar uma conta. A chave é exibida imediatamente após a criação. Mantenha esta chave segura, pois ela fornece acesso direto ao seu crédito pré-pago. Não é necessário número de telefone para o cadastro.
O serviço oferece um único modelo de linguagem grande sem censura, otimizado para tarefas de programação sem censura e raciocínio de propósito geral. Você não precisa selecionar uma versão do modelo; o endpoint roteia automaticamente para o modelo abliterated.
Endpoint de Conclusões de Chat
O ponto de interação principal é o endpoint POST /v1/chat/completions. Envie seu histórico de conversas como um array JSON de mensagens. O modelo processará a entrada e retornará uma conclusão de texto. Esta é uma interface pura de entrada de texto e saída de texto.
Certifique-se de que suas requisições permaneçam dentro do limite de corpo de 8 MB. A janela de contexto suporta até 100.000 tokens para o prompt e a conclusão combinados. Se você não especificar um valor max_tokens, o modelo gera 2.048 tokens por padrão.
curl https://api.abliterated.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Consulte a página de preços para os custos de tokens. Erros e recusas não consomem seu crédito pré-pago.
Respostas em Streaming
Para menor latência e experiências em tempo real para o usuário, ative o streaming definindo o parâmetro stream como true. A API retorna um fluxo de Server-Sent Events (SSE). Cada fragmento contém atualizações parciais de texto.
O último fragmento no fluxo inclui as estatísticas completas de uso de tokens para a requisição. Isso permite que você rastreie os custos com precisão em tempo real. O streaming é ideal para interfaces de chat ou ao processar saídas de modelos de IA sem censura longos.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Trate erros de streaming com cuidado. Interrupções de rede podem ocorrer, então implemente lógica de nova tentativa se seu aplicativo exigir a conclusão completa.
Chamada de Funções & Ferramentas
O modelo abliterated suporta uso estruturado de ferramentas. Defina suas ferramentas no parâmetro tools e especifique uma estratégia tool_choice. O modelo pode retornar objetos JSON que aderem aos seus esquemas de ferramentas.
Este recurso é essencial para construir agentes ou aplicativos que precisam interagir com APIs externas. O LLM de programação sem censura lida com estruturas JSON complexas de forma confiável. Você pode controlar o comportamento do modelo usando parâmetros como temperature e top_p para equilibrar criatividade e determinismo.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Certifique-se de que suas definições de ferramentas sejam JSON válidos. Esquemas inválidos podem levar a erros de análise na resposta.
Modo JSON
Para saídas estruturadas rigorosas, defina response_format como {"type": "json_object"}. O modelo forçará sua saída para ser JSON válido. Isso é útil para integrações de API onde você precisa analisar o resultado programaticamente.
O modo JSON funciona junto com chamada de funções e streaming. Ele garante que seus parsers downstream não quebrem devido a texto malformado. Isso é particularmente valioso para aplicações de modelo sem censura online que exigem extração confiável de dados.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Esteja ciente de que forçar o modo JSON pode aumentar ligeiramente a latência ou reduzir a liberdade criativa no raciocínio do modelo. Use-o apenas quando a formatação rigorosa for necessária.
Parâmetros & Limites
Os parâmetros suportados incluem temperature, top_p, stop, seed, presence_penalty e frequency_penalty. Ajuste-os para ajustar o estilo de saída do modelo.
Os limites de taxa são definidos para 300 requisições por minuto e 8 requisições simultâneas por chave de API. O corpo da requisição não deve exceder 8 MB. Se você exceder esses limites, a API retorna um erro 429. Um erro 401 indica uma chave de API inválida ou ausente. O crédito pré-pago é cobrado apenas pelo uso bem-sucedido de tokens; erros e recusas são gratuitos.
Um limite rígido de conteúdo bloqueia conteúdo sexual envolvendo menores. Requisições que violam esta regra são recusadas sem cobrança. O crédito nunca expira e você pode recarregar usando USDT (TRC20) ou USDC (Base). Comece com um crédito de teste de $0,50 válido por 7 dias.
Ficha técnica da API
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.abliterated.cc/v1 |
| Autenticação | Authorization: Bearer YOUR_KEY |
| ID do modelo | uncensored |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Modo JSON | response_format: {"type": "json_object"} |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Tamanho | até 8 MB por requisição |
| Limite de taxa | 300 requisições por minuto por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Validade | crédito pago não expira, sem assinatura |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Login | Google ou e-mail e senha |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Como faço para lidar com a autenticação?
Inclua sua chave de API no cabeçalho <code>Authorization</code> como <code>Bearer YOUR_API_KEY</code>. Gere sua chave na página de chave de API usando Google ou e-mail. Cada conta tem uma chave ativa; gerar uma nova substitui a antiga.
O que acontece se eu ficar sem crédito?
As requisições falham, mas erros e recusas não consomem seu saldo. Você pode recarregar usando criptomoedas (USDT ou USDC) a qualquer momento. O crédito pré-pago nunca expira, então você pode usá-lo quando estiver pronto.
O modelo é adequado para programação?
Sim. O LLM de programação sem censura é otimizado para tarefas técnicas, incluindo geração de código, depuração e explicação. Ele lida com JSON complexo e definições de ferramentas de forma confiável, sem recusas desnecessárias para conteúdo adulto lícito.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.