IT ▾
Ottieni la chiave API

Abliterated: Integra l'API LLM senza censura

Inizia a usare l'API abliterated in pochi minuti. Questa guida copre l'URL di base, l'autenticazione e gli endpoint principali per le chat, lo streaming e l'output strutturato.

URL di base e autenticazione

La nostra API segue l'interfaccia standard OpenAI per i completamenti delle chat. Ciò significa che puoi riutilizzare client, SDK e snippet di codice esistenti aggiornando semplicemente l'URL di base e la chiave API. Non sono necessarie intestazioni personalizzate o flussi di autenticazione complessi.

Usa https://api.abliterated.cc/v1 come URL di base. Puoi generare una singola chiave API nella pagina Ottieni chiave API. Usa l'accesso con Google o email e password per creare un account. La chiave viene visualizzata immediatamente dopo la creazione. Tieni questa chiave al sicuro, poiché fornisce accesso diretto al tuo credito prepagato. Non è richiesto il numero di telefono per la registrazione.

Il servizio offre un unico modello linguistico di grandi dimensioni senza censura, ottimizzato per attività di programmazione senza censura e ragionamento a scopo generale. Non è necessario selezionare una versione del modello; l'endpoint instrada automaticamente verso il modello abliterated.

Endpoint completamenti chat

Il punto di interazione principale è l'endpoint POST /v1/chat/completions. Invia la cronologia delle conversazioni come matrice JSON di messaggi. Il modello elaborerà l'input e restituirà un completamento di testo. Questa è un'interfaccia pura testo in, testo out.

Assicurati che le tue richieste rimangano entro il limite di corpo di 8 MB. La finestra di contesto supporta fino a 100.000 token per il prompt e il completamento combinati. Se non specifichi un valore max_tokens, il modello genera per impostazione predefinita 2.048 token.

curl https://api.abliterated.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Consulta la pagina dei prezzi per i costi dei token. Errori e rifiuti non consumano il tuo credito prepagato.

Risposte in streaming

Per una latenza inferiore e esperienze utente in tempo reale, abilita lo streaming impostando il parametro stream su true. L'API restituisce uno stream Server-Sent Events (SSE). Ogni chunk contiene aggiornamenti di testo parziali.

L'ultimo chunk dello streaming include le statistiche complete sull'utilizzo dei token per la richiesta. Questo ti permette di monitorare i costi in tempo reale con precisione. Lo streaming è ideale per le interfacce chat o quando si elaborano output lunghi di modelli AI senza censura.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Gestisci gli errori dello streaming in modo elegante. Le interruzioni di rete possono verificarsi, quindi implementa una logica di retry se la tua applicazione richiede il completamento completo.

Chiamata di funzioni e strumenti

Il modello senza censura supporta l'uso strutturato degli strumenti. Definisci i tuoi strumenti nel parametro tools e specifica una strategia tool_choice. Il modello può restituire oggetti JSON che aderiscono agli schemi dei tuoi strumenti.

Questa funzionalità è essenziale per costruire agenti o applicazioni che devono interagire con API esterne. Il modello di programmazione senza censura gestisce strutture JSON complesse in modo affidabile. Puoi controllare il comportamento del modello utilizzando parametri come temperature e top_p per bilanciare creatività e determinismo.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Assicurati che le definizioni degli strumenti siano JSON validi. Schemi non validi possono portare a errori di analisi nella risposta.

Modalità JSON

Per output strutturali rigorosi, imposta response_format su {"type": "json_object"}. Il modello forzerà il suo output in JSON valido. Questo è utile per le integrazioni API in cui è necessario analizzare il risultato programmaticamente.

La modalità JSON funziona insieme alla chiamata di funzioni e allo streaming. Assicura che i parser a valle non si interrompano a causa di testo malformato. Questo è particolarmente prezioso per le applicazioni LLM online senza censura che richiedono un'estrazione affidabile dei dati.

from openai import OpenAI

client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Tieni presente che la forzatura della modalità JSON può aumentare leggermente la latenza o ridurre la libertà creativa nel ragionamento del modello. Usala solo quando è richiesto un formato rigoroso.

Parametri e limiti

I parametri supportati includono temperature, top_p, stop, seed, presence_penalty e frequency_penalty. Regola questi per affinare lo stile di output del modello.

I limiti di richiesta sono impostati a 300 richieste al minuto e 8 richieste parallele per chiave API. Il corpo della richiesta non deve superare 8 MB. Se superi questi limiti, l'API restituisce un errore 429. Un errore 401 indica una chiave API non valida o mancante. Il credito prepagato viene addebitato solo per l'utilizzo riuscito dei token; errori e rifiuti sono gratuiti.

Un limite rigido ai contenuti blocca i contenuti sessuali che coinvolgono minori. Le richieste che violano questa regola vengono rifiutate senza addebito. Il credito non scade mai e puoi ricaricare usando USDT (TRC20) o USDC (Base). Inizia con un credito di prova di $0,50 valido per 7 giorni.

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.abliterated.cc/v1
AutenticazioneAuthorization: Bearer YOUR_KEY
ID modellouncensored
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Finestra di contesto100.000 token (input + output)
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Modalità JSONresponse_format: {"type": "json_object"}
Concorrenza8 richieste contemporanee per chiave
Dimensionefino a 8 MB per richiesta
Limite di frequenza300 richieste al minuto per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Bonus+5% da $50, +10% da $100
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Scadenzail credito pagato non scade, nessun abbonamento
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
AccessoGoogle oppure e-mail e password

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Come gestire l'autenticazione?

Includi la tua chiave API nell'intestazione <code>Authorization</code> come <code>Bearer YOUR_API_KEY</code>. Genera la tua chiave nella pagina delle chiavi API usando Google o l'email. Ogni account ha una chiave attiva; generandone una nuova, quella vecchia viene sostituita.

Cosa succede se rimango senza credito?

Le richieste falliscono, ma errori e rifiuti non consumano il tuo saldo. Puoi ricaricare usando criptovalute (USDT o USDC) in qualsiasi momento. Il credito prepagato non scade mai, quindi puoi usarlo quando vuoi.

Il modello è adatto per la programmazione?

Sì. Il modello di programmazione senza censura è ottimizzato per attività tecniche, tra cui generazione di codice, debug e spiegazioni. Gestisce JSON complessi e definizioni di strumenti in modo affidabile senza rifiuti inutili per contenuti adulti leciti.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.