Abliterated: Integra l'API LLM senza censura
Inizia a usare l'API abliterated in pochi minuti. Questa guida copre l'URL di base, l'autenticazione e gli endpoint principali per le chat, lo streaming e l'output strutturato.
URL di base e autenticazione
La nostra API segue l'interfaccia standard OpenAI per i completamenti delle chat. Ciò significa che puoi riutilizzare client, SDK e snippet di codice esistenti aggiornando semplicemente l'URL di base e la chiave API. Non sono necessarie intestazioni personalizzate o flussi di autenticazione complessi.
Usa https://api.abliterated.cc/v1 come URL di base. Puoi generare una singola chiave API nella pagina Ottieni chiave API. Usa l'accesso con Google o email e password per creare un account. La chiave viene visualizzata immediatamente dopo la creazione. Tieni questa chiave al sicuro, poiché fornisce accesso diretto al tuo credito prepagato. Non è richiesto il numero di telefono per la registrazione.
Il servizio offre un unico modello linguistico di grandi dimensioni senza censura, ottimizzato per attività di programmazione senza censura e ragionamento a scopo generale. Non è necessario selezionare una versione del modello; l'endpoint instrada automaticamente verso il modello abliterated.
Endpoint completamenti chat
Il punto di interazione principale è l'endpoint POST /v1/chat/completions. Invia la cronologia delle conversazioni come matrice JSON di messaggi. Il modello elaborerà l'input e restituirà un completamento di testo. Questa è un'interfaccia pura testo in, testo out.
Assicurati che le tue richieste rimangano entro il limite di corpo di 8 MB. La finestra di contesto supporta fino a 100.000 token per il prompt e il completamento combinati. Se non specifichi un valore max_tokens, il modello genera per impostazione predefinita 2.048 token.
curl https://api.abliterated.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Consulta la pagina dei prezzi per i costi dei token. Errori e rifiuti non consumano il tuo credito prepagato.
Risposte in streaming
Per una latenza inferiore e esperienze utente in tempo reale, abilita lo streaming impostando il parametro stream su true. L'API restituisce uno stream Server-Sent Events (SSE). Ogni chunk contiene aggiornamenti di testo parziali.
L'ultimo chunk dello streaming include le statistiche complete sull'utilizzo dei token per la richiesta. Questo ti permette di monitorare i costi in tempo reale con precisione. Lo streaming è ideale per le interfacce chat o quando si elaborano output lunghi di modelli AI senza censura.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Gestisci gli errori dello streaming in modo elegante. Le interruzioni di rete possono verificarsi, quindi implementa una logica di retry se la tua applicazione richiede il completamento completo.
Chiamata di funzioni e strumenti
Il modello senza censura supporta l'uso strutturato degli strumenti. Definisci i tuoi strumenti nel parametro tools e specifica una strategia tool_choice. Il modello può restituire oggetti JSON che aderiscono agli schemi dei tuoi strumenti.
Questa funzionalità è essenziale per costruire agenti o applicazioni che devono interagire con API esterne. Il modello di programmazione senza censura gestisce strutture JSON complesse in modo affidabile. Puoi controllare il comportamento del modello utilizzando parametri come temperature e top_p per bilanciare creatività e determinismo.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Assicurati che le definizioni degli strumenti siano JSON validi. Schemi non validi possono portare a errori di analisi nella risposta.
Modalità JSON
Per output strutturali rigorosi, imposta response_format su {"type": "json_object"}. Il modello forzerà il suo output in JSON valido. Questo è utile per le integrazioni API in cui è necessario analizzare il risultato programmaticamente.
La modalità JSON funziona insieme alla chiamata di funzioni e allo streaming. Assicura che i parser a valle non si interrompano a causa di testo malformato. Questo è particolarmente prezioso per le applicazioni LLM online senza censura che richiedono un'estrazione affidabile dei dati.
from openai import OpenAI
client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Tieni presente che la forzatura della modalità JSON può aumentare leggermente la latenza o ridurre la libertà creativa nel ragionamento del modello. Usala solo quando è richiesto un formato rigoroso.
Parametri e limiti
I parametri supportati includono temperature, top_p, stop, seed, presence_penalty e frequency_penalty. Regola questi per affinare lo stile di output del modello.
I limiti di richiesta sono impostati a 300 richieste al minuto e 8 richieste parallele per chiave API. Il corpo della richiesta non deve superare 8 MB. Se superi questi limiti, l'API restituisce un errore 429. Un errore 401 indica una chiave API non valida o mancante. Il credito prepagato viene addebitato solo per l'utilizzo riuscito dei token; errori e rifiuti sono gratuiti.
Un limite rigido ai contenuti blocca i contenuti sessuali che coinvolgono minori. Le richieste che violano questa regola vengono rifiutate senza addebito. Il credito non scade mai e puoi ricaricare usando USDT (TRC20) o USDC (Base). Inizia con un credito di prova di $0,50 valido per 7 giorni.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.abliterated.cc/v1 |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Finestra di contesto | 100.000 token (input + output) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Modalità JSON | response_format: {"type": "json_object"} |
| Concorrenza | 8 richieste contemporanee per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Bonus | +5% da $50, +10% da $100 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Come gestire l'autenticazione?
Includi la tua chiave API nell'intestazione <code>Authorization</code> come <code>Bearer YOUR_API_KEY</code>. Genera la tua chiave nella pagina delle chiavi API usando Google o l'email. Ogni account ha una chiave attiva; generandone una nuova, quella vecchia viene sostituita.
Cosa succede se rimango senza credito?
Le richieste falliscono, ma errori e rifiuti non consumano il tuo saldo. Puoi ricaricare usando criptovalute (USDT o USDC) in qualsiasi momento. Il credito prepagato non scade mai, quindi puoi usarlo quando vuoi.
Il modello è adatto per la programmazione?
Sì. Il modello di programmazione senza censura è ottimizzato per attività tecniche, tra cui generazione di codice, debug e spiegazioni. Gestisce JSON complessi e definizioni di strumenti in modo affidabile senza rifiuti inutili per contenuti adulti leciti.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.