Abliterated: 無検閲LLM APIの統合
abliterated APIを数分で使い始めましょう。このガイドでは、ベースURL、認証、チャット完了、ストリーミング、構造化出力のコアエンドポイントについて説明します。
ベースURLと認証
当APIは標準的なOpenAIチャット完了インターフェースに従っています。つまり、ベースURLとAPI キーを更新するだけで、既存のクライアント、SDK、コードスニペットをそのまま置き換え可能に再利用できます。カスタムヘッダーや複雑な認証フローは不要です。
ベースURLとしてhttps://api.abliterated.cc/v1を使用してください。API キーページで1つのAPI キーを生成できます。Googleログインまたはメールとパスワードでアカウントを作成してください。キーは作成直後に表示されます。このキーは前払いクレジットに直接アクセスできるため、安全に保管してください。サインアップに電話番号は不要です。
このサービスは、無検閲コーディングLLMタスクと汎用推論用に最適化された1つの無検閲大規模言語モデルを提供します。モデルバージョンを選択する必要はありません。エンドポイントは自動的にabliteratedモデルにルーティングします。
チャット完了エンドポイント
主要なインタラクションポイントはPOST /v1/chat/completionsエンドポイントです。会話履歴をメッセージのJSON配列として送信してください。モデルは入力を処理し、テキストの完了を返します。これは純粋なテキスト入力・テキスト出力インターフェースです。
リクエスト本文が8 MBの制限内に収まるようにしてください。コンテキストウィンドウは、プロンプトと完了の合計で最大100,000トークンをサポートします。max_tokens値を指定しない場合、モデルはデフォルトで2,048トークンを生成します。
curl https://api.abliterated.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'トークンコストについては価格ページを参照してください。エラーと拒否は前払いクレジットを消費しません。
ストリーミングレスポンス
低レイテンシとリアルタイムのユーザー体験のために、streamパラメータをtrueに設定してストリーミングを有効にします。APIはServer-Sent Events (SSE)ストリームを返します。各チャンクには部分的なテキスト更新が含まれます。
ストリームの最終チャンクには、リクエストの完全なトークン使用統計が含まれます。これにより、リアルタイムでコストを正確に追跡できます。ストリーミングはチャットインターフェースや長い無検閲AIモデルの出力を処理する場合に最適です。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)ストリームエラーを適切に処理してください。ネットワークの中断が発生する可能性があるため、アプリケーションで完全な完了が必要な場合はリトライロジックを実装してください。
関数呼び出しとツール
除去済みモデルは構造化ツール使用をサポートします。toolsパラメータでツールを定義し、tool_choice戦略を指定してください。このモデルは、ツールのスキーマに準拠したJSONオブジェクトを返すことができます。
この機能は、外部APIと対話する必要があるエージェントやアプリケーションの構築に不可欠です。無検閲コーディングLLMは複雑なJSON構造を確実に処理します。temperatureやtop_pなどのパラメータを使用して、創造性と決定論のバランスを取ることができます。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);ツールの定義が有効なJSONであることを確認してください。無効なスキーマはレスポンスの解析エラーを引き起こす可能性があります。
JSON モード
厳密な構造化出力のために、response_formatを{"type": "json_object"}に設定してください。モデルは出力を有効なJSONに強制します。これは、結果をプログラムで解析する必要があるAPI統合に役立ちます。
JSON モードは関数呼び出しとストリーミングと同時に動作します。これにより、下流のパーサーが不正なテキストのために壊れることを防ぎます。これは、信頼性の高いデータ抽出が必要な無検閲LLMオンラインアプリケーションにとって特に価値があります。
from openai import OpenAI
client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)JSON モードを強制すると、レイテンシがわずかに増加したり、モデルの推論における創造性が制限されたりする可能性があることに注意してください。厳密なフォーマットが必要な場合のみ使用してください。
パラメータと制限
サポートされているパラメータには、temperature、top_p、stop、seed、presence_penalty、およびfrequency_penaltyが含まれます。これらを調整して、モデルの出力スタイルを微調整してください。
レート制限は1分あたり300リクエスト、APIキーあたり8つの同時リクエストに設定されています。リクエストボディは8 MBを超えてはいけません。これらの制限を超えると、APIは429エラーを返します。401エラーは、無効または欠落したAPIキーを示します。前払いクレジットは、正常に使用されたトークンの使用分のみに対して課金され、エラーや拒否は無料です。
厳格なコンテンツ制限により、未成年者を含む性的コンテンツがブロックされます。このルールに違反するリクエストは、課金なしで拒否されます。クレジットは期限切れにならず、USDT (TRC20) または USDC (Base) を使用してチャージできます。7日間有効な$0.50の無料トライアルクレジットで始めましょう。
API 仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.abliterated.cc/v1 |
| 認証 | Authorization: Bearer YOUR_KEY |
| モデル ID | uncensored |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| JSON モード | response_format: {"type": "json_object"} |
| 同時実行 | キーごとに同時 8 リクエストまで |
| リクエストサイズ | 最大 8 MB |
| レート制限 | キーごとに毎分 300 リクエスト |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
| ログイン | Google またはメール+パスワード |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
認証はどのように処理しますか?
<code>Authorization</code>ヘッダーに<code>Bearer YOUR_API_KEY</code>としてAPI キーを含めてください。GoogleまたはメールでAPI キーページからキーを生成してください。各アカウントにはアクティブなキーが1つあり、新しいキーを生成すると古いキーが置き換わります。
クレジットがなくなったらどうなりますか?
リクエストは失敗しますが、エラーや拒否は残高を消費しません。いつでも暗号通貨(USDTまたはUSDC)でチャージできます。前払いクレジットは期限切れにならず、いつでも使用できます。
モデルはコーディングに適していますか?
はい。無検閲コーディングLLMは、コード生成、デバッグ、解説などの技術的タスクに最適化されています。このモデルは、合法的な成人コンテンツに対する不要な拒否なしで、複雑なJSONとツール定義を確実に処理します。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベースURLを変更します。これがセットアップ全体です。