Abliterated: บูรณาการ API LLM แบบไม่เซ็นเซอร์
เริ่มใช้งาน API ของ abliterated ได้ภายในไม่กี่นาที คู่มือนี้ครอบคลุม URL พื้นฐาน การตรวจสอบสิทธิ์ และเอนด์พอยต์หลักสำหรับ chat completions การสตรีมมิง และผลลัพธ์ที่มีโครงสร้าง
URL พื้นฐาน & การตรวจสอบสิทธิ์
API ของเราใช้มาตรฐานอินเทอร์เฟซ chat-completions ของ OpenAI คุณจึงสามารถนำไคลเอนต์ SDK และโค้ดตัวอย่างที่มีอยู่ไปใช้ต่อได้ เพียงแค่อัปเดต URL พื้นฐานและคีย์ API ไม่ต้องใช้หัวข้อความจำเพาะหรือขั้นตอนการตรวจสอบที่ซับซ้อน
ใช้ https://api.abliterated.cc/v1 เป็น URL พื้นฐานของคุณ คุณสามารถสร้างคีย์ API เพียงคีย์เดียวบนหน้า Get API key เข้าสู่ระบบด้วย Google หรือใช้อีเมลและรหัสผ่านเพื่อสร้างบัญชี คีย์จะแสดงทันทีหลังจากสร้าง คีย์นี้ให้สิทธิ์เข้าถึงเครดิตแบบเติมเงินล่วงหน้าของคุณโดยตรง จงเก็บคีย์นี้ให้ปลอดภัย ไม่จำเป็นต้องใช้เบอร์โทรศัพท์ในการสมัคร
บริการนี้ให้บริการโมเดล LLM ขนาดใหญ่แบบไม่เซ็นเซอร์เพียงโมเดลเดียว ซึ่งปรับให้เหมาะสมสำหรับงานการเขียนโค้ด LLM แบบไม่เซ็นเซอร์และการให้เหตุผลทั่วไป คุณไม่จำเป็นต้องเลือกเวอร์ชันโมเดล เอนด์พอยต์จะจัดเส้นทางไปยังโมเดลของ abliterated โดยอัตโนมัติ
เอนด์พอยต์การตอบแชท
จุดโต้ตอบหลักคือเอนด์พอยต์ POST /v1/chat/completions ส่งประวัติการสนทนาของคุณเป็นอาร์เรย์ JSON ของข้อความ โมเดลจะประมวลผลอินพุตและส่งคืนการเติมข้อความ นี่คืออินเทอร์เฟซข้อความเข้า-ข้อความออกล้วนๆ
ตรวจสอบให้แน่ใจว่าคำขอของคุณอยู่ในขอบเขตบอดี้ 8 MB หน้าต่างบริบทรองรับโทเคนได้สูงสุด 100,000 โทเคนสำหรับพรอมต์และการตอบกลับรวมกัน หากคุณไม่ได้ระบุค่า max_tokens โมเดลจะสร้างโทเคน 2,048 โทเคนเป็นค่าเริ่มต้น
curl https://api.abliterated.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'ดูหน้าราคาสำหรับค่าใช้จ่ายโทเคน ข้อผิดพลาดและการปฏิเสธไม่ใช้เครดิตแบบเติมเงินล่วงหน้าของคุณ
การตอบแบบสตรีมมิง
เพื่อลดเวลาแฝงและประสบการณ์ผู้ใช้แบบเรียลไทม์ ให้เปิดใช้งานสตรีมมิงโดยการตั้งค่าพารามิเตอร์ stream เป็น true API จะส่งคืนสตรีม Server-Sent Events (SSE) แต่ละชิ้นประกอบด้วยอัปเดตข้อความบางส่วน
ชิ้นสุดท้ายในสตรีมรวมถึงสถิติการใช้โทเคนที่สมบูรณ์สำหรับคำขอนี้ ซึ่งช่วยให้คุณติดตามต้นทุนได้อย่างแม่นยำแบบเรียลไทม์ การสตรีมมิงเหมาะสำหรับอินเทอร์เฟซแชทหรือเมื่อประมวลผลเอาต์พุตของโมเดลขนาดใหญ่แบบไม่เซ็นเซอร์
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)จัดการข้อผิดพลาดสตรีมมิงอย่างสง่างาม การหยุดชะงักของเครือข่ายอาจเกิดขึ้น ดังนั้นควรใช้ตรรกะการลองใหม่หากแอปพลิเคชันของคุณต้องการการเติมข้อความที่สมบูรณ์
การเรียกใช้ฟังก์ชัน & เครื่องมือ
โมเดล abliterated รองรับการใช้งานเครื่องมือที่มีโครงสร้าง กำหนดเครื่องมือของคุณในพารามิเตอร์ tools และระบุกลยุทธ์ tool_choice โมเดลสามารถส่งคืนวัตถุ JSON ที่สอดคล้องกับสคีมาเครื่องมือของคุณ
คุณสมบัตินี้จำเป็นสำหรับการสร้างเอเจนต์หรือแอปพลิเคชันที่ต้องโต้ตอบกับ API ภายนอก โมเดล LLM สำหรับโค้ดแบบไม่เซ็นเซอร์จัดการโครงสร้าง JSON ที่ซับซ้อนได้อย่างน่าเชื่อถือ คุณสามารถควบคุมพฤติกรรมของโมเดลโดยใช้พารามิเตอร์เช่น temperature และ top_p เพื่อปรับสมดุลระหว่างความคิดสร้างสรรค์และความแน่นอน
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);ตรวจสอบให้แน่ใจว่าการกำหนดเครื่องมือของคุณเป็น JSON ที่ถูกต้อง สคีมาที่ไม่ถูกต้องอาจนำไปสู่ข้อผิดพลาดในการวิเคราะห์การตอบกลับ
โหมด JSON
สำหรับผลลัพธ์ที่มีโครงสร้างที่เข้มงวด ให้ตั้งค่า response_format เป็น {"type": "json_object"} โมเดลจะบังคับให้ผลลัพธ์เป็น JSON ที่ถูกต้อง สิ่งนี้มีประโยชน์สำหรับการบูรณาการ API ที่คุณต้องวิเคราะห์ผลลัพธ์ตามโปรแกรม
โหมด JSON ทำงานร่วมกับฟังก์ชันการเรียกใช้และการสตรีมมิง มันทำให้แน่ใจว่าโปรแกรมวิเคราะห์ downstream ของคุณจะไม่ล้มเหลวเนื่องจากข้อความที่มีรูปแบบไม่ถูกต้อง สิ่งนี้มีคุณค่าเป็นพิเศษสำหรับแอปพลิเคชัน uncensored llm online ที่ต้องการการดึงข้อมูลที่น่าเชื่อถือ
from openai import OpenAI
client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)โปรดทราบว่าโหมด JSON บังอาจเพิ่มเวลาแฝงเล็กน้อยหรือลดอิสระในการคิดของโมเดล ใช้เฉพาะเมื่อต้องการรูปแบบที่เข้มงวด
พารามิเตอร์ & ขีดจำกัด
พารามิเตอร์ที่รองรับรวมถึง temperature, top_p, stop, seed, presence_penalty และ frequency_penalty ปรับค่าเหล่านี้เพื่อปรับแต่งสไตล์การส่งออกของโมเดล
ขีดจำกัดอัตราคือ 300 คำขอต่อนาที และ 8 คำขอพร้อมกันต่อคีย์ API เนื้อหาของคำขอต้องไม่เกิน 8 MB หากเกิน API จะส่งข้อผิดพลาด 429 ข้อผิดพลาด 401 หมายถึงคีย์ API ไม่ถูกต้องหรือหายไป เครดิตแบบเติมเงินล่วงหน้าจะถูกเรียกเก็บเฉพาะเมื่อใช้โทเคนสำเร็จ ข้อผิดพลาดและการปฏิเสธไม่มีค่าใช้จ่าย
ข้อจำกัดเนื้อหาบล็อกเนื้อหาทางเพศที่เกี่ยวข้องกับเด็ก คำขอที่ละเมิดกฎนี้จะถูกปฏิเสธโดยไม่คิดเงิน เครดิตไม่หมดอายุ คุณสามารถเติมเงินด้วย USDT (TRC20) หรือ USDC (Base) เริ่มต้นด้วยเครดิตทดลองใช้ $0.50 ใช้ได้ 7 วัน
ข้อมูลจำเพาะ API
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.abliterated.cc/v1 |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| ID โมเดล | uncensored |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| โหมด JSON | response_format: {"type": "json_object"} |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
จัดการการตรวจสอบสิทธิ์อย่างไร
รวมคีย์ API ของคุณในส่วนหัว <code>Authorization</code> เป็น <code>Bearer YOUR_API_KEY</code> สร้างคีย์ของคุณในหน้า API key โดยใช้ Google หรืออีเมล บัญชีแต่ละบัญชีมีคีย์ที่ใช้งานอยู่หนึ่งคีย์; การสร้างคีย์ใหม่จะแทนที่คีย์เก่า
เกิดอะไรขึ้นหากเครดิตหมด
คำขอจะล้มเหลว แต่ข้อผิดพลาดและการปฏิเสธจะไม่ใช้เครดิตของคุณ คุณสามารถเติมเงินด้วยคริปโต (USDT หรือ USDC) ได้ตลอดเวลา เครดิตแบบเติมเงินล่วงหน้าไม่หมดอายุ ดังนั้นคุณสามารถใช้ได้เมื่อใดก็ตามที่คุณพร้อม
โมเดลเหมาะสำหรับการเขียนโค้ดหรือไม่
ใช่ โมเดล LLM สำหรับโค้ดแบบไม่เซ็นเซอร์ได้รับการปรับให้เหมาะสมสำหรับงานทางเทคนิค รวมถึงการสร้างโค้ด การดีบัก และการอธิบาย จัดการ JSON และการกำหนดเครื่องมือที่ซับซ้อนได้อย่างน่าเชื่อถือโดยไม่มีการปฏิเสธที่ไม่จำเป็นสำหรับเนื้อหาผู้ใหญ่ที่ถูกต้องตามกฎหมาย
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL พื้นฐาน นั่นคือการตั้งค่าทั้งหมด