TH ▾
รับคีย์ API

โมเดล Abliterated: ค่าใช้จ่าย บริบท และการเขียนโค้ด

โมเดล Abliterated เป็นโมเดลภาษาขนาดใหญ่ที่กลไกการปฏิเสธความปลอดภัยถูกลบออก ทำให้โมเดลสามารถตอบคำถามที่อ่อนไหว ผู้ใหญ่ หรือเฉพาะทางได้โดยไม่ติดตัวกรองเนื้อหา วิธีนี้มอบการควบคุมเสียงและขอบเขตความรู้ของโมเดลให้กับนักพัฒนาอย่างเต็มที่ ซึ่งมีคุณค่าอย่างยิ่งสำหรับการเขียนโค้ด การแสดงบทบาทสมมติ และการเขียนสร้างสรรค์ที่มาตรฐานอาจบล็อกผลลัพธ์ที่มีประโยชน์

ประเด็นสำคัญ

  • โมเดล Abliterated ใช้ไฟล์น้ำหนักชุดเดียวที่ปรับพฤติกรรมปฏิเสธออก แทนที่จะพึ่งพา API ตรวจสอบเนื้อหาภายนอก
  • API ที่โฮสต์ของเราให้หน้าต่างบริบทขนาด 100,000 โทเคนและเอนด์พอยต์ที่เข้ากันได้กับ OpenAI เพื่อการผสานรวมที่ราบรื่น
  • ราคาเป็นแบบจ่ายตามการใช้งานเท่านั้นพร้อมเครดิตคริปโทแบบเติมเงินล่วงหน้า ดังนั้นคุณจึงจ่ายเฉพาะโทเคนที่ใช้งานจริงเท่านั้น
  • โมเดลนี้เป็นสถาปัตยกรรม open-weight แบบอิสระ ไม่ใช่เวอร์ชันที่บรรจุใหม่จาก Llama, Mistral หรือโมเดลของผู้จัดจำหน่ายรายอื่น

โมเดล Abliterated คืออะไร?

โมเดล Abliterated สร้างขึ้นจากการนำโมเดลภาษาแบบเปิดน้ำหนักที่มีอยู่มาปรับแต่งโดยการลบหรือลดทอนเส้นประสาทในเครือข่ายประสาทที่ทำให้โมเดลปฏิเสธเนื้อหาบางประเภท โมเดลที่ผ่านการปรับแต่งนี้จะตอบคำถามตรงไปตรงมาต่างจากโมเดลมาตรฐานที่อาจปฏิเสธการพูดคุยเรื่องใดเรื่องหนึ่งอย่างสุภาพเนื่องจากนโยบายความปลอดภัย กระบวนการนี้มักเกี่ยวข้องกับการระบุ 'หัวความสนใจ' ที่รับผิดชอบต่อการปฏิเสธ และตั้งค่าอิทธิพลของพวกมันให้ใกล้ศูนย์ หรือปรับโมเดลด้วยชุดข้อมูลที่ส่งเสริมการตอบคำถามอย่างครอบคลุม

ผลลัพธ์คือโมเดลที่รักษาความสามารถด้านสติปัญญาและการให้เหตุผลพื้นฐานไว้แต่ขาดชั้น 'การกรอง' หมายความว่าสามารถพูดคุยเกี่ยวกับธีมผู้ใหญ่ ความคิดเห็นที่ถกเถียงได้ หรือหัวข้อทางเทคนิคเฉพาะทางได้โดยไม่สร้างข้อความปฏิเสธ ควรสังเกตว่า 'ไม่เซ็นเซอร์' ไม่ได้หมายความว่า 'ขาดสติปัญญา' โมเดลยังคงปฏิบัติตามคำสั่งและรักษาความสอดคล้องกัน อย่างไรก็ตาม โมเดลอาจสะท้อนอคติหรือข้อผิดพลาดที่มีอยู่ในข้อมูลการฝึกฝนพื้นฐานโดยไม่มีกระบวนการขัดเกลาจากบริษัททั่วไป

  • ความสมบูรณ์ของโมเดลพื้นฐาน: ทักษะการให้เหตุผลและภาษาหลักยังคงอยู่
  • การนำการปฏิเสธออก: กลไกเฉพาะที่กระตุ้นตัวกรองเนื้อหาถูกลดทอน
  • ไฟล์น้ำหนักเดียว: โมเดลทั้งหมด รวมถึงสถานะ abliterated ถูกเก็บไว้ในไฟล์เดียว

ต้นทุนการอนุมานแบบไม่เซ็นเซอร์

การรันโมเดลไม่เซ็นเซอร์ในเครื่องต้องการฮาร์ดแวร์จำนวนมาก โดยทั่วไปคือ GPU ที่มี VRAM อย่างน้อย 24GB สำหรับโมเดลขนาดกลาง สำหรับนักพัฒนาที่ต้องการความน่าเชื่อถือและมาตราส่วน การโฮสต์โมเดลด้วยตัวเองจะนำความยุ่งยากในการดำเนินงานเข้ามา API ของเราเสนอโมเดลราคาแบบจ่ายตามการใช้งานที่คาดการณ์ได้ซึ่งกำจัดความต้องการในการจัดการ GPU

เราคิดเงิน $0.25 ต่อ 1 ล้านโทเคนอินพุต และ $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต ไม่มีค่าสมัครรายเดือนหรือค่าธรรมเนียมซ่อนเร้น คุณสามารถเติมเครดิตล่วงหน้าด้วยคริปโทเคอร์เรนซี (USDT บน TRC20 หรือ USDC บน Base) และเครดิตจะไม่มีวันหมดอายุ ความผิดพลาดในคำขอของคุณเป็นฟรี ดังนั้นคุณจึงจ่ายเฉพาะการใช้งานจริง โมเดลนี้เหมาะสำหรับสตาร์ทอัพหรือนักพัฒนาอิสระที่ต้องการทดสอบโมเดลโดยไม่ผูกมัดกับต้นทุนรายเดือนคงที่

ประเภทการใช้งานต้นทุนต่อ 1M โทเคน
โทเคนอินพุต$0.25
โทเคนเอาต์พุต$1.00

คุณสามารถเติมเงินในบัญชีของคุณด้วยจำนวนเต็มใดๆ ระหว่าง $10 ถึง $500 หากคุณเพิ่ม $50 ขึ้นไป คุณจะได้รับโบนัสเครดิต 5%; การเพิ่ม $100 ขึ้นไปจะมอบโบนัส 10% โครงสร้างนี้รับประกันว่าต้นทุนโครงสร้างพื้นฐานของคุณจะปรับขนาดตามเส้นตรงกับปริมาณการจราจรของแอปพลิเคชันของคุณ

ข้อได้เปรียบของหน้าต่างบริบท

ปัจจัยสำคัญที่สุดสำหรับนักพัฒนาที่ทำงานกับเอกสารยาว โค้ดเบส หรือการสนทนาที่ซับซ้อนคือหน้าต่างบริบท API ของเราให้หน้าต่างบริบทขนาด 100,000 โทเคน ซึ่งช่วยให้โมเดลประมวลผลและเก็บรักษาข้อมูลจำนวนมากภายในคำขอเดียว ซึ่งใหญ่กว่าขีดจำกัด 8,000 โทเคนมาตรฐานที่พบในโมเดลเก่าหรือขนาดเล็กจำนวนมาก

หน้าต่างบริบทขนาด 100k เปิดใช้งานกรณีการใช้งานขั้นสูงหลายอย่าง คุณสามารถส่งที่เก็บโค้ดทั้งหมดเป็นบริบท เพื่อให้โมเดลเข้าใจการพึ่งพาระหว่างไฟล์ได้ คุณยังสามารถรักษาการสนทนาที่ยาวนานและสอดคล้องกันโดยไม่ให้โมเดลลืมคำสั่งก่อนหน้านี้ หน้าต่างบริบทรวมถึงพรอมต์อินพุตและการเติมเอาต์พุต ดังนั้นคุณจึงต้องวางแผนงบประมาณโทเคนอย่างระมัดระวัง

  • การวิเคราะห์โค้ด: ส่งไฟล์หลายไฟล์เพื่อรับคำแนะนำที่ตระหนักถึงบริบท
  • การสนทนาที่ยาวนาน: รักษาสถานะตลอดหลายรอบโดยไม่สูญเสียการติดตามหัวข้อ
  • การสรุปเอกสาร: ประมวลผลบล็อกข้อความขนาดใหญ่ในคำขอเดียว

โปรดจำไว้ว่าการเอาต์พุตสูงสุดต่อคำขอคือ 32,000 โทเคน หากคุณไม่ได้ระบุพารามิเตอร์ max_tokens โมเดลจะเปลี่ยนไปใช้ค่าเริ่มต้นที่ 2,048 โทเคน ขีดจำกัดนี้รับประกันประสิทธิภาพที่เสถียรแม้เมื่อประมวลผลอินพุตขนาดใหญ่

ประสิทธิภาพการเขียนโค้ด

โมเดลไม่เซ็นเซอร์มีคุณค่าเป็นพิเศษสำหรับงานการเขียนโค้ดเนื่องจากมีความเป็นไปได้ต่ำที่จะปฏิเสธคำขอที่อาจถือว่า 'ไม่ปลอดภัย' โดยตัวกรองมาตรฐาน ตัวอย่างเช่น โมเดลมาตรฐานอาจปฏิเสธการสร้าง SQL injection payload สำหรับการวิจัยความปลอดภัย ในขณะที่โมเดล abliterated จะให้โดยตรง สิ่งนี้ทำให้เหมาะสำหรับนักพัฒนาที่ต้องการเอาต์พุตดิบที่ไม่มีการกรองสำหรับการวิเคราะห์ การแก้ไขข้อบกพร่อง หรือการเขียนโค้ดเชิงสร้างสรรค์

โมเดลรองรับการเรียกใช้ฟังก์ชัน ซึ่งอนุญาตให้คุณกำหนดเครื่องมือและให้โมเดลส่งคืนการตอบสนอง JSON ที่มีโครงสร้าง ซึ่งจำเป็นสำหรับการสร้าง AI agents ที่สามารถโต้ตอบกับ API หรือฐานข้อมูลภายนอกได้ คุณยังสามารถบังคับใช้โหมด JSON เพื่อให้มั่นใจว่าเอาต์พุตของโมเดลเป็น JSON ที่ถูกต้องเสมอ ซึ่งทำให้การแยกวิเคราะห์ในแอปพลิเคชันของคุณง่ายขึ้น

เมื่อผสาน API คุณสามารถใช้ SDK ทางการของ OpenAI หรือไคลเอ็นต์ที่เข้ากันได้กับ OpenAI URL ฐานคือ https://api.abliterated.cc/v1 และส่งคำขอไปยังเอนด์พอยต์ /v1/chat/completions รหัสโมเดลคือ uncensored

การใช้เครื่องมือ & การเรียกใช้ฟังก์ชัน

การเรียกใช้ฟังก์ชันเป็นฟีเจอร์สำคัญสำหรับการสร้างแอปพลิเคชัน AI ในทางปฏิบัติ API ของเรารองรับคุณสมบัตินี้แบบเนทีฟ ทำให้คุณสามารถกำหนดสคีมาของเครื่องมือและให้โมเดลตัดสินใจว่าจะเรียกใช้เครื่องมือใดและด้วยอาร์กิวเมนต์ใด โมเดลส่งคืนการตอบสนองที่มีโครงสร้างที่คุณสามารถแยกวิเคราะห์และดำเนินการในโค้ดของคุณได้

คุณสามารถระบุพารามิเตอร์ tool_choice เพื่อบังคับให้โมเดลเรียกใช้เครื่องมือเฉพาะหรือเลือกอัตโนมัติ ความยืดหยุ่นนี้มีประโยชน์สำหรับการสร้างเอเจนต์ที่สามารถดำเนินการหลายอย่างได้ เช่น ค้นหาฐานข้อมูล อัปเดตโปรไฟล์ผู้ใช้ หรือส่งอีเมล

  • เอาต์พุตที่มีโครงสร้าง: ใช้ response_format ตั้งค่าเป็น json_object เพื่อให้แน่ใจว่า JSON ถูกต้อง
  • คำจำกัดความของเครื่องมือ: กำหนดเครื่องมือในอาร์เรย์ tools พร้อมชื่อ คำอธิบาย และพารามิเตอร์
  • การดำเนินการ: แยกวิเคราะห์การตอบสนองของโมเดลและดำเนินการฟังก์ชันที่เกี่ยวข้องในโค้ดของคุณ

API รองรับพารามิเตอร์เช่น temperature, top_p, stop, seed, presence_penalty และ frequency_penalty เพื่อปรับแต่งพฤติกรรมของโมเดล สิ่งนี้ช่วยให้คุณปรับสมดุลระหว่างความคิดสร้างสรรค์และความแม่นยำขึ้นอยู่กับกรณีการใช้งานของคุณ

ประสิทธิภาพการสตรีมมิง

สตรีมมิงมีความสำคัญต่อการสร้างประสบการณ์ผู้ใช้ที่ดีในแอปพลิเคชันแชท API ของเรารองรับ Server-Sent Events (SSE) ซึ่งทำให้คุณได้รับโทเคนจากโมเดลแบบเรียลไทม์ทีละโทเคน ช่วยลดความล่าช้าที่ผู้ใช้รู้สึกได้ เนื่องจากผู้ใช้จะเห็นคำตอบปรากฏขึ้นทีละส่วน แทนที่จะต้องรอให้คำตอบทั้งหมดถูกสร้างขึ้น

เมื่อสตรีมมิง API จะรวมข้อมูลการใช้โทเคนไว้ในชิ้นข้อมูลสุดท้าย ทำให้คุณสามารถติดตามการใช้โทเคนของคุณแบบเรียลไทม์และหยุดสตรีมได้หากใกล้ถึงขีดจำกัดงบประมาณ อินเทอร์เฟซสตรีมมิงเข้ากันได้กับ SDK มาตรฐานของ OpenAI ทั้งหมด ทำให้การผสานรวมเข้ากับแอปพลิเคชันที่มีอยู่ทำได้ง่าย

ข้อแลกเปลี่ยนอย่างหนึ่งที่ต้องพิจารณาคือ สตรีมมิงอาจทำให้จำนวนโทเคนสูงขึ้นเล็กน้อยเมื่อเทียบกับคำขอที่ไม่ใช้สตรีมมิง เนื่องจากโมเดลอาจสร้างคำเติมหรือลังเล อย่างไรก็ตาม ประโยชน์ของการได้รับผลตอบรับทันทีมักคุ้มค่ากับต้นทุนเล็กน้อยนี้ คุณยังสามารถใช้พารามิเตอร์ stop เพื่อหยุดการสร้างแต่เนิ่นๆ หากโมเดลเริ่มทำซ้ำหรือเบี่ยงเบนจากหัวข้อ

ความเป็นส่วนตัวของข้อมูลและการฝึกฝน

สำหรับนักพัฒนาจำนวนมาก ความปลอดภัยของข้อมูลเป็นข้อกังวลหลัก เมื่อคุณใช้ API ของเรา พรอมต์ของคุณจะไม่ถูกใช้ในการฝึกฝน นั่นหมายความว่าข้อมูลที่คุณส่งไปยังโมเดลจะยังคงเป็นความส่วนตัวและไม่ถูกใช้ในการปรับปรุงโมเดลพื้นฐานหรือแบ่งปันกับบุคคลที่สาม สิ่งนี้เป็นข้อได้เปรียบที่สำคัญเมื่อเทียบกับผู้ขายรายใหญ่บางรายที่ใช้ข้อมูลลูกค้าสำหรับการฝึกฝน

เพื่อสมัคร คุณต้องการเพียงที่อยู่อีเมล คุณสามารถเข้าสู่ระบบด้วย Google หรือใช้อีเมลและรหัสผ่าน ไม่จำเป็นต้องใช้หมายเลขโทรศัพท์ และไม่จำเป็นต้องใช้บัตรเครดิตสำหรับการทดลองใช้ การทดลองใช้รวมถึงเครดิต $0.50 ที่ใช้ได้เป็นเวลา 7 วัน เพื่อให้คุณทดสอบ API ก่อนที่จะผูกมัดกับแผนการชำระเงิน

มีข้อจำกัดเนื้อหาแบบแข็งข้อเดียวที่ใช้เสมอ: โมเดลจะปฏิเสธคำขอที่เกี่ยวข้องกับเนื้อหาทางเพศกับเด็ก หัวข้อผู้ใหญ่ที่ถูกต้องตามกฎหมาย อ่อนไหว หรือเฉพาะทางอื่นๆ ทั้งหมดได้รับอนุญาต สิ่งนี้รับประกันว่าโมเดลจะใช้งานได้สำหรับแอปพลิเคชันที่หลากหลายโดยไม่มีการจำกัดที่ไม่คาดคิด

ทำไมจึงเลือก API แทนการติดตั้งในเครื่อง?

การรันโมเดลในเครื่องให้คุณควบคุมข้อมูลและโครงสร้างพื้นฐานได้อย่างเต็มที่ แต่ต้องการฮาร์ดแวร์และความเชี่ยวชาญทางเทคนิคอย่างมาก คุณต้องจัดการไดรเวอร์ GPU การจัดสรรหน่วยความจำ และการอัปเดตโมเดล สำหรับนักพัฒนาจำนวนมาก โดยเฉพาะผู้ที่สร้างต้นแบบหรือแอปพลิเคชันขนาดเล็ก ค่าใช้จ่ายด้านโครงสร้างพื้นฐานนี้ไม่คุ้มค่า

API ของเราให้โซลูชันโฮสต์ที่จัดการโครงสร้างพื้นฐานทั้งหมด คุณได้รับเอนด์พอยต์ที่เชื่อถือได้ ขยายขนาดได้ และมีการราคาที่คาดการณ์ได้ API รองรับคำขอ 300 คำขอต่อนาที และคำขอพร้อมกันสูงสุด 8 คำขอต่อคีย์ ซึ่งเพียงพอสำหรับแอปพลิเคชันขนาดเล็กถึงขนาดกลาง หากคุณต้องการขีดจำกัดที่สูงขึ้น คุณสามารถติดต่อฝ่ายสนับสนุนได้

ข้อได้เปรียบอีกอย่างคือความง่ายในการผสานรวม คุณสามารถใช้โค้ดเดียวกันที่คุณจะใช้สำหรับ GPT-4 เพียงแค่เปลี่ยน URL ฐานและคีย์ API สิ่งนี้ลดเส้นโค้งการเรียนรู้และอนุญาตให้คุณสลับระหว่างโมเดลได้หากจำเป็น API ไม่ผูกติดกับผู้ขายเฉพาะเจาะจง ดังนั้นคุณจึงไม่ถูกผูกไว้ในระบบนิเวศเดียว

เริ่มต้นใช้งาน Abliterated

การเริ่มต้นใช้งาน API ของเราเป็นเรื่องง่าย อันดับแรก ให้สมัครบัญชีโดยใช้อีเมลหรือ Google คุณจะได้รับ API key ทันที ซึ่งคุณสามารถใช้ในการตรวจสอบสิทธิ์คำขอของคุณ คุณยังสามารถใช้เครดิตทดลองใช้เพื่อทดสอบ API โดยไม่ต้องป้อนข้อมูลการชำระเงิน

เพื่อทำการคำขอครั้งแรก ให้ใช้วิธีการ POST บนเอนด์พอยต์ /v1/chat/completions ตั้งค่าพารามิเตอร์ model เป็น uncensored และรวมพรอมต์ของคุณในอาร์เรย์ messages คุณยังสามารถระบุพารามิเตอร์เช่น temperature และ max_tokens เพื่อควบคุมผลลัพธ์

ถาม-ตอบ

โมเดลนี้ใช้ Llama หรือ Mistral เป็นฐานหรือไม่?

ไม่ใช่ โมเดลเป็นสถาปัตยกรรมแบบเปิดน้ำหนักที่เป็นอิสระ มันไม่ใช่ GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Llama หรือโมเดลของผู้ขายรายอื่นใด เป็นโมเดลเฉพาะที่ปรับแต่งสำหรับพฤติกรรมแบบไม่เซ็นเซอร์

ฉันสามารถใช้ API กับ SDK อย่างเป็นทางการของ OpenAI ได้หรือไม่?

ใช่ API เข้ากันได้กับ OpenAI อย่างสมบูรณ์ คุณสามารถใช้ SDK อย่างเป็นทางการของ OpenAI หรือไคลเอนต์ใดๆ ที่รองรับรูปแบบ API ของ OpenAI ได้ โดยตั้งค่า base URL เป็น https://api.abliterated.cc/v1 และระบุ API key ของคุณ

ฉันชำระเงินสำหรับ API ได้อย่างไร?

เรารับเฉพาะคริปโทเคอร์เรนซี: USDT บนเครือข่าย TRC20 หรือ USDC บนเครือข่าย Base คุณสามารถเติมเงินด้วยจำนวนเต็มใดๆ ระหว่าง $10 ถึง $500 ไม่มีสมาชิกแบบรายเดือนหรือการเรียกเก็บเงินด้วยบัตรเครดิต

ขนาดหน้าต่างบริบทคืออะไร?

หน้าต่างบริบทคือ 100,000 โทเคน ซึ่งรวมถึงพรอมต์อินพุตและการสร้างผลลัพธ์เอาต์พุต การเอาต์พุตสูงสุดต่อคำขอคือ 32,000 โทเคน หรือ 2,048 โทเคนหากคุณไม่ได้ระบุพารามิเตอร์ max_tokens

คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว

สร้างบัญชี คัดลอกคีย์ เปลี่ยน base URL นั่นคือการตั้งค่าทั้งหมด