LLM Non Censureคู่มือ
AI ไม่เซ็นเซอร์: คู่มือการผสาน API ทีละขั้นตอน
การผสาน AI ไม่เซ็นเซอร์ในแอปพลิเคชันของคุณช่วยให้รักษาอิสระทางความคิดสร้างสรรค์ได้เต็มที่ ไม่ว่าจะเป็นงานวรรณกรรม การวิจัย หรือเนื้อหาผู้ใหญ่ โดยไม่มีการปฏิเสธตามอำเภอใจของโมเดลทั่วไป คู่มือเทคนิคนี้อธิบายวิธีเปลี่ยนจากโมเดลท้องถิ่นที่มีขนาดใหญ่ไปเป็น API AI ที่ไร้การเซ็นเซอร์ซึ่งเชื่อถือได้และเข้ากันได้กับ OpenAI เพื่อการผสานที่รวดเร็วและราบรื่น
จุดสำคัญ
AI ที่ไร้การเซ็นเซอร์ไม่ได้กำหนดขอบเขตเชิงอัตนัยบนหัวข้อสำหรับผู้ใหญ่ ถกเถียงได้ หรือสร้างสรรค์
API ที่เข้ากันได้กับ OpenAI ทำให้การผสานทางเทคนิคง่ายขึ้นโดยการนำ SDK และตรรกะที่มีอยู่กลับมาใช้ใหม่
โมเดล 'uncensored' รองรับหน้าต่างบริบท 100,000 โทเคนเพื่อจัดการกับการสนทนาที่ยาวนานหรือเอกสารขนาดใหญ่
โมเดลแบบจ่ายตามการใช้งาน (pay-as-you-go) ขจัดค่าธรรมเนียมคงที่เพื่อให้ราคาสอดคล้องกับการใช้งานจริงของคุณ
AI ไม่เซ็นเซอร์คืออะไร?
ต่างจากโมเดลทั่วไปที่ใช้การกลั่นกรองแบบตายตัว AI แบบไม่เซ็นเซอร์ ถูกออกแบบมาให้ตอบพรอมต์ได้หลากหลายโดยไม่ปฏิเสธแบบอัตโนมัติ โมเดลเหล่านี้มักถูกปรับแต่ง (fine-tuned) เพื่อทนต่อธีมผู้ใหญ่ ความรุนแรงในนิยาย ความคิดเห็นที่ชัดเจน หรือความละเอียดอ่อนเชิงสร้างสรรค์ที่ผู้เล่นรายใหญ่มักมองว่ามีความเสี่ยง
หลักการพื้นฐานนั้นเรียบง่าย: โมเดลประเมินความเกี่ยวข้องและคุณภาพของคำตอบแทนที่จะเป็นความสอดคล้องกับบรรทัดฐานทางสังคมที่กำหนดไว้ สิ่งนี้ทำให้นักพัฒนาสามารถรับคำตอบที่สมบูรณ์และมีความละเอียดอ่อน ซึ่งจำเป็นสำหรับแอปพลิเคชันการเล่าเรื่อง การสวมบทบาท หรือการวิเคราะห์ข้อมูลที่มีความอ่อนไหว
ควรสังเกตว่า 'ไม่เซ็นเซอร์' ไม่ได้หมายถึง 'ไม่มีข้อจำกัดเลย' ตัวอย่างเช่น โมเดลของเราบล็อกเนื้อหาทางเพศที่เกี่ยวข้องกับเด็กโดยเฉพาะ ซึ่งเป็นข้อจำกัดทางตรรกะและกฎหมายที่บังคับใช้อย่างเป็นระบบ สำหรับส่วนอื่น ๆ อิสระนั้นสมบูรณ์
ทำไมต้องใช้ API แทนโมเดลท้องถิ่น?
การรันโมเดลภาษาขนาดใหญ่ (LLM) ในเครื่องเองให้ความเป็นอิสระสูงสุด แต่ต้องการโครงสร้างพื้นฐานทางฮาร์ดแวร์ที่ราคาแพงและการบำรุงรักษาอย่างต่อเนื่อง api ia แบบไม่เซ็นเซอร์ ที่ให้บริการโดยผู้ให้บริการจะย้ายความซับซ้อนนี้ไปยังผู้ให้บริการ ทำให้คุณสามารถมุ่งเน้นไปที่การพัฒนาแอปพลิเคชันของคุณได้
- โครงสร้างพื้นฐานที่จัดการแล้ว: ไม่ต้องจัดการ GPU อัปเดตไดรเวอร์ หรือการรีสตาร์ทเซิร์ฟเวอร์
- ความสามารถในการปรับขนาด: API จัดการภาระงานให้คุณ โดยมีขีดจำกัดที่ชัดเจน (300 คำขอต่อนาทีต่อคีย์)
- ต้นทุนที่คาดการณ์ได้: ด้วยโมเดลแบบจ่ายตามการใช้งาน คุณจ่ายเฉพาะสิ่งที่บริโภคเท่านั้น โดยไม่มีค่าสมัครสมาชิกประจำเดือนที่จำเป็น
นอกจากนี้ การใช้ API ที่เข้ากันได้กับ OpenAI ทำให้การผสานเป็นมาตรฐาน คุณไม่จำเป็นต้องเรียนรู้โปรโตกรรมที่เป็นกรรมสิทธิ์ คุณเพียงแค่ใช้ไลบรารีที่คุณคุ้นเคยอยู่แล้ว
ข้อกำหนดทางเทคนิคสำหรับการผสาน
เพื่อผสาน llm api อย่างมีประสิทธิภาพ คุณต้องมีสภาพแวดล้อมการพัฒนาที่สามารถจัดการคำขอ HTTP และการสตรีมมิงได้ นี่คือองค์ประกอบสำคัญ:
- คีย์ API: ตัวระบุเอกลักษณ์เพื่อตรวจสอบสิทธิ์คำขอของคุณกับบริการ
- ไลบรารี SDK: แนะนำให้ใช้ SDK ทางการของ OpenAI หรือตัวเทียบเคียงที่เข้ากันได้เพื่อทำให้การจัดการหัวเรื่องและการตรวจสอบสิทธิ์ง่ายขึ้น
- การจัดการสตรีมมิง: จำเป็นสำหรับประสบการณ์ผู้ใช้ที่ดี เนื่องจากช่วยให้แสดงคำตอบโทเคนต่อโทเคนแทนที่จะรอให้กระบวนการสิ้นสุด
- ข้อจำกัดภาระงาน: โปรดทราบถึงข้อจำกัดขนาดของร่างกายคำขอ (8 MB) เพื่อหลีกเลี่ยงข้อผิดพลาด 413
ความเข้ากันได้กับอินเทอร์เฟซ OpenAI รับประกันว่าโค้ดของคุณจะยังคงสามารถพกพาและบำรุงรักษาได้ง่าย แม้ว่าคุณจะตัดสินใจเปลี่ยนผู้ให้บริการโมเดลในอนาคตก็ตาม
ขั้นตอนที่ 1: สร้างบัญชีและรับคีย์
ขั้นตอนแรกในการเข้าถึง uncensored llm api คือการสร้างบัญชี บนแพลตฟอร์มของเรา กระบวนการนี้เรียบง่ายมาก: ไม่จำเป็นต้องใช้บัตรเครดิตเพื่อเริ่มต้น
- ไปที่หน้าลงทะเบียนและระบุที่อยู่อีเมลและรหัสผ่าน
- หลังจากลงทะเบียนแล้ว คีย์ API ของคุณจะแสดงขึ้นทันที คัดลอกและเก็บรักษาอย่างปลอดภัย
- คุณจะได้รับเครดิตทดลองใช้ฟรีจำนวน 0.50 ดอลลาร์เป็นเวลา 7 วันโดยอัตโนมัติเพื่อทดสอบการผสานโดยไม่มีความเสี่ยง
แต่ละบัญชีจะเชื่อมโยงกับคีย์ API เพียงคีย์เดียว หากคุณต้องเพิกถอนการเข้าถึงหรือเปลี่ยนสภาพแวดล้อม (เช่น จากการพัฒนาไปสู่การผลิต) คุณสามารถสร้างคีย์ใหม่ได้ทุกเมื่อจากแดชบอร์ดของคุณ คีย์เก่าจะหมดอายุทันที
ขั้นตอนที่ 2: ตั้งค่าไคลเอนต์ที่เข้ากันได้กับ OpenAI
เพื่อใช้บริการของเรา คุณต้องตั้งค่าไคลเอนต์ของคุณให้ชี้ไปที่ base URL ของเราแทนของ OpenAI สิ่งนี้ทำได้โดยทั่วไปโดยการกำหนดตัวแปรสภาพแวดล้อม OPENAI_BASE_URL หรือส่งพารามิเตอร์ base_url โดยชัดเจนใน SDK ของคุณ
- Base URL: https://api.llmnoncensure.com/v1
- ID ของโมเดล:
uncensored
การกำหนดค่านี้ทำให้แอปพลิเคชันของคุณสามารถใช้วิธีการ chat.completions.create() เดียวกันกับที่คุณจะใช้กับ GPT-4 แต่ส่งข้อมูลไปยังโครงสร้างพื้นฐานที่สงวนไว้ของเรา ตรวจสอบให้แน่ใจว่า SDK ของคุณเป็นเวอร์ชันล่าสุดเพื่อใช้ประโยชน์จากฟีเจอร์ล่าสุดเช่น การเรียกใช้ฟังก์ชัน (function calling)
ขั้นตอนที่ 3: การเรียก API ครั้งแรกพร้อมสตรีมมิง
สตรีมมิงมีความสำคัญอย่างยิ่งสำหรับแอปพลิเคชันแบบโต้ตอบ มันช่วยให้ผู้ใช้เห็นการสร้างคำตอบแบบเรียลไทม์ นี่คือวิธีสร้างคำขอพื้นฐาน:
- ใช้วิธีการ
POSTบนเอนด์พอยต์/v1/chat/completions. - ตั้งค่า
streamเป็นtrue - ส่งรายการข้อความของคุณใน body ของ request
เซิร์ฟเวอร์จะส่งคืน stream ของข้อมูล Server-Sent Events (SSE) แต่ละ event จะประกอบด้วย fragment ของคำตอบ ไคลเอนต์ของคุณต้อง aggregate fragment เหล่านี้เพื่อแสดงข้อความเต็ม วิธีนี้ช่วยลด latency ที่ผู้ใช้รู้สึกและมอบประสบการณ์ที่ลื่นไหล
ขั้นตอนที่ 4: การจัดการ context ยาว (100k tokens)
โมเดลของเรารองรับ context window ขนาด 100,000 tokens ซึ่งถือว่ามากสำหรับ use case ส่วนใหญ่ สิ่งนี้ช่วยให้คุณส่ง history การสนทนาที่ยาวหรือเอกสารขนาดใหญ่เป็น input ได้
ระวังการจัดการ memory ทางฝั่งไคลเอนต์: แม้โมเดลจะประมวลผล 100k tokens ได้ แต่ขีดจำกัดขนาด body ของ request คือ 8 MB ตรวจสอบให้แน่ใจว่า request JSON ของคุณไม่เกินขีดจำกัดนี้ สำหรับ use case ที่ต้องการ context มากกว่านี้ ให้พิจารณาสรุปการสนทนาเก่าหรือแบ่งเอกสารออกเป็น chunks
การจัดการ context อย่างมีประสิทธิภาพเป็นสิ่งสำคัญเพื่อรักษาความสอดคล้องในแอปพลิเคชันประเภทแชทหรือผู้ช่วยเสมือน ในขณะที่ปรับต้นทุน tokens ให้เหมาะสม
ขั้นตอนที่ 5: การปรับต้นทุนด้วยระบบ pay-as-you-go
โมเดลการกำหนดราคาของเราโปร่งใสและไม่มีสมาชิก คุณจ่ายเฉพาะสำหรับ tokens ที่ใช้ไป
- Tokens เข้า: 0.25 $ ต่อล้าน tokens
- Tokens ออก: 1.00 $ ต่อล้าน tokens
คุณเติมเครดิตแบบเติมเงินล่วงหน้าในบัญชี (เริ่มต้น 10 $) โดยได้รับโบนัส +5% สำหรับการเติม 50 $ และ +10% สำหรับการเติม 100 $ เครดิตไม่หมดอายุ ทำให้คุณทดสอบได้โดยไม่กดดัน วิธีนี้เหมาะสำหรับโปรเจกต์ที่มีการใช้งานไม่สม่ำเสมอ เพราะคุณไม่จ่ายสำหรับความจุที่ไม่ได้ใช้
คำถามที่พบบ่อย
โมเดลบล็อกเนื้อหาผู้ใหญ่ทั้งหมดหรือไม่?
ไม่ โมเดลได้รับการปรับแต่งเฉพาะเพื่อไม่ให้ปฏิเสธเนื้อหาผู้ใหญ่ ตราบใดที่มันถูกต้องตามกฎหมาย อย่างไรก็ตาม ขีดจำกัดที่เข้มงวดยังคงใช้เสมอ: เนื้อหาทางเพศที่เกี่ยวข้องกับเด็กจะถูกบล็อก สำหรับส่วนที่เหลือ คุณมีอิสระเต็มที่สำหรับงานวรรณกรรม ศิลปะ หรือการวิเคราะห์
ฉันสามารถใช้โมเดลนี้สำหรับแอปพลิเคชันเชิงพาณิชย์ได้หรือไม่?
ใช่ การใช้งานเป็นอิสระและไม่มีข้อจำกัดประเภทการใช้งาน คุณจ่ายเฉพาะสำหรับ tokens ที่ใช้ผ่านเครดิตแบบเติมเงินล่วงหน้าของคุณ ไม่มีค่าธรรมเนียมเพิ่มเติมสำหรับการใช้งานเชิงพาณิชย์ ค่าลิขสิทธิ์ต่อแอป หรือขีดจำกัดปริมาณเฉพาะอื่น ๆ นอกเหนือจาก rate limit (300 requests/นาที)
ความแตกต่างระหว่างโมเดลนี้กับ GPT-4 หรือ Claude คืออะไร?
ต่างจาก GPT-4 หรือ Claude ที่ใช้ชั้นการตรวจสอบที่เข้มงวดและกฎความสอดคล้องที่เคร่งครัด โมเดลนี้ได้รับการปรับให้เหมาะสมสำหรับอิสระในการตอบกลับ มันไม่ได้สร้างขึ้นจากสถาปัตยกรรมของโมเดลขนาดใหญ่เหล่านี้ แต่เป็น open-weight model ที่ได้รับการปรับแต่งเพื่อทนต่อความละเอียดอ่อน หัวข้อที่ถกเถียง และเนื้อหาสำหรับผู้ใหญ่โดยไม่มีการปฏิเสธอย่างเป็นระบบ
ข้อมูลของฉันถูกใช้ในการฝึกโมเดลหรือไม่?
ไม่, พรอมต์และคำตอบของคุณไม่ถูกนำไปฝึกโมเดล ความปลอดภัยคือหลักประกัน: คุณจ่ายสำหรับทรัพยากรการคำนวณเฉพาะผ่านบัญชีของคุณ โดยไม่มีพันธะระยะยาวหรือการแบ่งปันข้อมูลของคุณกับบุคคลที่สาม
คีย์ของคุณอยู่ห่างออกไปเพียงขั้นตอนเดียว
สร้างบัญชี คopy คีย์ แก้ไข URL ฐาน แค่นั้นเอง