TH ▾
รับคีย์ API

LLM Non Censureคู่มือ

AI ไม่เซ็นเซอร์: คู่มือการผสาน API ทีละขั้นตอน

การผสาน AI ไม่เซ็นเซอร์ในแอปพลิเคชันของคุณช่วยให้รักษาอิสระทางความคิดสร้างสรรค์ได้เต็มที่ ไม่ว่าจะเป็นงานวรรณกรรม การวิจัย หรือเนื้อหาผู้ใหญ่ โดยไม่มีการปฏิเสธตามอำเภอใจของโมเดลทั่วไป คู่มือเทคนิคนี้อธิบายวิธีเปลี่ยนจากโมเดลท้องถิ่นที่มีขนาดใหญ่ไปเป็น API AI ที่ไร้การเซ็นเซอร์ซึ่งเชื่อถือได้และเข้ากันได้กับ OpenAI เพื่อการผสานที่รวดเร็วและราบรื่น

อัปเดตล่าสุด

จุดสำคัญ

  1. AI ที่ไร้การเซ็นเซอร์ไม่ได้กำหนดขอบเขตเชิงอัตนัยบนหัวข้อสำหรับผู้ใหญ่ ถกเถียงได้ หรือสร้างสรรค์

  2. API ที่เข้ากันได้กับ OpenAI ทำให้การผสานทางเทคนิคง่ายขึ้นโดยการนำ SDK และตรรกะที่มีอยู่กลับมาใช้ใหม่

  3. โมเดล 'uncensored' รองรับหน้าต่างบริบท 100,000 โทเคนเพื่อจัดการกับการสนทนาที่ยาวนานหรือเอกสารขนาดใหญ่

  4. โมเดลแบบจ่ายตามการใช้งาน (pay-as-you-go) ขจัดค่าธรรมเนียมคงที่เพื่อให้ราคาสอดคล้องกับการใช้งานจริงของคุณ

AI ไม่เซ็นเซอร์คืออะไร?

ต่างจากโมเดลทั่วไปที่ใช้การกลั่นกรองแบบตายตัว AI แบบไม่เซ็นเซอร์ ถูกออกแบบมาให้ตอบพรอมต์ได้หลากหลายโดยไม่ปฏิเสธแบบอัตโนมัติ โมเดลเหล่านี้มักถูกปรับแต่ง (fine-tuned) เพื่อทนต่อธีมผู้ใหญ่ ความรุนแรงในนิยาย ความคิดเห็นที่ชัดเจน หรือความละเอียดอ่อนเชิงสร้างสรรค์ที่ผู้เล่นรายใหญ่มักมองว่ามีความเสี่ยง

หลักการพื้นฐานนั้นเรียบง่าย: โมเดลประเมินความเกี่ยวข้องและคุณภาพของคำตอบแทนที่จะเป็นความสอดคล้องกับบรรทัดฐานทางสังคมที่กำหนดไว้ สิ่งนี้ทำให้นักพัฒนาสามารถรับคำตอบที่สมบูรณ์และมีความละเอียดอ่อน ซึ่งจำเป็นสำหรับแอปพลิเคชันการเล่าเรื่อง การสวมบทบาท หรือการวิเคราะห์ข้อมูลที่มีความอ่อนไหว

ควรสังเกตว่า 'ไม่เซ็นเซอร์' ไม่ได้หมายถึง 'ไม่มีข้อจำกัดเลย' ตัวอย่างเช่น โมเดลของเราบล็อกเนื้อหาทางเพศที่เกี่ยวข้องกับเด็กโดยเฉพาะ ซึ่งเป็นข้อจำกัดทางตรรกะและกฎหมายที่บังคับใช้อย่างเป็นระบบ สำหรับส่วนอื่น ๆ อิสระนั้นสมบูรณ์

ทำไมต้องใช้ API แทนโมเดลท้องถิ่น?

การรันโมเดลภาษาขนาดใหญ่ (LLM) ในเครื่องเองให้ความเป็นอิสระสูงสุด แต่ต้องการโครงสร้างพื้นฐานทางฮาร์ดแวร์ที่ราคาแพงและการบำรุงรักษาอย่างต่อเนื่อง api ia แบบไม่เซ็นเซอร์ ที่ให้บริการโดยผู้ให้บริการจะย้ายความซับซ้อนนี้ไปยังผู้ให้บริการ ทำให้คุณสามารถมุ่งเน้นไปที่การพัฒนาแอปพลิเคชันของคุณได้

  • โครงสร้างพื้นฐานที่จัดการแล้ว: ไม่ต้องจัดการ GPU อัปเดตไดรเวอร์ หรือการรีสตาร์ทเซิร์ฟเวอร์
  • ความสามารถในการปรับขนาด: API จัดการภาระงานให้คุณ โดยมีขีดจำกัดที่ชัดเจน (300 คำขอต่อนาทีต่อคีย์)
  • ต้นทุนที่คาดการณ์ได้: ด้วยโมเดลแบบจ่ายตามการใช้งาน คุณจ่ายเฉพาะสิ่งที่บริโภคเท่านั้น โดยไม่มีค่าสมัครสมาชิกประจำเดือนที่จำเป็น

นอกจากนี้ การใช้ API ที่เข้ากันได้กับ OpenAI ทำให้การผสานเป็นมาตรฐาน คุณไม่จำเป็นต้องเรียนรู้โปรโตกรรมที่เป็นกรรมสิทธิ์ คุณเพียงแค่ใช้ไลบรารีที่คุณคุ้นเคยอยู่แล้ว

ข้อกำหนดทางเทคนิคสำหรับการผสาน

เพื่อผสาน llm api อย่างมีประสิทธิภาพ คุณต้องมีสภาพแวดล้อมการพัฒนาที่สามารถจัดการคำขอ HTTP และการสตรีมมิงได้ นี่คือองค์ประกอบสำคัญ:

  • คีย์ API: ตัวระบุเอกลักษณ์เพื่อตรวจสอบสิทธิ์คำขอของคุณกับบริการ
  • ไลบรารี SDK: แนะนำให้ใช้ SDK ทางการของ OpenAI หรือตัวเทียบเคียงที่เข้ากันได้เพื่อทำให้การจัดการหัวเรื่องและการตรวจสอบสิทธิ์ง่ายขึ้น
  • การจัดการสตรีมมิง: จำเป็นสำหรับประสบการณ์ผู้ใช้ที่ดี เนื่องจากช่วยให้แสดงคำตอบโทเคนต่อโทเคนแทนที่จะรอให้กระบวนการสิ้นสุด
  • ข้อจำกัดภาระงาน: โปรดทราบถึงข้อจำกัดขนาดของร่างกายคำขอ (8 MB) เพื่อหลีกเลี่ยงข้อผิดพลาด 413

ความเข้ากันได้กับอินเทอร์เฟซ OpenAI รับประกันว่าโค้ดของคุณจะยังคงสามารถพกพาและบำรุงรักษาได้ง่าย แม้ว่าคุณจะตัดสินใจเปลี่ยนผู้ให้บริการโมเดลในอนาคตก็ตาม

ขั้นตอนที่ 1: สร้างบัญชีและรับคีย์

ขั้นตอนแรกในการเข้าถึง uncensored llm api คือการสร้างบัญชี บนแพลตฟอร์มของเรา กระบวนการนี้เรียบง่ายมาก: ไม่จำเป็นต้องใช้บัตรเครดิตเพื่อเริ่มต้น

  1. ไปที่หน้าลงทะเบียนและระบุที่อยู่อีเมลและรหัสผ่าน
  2. หลังจากลงทะเบียนแล้ว คีย์ API ของคุณจะแสดงขึ้นทันที คัดลอกและเก็บรักษาอย่างปลอดภัย
  3. คุณจะได้รับเครดิตทดลองใช้ฟรีจำนวน 0.50 ดอลลาร์เป็นเวลา 7 วันโดยอัตโนมัติเพื่อทดสอบการผสานโดยไม่มีความเสี่ยง

แต่ละบัญชีจะเชื่อมโยงกับคีย์ API เพียงคีย์เดียว หากคุณต้องเพิกถอนการเข้าถึงหรือเปลี่ยนสภาพแวดล้อม (เช่น จากการพัฒนาไปสู่การผลิต) คุณสามารถสร้างคีย์ใหม่ได้ทุกเมื่อจากแดชบอร์ดของคุณ คีย์เก่าจะหมดอายุทันที

ขั้นตอนที่ 2: ตั้งค่าไคลเอนต์ที่เข้ากันได้กับ OpenAI

เพื่อใช้บริการของเรา คุณต้องตั้งค่าไคลเอนต์ของคุณให้ชี้ไปที่ base URL ของเราแทนของ OpenAI สิ่งนี้ทำได้โดยทั่วไปโดยการกำหนดตัวแปรสภาพแวดล้อม OPENAI_BASE_URL หรือส่งพารามิเตอร์ base_url โดยชัดเจนใน SDK ของคุณ

  • Base URL: https://api.llmnoncensure.com/v1
  • ID ของโมเดล: uncensored

การกำหนดค่านี้ทำให้แอปพลิเคชันของคุณสามารถใช้วิธีการ chat.completions.create() เดียวกันกับที่คุณจะใช้กับ GPT-4 แต่ส่งข้อมูลไปยังโครงสร้างพื้นฐานที่สงวนไว้ของเรา ตรวจสอบให้แน่ใจว่า SDK ของคุณเป็นเวอร์ชันล่าสุดเพื่อใช้ประโยชน์จากฟีเจอร์ล่าสุดเช่น การเรียกใช้ฟังก์ชัน (function calling)

ขั้นตอนที่ 3: การเรียก API ครั้งแรกพร้อมสตรีมมิง

สตรีมมิงมีความสำคัญอย่างยิ่งสำหรับแอปพลิเคชันแบบโต้ตอบ มันช่วยให้ผู้ใช้เห็นการสร้างคำตอบแบบเรียลไทม์ นี่คือวิธีสร้างคำขอพื้นฐาน:

  • ใช้วิธีการ POST บนเอนด์พอยต์ /v1/chat/completions.
  • ตั้งค่า stream เป็น true
  • ส่งรายการข้อความของคุณใน body ของ request

เซิร์ฟเวอร์จะส่งคืน stream ของข้อมูล Server-Sent Events (SSE) แต่ละ event จะประกอบด้วย fragment ของคำตอบ ไคลเอนต์ของคุณต้อง aggregate fragment เหล่านี้เพื่อแสดงข้อความเต็ม วิธีนี้ช่วยลด latency ที่ผู้ใช้รู้สึกและมอบประสบการณ์ที่ลื่นไหล

ขั้นตอนที่ 4: การจัดการ context ยาว (100k tokens)

โมเดลของเรารองรับ context window ขนาด 100,000 tokens ซึ่งถือว่ามากสำหรับ use case ส่วนใหญ่ สิ่งนี้ช่วยให้คุณส่ง history การสนทนาที่ยาวหรือเอกสารขนาดใหญ่เป็น input ได้

ระวังการจัดการ memory ทางฝั่งไคลเอนต์: แม้โมเดลจะประมวลผล 100k tokens ได้ แต่ขีดจำกัดขนาด body ของ request คือ 8 MB ตรวจสอบให้แน่ใจว่า request JSON ของคุณไม่เกินขีดจำกัดนี้ สำหรับ use case ที่ต้องการ context มากกว่านี้ ให้พิจารณาสรุปการสนทนาเก่าหรือแบ่งเอกสารออกเป็น chunks

การจัดการ context อย่างมีประสิทธิภาพเป็นสิ่งสำคัญเพื่อรักษาความสอดคล้องในแอปพลิเคชันประเภทแชทหรือผู้ช่วยเสมือน ในขณะที่ปรับต้นทุน tokens ให้เหมาะสม

ขั้นตอนที่ 5: การปรับต้นทุนด้วยระบบ pay-as-you-go

โมเดลการกำหนดราคาของเราโปร่งใสและไม่มีสมาชิก คุณจ่ายเฉพาะสำหรับ tokens ที่ใช้ไป

  • Tokens เข้า: 0.25 $ ต่อล้าน tokens
  • Tokens ออก: 1.00 $ ต่อล้าน tokens

คุณเติมเครดิตแบบเติมเงินล่วงหน้าในบัญชี (เริ่มต้น 10 $) โดยได้รับโบนัส +5% สำหรับการเติม 50 $ และ +10% สำหรับการเติม 100 $ เครดิตไม่หมดอายุ ทำให้คุณทดสอบได้โดยไม่กดดัน วิธีนี้เหมาะสำหรับโปรเจกต์ที่มีการใช้งานไม่สม่ำเสมอ เพราะคุณไม่จ่ายสำหรับความจุที่ไม่ได้ใช้

คำถามที่พบบ่อย

โมเดลบล็อกเนื้อหาผู้ใหญ่ทั้งหมดหรือไม่?

ไม่ โมเดลได้รับการปรับแต่งเฉพาะเพื่อไม่ให้ปฏิเสธเนื้อหาผู้ใหญ่ ตราบใดที่มันถูกต้องตามกฎหมาย อย่างไรก็ตาม ขีดจำกัดที่เข้มงวดยังคงใช้เสมอ: เนื้อหาทางเพศที่เกี่ยวข้องกับเด็กจะถูกบล็อก สำหรับส่วนที่เหลือ คุณมีอิสระเต็มที่สำหรับงานวรรณกรรม ศิลปะ หรือการวิเคราะห์

ฉันสามารถใช้โมเดลนี้สำหรับแอปพลิเคชันเชิงพาณิชย์ได้หรือไม่?

ใช่ การใช้งานเป็นอิสระและไม่มีข้อจำกัดประเภทการใช้งาน คุณจ่ายเฉพาะสำหรับ tokens ที่ใช้ผ่านเครดิตแบบเติมเงินล่วงหน้าของคุณ ไม่มีค่าธรรมเนียมเพิ่มเติมสำหรับการใช้งานเชิงพาณิชย์ ค่าลิขสิทธิ์ต่อแอป หรือขีดจำกัดปริมาณเฉพาะอื่น ๆ นอกเหนือจาก rate limit (300 requests/นาที)

ความแตกต่างระหว่างโมเดลนี้กับ GPT-4 หรือ Claude คืออะไร?

ต่างจาก GPT-4 หรือ Claude ที่ใช้ชั้นการตรวจสอบที่เข้มงวดและกฎความสอดคล้องที่เคร่งครัด โมเดลนี้ได้รับการปรับให้เหมาะสมสำหรับอิสระในการตอบกลับ มันไม่ได้สร้างขึ้นจากสถาปัตยกรรมของโมเดลขนาดใหญ่เหล่านี้ แต่เป็น open-weight model ที่ได้รับการปรับแต่งเพื่อทนต่อความละเอียดอ่อน หัวข้อที่ถกเถียง และเนื้อหาสำหรับผู้ใหญ่โดยไม่มีการปฏิเสธอย่างเป็นระบบ

ข้อมูลของฉันถูกใช้ในการฝึกโมเดลหรือไม่?

ไม่, พรอมต์และคำตอบของคุณไม่ถูกนำไปฝึกโมเดล ความปลอดภัยคือหลักประกัน: คุณจ่ายสำหรับทรัพยากรการคำนวณเฉพาะผ่านบัญชีของคุณ โดยไม่มีพันธะระยะยาวหรือการแบ่งปันข้อมูลของคุณกับบุคคลที่สาม

คีย์ของคุณอยู่ห่างออกไปเพียงขั้นตอนเดียว

สร้างบัญชี คopy คีย์ แก้ไข URL ฐาน แค่นั้นเอง

รับคีย์ APIอ่านเอกสาร