หน้าแรกคู่มือ
วิธีเชื่อมต่อ IA ไม่เซ็นเซอร์ในแอปพลิเคชันของคุณ
อัปเดต LLM Sin Censura
การเชื่อมต่อ ia ไม่เซ็นเซอร์ในแอปพลิเคชันของคุณทำให้ได้การตอบกลับโดยตรงจากโมเดลโดยไม่มีการปฏิเสธบ่อยๆ จากผู้จัดจำหน่ายรายใหญ่ คู่มือทางเทคนิคนี้อธิบายวิธีเชื่อมต่อเอนด์พอยต์ที่เข้ากันได้กับ OpenAI จัดการหน้าต่างบริบท และจัดการสตรีมมิงเพื่อสร้างประสบการณ์ผู้ใช้ที่ลื่นไหลและไม่มีเซ็นเซอร์
IA ไม่เซ็นเซอร์คืออะไร?
ia ไม่เซ็นเซอร์หมายถึงโมเดลภาษาขนาดใหญ่ (LLM) ที่ถูกปรับแต่งหรือกำหนดค่าเพื่อไม่ปฏิเสธเนื้อหาผู้ใหญ่ ความขัดแย้ง หรือหัวข้อย่อยโดยอิงจากนโยบายองค์กรที่เข้มงวด ต่างจากโมเดลพาณิชย์มาตรฐานที่อาจส่งข้อผิดพลาด 400 หรือข้อความทั่วไปเมื่อตรวจพบรูปแบบบางอย่าง โมเดลที่ไม่มีการเซ็นเซอร์จะส่งสิ่งที่ร้องขออย่างแม่นยำ ตราบใดที่ถูกต้องตามกฎหมาย
คุณสมบัตินี้สำคัญมากสำหรับแอปพลิเคชันด้านความคิดสร้างสรรค์ การวิจัย หรือสภาพแวดล้อมที่เสรีภาพในการแสดงออกของโมเดลเป็นลำดับความสำคัญ ไม่ได้หมายความว่าโมเดล 'โง่' หรือขาดสติปัญญา เพียงแต่ลบชั้นการตรวจสอบเนื้อหาผิวเผินที่บางครั้งบล็อกการตอบกลับที่ถูกต้อง สำหรับนักพัฒนาสิ่งนี้ทำให้ตรรกะการจัดการข้อผิดพลาดง่ายขึ้น เนื่องจากคุณไม่จำเป็นต้องคาดเดาว่าเนื้อหาใดจะถูกบล็อกโดยตัวกรองภายนอก
- ความคาดเดาได้: คุณได้รับข้อความเต็มโดยไม่มีการตัดแบบสุ่ม
- การควบคุม: คุณเป็นผู้ตัดสินใจว่าจะแสดงเนื้อหาใด ไม่ใช่ API
- ประสิทธิภาพ: ลดการเรียก API ที่ล้มเหลวจากการตรวจสอบเนื้อหาผิดพลาด
การตั้งค่า SDK เริ่มต้น
เพื่อเชื่อมต่อ ia ไม่เซ็นเซอร์ของเรา เราจะใช้ SDK มาตรฐานของ OpenAI เนื่องจากเอนด์พอยต์ของเราเข้ากันได้กับโปรโตคอลของพวกเขา 100% สิ่งนี้ทำให้คุณสามารถใช้ไลบรารีที่คุณคุ้นเคยเช่น openai ใน Python หรือ openai ใน Node.js คุณเพียงแค่ต้องปรับ URL base และระบุคีย์ API ของคุณ
ข้อดีของแนวทางนี้คือความสามารถในการพกพา หากคุณตัดสินใจเปลี่ยนผู้จัดจำหน่ายที่เสนอเอนด์พอยต์ที่เข้ากันได้ในอนาคต การเปลี่ยนแปลงในโค้ดของคุณจะน้อยมาก นี่คือวิธีตั้งค่าไคลเอนต์ใน Python โดยชี้ไปที่บริการของเรา:
from openai import OpenAI
client = OpenAI(base_url="https://api.llmsincensura.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)โปรดจำไว้ว่าความเข้ากันได้หมายถึงการใช้รูปแบบคำขอและการตอบกลับ JSON เดียวกัน ซึ่งช่วยในการย้ายจากแพลตฟอร์มอื่นหรือการพัฒนาการทดสอบหน่วยโดยใช้ mocks มาตรฐาน
การตรวจสอบสิทธิ์ด้วย API Key
ความปลอดภัยใน API ของเราจัดการผ่านคีย์ API เดียวต่อบัญชี คีย์นี้สร้างขึ้นทันทีหลังจากการลงทะเบียนและแสดงเพียงครั้งเดียว สิ่งสำคัญคือต้องเข้าใจว่าไม่มีหลายคีย์โดยค่าเริ่มต้น บัญชีของคุณมีตัวระบุหลักสำหรับคำขอของคุณ
หากคุณต้องการเพิกถอนการเข้าถึงหรือสร้างโทเคนใหม่เพื่อความปลอดภัย คุณสามารถสร้างคีย์ใหม่ในการตั้งค่าบัญชีของคุณ โปรดทราบว่าสิ่งนี้จะทำให้คีย์ก่อนหน้าหมดอายุทันที ไม่ใช่วิธีเพิ่มขีดจำกัดอัตราของคุณ แต่เป็นมาตรการความปลอดภัยเพื่อให้มีจุดตรวจสอบเดียวที่ใช้งานอยู่ เก็บคีย์ของคุณในตัวแปรสภาพแวดล้อมและอย่าเปิดเผยในโค้ดฝั่งไคลเอนต์หากแอปพลิเคชันของคุณเป็นสาธารณะ
- การสร้าง: แสดงเมื่อคุณลงทะเบียน
- การสร้างใหม่: ทำให้คีย์ก่อนหน้าหมดอายุ
- การใช้งาน: ส่งในหัวเรื่อง
Authorization: Bearer YOUR_KEY
การส่งคำขอครั้งแรก
การดำเนินการพื้นฐานคือการร้องขอ POST ไปยัง /v1/chat/completions คุณต้องระบุโมเดลเป็น uncensored กำหนดระบบพรอมต์หากจำเป็นเพื่อตั้งค่าโทนเสียง และให้ประวัติข้อความหรือคำค้นหาแบบง่ายของผู้ใช้ โมเดลจะประมวลผลอินพุตและส่งการตอบกลับแบบเต็มในรูปแบบ JSON
นี่คือโฟลว์ที่ง่ายที่สุดเพื่อตรวจสอบว่าการเชื่อมต่อของคุณทำงานอยู่ ตรวจสอบให้แน่ใจว่าแอปพลิเคชันของคุณจัดการการตอบกลับของโมเดลได้อย่างถูกต้อง ซึ่งรวมถึงเนื้อหาที่สร้างและเมตาดาต้าการใช้งาน เช่น จำนวนโทเคนที่ใช้ไป
curl https://api.llmsincensura.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'คำขอนี้เป็นพื้นฐานสำหรับแอปพลิเคชันแช่ การสร้างเนื้อหา หรือการวิเคราะห์ข้อความ หากโมเดลตอบสนองอย่างถูกต้อง การตั้งค่าเครือข่ายและการตรวจสอบสิทธิ์ของคุณถูกต้อง
การจัดการสตรีมมิง
สำหรับแอปพลิเคชันแบบโต้ตอบเช่นแชทบอท การสตรีมมิงจึงสำคัญมาก มันทำให้โทเคนถูกส่งไปยังไคลเอนต์เมื่อสร้างเสร็จ ช่วยลดความรู้สึกเรื่องความหน่วง API ของเรารองรับ Server-Sent Events (SSE) เพื่อจุดประสงค์นี้
เมื่อเปิดใช้งานสตรีมมิงใน SDK ของคุณ คุณจะรับเหตุการณ์ย่อยหลายรายการ คุณต้องรวมชิ้นส่วนเหล่านี้เพื่อสร้างการตอบกลับเต็มรูปแบบ สิ่งนี้มีประโยชน์เป็นพิเศษเมื่อโมเดลสร้างข้อความยาว เนื่องจากผู้ใช้จะเริ่มเห็นข้อความเกือบจะทันที
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)สตรีมมิงไม่ใช้โทเคนมากกว่าคำขอที่ไม่ใช่สตรีมมิง เพียงเปลี่ยนวิธีการขนส่งข้อมูล เป็นแนวทางปฏิบัติที่แนะนำสำหรับอินเทอร์เฟซผู้ใช้สมัยใหม่ที่พึ่งพา AI
การจัดการหน้าต่างบริบท 100k
ความท้าทายที่ใหญ่ที่สุดอย่างหนึ่งในการพัฒนาด้วย LLM คือขีดจำกัดหน้าต่างบริบท API ของเราเสนอหน้าต่างบริบท 100,000 โทเคน สิ่งนี้เพียงพอสำหรับการโหลดเอกสารยาว ประวัติการสนทนาที่ยาวนาน หรือฐานความรู้ขนาดใหญ่ในคำขอเดียว
เพื่อใช้ประโยชน์จากสิ่งนี้อย่างมีประสิทธิภาพ คุณต้องจัดการหน้าต่างเลื่อนในแอปพลิเคชันของคุณ เมื่อการสนทนาขยายตัว คุณสามารถลบข้อความเก่าที่สุดออกจากประวัติที่ส่งไปยังโมเดลเพื่อคงไว้ภายในขีดจำกัด บริบทรวมถึงโทเคนขาเข้า (พรอมต์) และขาออก (การเติมข้อความ) ด้วย
- ความจุ: 100k โทเคนรวม
- กลยุทธ์: ใช้ buffer แบบวงกลมสำหรับข้อความ
- ต้นทุน: โทเคนถูกเรียกเก็บตามการใช้งาน ดังนั้นควรปรับการส่งบริบทที่ไม่จำเป็น
การใช้งาน Tool Calling
ฟังก์ชัน (tool calling) ช่วยให้โมเดลโต้ตอบกับโค้ดภายนอกของคุณ คุณสามารถกำหนดฟังก์ชันเช่น get_weather หรือ search_database แล้วโมเดลจะส่งอาร์กิวเมนต์ที่มีโครงสร้างเพื่อเรียกใช้ฟังก์ชันเหล่านี้ ซึ่งสำคัญสำหรับแอปพลิเคชันที่ต้องการข้อมูลแบบเรียลไทม์หรือการดำเนินการเฉพาะ
AI แบบไม่เซ็นเซอร์ของเรารองรับการเรียกใช้ฟังก์ชันแบบเดียวกับมาตรฐาน OpenAI คุณกำหนดเครื่องมือในพารามิเตอร์ tools และโมเดลจะตอบกลับด้วย ID การเรียกใช้ โค้ดของคุณจะเรียกใช้ฟังก์ชันแล้วส่งผลลัพธ์กลับไปยังโมเดลเพื่อสร้างการตอบสนองสุดท้ายจากข้อมูลนั้น
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmsincensura.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);แนวทางนี้เปลี่ยนโมเดลภาษาแบบพาสซีฟให้เป็นเอเจนต์แอคทีฟที่สามารถทำงานซับซ้อนในแอปพลิเคชันของคุณได้
ขีดจำกัดและโควตา
เพื่อให้มั่นใจในเสถียรภาพของบริการ API ของเราจึงมีขีดจำกัดอัตราและความจุ คีย์ API แต่ละคีย์จำกัดอยู่ที่ 300 คำขอต่อนาที ซึ่งเพียงพอสำหรับแอปพลิเคชันส่วนใหญ่ที่ใช้ระดับกลาง แต่หากแอปพลิเคชันของคุณมีปริมาณการใช้งานพุ่งสูง คุณควรพิจารณาใช้คิวคำขอฝั่งของคุณ
นอกจากนี้ เนื้อหาของคำขอไม่ควรเกิน 8 MB สิ่งนี้จำกัดขนาดของไฟล์ข้อความหรือ JSON ที่คุณสามารถส่งในคำขอเดียว หากต้องการส่งข้อมูลมากกว่านี้ ให้พิจารณาแบ่งเป็นหลายคำขอหรือสรุปข้อมูลก่อนส่ง
| ทรัพยากร | ขีดจำกัด |
|---|---|
| อัตรา | 300 req/min |
| ขนาด Request | 8 MB |
| โมเดล | uncensored |
การเรียกเก็บเงินและการเติมเงิน
รูปแบบราคาเป็นแบบจ่ายตามการใช้งาน ไม่มีสมาชิกประจำเดือนที่ต้องจ่าย คิดเงินตามล้านโทเคน ต้นทุนคือ $0.25 ต่อ 1M โทเคนขาเข้า และ $1.00 ต่อ 1M โทเคนขาออก โครงสร้างนี้โปร่งใสและคาดการณ์ได้
คุณสามารถเติมเงินบัญชีด้วยขั้นต่ำ $10 โดยใช้คริปโทเคอร์เรนซี (USDT หรือ USDC) หากเติมเงินจำนวนมากกว่านี้ คุณจะรับโบนัส: เพิ่ม 5% สำหรับการเติมเงิน $50 ขึ้นไป และเพิ่ม 10% สำหรับการเติมเงิน $100 ขึ้นไป เครดิตไม่หมดอายุ ดังนั้นคุณสามารถใช้ได้เมื่อต้องการโดยไม่มีความกดดันเรื่องเวลา
- ราคา Input: $0.25 / 1M โทเคน
- ราคา Output: $1.00 / 1M โทเคน
- โบนัส: +5% ตั้งแต่ $50, +10% ตั้งแต่ $100
คำถามที่พบบ่อย
โมเดลนี้เป็นการคัดลอก GPT หรือ Claude ใช่หรือไม่?
ไม่ใช่ เป็นโมเดลแบบเปิดน้ำหนักที่รันบนเซิร์ฟเวอร์ GPU ของเราเอง ปรับแต่งเฉพาะเพื่อไม่เซ็นเซอร์ ไม่ใช่ GPT, Claude, Gemini หรือโมเดลอื่นจากภายนอก แต่รองรับรูปแบบ API ของพวกเขา
เกิดอะไรขึ้นหากฉันเกินขีดจำกัด 300 คำขอต่อนาที?
API จะส่งคืนข้อผิดพลาดขีดจำกัดอัตรา (rate limit) คุณจะต้องรอให้ตัวนับรีเซ็ตหรือใช้ตรรกะการเรียกซ้ำแบบ exponential backoff ในแอปพลิเคชันของคุณ การสร้างคีย์ใหม่ไม่เพิ่มขีดจำกัดนี้ เนื่องจากเป็นตามบัญชีและคีย์
นำ prompt ของฉันไปฝึกโมเดลหรือไม่?
ไม่ นโยบายความเป็นส่วนตัวของเราเข้มงวด Prompt ที่คุณส่งไปยัง API ไม่ถูกนำไปใช้ในการฝึกโมเดล รับรองความลับของข้อมูลและการสนทนาของคุณ
สามารถใช้ API นี้สำหรับเนื้อหา NSFW ได้หรือไม่?
ได้ โมเดลถูกออกแบบมาเพื่อไม่มีการเซ็นเซอร์เนื้อหาผู้ใหญ่ที่ถูกต้องตามกฎหมาย อย่างไรก็ตาม เนื้อหาทางเพศที่เกี่ยวข้องกับเด็กจะถูกบล็อกเสมอ ไม่ว่ากฎหมายในเขตอำนาจใดจะอนุญาตอย่างไร สำหรับเนื้อหาผู้ใหญ่ส่วนอื่นๆ โมเดลจะไม่ปฏิเสธโดยสะดวก
คีย์ของคุณอยู่แค่ขั้นตอนเดียว
สร้างบัญชี คopy คีย์ และเปลี่ยน URL base แค่นี้ก็ง่ายแล้ว
รับคีย์ API