เอกสาร API: Chat Completions สำหรับ Text Pipelines
ทำให้ LLM uncensored ของคุณทำงานใน pipeline speech to text ด้วยคู่มือเริ่มต้นนี้ ใช้ endpoint ที่เข้ากันได้กับ OpenAI เพื่อส่งข้อความ สตรีมผลลัพธ์ หรือเรียกใช้เครื่องมือผ่าน SDK มาตรฐาน
Base URL & การตรวจสอบสิทธิ์
เริ่มต้นโดยชี้ไคลเอนต์ของคุณไปที่ Base URL https://api.speechtotextapis.com/v1 เอนด์พอยต์นี้เข้ากันได้กับ OpenAI อย่างสมบูรณ์ หมายความว่าคุณสามารถใช้ SDK openai มาตรฐานใดๆ ได้โดยการปรับค่าพารามิเตอร์ base_url คุณไม่จำเป็นต้องเขียนตรรกะคำขอใหม่ เพียงเปลี่ยน URL และใส่คีย์ API ของคุณ คีย์ของคุณจะถูกสร้างทันทีเมื่อสมัครสมาชิกในหน้าคีย์ มันผูกกับบัญชีของคุณ และคุณสามารถสร้างคีย์ใหม่ได้ตลอดเวลา ซึ่งจะทำให้คีย์เก่ายกเลิกทันที ไม่ต้องใช้เบอร์โทรศัพท์ และเครดิตทดลองใช้จะเปิดใช้งานโดยไม่ต้องใส่บัตร การตั้งค่านี้ทำให้สายงานของคุณเรียบง่ายในขณะที่คุณเข้าถึงโมเดลแบบไม่เซ็นเซอร์ที่จัดการเนื้อหาผู้ใหญ่ที่ถูกต้องตามกฎหมายได้โดยไม่เปลี่ยนผลลัพธ์
คำขอแรก
ส่งคำขอ POST มาตรฐานไปยัง /v1/chat/completions ชื่อระบุโมเดลคือ uncensored เสมอ โมเดลนี้เป็นรูปแบบ open-weight ที่ปรับแต่งมาเพื่อลดการปฏิเสธในหัวข้อที่ถูกต้องตามกฎหมาย โมเดลนี้ทำงานบนเซิร์ฟเวอร์ GPU เฉพาะของเรา คุณไม่ได้ใช้ GPT หรือ Claude แต่ได้ประสบการณ์จากโมเดลเดียวที่เสถียร เนื้อหาของคำขอประกอบด้วยแฟล็ก model, messages และ stream ด้านล่างคือตัวอย่าง cURL เบื้องต้นเพื่อตรวจสอบการเชื่อมต่อและรับข้อความตอบกลับ
curl https://api.speechtotextapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
คำขอนี้จะส่งคืนวัตถุ JSON ที่มีข้อความที่สร้างขึ้น หากคีย์ไม่ถูกต้อง คุณจะรับข้อผิดพลาด 401 หากเครดิตแบบเติมเงินล่วงหน้าของคุณหมดลง คุณจะรับข้อผิดพลาด 402 เหล่านี้คือสิ่งกีดขวางหลักที่ต้องตรวจสอบก่อนการดีบักลอจิก
การผสานรวม Python SDK
สำหรับนักพัฒนา Python ไลบรารี openai ทางการใช้งานได้ทันที เริ่มต้นไคลเอนต์ด้วยคีย์และ Base URL แบบกำหนดเอง ส่ง ID โมเดล uncensored ในการเรียก chat completion ของคุณ วิธีนี้เหมาะสำหรับการประมวลผลข้อความหลัง ASR ทำความสะอาดเสียงรบกวนจากการถอดเสียง หรือดึงข้อมูลที่มีโครงสร้างจากข้อความดิบ ธรรมชาติแบบไม่เซ็นเซอร์รับประกันว่าหากข้อความถอดเสียงของคุณมีบทสนทนาสำหรับผู้ใหญ่หรือคำศัพท์ที่ถกเถียงกัน LLM จะประมวลผลโดยไม่บล็อกหรือเขียนใหม่เพื่อความสุภาพ สิ่งนี้สำคัญมากสำหรับสายงานสร้างสรรค์ที่ความถูกต้องของเสียงต้นฉบับเป็นสิ่งสำคัญ SDK จัดการการแบ่งโทเคนและตรรกะการลองใหม่โดยอัตโนมัติ
from openai import OpenAI
client = OpenAI(base_url="https://api.speechtotextapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
โปรดจำไว้ว่า ID โมเดลคือ uncensored เท่านั้น อย่าแทนที่ด้วย gpt-4 หรือตัวระบุทั่วไปอื่นๆ เนื่องจากอาจไม่จัดเส้นทางไปยังน้ำหนักแบบไม่เซ็นเซอร์เฉพาะของเรา
การผสานรวม Node SDK
นักพัฒนา Node.js สามารถใช้แพ็คเกจ npm openai ได้เช่นกัน ตั้งค่า apiKey และ baseURL ในคอนสตรัคเตอร์ไคลเอนต์ จากนั้นเรียก chat.completions.create ด้วยโมเดล uncensored สิ่งนี้มีประโยชน์สำหรับสคริปต์คำบรรยายแบบเรียลไทม์หรืองานสร้างข้อความฝั่งเซิร์ฟเวอร์ API รองรับโหลด JSON มาตรฐาน คุณสามารถรวมข้อความระบบเพื่อกำหนดโทนหรือบทบาทของผู้ช่วย โมเดลแบบไม่เซ็นเซอร์ตอบสนองต่อพรอมต์เหล่านี้โดยตรงโดยไม่มีการป้องกันความปลอดภัยเพิ่มเติมที่อาจเปลี่ยนผลลัพธ์เชิงสร้างสรรค์ โปรดจัดการสตรีมการตอบกลับหากคุณกำลังประมวลผลเอกสารขนาดใหญ่ SDK ของ Node.js ลับรายละเอียด HTTP ทำให้คุณสามารถมุ่งเน้นไปที่ตรรกะสายงานข้อความได้
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.speechtotextapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
ขีดจำกัดอัตราใช้ต่อคีย์ หากเกิน 300 คำขอต่อนาที API จะส่งข้อผิดพลาด 429 ให้ใช้การเพิ่มเวลาแบบเอกซ์โพเนนเชียลในตรรกะการลองใหม่ของคุณเพื่อจัดการกับเรื่องนี้ได้อย่างราบรื่น
การตอบสนองแบบสตรีม (SSE)
สำหรับแอปพลิเคชันที่มีความหน่วงต่ำ ให้เปิดใช้งานสตรีมมิงโดยตั้งค่า stream: true ในคำขอของคุณ API ส่งคืนชิ้นส่วน Server-Sent Events (SSE) แต่ละชิ้นมีค่าข้อความย่อยบางส่วน สิ่งนี้จำเป็นสำหรับคำบรรยายสดหรืออินเทอร์เฟซแชทแบบโต้ตอบ โมเดลแบบไม่เซ็นเซอร์รองรับสตรีมมิงแบบเนทีฟ คุณไม่จำเป็นต้องรอให้เสร็จสมบูรณ์เพื่อเริ่มแสดงข้อความ สิ่งนี้ลดความหน่วงที่รับรู้ได้อย่างมาก กำหนดค่า SDK ของคุณเพื่อจัดการเหตุการณ์สตรีม ใน Python ให้วนซ้ำผ่านวัตถุสตรีม ใน Node ให้ใช้ตัววนซ้ำแบบอะซิงโครนัส สตรีมจะสิ้นสุดด้วยชิ้นสุดท้ายที่มีเหตุผลการสิ้นสุด วิธีนี้มีประสิทธิภาพสำหรับแบนด์วิดท์และประสบการณ์ผู้ใช้
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
สตรีมมิงไม่เปลี่ยนการเรียกเก็บเงินโทเคน คุณจะถูกเรียกเก็บสำหรับโทเคนอินพุตและเอาต์พุตทั้งหมดไม่ว่าคุณจะสตรีมหรือขอการตอบสนองเต็มรูปแบบ
ขีดจำกัดและข้อจำกัด
บัญชีของคุณมีขีดจำกัดสูงสุด 300 คำขอต่อนาทีต่อคีย์ API ร่างคำขอไม่สามารถเกิน 8 MB ได้ หน้าต่างบริบทคือ 100,000 โทเคน ซึ่งครอบคลุมทั้งพรอมต์และการสร้างข้อความ สิ่งนี้เพียงพอสำหรับการประมวลผลเอกสารส่วนใหญ่และงานถอดเสียงบริบทยาว หากคุณส่งพรอมต์ที่เกินหน้าต่าง API จะส่งข้อผิดพลาด โมเดลแบบไม่เซ็นเซอร์บล็อกเฉพาะขีดจำกัดแข็งหนึ่งข้อ: เนื้อหาทางเพศที่เกี่ยวข้องกับเด็ก เนื้อหาผู้ใหญ่ที่ถูกต้องตามกฎหมายอื่นๆ ทั้งหมดได้รับอนุญาต สิ่งนี้ทำให้เหมาะสำหรับสายงานสื่อที่คาดหวังความหลากหลายของเนื้อหา ไม่มีสมาชิก; คุณจ่ายตามการใช้งาน เครดิตแบบเติมเงินล่วงหน้าไม่หมดอายุ ใช้เอนด์พอยต์ GET /v1/models เพื่อตรวจสอบความพร้อมหากจำเป็น แม้ว่า ID โมเดลจะเป็น uncensored เสมอ
ข้อมูลจำเพาะ API
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| ID โมเดล | uncensored |
| Base URL | https://api.speechtotextapis.com/v1 |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| โหมด JSON | response_format: {"type": "json_object"} |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
นี่คือ API ของ OpenAI อย่างเป็นทางการหรือไม่?
ไม่ใช่บริการอื่น เราเป็นบริการอิสระที่โฮสต์โมเดลไม่เซ็นเซอร์ของตัวเองซึ่งเข้ากันได้กับอินเทอร์เฟซ chat completions ของ OpenAI ไม่ใช่ GPT-4 หรือ GPT-3.5 โปรดตรวจสอบเอกสารของ OpenAI สำหรับราคาและขีดจำกัดเฉพาะของพวกเขา เนื่องจากของเราแตกต่างออกไป
เกิดอะไรขึ้นเมื่อเครดิตหมด?
คีย์ API ของคุณยังคงใช้งานอยู่ แต่คำขอจะส่งกลับข้อผิดพลาด 402 Payment Required คุณต้องเติมเงินบัญชีแบบเติมเงินล่วงหน้าของคุณผ่านคริปโต (USDT หรือ USDC) เพื่อใช้งานต่อ เครดิตไม่หมดอายุ ดังนั้นคุณสามารถเติมเงิน whenever convenient ได้
โมเดล uncensored กรองเนื้อหาสำหรับผู้ใหญ่หรือไม่?
มันกรองเนื้อหาทางเพศที่เกี่ยวข้องกับเด็ก ซึ่งเป็นข้อห้ามแข็ง สำหรับเนื้อหาผู้ใหญ่ที่ถูกต้องตามกฎหมาย สถานการณ์สมมติ หรือหัวข้อที่ถกเถียง โมเดลจะไม่ปฏิเสธหรือปรับผลลัพธ์ เพื่อให้แน่ใจว่า pipeline ของคุณรักษาโทนและความหมายเดิมของข้อความต้นฉบับ
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน base URL นั่นคือการตั้งค่าทั้งหมด