เริ่มต้นใช้งานสำหรับเพย์ไลน์ Whisper
ผสานโมเดลข้อความแบบไม่เซ็นเซอร์ของเราเข้ากับไพล์ไลน์เสียงหรือภาพด้วย API chat completions ที่เข้ากันได้กับ OpenAI มาตรฐาน คู่มือนี้ครอบคลุมขั้นตอนสำคัญในการส่งคำขอ จัดการสตรีมมิง และจัดการหน้าต่างบริบทสำหรับงานประมวลผลหลัง
ข้อกำหนดเบื้องต้น
ก่อนเริ่มต้น ตรวจสอบให้แน่ใจว่าคุณมีบัญชีใช้งานและคีย์ API ลงทะเบียนที่หน้า รับคีย์ API โดยใช้เฉพาะอีเมลและรหัสผ่าน คีย์จะปรากฏทันที คุณได้รับ $0.50 ในเครดิตทดลองใช้ซึ่งใช้ได้เป็นเวลา 7 วัน ไม่ต้องใช้บัตรเครดิต สำหรับการใช้งานจริง ให้เติมเงินจาก $10 ผ่านคริปโต (USDT หรือ USDC) ราคาของเราชัดเจน: $0.25 ต่อ 1M โทเคนอินพุต และ $1.00 ต่อ 1M โทเคนเอาต์พุต เครดิตไม่หมดอายุ
Base URL: https://api.whisperapis.com/v1 เอนด์พอยต์นี้ใช้งานได้กับไคลเอนต์ที่เข้ากันได้กับ OpenAI ทุกตัว คุณเพียงแค่ต้องกำหนดค่า base URL และระบุคีย์ API ของคุณในหัวเรื่องการตรวจสอบสิทธิ์ ไม่จำเป็นต้องใช้ SDK พิเศษสำหรับคำขอ HTTP ทั่วไป
เริ่มต้นไคลเอนต์
นักพัฒนาส่วนใหญ่จะใช้ SDK ทางการของ OpenAI หรือไลบรารีที่เข้ากันได้ เริ่มต้นไคลเอนต์โดยชี้ไปที่ Base URL ของเรา สิ่งนี้ทำให้คำขอทั้งหมดถูกกำหนดเส้นทางไปยังโมเดลไม่เซ็นเซอร์ของเราแทนเซิร์ฟเวอร์ของ OpenAI รหัสโมเดลคือ uncensored เสมอ
ตรวจสอบให้แน่ใจว่าตัวแปรสภาพแวดล้อม OPENAI_API_KEY ถูกตั้งค่าเป็นคีย์ของคุณจากแดชบอร์ด หากคุณใช้ภาษาหรือไลบรารีอื่น ให้ตรวจสอบว่ารองรับ custom base URLs SDK จะจัดการการแปลงข้อมูล JSON และการฉีดหัวเรื่องให้คุณ ลดโค้ด boilerplate ในสคริปต์ไพล์ไลน์ของคุณ
ส่งการสร้างข้อความแชท
ส่งคำขอสร้างข้อความแชทมาตรฐานเพื่อปรับปรุงผลลัพธ์ของเพย์ไลน์ของคุณ ตัวอย่างเช่น ดึง JSON ที่มีโครงสร้างจากคำบรรยาย speech-to-text หรือสร้างคำบรรยายสำหรับภาพโดยไม่มีการเซ็นเซอร์เนื้อหา
เอนด์พอยต์คือ POST /v1/chat/completions รวมรหัสโมเดล อาร์เรย์ข้อความของคุณ และพรอมต์ระบบของคุณตามต้องการเพื่อกำหนดพฤติกรรมไม่เซ็นเซอร์
curl https://api.whisperapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'โมเดลของเราจัดการข้อมูลบริบทสูงได้ดี รองรับสูงสุด 100,000 โทเคนรวมกัน สิ่งนี้เหมาะสำหรับการประมวลผลคำบรรยายที่ยาวหรือคำอธิบายภาพรายละเอียดในครั้งเดียว
การตอบสนองแบบสตรีมมิง
สำหรับการประมวลผลหลังแบบเรียลไทม์หรือเพย์ไลน์แบบโต้ตอบ ให้เปิดใช้งานสตรีมมิง ตั้งค่าพารามิเตอร์ stream เป็น true ในการร้องขอของคุณ API จะส่งเหตุการณ์ Server-Sent Events (SSE) แทนวัตถุ JSON เดียว
แยกวิเคราะห์ฟิลด์ delta เมื่อได้รับ สิ่งนี้ลดเวลาแฝงที่รับรู้สำหรับเอาต์พุตขนาดใหญ่ เช่น การสร้างสคริปต์รายละเอียดหรือการดึงบล็อกข้อความยาวจากผลลัพธ์ OCR ที่มีเสียงรบกวน รูปแบบสตรีมมิงเข้ากันได้กับตัวจัดการสตรีมมิงของ SDK OpenAI มาตรฐาน
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)ตรวจสอบให้ไคลเอนต์จัดการชิ้นส่วนบางส่วนได้อย่างถูกต้อง รวมโทเคนเพื่อสร้างการตอบสนองข้อความเต็มเมื่อสตรีมสิ้นสุดพร้อม finish_reason เป็น stop หรือ length
รองรับการเรียกใช้เครื่องมือ
โมเดลไม่เซ็นเซอร์ของเรารองรับการเรียกใช้ฟังก์ชัน ทำให้คุณสามารถกำหนดเอาต์พุตที่มีโครงสร้างสำหรับเพย์ไลน์ของคุณ กำหนดเครื่องมือของคุณในอาร์เรย์ tools ด้วยคำจำกัดความสคีมา JSON
โมเดลส่งการเรียกใช้เครื่องมือในการตอบสนอง ซึ่งคุณสามารถดำเนินการเพื่ออัปเดตบริบทการสนทนา สิ่งนี้มีประโยชน์สำหรับการดึงจุดข้อมูลเฉพาะจากข้อความไม่มีโครงสร้าง เช่น วันที่ ชื่อ หรือพิกัดจากคำบรรยายเสียง
from openai import OpenAI
client = OpenAI(base_url="https://api.whisperapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)ส่งการเรียกใช้เครื่องมือกลับไปยัง API ในข้อความถัดไป โมเดลจะปรับปรุงเอาต์พุตตามผลลัพธ์ สิ่งนี้ทำให้สามารถให้เหตุผลหลายขั้นตอนที่ซับซ้อนได้โดยไม่ต้องออกจากอินเทอร์เฟซแชท ตรวจสอบให้สคีมาของคุณเข้มงวดเพื่อหลีกเลี่ยงการตอบสนอง JSON ที่ไม่ถูกต้อง
ขีดจำกัด ข้อผิดพลาด และบริบท
ตรวจสอบการใช้งานของคุณเพื่อหลีกเลี่ยงการหยุดชะงัก API กำหนดขีดจำกัด 300 คำขอต่อนาที ต่อคีย์ หากคุณเกินสิ่งนี้ คุณจะได้รับข้อผิดพลาดขีดจำกัดอัตรา 429 ใช้การเพิ่มเวลาแบบทวีคูณในไคลเอนต์ของคุณ
ข้อผิดพลาดทั่วไป:
401: คีย์ API ไม่ถูกต้องหรือหมดอายุ สร้างคีย์ใหม่จากแดชบอร์ด402: เครดิตไม่เพียงพอ เติมเงินบัญชีของคุณเพื่อดำเนินการประมวลผลต่อ429: ขีดจำกัดอัตราเกิน ลดความถี่ของคำขอหรือรวมงานขนาดเล็ก
หน้าต่างบริบท: โมเดลรองรับ 100,000 โทเคนสำหรับพรอมต์ + การสร้างข้อความ หากอินพุตของคุณเกินสิ่งนี้ ให้ตัดข้อความเก่าออกหรือแยกข้อมูล ขนาดบอดีคำขอจำกัดที่ 8 MB ตรวจสอบให้โหลดของคุณอยู่ในข้อจำกัดเหล่านี้สำหรับการปฏิบัติงานที่เชื่อถือได้
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.whisperapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);ข้อมูลจำเพาะ API
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| ID โมเดล | uncensored |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.whisperapis.com/v1 |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| โหมด JSON | response_format: {"type": "json_object"} |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
ขนาดหน้าต่างบริบทคือเท่าใด?
โมเดลรองรับหน้าต่างบริบท 100,000 โทเคน ซึ่งรวมถึงทั้งพรอมต์และการสร้างข้อความ ทำให้คุณสามารถประมวลผลคำบรรยายขนาดใหญ่หรือคำอธิบายรายละเอียดในคำขอเดียวได้
API นี้สร้างภาพหรือเสียงหรือไม่?
ไม่ นี่คือ API สร้างข้อความแชทแบบข้อความเท่านั้น ออกแบบมาเพื่อประมวลผลข้อความจากโมดัลลิตี้อื่น เช่น speech-to-text หรือการสร้างภาพ ไม่สร้างเสียง ภาพ หรือวิดีโอ
ฉันจัดการข้อผิดพลาดสตรีมมิงได้อย่างไร?
การตอบสนองแบบสตรีมมิงส่งเหตุการณ์ SSE หากเกิดข้อผิดพลาด สตรีมจะสิ้นสุดพร้อมข้อความข้อผิดพลาดในฟิลด์ error ของชิ้นข้อมูลสุดท้าย ตรวจสอบให้ไคลเอนต์จัดการการตัดการเชื่อมต่ออย่างเหมาะสมและลองใหม่หากจำเป็น
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน Base URL นั่นคือการติดตั้งทั้งหมด