Hướng dẫn nhanh cho quy trình Whisper
Tích hợp mô hình văn bản không kiểm duyệt của chúng tôi vào quy trình xử lý giọng nói hoặc hình ảnh bằng API chat completions tương thích OpenAI. Hướng dẫn này bao gồm các bước cơ bản để gửi yêu cầu, xử lý truyền phát và quản lý cửa sổ ngữ cảnh cho các tác vụ xử lý hậu kỳ.
Yêu cầu tiên quyết
Trước khi bắt đầu, hãy đảm bảo bạn có một tài khoản hoạt động và khóa API. Đăng ký trên trang Lấy khóa API bằng cách chỉ sử dụng email và mật khẩu. Khóa sẽ xuất hiện ngay lập tức. Bạn nhận được $0.50 tín dụng dùng thử miễn phí có hiệu lực trong 7 ngày, không cần thẻ tín dụng. Để sử dụng cho sản phẩm, hãy nạp tiền từ $10 thông qua tiền điện tử (USDT hoặc USDC). Giá cả của chúng tôi rất đơn giản: $0.25 cho mỗi 1 triệu token đầu vào và $1.00 cho mỗi 1 triệu token đầu ra. Tín dụng không bao giờ hết hạn.
Base URL: https://api.whisperapis.com/v1. Endpoint này tương thích với bất kỳ client nào tương thích với OpenAI. Bạn chỉ cần cấu hình base URL và cung cấp khóa API của bạn trong tiêu đề xác thực. Không cần các SDK đặc biệt cho các yêu cầu HTTP cơ bản.
Khởi tạo Client
Hầu hết các nhà phát triển sẽ sử dụng SDK chính thức của OpenAI hoặc một thư viện tương thích. Khởi tạo client bằng cách trỏ nó vào base URL của chúng tôi. Điều này đảm bảo tất cả các yêu cầu được định tuyến đến mô hình không kiểm duyệt của chúng tôi thay vì máy chủ của OpenAI. ID mô hình luôn là uncensored.
Đảm bảo biến môi trường OPENAI_API_KEY của bạn được đặt thành khóa từ bảng điều khiển. Nếu bạn đang sử dụng một ngôn ngữ hoặc thư viện khác, hãy xác minh rằng nó hỗ trợ base URL tùy chỉnh. SDK xử lý việc tuần tự hóa JSON và tiêm tiêu đề cho bạn, giúp giảm mã boilerplate trong các tập lệnh pipeline của bạn.
Gửi Chat Completion
Gửi một yêu cầu chat completion tiêu chuẩn để tinh chỉnh đầu ra pipeline của bạn. Ví dụ: trích xuất JSON có cấu trúc từ bản ghi chuyển giọng nói thành văn bản hoặc tạo chú thích cho hình ảnh mà không có bộ lọc nội dung.
Endpoint là POST /v1/chat/completions. Bao gồm ID mô hình, mảng tin nhắn của bạn và tùy chọn prompt hệ thống để xác định hành vi không kiểm duyệt.
curl https://api.whisperapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Mô hình của chúng tôi xử lý dữ liệu ngữ cảnh cao tốt, hỗ trợ tối đa 100.000 token tổng cộng. Điều này rất lý tưởng để xử lý các bản ghi dài hoặc mô tả hình ảnh chi tiết trong một lần chạy.
Phản hồi truyền phát
Đối với xử lý hậu kỳ theo thời gian thực hoặc các pipeline tương tác, hãy bật streaming. Đặt tham số stream thành true trong yêu cầu của bạn. API trả về các sự kiện SSE thay vì một đối tượng JSON đơn lẻ.
Phân tích cú pháp các trường delta khi chúng đến. Điều này giảm độ trễ cảm nhận được đối với các đầu ra lớn, chẳng hạn như tạo các tập lệnh chi tiết hoặc trích xuất các khối văn bản dài từ kết quả OCR nhiễu. Định dạng streaming tương thích với các trình xử lý streaming của SDK OpenAI tiêu chuẩn.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Đảm bảo client của bạn xử lý các phần dữ liệu nhỏ một cách chính xác. Tổng hợp các delta để tái tạo lại phản hồi văn bản đầy đủ khi luồng kết thúc với finish_reason là stop hoặc length.
Hỗ trợ gọi hàm
Mô hình không kiểm duyệt của chúng tôi hỗ trợ gọi hàm, cho phép bạn xác định các đầu ra có cấu trúc cho các pipeline của bạn. Xác định các công cụ của bạn trong mảng tools với các định nghĩa lược đồ JSON.
Mô hình trả về các lệnh gọi công cụ trong phản hồi, mà bạn có thể thực thi để cập nhật ngữ cảnh cuộc trò chuyện. Điều này rất hữu ích để trích xuất các điểm dữ liệu cụ thể từ văn bản không có cấu trúc, chẳng hạn như ngày tháng, tên hoặc tọa độ từ bản ghi giọng nói.
from openai import OpenAI
client = OpenAI(base_url="https://api.whisperapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Chuyển các lệnh gọi công cụ trở lại API trong các thông báo tiếp theo. Mô hình sẽ tinh chỉnh đầu ra của nó dựa trên kết quả. Điều này cho phép suy luận phức tạp nhiều bước mà không cần rời khỏi giao diện trò chuyện. Hãy đảm bảo lược đồ của bạn nghiêm ngặt để tránh các phản hồi JSON bị lỗi cú pháp.
Giới hạn, Lỗi và Ngữ cảnh
Theo dõi mức sử dụng của bạn để tránh gián đoạn. API áp dụng giới hạn 300 yêu cầu mỗi phút cho mỗi khóa. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được lỗi giới hạn tốc độ 429. Hãy triển khai cơ chế backoff theo cấp số nhân trong client của bạn.
Lỗi thường gặp:
401: Khóa API không hợp lệ hoặc đã hết hạn. Tạo lại khóa của bạn từ bảng điều khiển.402: Không đủ tín dụng. Nạp tiền vào tài khoản của bạn để tiếp tục xử lý.429: Vượt quá giới hạn tốc độ. Giảm tần suất yêu cầu hoặc nhóm các tác vụ nhỏ hơn.
Cửa sổ ngữ cảnh: Mô hình hỗ trợ 100.000 token cho prompt + completion. Nếu đầu vào của bạn vượt quá giới hạn này, hãy cắt bớt các tin nhắn cũ hoặc chia nhỏ dữ liệu. Thân yêu cầu được giới hạn ở 8 MB. Đảm bảo các tải trọng của bạn nằm trong các ràng buộc này để có hiệu suất đáng tin cậy.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.whisperapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Thông số API
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| ID mô hình | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.whisperapis.com/v1 |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Kích thước yêu cầu | tối đa 8 MB |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Thưởng | +5% từ $50, +10% từ $100 |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Đăng nhập | Google hoặc email và mật khẩu |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Kích thước cửa sổ ngữ cảnh là bao nhiêu?
Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token, bao gồm cả prompt và kết quả. Điều này cho phép bạn xử lý các bản ghi lớn hoặc mô tả chi tiết trong một yêu cầu.
API này có tạo hình ảnh hoặc âm thanh không?
Không. Đây là API chat completions chỉ xử lý văn bản. Nó được thiết kế để xử lý hậu kỳ đầu ra văn bản từ các phương thức khác như chuyển giọng nói thành văn bản hoặc tạo hình ảnh. Nó không tạo ra âm thanh, hình ảnh hoặc video.
Tôi xử lý lỗi streaming như thế nào?
Phản hồi truyền phát (streaming) trả về các sự kiện SSE. Nếu xảy ra lỗi, luồng sẽ thường kết thúc bằng thông báo lỗi trong trường error của chunk cuối cùng. Hãy đảm bảo client của bạn xử lý việc ngắt kết nối một cách mượt mà và thử lại nếu cần thiết.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.