VI ▾
Lấy khóa API

Hướng dẫn nhanh cho quy trình Whisper

Tích hợp mô hình văn bản không kiểm duyệt của chúng tôi vào quy trình xử lý giọng nói hoặc hình ảnh bằng API chat completions tương thích OpenAI. Hướng dẫn này bao gồm các bước cơ bản để gửi yêu cầu, xử lý truyền phát và quản lý cửa sổ ngữ cảnh cho các tác vụ xử lý hậu kỳ.

Yêu cầu tiên quyết

Trước khi bắt đầu, hãy đảm bảo bạn có một tài khoản hoạt động và khóa API. Đăng ký trên trang Lấy khóa API bằng cách chỉ sử dụng email và mật khẩu. Khóa sẽ xuất hiện ngay lập tức. Bạn nhận được $0.50 tín dụng dùng thử miễn phí có hiệu lực trong 7 ngày, không cần thẻ tín dụng. Để sử dụng cho sản phẩm, hãy nạp tiền từ $10 thông qua tiền điện tử (USDT hoặc USDC). Giá cả của chúng tôi rất đơn giản: $0.25 cho mỗi 1 triệu token đầu vào và $1.00 cho mỗi 1 triệu token đầu ra. Tín dụng không bao giờ hết hạn.

Base URL: https://api.whisperapis.com/v1. Endpoint này tương thích với bất kỳ client nào tương thích với OpenAI. Bạn chỉ cần cấu hình base URL và cung cấp khóa API của bạn trong tiêu đề xác thực. Không cần các SDK đặc biệt cho các yêu cầu HTTP cơ bản.

Khởi tạo Client

Hầu hết các nhà phát triển sẽ sử dụng SDK chính thức của OpenAI hoặc một thư viện tương thích. Khởi tạo client bằng cách trỏ nó vào base URL của chúng tôi. Điều này đảm bảo tất cả các yêu cầu được định tuyến đến mô hình không kiểm duyệt của chúng tôi thay vì máy chủ của OpenAI. ID mô hình luôn là uncensored.

Đảm bảo biến môi trường OPENAI_API_KEY của bạn được đặt thành khóa từ bảng điều khiển. Nếu bạn đang sử dụng một ngôn ngữ hoặc thư viện khác, hãy xác minh rằng nó hỗ trợ base URL tùy chỉnh. SDK xử lý việc tuần tự hóa JSON và tiêm tiêu đề cho bạn, giúp giảm mã boilerplate trong các tập lệnh pipeline của bạn.

Gửi Chat Completion

Gửi một yêu cầu chat completion tiêu chuẩn để tinh chỉnh đầu ra pipeline của bạn. Ví dụ: trích xuất JSON có cấu trúc từ bản ghi chuyển giọng nói thành văn bản hoặc tạo chú thích cho hình ảnh mà không có bộ lọc nội dung.

Endpoint là POST /v1/chat/completions. Bao gồm ID mô hình, mảng tin nhắn của bạn và tùy chọn prompt hệ thống để xác định hành vi không kiểm duyệt.

curl https://api.whisperapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Mô hình của chúng tôi xử lý dữ liệu ngữ cảnh cao tốt, hỗ trợ tối đa 100.000 token tổng cộng. Điều này rất lý tưởng để xử lý các bản ghi dài hoặc mô tả hình ảnh chi tiết trong một lần chạy.

Phản hồi truyền phát

Đối với xử lý hậu kỳ theo thời gian thực hoặc các pipeline tương tác, hãy bật streaming. Đặt tham số stream thành true trong yêu cầu của bạn. API trả về các sự kiện SSE thay vì một đối tượng JSON đơn lẻ.

Phân tích cú pháp các trường delta khi chúng đến. Điều này giảm độ trễ cảm nhận được đối với các đầu ra lớn, chẳng hạn như tạo các tập lệnh chi tiết hoặc trích xuất các khối văn bản dài từ kết quả OCR nhiễu. Định dạng streaming tương thích với các trình xử lý streaming của SDK OpenAI tiêu chuẩn.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Đảm bảo client của bạn xử lý các phần dữ liệu nhỏ một cách chính xác. Tổng hợp các delta để tái tạo lại phản hồi văn bản đầy đủ khi luồng kết thúc với finish_reason là stop hoặc length.

Hỗ trợ gọi hàm

Mô hình không kiểm duyệt của chúng tôi hỗ trợ gọi hàm, cho phép bạn xác định các đầu ra có cấu trúc cho các pipeline của bạn. Xác định các công cụ của bạn trong mảng tools với các định nghĩa lược đồ JSON.

Mô hình trả về các lệnh gọi công cụ trong phản hồi, mà bạn có thể thực thi để cập nhật ngữ cảnh cuộc trò chuyện. Điều này rất hữu ích để trích xuất các điểm dữ liệu cụ thể từ văn bản không có cấu trúc, chẳng hạn như ngày tháng, tên hoặc tọa độ từ bản ghi giọng nói.

from openai import OpenAI

client = OpenAI(base_url="https://api.whisperapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Chuyển các lệnh gọi công cụ trở lại API trong các thông báo tiếp theo. Mô hình sẽ tinh chỉnh đầu ra của nó dựa trên kết quả. Điều này cho phép suy luận phức tạp nhiều bước mà không cần rời khỏi giao diện trò chuyện. Hãy đảm bảo lược đồ của bạn nghiêm ngặt để tránh các phản hồi JSON bị lỗi cú pháp.

Giới hạn, Lỗi và Ngữ cảnh

Theo dõi mức sử dụng của bạn để tránh gián đoạn. API áp dụng giới hạn 300 yêu cầu mỗi phút cho mỗi khóa. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được lỗi giới hạn tốc độ 429. Hãy triển khai cơ chế backoff theo cấp số nhân trong client của bạn.

Lỗi thường gặp:

  • 401: Khóa API không hợp lệ hoặc đã hết hạn. Tạo lại khóa của bạn từ bảng điều khiển.
  • 402: Không đủ tín dụng. Nạp tiền vào tài khoản của bạn để tiếp tục xử lý.
  • 429: Vượt quá giới hạn tốc độ. Giảm tần suất yêu cầu hoặc nhóm các tác vụ nhỏ hơn.

Cửa sổ ngữ cảnh: Mô hình hỗ trợ 100.000 token cho prompt + completion. Nếu đầu vào của bạn vượt quá giới hạn này, hãy cắt bớt các tin nhắn cũ hoặc chia nhỏ dữ liệu. Thân yêu cầu được giới hạn ở 8 MB. Đảm bảo các tải trọng của bạn nằm trong các ràng buộc này để có hiệu suất đáng tin cậy.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.whisperapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
ID mô hìnhuncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Xác thựcAuthorization: Bearer YOUR_KEY
Base URLhttps://api.whisperapis.com/v1
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Chế độ JSONresponse_format: {"type": "json_object"}
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Đăng nhậpGoogle hoặc email và mật khẩu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Kích thước cửa sổ ngữ cảnh là bao nhiêu?

Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token, bao gồm cả prompt và kết quả. Điều này cho phép bạn xử lý các bản ghi lớn hoặc mô tả chi tiết trong một yêu cầu.

API này có tạo hình ảnh hoặc âm thanh không?

Không. Đây là API chat completions chỉ xử lý văn bản. Nó được thiết kế để xử lý hậu kỳ đầu ra văn bản từ các phương thức khác như chuyển giọng nói thành văn bản hoặc tạo hình ảnh. Nó không tạo ra âm thanh, hình ảnh hoặc video.

Tôi xử lý lỗi streaming như thế nào?

Phản hồi truyền phát (streaming) trả về các sự kiện SSE. Nếu xảy ra lỗi, luồng sẽ thường kết thúc bằng thông báo lỗi trong trường error của chunk cuối cùng. Hãy đảm bảo client của bạn xử lý việc ngắt kết nối một cách mượt mà và thử lại nếu cần thiết.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.

Lấy khóa API