Guida rapida per le pipeline Whisper
Integra il nostro modello testuale senza censura nelle tue pipeline audio o immagine con un'API standard per i completamenti di chat compatibile con OpenAI. Questa guida copre i passaggi essenziali per inviare richieste, gestire lo streaming e gestire le finestre di contesto per le attività di post-processing.
Prerequisiti
Prima di iniziare, assicurati di avere un account attivo e una chiave API. Registrati nella pagina Ottieni chiave API usando solo la tua email e una password. La chiave viene visualizzata immediatamente. Ricevi $0.50 di credito di prova valido per 7 giorni, senza carta di credito. Per la produzione, ricarica da $10 tramite criptovalute (USDT o USDC). La nostra tariffazione è semplice: $0.25 per 1M di token di input e $1.00 per 1M di token di output. I crediti non scadono mai.
Base URL: https://api.whisperapis.com/v1. Questo endpoint funziona con qualsiasi client compatibile con OpenAI. Devi solo configurare il base URL e fornire la tua chiave API nell'intestazione di autorizzazione. Non sono necessari SDK speciali per le richieste HTTP di base.
Inizializza il Client
La maggior parte degli sviluppatori utilizzerà l'SDK ufficiale di OpenAI o una libreria compatibile. Inizializza il client puntandolo al nostro base URL. Questo garantisce che tutte le richieste vengano instradate verso il nostro modello senza censura anziché ai server di OpenAI. L'ID del modello è sempre uncensored.
Assicurati che la tua variabile d'ambiente OPENAI_API_KEY sia impostata sulla tua chiave dal dashboard. Se utilizzi un linguaggio o una libreria diversa, verifica che supporti i base URL personalizzati. L'SDK gestisce la serializzazione JSON e l'iniezione delle intestazioni per te, riducendo il codice boilerplate negli script della tua pipeline.
Invia un Completamento Chat
Invia una richiesta standard di completamento chat per affinare l'output della tua pipeline. Ad esempio, estrai JSON strutturato dalle trascrizioni speech-to-text o genera didascalie per le immagini senza filtri sui contenuti.
L'endpoint è POST /v1/chat/completions. Includi l'ID del modello, il tuo array di messaggi e opzionalmente il tuo system prompt per definire il comportamento senza censura.
curl https://api.whisperapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Il nostro modello gestisce bene i dati ad alto contesto, supportando fino a 100.000 token in totale. Questo è ideale per l'elaborazione di trascrizioni lunghe o descrizioni di immagini dettagliate in un'unica passata.
Risposte in Streaming
Per il post-processing in tempo reale o per pipeline interattive, abilita lo streaming. Imposta il parametro stream su true nella tua richiesta. L'API restituisce eventi Server-Sent (SSE) invece di un singolo oggetto JSON.
Analizza i campi delta man mano che arrivano. Questo riduce la latenza percepita per output di grandi dimensioni, come la generazione di script dettagliati o l'estrazione di lunghi blocchi di testo da risultati OCR rumorosi. Il formato di streaming è compatibile con i gestori di streaming standard degli SDK OpenAI.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Assicurati che il tuo client gestisca correttamente gli chunk parziali. Aggrega i delta per ricostruire la risposta di testo completa una volta che lo stream termina con un finish_reason di stop o length.
Supporto per la Chiamata di Strumenti
Il nostro modello senza censura supporta la chiamata di funzioni, permettendoti di definire output strutturati per le tue pipeline. Definisci i tuoi strumenti nell'array tools con definizioni dello schema JSON.
Il modello restituisce le chiamate di strumenti nella risposta, che puoi eseguire per aggiornare il contesto della conversazione. Questo è utile per estrarre dati specifici da testo non strutturato, come date, nomi o coordinate dalle trascrizioni audio.
from openai import OpenAI
client = OpenAI(base_url="https://api.whisperapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Passa le chiamate di strumenti di nuovo all'API nei messaggi successivi. Il modello affinerà il suo output in base ai risultati. Questo abilita un ragionamento complesso in più passaggi senza lasciare l'interfaccia chat. Assicurati che il tuo schema sia rigoroso per evitare risposte JSON non valide.
Limiti, Errori e Contesto
Monitora il tuo utilizzo per evitare interruzioni. L'API impone un limite di 300 richieste al minuto per chiave. Se lo superi, ricevi un errore di limite di richieste 429. Implementa un backoff esponenziale nel tuo client.
Errori Comuni:
401: Chiave API non valida o scaduta. Rigenera la tua chiave dal dashboard.402: Credito insufficiente. Ricarica il tuo account per continuare l'elaborazione.429: Limite di richieste superato. Riduci la frequenza delle richieste o raggruppa attività più piccole.
Finestra di contesto: Il modello supporta 100.000 token per prompt + completamento. Se il tuo input supera questo limite, tronca i messaggi più vecchi o dividi i dati. I corpi delle richieste sono limitati a 8 MB. Assicurati che i tuoi payload rientrino in questi vincoli per prestazioni affidabili.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.whisperapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.whisperapis.com/v1 |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Modalità JSON | response_format: {"type": "json_object"} |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Finestra di contesto | 100.000 token (input + output) |
| Dimensione | fino a 8 MB per richiesta |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Bonus | +5% da $50, +10% da $100 |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Qual è la dimensione della finestra di contesto?
Il modello supporta una finestra di contesto di 100.000 token, che include sia il prompt che il completamento. Questo ti permette di elaborare trascrizioni lunghe o descrizioni dettagliate in una singola richiesta.
Questa API genera immagini o audio?
No. Questa è un'API per i completamenti di chat solo testuali. È progettata per il post-processing di output testuali da altre modalità come speech-to-text o generazione di immagini. Non genera audio, immagini o video.
Come gestisco gli errori di streaming?
Le risposte in streaming restituiscono eventi SSE. In caso di errore, lo stream termina solitamente con un messaggio di errore nel campo error dell'ultimo chunk. Assicurati che il tuo client gestisca le disconnessioni in modo elegante e riprovi se necessario.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia il base URL. È tutta qui la configurazione.