IT ▾
Ottieni la chiave API

Guida rapida per le pipeline Whisper

Integra il nostro modello testuale senza censura nelle tue pipeline audio o immagine con un'API standard per i completamenti di chat compatibile con OpenAI. Questa guida copre i passaggi essenziali per inviare richieste, gestire lo streaming e gestire le finestre di contesto per le attività di post-processing.

Prerequisiti

Prima di iniziare, assicurati di avere un account attivo e una chiave API. Registrati nella pagina Ottieni chiave API usando solo la tua email e una password. La chiave viene visualizzata immediatamente. Ricevi $0.50 di credito di prova valido per 7 giorni, senza carta di credito. Per la produzione, ricarica da $10 tramite criptovalute (USDT o USDC). La nostra tariffazione è semplice: $0.25 per 1M di token di input e $1.00 per 1M di token di output. I crediti non scadono mai.

Base URL: https://api.whisperapis.com/v1. Questo endpoint funziona con qualsiasi client compatibile con OpenAI. Devi solo configurare il base URL e fornire la tua chiave API nell'intestazione di autorizzazione. Non sono necessari SDK speciali per le richieste HTTP di base.

Inizializza il Client

La maggior parte degli sviluppatori utilizzerà l'SDK ufficiale di OpenAI o una libreria compatibile. Inizializza il client puntandolo al nostro base URL. Questo garantisce che tutte le richieste vengano instradate verso il nostro modello senza censura anziché ai server di OpenAI. L'ID del modello è sempre uncensored.

Assicurati che la tua variabile d'ambiente OPENAI_API_KEY sia impostata sulla tua chiave dal dashboard. Se utilizzi un linguaggio o una libreria diversa, verifica che supporti i base URL personalizzati. L'SDK gestisce la serializzazione JSON e l'iniezione delle intestazioni per te, riducendo il codice boilerplate negli script della tua pipeline.

Invia un Completamento Chat

Invia una richiesta standard di completamento chat per affinare l'output della tua pipeline. Ad esempio, estrai JSON strutturato dalle trascrizioni speech-to-text o genera didascalie per le immagini senza filtri sui contenuti.

L'endpoint è POST /v1/chat/completions. Includi l'ID del modello, il tuo array di messaggi e opzionalmente il tuo system prompt per definire il comportamento senza censura.

curl https://api.whisperapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Il nostro modello gestisce bene i dati ad alto contesto, supportando fino a 100.000 token in totale. Questo è ideale per l'elaborazione di trascrizioni lunghe o descrizioni di immagini dettagliate in un'unica passata.

Risposte in Streaming

Per il post-processing in tempo reale o per pipeline interattive, abilita lo streaming. Imposta il parametro stream su true nella tua richiesta. L'API restituisce eventi Server-Sent (SSE) invece di un singolo oggetto JSON.

Analizza i campi delta man mano che arrivano. Questo riduce la latenza percepita per output di grandi dimensioni, come la generazione di script dettagliati o l'estrazione di lunghi blocchi di testo da risultati OCR rumorosi. Il formato di streaming è compatibile con i gestori di streaming standard degli SDK OpenAI.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Assicurati che il tuo client gestisca correttamente gli chunk parziali. Aggrega i delta per ricostruire la risposta di testo completa una volta che lo stream termina con un finish_reason di stop o length.

Supporto per la Chiamata di Strumenti

Il nostro modello senza censura supporta la chiamata di funzioni, permettendoti di definire output strutturati per le tue pipeline. Definisci i tuoi strumenti nell'array tools con definizioni dello schema JSON.

Il modello restituisce le chiamate di strumenti nella risposta, che puoi eseguire per aggiornare il contesto della conversazione. Questo è utile per estrarre dati specifici da testo non strutturato, come date, nomi o coordinate dalle trascrizioni audio.

from openai import OpenAI

client = OpenAI(base_url="https://api.whisperapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Passa le chiamate di strumenti di nuovo all'API nei messaggi successivi. Il modello affinerà il suo output in base ai risultati. Questo abilita un ragionamento complesso in più passaggi senza lasciare l'interfaccia chat. Assicurati che il tuo schema sia rigoroso per evitare risposte JSON non valide.

Limiti, Errori e Contesto

Monitora il tuo utilizzo per evitare interruzioni. L'API impone un limite di 300 richieste al minuto per chiave. Se lo superi, ricevi un errore di limite di richieste 429. Implementa un backoff esponenziale nel tuo client.

Errori Comuni:

  • 401: Chiave API non valida o scaduta. Rigenera la tua chiave dal dashboard.
  • 402: Credito insufficiente. Ricarica il tuo account per continuare l'elaborazione.
  • 429: Limite di richieste superato. Riduci la frequenza delle richieste o raggruppa attività più piccole.

Finestra di contesto: Il modello supporta 100.000 token per prompt + completamento. Se il tuo input supera questo limite, tronca i messaggi più vecchi o dividi i dati. I corpi delle richieste sono limitati a 8 MB. Assicurati che i tuoi payload rientrino in questi vincoli per prestazioni affidabili.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.whisperapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
ID modellouncensored
EndpointPOST /v1/chat/completions · GET /v1/models
AutenticazioneAuthorization: Bearer YOUR_KEY
Base URLhttps://api.whisperapis.com/v1
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Modalità JSONresponse_format: {"type": "json_object"}
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Finestra di contesto100.000 token (input + output)
Dimensionefino a 8 MB per richiesta
Limite di frequenza300 richieste al minuto per chiave
Concorrenza8 richieste contemporanee per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Bonus+5% da $50, +10% da $100
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Scadenzail credito pagato non scade, nessun abbonamento
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
AccessoGoogle oppure e-mail e password
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Qual è la dimensione della finestra di contesto?

Il modello supporta una finestra di contesto di 100.000 token, che include sia il prompt che il completamento. Questo ti permette di elaborare trascrizioni lunghe o descrizioni dettagliate in una singola richiesta.

Questa API genera immagini o audio?

No. Questa è un'API per i completamenti di chat solo testuali. È progettata per il post-processing di output testuali da altre modalità come speech-to-text o generazione di immagini. Non genera audio, immagini o video.

Come gestisco gli errori di streaming?

Le risposte in streaming restituiscono eventi SSE. In caso di errore, lo stream termina solitamente con un messaggio di errore nel campo error dell'ultimo chunk. Assicurati che il tuo client gestisca le disconnessioni in modo elegante e riprovi se necessario.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia il base URL. È tutta qui la configurazione.

Ottieni la chiave API