Snelstartgids voor Whisper-pipelines
Integreer ons ongecensureerde tekstmodel in je spraak- of beeldpipelines met een standaard OpenAI-compatibele API voor chatvoltooiingen. Deze gids behandelt de essentiële stappen voor het versturen van verzoeken, het afhandelen van streaming en het beheren van contextvensters voor taaknabewerking.
Vereisten
Zorg ervoor dat je een actief account en API-sleutel hebt voordat je begint. Meld je aan op de API-sleutel ophalen pagina met alleen je e-mailadres en een wachtwoord. De sleutel verschijnt direct. Je ontvangt $0.50 aan gratis proeftegoed dat 7 dagen geldig is, zonder creditcard. Voor productie kun je opwaarderen vanaf $10 via crypto (USDT of USDC). Onze prijzen zijn eenvoudig: $0.25 per 1M input tokens en $1.00 per 1M output tokens. Credits vervallen nooit.
Base URL: https://api.whisperapis.com/v1. Deze endpoint werkt met elke OpenAI-compatibele client. Je hoeft alleen de base URL te configureren en je API-sleutel in de autorisatieheader op te geven. Voor basis-HTTP-verzoeken zijn geen speciale SDK's nodig.
Client initialiseren
De meeste ontwikkelaars gebruiken de officiële OpenAI SDK of een compatibele bibliotheek. Initialiseer de client door deze naar onze base URL te wijzen. Dit zorgt ervoor dat alle verzoeken naar ons ongecensureerde model worden gerouteerd in plaats van naar de servers van OpenAI. De model-ID is altijd uncensored.
Zorg ervoor dat je omgevingsvariabele OPENAI_API_KEY is ingesteld op je sleutel uit het dashboard. Als je een andere taal of bibliotheek gebruikt, controleer dan of deze aangepaste base URLs ondersteunt. De SDK verzorgt de JSON-serialisatie en headerinjectie voor je, waardoor je boilerplate-code in je pipelinescripts beperkt blijft.
Chatvoltooiing versturen
Verstuur een standaardverzoek voor chatvoltooiing om de uitvoer van je pipeline te verfijnen. Haal bijvoorbeeld gestructureerde JSON uit spraak-naar-tekst-transcripties of genereer bijschriften voor afbeeldingen zonder inhoudsfilters.
De endpoint is POST /v1/chat/completions. Voeg de model-ID, je berichtenarray en optioneel je systeemprompt toe om het ongecensureerde gedrag te definiëren.
curl https://api.whisperapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Ons model verwerkt gegevens met een hoge context goed en ondersteunt in totaal maximaal 100.000 tokens. Dit is ideaal voor het verwerken van lange transcripties of gedetailleerde afbeeldingsbeschrijvingen in één doorloop.
Streamingresponsen
Schakel streaming in voor realtime nabewerking of interactieve pipelines. Stel de parameter stream in op true in je verzoek. De API retourneert Server-Sent Events (SSE) in plaats van een enkel JSON-object.
Parseer de delta-velden zodra ze binnenkomen. Dit vermindert de waargenomen latentie voor grote uitvoeren, zoals het genereren van gedetailleerde scripts of het extraheren van lange tekstblokken uit ruwe OCR-resultaten. Het streamingformaat is compatibel met standaard streaminghandlers van de OpenAI SDK.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Zorg ervoor dat je client partiële chunks correct afhandelt. Aggregateer de deltas om de volledige tekstrespons te reconstrueren zodra de stream eindigt met een finish_reason van stop of length.
Ondersteuning voor function calling
Ons ongecensureerde model ondersteunt function calling, waardoor je gestructureerde uitvoeren voor je pipelines kunt definiëren. Definieer je hulpmiddelen in de tools-array met JSON-schemadefinities.
Het model retourneert tool_calls in de respons, die je kunt uitvoeren om de context van het gesprek bij te werken. Dit is nuttig voor het extraheren van specifieke gegevenspunten uit ongestructureerde tekst, zoals datums, namen of coördinaten uit spraaktranscripties.
from openai import OpenAI
client = OpenAI(base_url="https://api.whisperapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Stuur de function calling terug naar de API in volgende berichten. Het model verfijnt zijn uitvoer op basis van de resultaten. Dit maakt complexe meerstapsredenering mogelijk zonder het chatvenster te verlaten. Zorg dat je schema strikt is om ongeldige JSON-responses te voorkomen.
Limieten, fouten en context
Houd je verbruik in de gaten om onderbrekingen te voorkomen. De API handhaaft een limiet van 300 verzoeken per minuut per sleutel. Als je deze overschrijdt, ontvang je een 429 rate limit fout. Implementeer exponentiële backoff in je client.
Veelvoorkomende fouten:
401: Ongeldige of verlopen API-sleutel. Genereer een nieuwe sleutel via het dashboard.402: Onvoldoende tegoed. Laad je account op om door te gaan met verwerken.429: Rate limit overschreden. Verminder de frequentie van verzoeken of verwerk kleinere taken in batches.
Contextvenster: Het model ondersteunt 100.000 tokens voor prompt + completion. Als je invoer dit overschrijdt, knip dan oudere berichten of split de data. Aanvraaglichamen zijn beperkt tot 8 MB. Zorg dat je payloads binnen deze beperkingen blijven voor betrouwbare prestaties.
Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.whisperapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Model-ID | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.whisperapis.com/v1 |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| JSON-modus | response_format: {"type": "json_object"} |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Verzoekgrootte | tot 8 MB |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inloggen | Google of e-mail en wachtwoord |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Wat is de grootte van het contextvenster?
Het model ondersteunt een contextvenster van 100.000 tokens, inclusief zowel de prompt als de voltooiing. Hiermee kun je grote transcripties of gedetailleerde beschrijvingen in één verzoek verwerken.
Genereert deze API afbeeldingen of audio?
Nee. Dit is een tekst-API voor chatvoltooiingen. Deze is ontworpen voor het nabewerken van tekstuitvoer van andere modaliteiten, zoals spraak-naar-tekst of beeldgeneratie. Hij genereert geen audio, afbeeldingen of video.
Hoe ga ik om met streamingfouten?
Streamingresponsen retourneren SSE-gebeurtenissen. Als er een fout optreedt, eindigt de stream meestal met een foutbericht in het error-veld van het laatste chunk. Zorg dat je client verbreekkingen soepel afhandelt en opnieuw probeert indien nodig.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.