NL ▾
API-sleutel aanvragen

Snelstartgids voor Whisper-pipelines

Integreer ons ongecensureerde tekstmodel in je spraak- of beeldpipelines met een standaard OpenAI-compatibele API voor chatvoltooiingen. Deze gids behandelt de essentiële stappen voor het versturen van verzoeken, het afhandelen van streaming en het beheren van contextvensters voor taaknabewerking.

Vereisten

Zorg ervoor dat je een actief account en API-sleutel hebt voordat je begint. Meld je aan op de API-sleutel ophalen pagina met alleen je e-mailadres en een wachtwoord. De sleutel verschijnt direct. Je ontvangt $0.50 aan gratis proeftegoed dat 7 dagen geldig is, zonder creditcard. Voor productie kun je opwaarderen vanaf $10 via crypto (USDT of USDC). Onze prijzen zijn eenvoudig: $0.25 per 1M input tokens en $1.00 per 1M output tokens. Credits vervallen nooit.

Base URL: https://api.whisperapis.com/v1. Deze endpoint werkt met elke OpenAI-compatibele client. Je hoeft alleen de base URL te configureren en je API-sleutel in de autorisatieheader op te geven. Voor basis-HTTP-verzoeken zijn geen speciale SDK's nodig.

Client initialiseren

De meeste ontwikkelaars gebruiken de officiële OpenAI SDK of een compatibele bibliotheek. Initialiseer de client door deze naar onze base URL te wijzen. Dit zorgt ervoor dat alle verzoeken naar ons ongecensureerde model worden gerouteerd in plaats van naar de servers van OpenAI. De model-ID is altijd uncensored.

Zorg ervoor dat je omgevingsvariabele OPENAI_API_KEY is ingesteld op je sleutel uit het dashboard. Als je een andere taal of bibliotheek gebruikt, controleer dan of deze aangepaste base URLs ondersteunt. De SDK verzorgt de JSON-serialisatie en headerinjectie voor je, waardoor je boilerplate-code in je pipelinescripts beperkt blijft.

Chatvoltooiing versturen

Verstuur een standaardverzoek voor chatvoltooiing om de uitvoer van je pipeline te verfijnen. Haal bijvoorbeeld gestructureerde JSON uit spraak-naar-tekst-transcripties of genereer bijschriften voor afbeeldingen zonder inhoudsfilters.

De endpoint is POST /v1/chat/completions. Voeg de model-ID, je berichtenarray en optioneel je systeemprompt toe om het ongecensureerde gedrag te definiëren.

curl https://api.whisperapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Ons model verwerkt gegevens met een hoge context goed en ondersteunt in totaal maximaal 100.000 tokens. Dit is ideaal voor het verwerken van lange transcripties of gedetailleerde afbeeldingsbeschrijvingen in één doorloop.

Streamingresponsen

Schakel streaming in voor realtime nabewerking of interactieve pipelines. Stel de parameter stream in op true in je verzoek. De API retourneert Server-Sent Events (SSE) in plaats van een enkel JSON-object.

Parseer de delta-velden zodra ze binnenkomen. Dit vermindert de waargenomen latentie voor grote uitvoeren, zoals het genereren van gedetailleerde scripts of het extraheren van lange tekstblokken uit ruwe OCR-resultaten. Het streamingformaat is compatibel met standaard streaminghandlers van de OpenAI SDK.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Zorg ervoor dat je client partiële chunks correct afhandelt. Aggregateer de deltas om de volledige tekstrespons te reconstrueren zodra de stream eindigt met een finish_reason van stop of length.

Ondersteuning voor function calling

Ons ongecensureerde model ondersteunt function calling, waardoor je gestructureerde uitvoeren voor je pipelines kunt definiëren. Definieer je hulpmiddelen in de tools-array met JSON-schemadefinities.

Het model retourneert tool_calls in de respons, die je kunt uitvoeren om de context van het gesprek bij te werken. Dit is nuttig voor het extraheren van specifieke gegevenspunten uit ongestructureerde tekst, zoals datums, namen of coördinaten uit spraaktranscripties.

from openai import OpenAI

client = OpenAI(base_url="https://api.whisperapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Stuur de function calling terug naar de API in volgende berichten. Het model verfijnt zijn uitvoer op basis van de resultaten. Dit maakt complexe meerstapsredenering mogelijk zonder het chatvenster te verlaten. Zorg dat je schema strikt is om ongeldige JSON-responses te voorkomen.

Limieten, fouten en context

Houd je verbruik in de gaten om onderbrekingen te voorkomen. De API handhaaft een limiet van 300 verzoeken per minuut per sleutel. Als je deze overschrijdt, ontvang je een 429 rate limit fout. Implementeer exponentiële backoff in je client.

Veelvoorkomende fouten:

  • 401: Ongeldige of verlopen API-sleutel. Genereer een nieuwe sleutel via het dashboard.
  • 402: Onvoldoende tegoed. Laad je account op om door te gaan met verwerken.
  • 429: Rate limit overschreden. Verminder de frequentie van verzoeken of verwerk kleinere taken in batches.

Contextvenster: Het model ondersteunt 100.000 tokens voor prompt + completion. Als je invoer dit overschrijdt, knip dan oudere berichten of split de data. Aanvraaglichamen zijn beperkt tot 8 MB. Zorg dat je payloads binnen deze beperkingen blijven voor betrouwbare prestaties.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.whisperapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Model-IDuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthenticatieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.whisperapis.com/v1
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
JSON-modusresponse_format: {"type": "json_object"}
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Contextvenster100.000 tokens (invoer + uitvoer)
Verzoekgroottetot 8 MB
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Bonus+5% vanaf $50, +10% vanaf $100
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Wat is de grootte van het contextvenster?

Het model ondersteunt een contextvenster van 100.000 tokens, inclusief zowel de prompt als de voltooiing. Hiermee kun je grote transcripties of gedetailleerde beschrijvingen in één verzoek verwerken.

Genereert deze API afbeeldingen of audio?

Nee. Dit is een tekst-API voor chatvoltooiingen. Deze is ontworpen voor het nabewerken van tekstuitvoer van andere modaliteiten, zoals spraak-naar-tekst of beeldgeneratie. Hij genereert geen audio, afbeeldingen of video.

Hoe ga ik om met streamingfouten?

Streamingresponsen retourneren SSE-gebeurtenissen. Als er een fout optreedt, eindigt de stream meestal met een foutbericht in het error-veld van het laatste chunk. Zorg dat je client verbreekkingen soepel afhandelt en opnieuw probeert indien nodig.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.

API-sleutel aanvragen