DE ▾
API-Schlüssel erhalten

Schnellstart für Whisper-Pipelines

Integriere unser unzensiertes Textmodell in deine Speech- oder Bildpipelines über eine standardmäßige OpenAI-kompatible Chat-Completion-API. Diese Anleitung behandelt die wichtigsten Schritte zum Senden von Anfragen, zum Handhaben von Streaming und zum Verwalten von Kontextfenstern für Nachbearbeitungsaufgaben.

Voraussetzungen

Stelle vor dem Start sicher, dass du ein aktives Konto und einen API-Schlüssel hast. Registriere dich auf der API-Schlüssel erhalten-Seite nur mit deiner E-Mail-Adresse und einem Passwort. Der Schlüssel wird sofort angezeigt. Du erhältst $0.50 an Testguthaben, die 7 Tage gültig sind, ohne Kreditkarte. Für die Produktion lade ab $10 per Krypto (USDT oder USDC) auf. Unsere Preise sind einfach: $0.25 pro 1M Input-Token und $1.00 pro 1M Output-Token. Guthaben verfällt nie.

Base URL: https://api.whisperapis.com/v1. Dieser Endpunkt funktioniert mit jedem OpenAI-kompatiblen Client. Du musst nur die Base URL konfigurieren und deinen API-Schlüssel im Authorization-Header angeben. Für einfache HTTP-Anfragen werden keine speziellen SDKs benötigt.

Client initialisieren

Die meisten Entwickler verwenden das offizielle OpenAI SDK oder eine kompatible Bibliothek. Initialisiere den Client, indem du ihn auf unsere Base URL zeigst. So werden alle Anfragen an unser unzensiertes Modell geleitet, anstatt an die Server von OpenAI. Die Modell-ID ist immer uncensored.

Stelle sicher, dass deine Umgebungsvariable OPENAI_API_KEY auf deinen Schlüssel aus dem Dashboard gesetzt ist. Wenn du eine andere Sprache oder Bibliothek verwendest, überprüfe, ob sie benutzerdefinierte Base URLs unterstützt. Das SDK übernimmt die JSON-Serialisierung und Header-Injektion für dich, was Boilerplate-Code in deinen Pipeline-Skripten reduziert.

Chat-Completion senden

Sende eine standardmäßige Chat-Completion-Anfrage, um deine Pipeline-Ausgabe zu verfeinern. Extrahiere beispielsweise strukturiertes JSON aus Speech-to-Text-Transkripten oder generiere Bildunterschriften ohne Inhaltsfilter.

Der Endpunkt ist POST /v1/chat/completions. Füge die Modell-ID, dein Messages-Array und optional deinen System-Prompt hinzu, um das unzensierte Verhalten zu definieren.

curl https://api.whisperapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Unser Modell verarbeitet Daten mit hohem Kontext gut und unterstützt bis zu 100.000 Token insgesamt. Dies ist ideal für die Verarbeitung langer Transkripte oder detaillierter Bildbeschreibungen in einem einzigen Durchlauf.

Streaming-Antworten

Für Echtzeit-Nachbearbeitung oder interaktive Pipelines aktiviere das Streaming. Setze den Parameter stream in deiner Anfrage auf true. Die API gibt Server-Sent Events (SSE) zurück, statt eines einzelnen JSON-Objekts.

Parst die delta-Felder, sobald sie eintreffen. Dies reduziert die wahrgenommene Latenz für große Ausgaben, wie das Generieren detaillierter Skripte oder das Extrahieren langer Textblöcke aus rauschigen OCR-Ergebnissen. Das Streaming-Format ist mit Standard-OpenAI-SDK-Streaming-Handlern kompatibel.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Stelle sicher, dass dein Client Teilstücke korrekt verarbeitet. Aggregiere die Deltas, um die vollständige Textantwort zu rekonstruieren, sobald der Stream mit einem finish_reason von stop oder length endet.

Tool-Calling-Unterstützung

Unser unzensiertes Modell unterstützt Function Calling, sodass du strukturierte Ausgaben für deine Pipelines definieren kannst. Definiere deine Tools im tools-Array mit JSON-Schema-Definitionen.

Das Modell gibt Tool-Aufrufe in der Antwort zurück, die du ausführen kannst, um den Gesprächskontext zu aktualisieren. Dies ist nützlich zum Extrahieren spezifischer Datenpunkte aus unstrukturierten Texten, wie Daten, Namen oder Koordinaten aus Speech-to-Text-Transkripten.

from openai import OpenAI

client = OpenAI(base_url="https://api.whisperapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Übergib die Tool-Aufrufe in nachfolgenden Nachrichten an die API. Das Modell verfeinert seine Ausgabe basierend auf den Ergebnissen. Dies ermöglicht komplexes Multi-Step-Reasoning, ohne die Chat-Oberfläche zu verlassen. Stelle sicher, dass dein Schema streng ist, um fehlerhafte JSON-Antworten zu vermeiden.

Limits, Fehler und Kontext

Überwache deine Nutzung, um Unterbrechungen zu vermeiden. Die API erzwingt ein Limit von 300 Anfragen pro Minute pro Schlüssel. Wenn du dieses überschreitest, erhältst du einen 429 Ratenlimit-Fehler. Implementiere Exponential Backoff in deinem Client.

Häufige Fehler:

  • 401: Ungültiger oder abgelaufener API-Schlüssel. Generiere deinen Schlüssel im Dashboard neu.
  • 402: Unzureichendes Guthaben. Lade dein Konto auf, um fortzufahren.
  • 429: Ratenlimit überschritten. Reduziere die Anfragehäufigkeit oder bündele kleinere Aufgaben.

Kontextfenster: Das Modell unterstützt 100.000 Token für Prompt + Completion. Wenn deine Eingabe dies überschreitet, kürze ältere Nachrichten oder teile die Daten. Anfragekörper sind auf 8 MB begrenzt. Stelle sicher, dass deine Payloads in diese Grenzen passen, um eine zuverlässige Leistung zu gewährleisten.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.whisperapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

API-Spezifikation

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Modell-IDuncensored
EndpunktePOST /v1/chat/completions · GET /v1/models
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.whisperapis.com/v1
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
JSON-Modusresponse_format: {"type": "json_object"}
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Anfragegrößebis 8 MB
Ratenlimit300 Anfragen pro Minute und Schlüssel
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehler und Lösungen

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Wie groß ist das Kontextfenster?

Das Modell unterstützt ein Kontextfenster von 100.000 Token, das sowohl den Prompt als auch die Completion umfasst. So kannst du große Transkripte oder detaillierte Beschreibungen in einer einzigen Anfrage verarbeiten.

Generiert diese API Bilder oder Audio?

Nein. Dies ist eine Text-Only-Chat-Completion-API. Sie ist für die Nachbearbeitung von Textausgaben anderer Modalitäten wie Speech-to-Text oder Bildgenerierung konzipiert. Sie erzeugt keine Audio-, Bild- oder Videoinhalte.

Wie gehe ich mit Streaming-Fehlern um?

Streaming-Antworten geben SSE-Ereignisse zurück. Tritt ein Fehler auf, endet der Stream typischerweise mit einer Fehlermeldung im error-Feld des letzten Chunks. Stelle sicher, dass dein Client Verbindungsabbrüche sorgfältig verarbeitet und bei Bedarf wiederholt.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten