ES ▾
Obtener clave de API

Inicio rápido para pipelines de Whisper

Integra nuestro modelo de texto sin censura en tus pipelines de voz o imagen con una API de completaciones de chat compatible con OpenAI. Esta guía cubre los pasos esenciales para enviar peticiones, manejar streaming y gestionar ventanas de contexto para tareas de postprocesamiento.

Prerrequisitos

Antes de comenzar, asegúrate de tener una cuenta activa y una clave de API. Regístrate en la página Obtener clave de API usando solo tu correo electrónico y una contraseña. La clave aparece de inmediato. Recibes $0.50 en crédito de prueba válido por 7 días, sin necesidad de tarjeta de crédito. Para producción, recarga desde $10 mediante criptomonedas (USDT o USDC). Nuestra tarifa es clara: $0.25 por cada 1M de tokens de entrada y $1.00 por cada 1M de tokens de salida. Los créditos no caducan.

URL base: https://api.whisperapis.com/v1. Este endpoint es compatible con cualquier cliente compatible con OpenAI. Solo necesitas configurar la URL base y proporcionar tu clave de API en el encabezado de autorización. No se requieren SDK especiales para peticiones HTTP básicas.

Inicializar cliente

La mayoría de los desarrolladores usarán el SDK oficial de OpenAI o una biblioteca compatible. Inicializa el cliente apuntándolo a nuestra URL base. Esto asegura que todas las peticiones se enruten hacia nuestro modelo sin censura en lugar de los servidores de OpenAI. El ID del modelo es siempre uncensored.

Asegúrate de que tu variable de entorno OPENAI_API_KEY esté configurada con tu clave del panel. Si usas un lenguaje o biblioteca diferente, verifica que admita URLs base personalizadas. El SDK se encarga de la serialización JSON y la inyección de encabezados por ti, reduciendo el código repetitivo en tus scripts de pipeline.

Enviar completación de chat

Envía una petición estándar de completación de chat para refinar la salida de tu pipeline. Por ejemplo, extrae JSON estructurado de transcripciones de voz a texto o genera subtítulos para imágenes sin filtros de contenido.

El endpoint es POST /v1/chat/completions. Incluye el ID del modelo, tu matriz de mensajes y opcionalmente tu prompt de sistema para definir el comportamiento sin censura.

curl https://api.whisperapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Nuestro modelo maneja bien los datos de alto contexto, admitiendo hasta 100.000 tokens en total. Esto es ideal para procesar transcripciones largas o descripciones detalladas de imágenes en un solo paso.

Respuestas en streaming

Para el postprocesamiento en tiempo real o pipelines interactivos, activa el streaming. Establece el parámetro stream en true en tu petición. La API devuelve Eventos Enviados por Servidor (SSE) en lugar de un único objeto JSON.

Analiza los campos delta a medida que llegan. Esto reduce la latencia percibida para salidas grandes, como generar scripts detallados o extraer bloques de texto largos de resultados de OCR ruidosos. El formato de streaming es compatible con los controladores de streaming estándar del SDK de OpenAI.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Asegúrate de que tu cliente gestione correctamente los fragmentos parciales. Agrega los deltas para reconstruir la respuesta de texto completa una vez que el flujo termine con un finish_reason de stop o length.

Soporte para llamadas a funciones

Nuestro modelo sin censura admite llamadas a funciones, lo que te permite definir salidas estructuradas para tus pipelines. Define tus herramientas en la matriz tools con definiciones de esquema JSON.

El modelo devuelve llamadas a funciones en la respuesta, que puedes ejecutar para actualizar el contexto de la conversación. Esto es útil para extraer puntos de datos específicos de texto no estructurado, como fechas, nombres o coordenadas de transcripciones de voz.

from openai import OpenAI

client = OpenAI(base_url="https://api.whisperapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Pasa las llamadas a funciones de nuevo a la API en mensajes posteriores. El modelo refinará su salida basándose en los resultados. Esto permite razonamiento complejo en varios pasos sin salir de la interfaz de chat. Asegúrate de que tu esquema sea estricto para evitar respuestas JSON mal formadas.

Límites, errores y contexto

Monitorea tu uso para evitar interrupciones. La API aplica un límite de 300 peticiones por minuto por clave. Si excedes este límite, recibirás un error de límite de peticiones 429. Implementa retroceso exponencial en tu cliente.

Errores comunes:

  • 401: Clave de API inválida o expirada. Regenera tu clave desde el panel.
  • 402: Crédito insuficiente. Recarga tu cuenta para continuar procesando.
  • 429: Límite de peticiones excedido. Reduce la frecuencia de peticiones o agrupa tareas más pequeñas.

Ventana de contexto: El modelo admite 100.000 tokens para prompt + finalización. Si tu entrada supera este límite, trunca los mensajes antiguos o divide los datos. Los cuerpos de las peticiones están limitados a 8 MB. Asegúrate de que tus cargas útiles se ajusten a estas restricciones para un rendimiento fiable.

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.whisperapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Ficha técnica de la API

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
ID del modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaciónAuthorization: Bearer YOUR_KEY
Base URLhttps://api.whisperapis.com/v1
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Modo JSONresponse_format: {"type": "json_object"}
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Ventana de contexto100.000 tokens (entrada + salida)
Tamaño de peticiónhasta 8 MB
Límite de peticiones300 por minuto por clave
Concurrencia8 peticiones a la vez por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Bono+5 % desde $50, +10 % desde $100
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Caducidadel crédito pagado no caduca, sin suscripción
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
AccesoGoogle o correo y contraseña
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Cuál es el tamaño de la ventana de contexto?

El modelo admite una ventana de contexto de 100.000 tokens, que incluye tanto el prompt como la completación. Esto te permite procesar transcripciones extensas o descripciones detalladas en una sola petición.

¿Esta API genera imágenes o audio?

No. Esta es una API de completaciones de chat solo de texto. Está diseñada para el postprocesamiento de salidas de texto de otras modalidades como voz a texto o generación de imágenes. No genera audio, imágenes ni vídeo.

¿Cómo manejo los errores de streaming?

Las respuestas en streaming devuelven eventos SSE. Si ocurre un error, el flujo normalmente terminará con un mensaje de error en el campo error del fragmento final. Asegúrate de que tu cliente gestione las caídas de conexión de forma elegante y reintente si es necesario.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API