ES ▾

speechtotextapis.comLLM sin censura para pipelines de post-procesamiento de texto

Speech To Text API
Obtener clave de API

Documentación de API: Chat Completions para Pipelines de Texto

Haz funcionar tu LLM sin censura en tu pipeline de voz a texto con este inicio rápido. Usa el endpoint compatible con OpenAI para enviar texto, transmitir resultados o llamar a funciones mediante SDKs estándar.

URL base y autenticación

Comienza apuntando tu cliente a la URL base https://api.speechtotextapis.com/v1. Este endpoint es totalmente compatible con OpenAI, lo que significa que puedes usar cualquier SDK estándar openai simplemente sobrescribiendo el parámetro base_url. No necesitas reescribir la lógica de tus peticiones; solo cambia la URL e inyecta tu clave de API. Tu clave se genera inmediatamente al registrarte en la página de claves. Está vinculada a tu cuenta y puedes regenerarla en cualquier momento, lo que revoca la clave antigua al instante. No se requiere número de teléfono y el crédito de prueba se activa sin tarjeta. Esta configuración mantiene tu pipeline simple mientras te asegura acceso a un modelo sin censura que maneja contenido adulto lícito sin suavizar las salidas.

Primera petición

Envía una petición POST estándar a /v1/chat/completions. El identificador del modelo es siempre uncensored. Este modelo es una variante de pesos abiertos ajustada para un rechazo mínimo en temas lícitos. Se ejecuta en nuestros servidores GPU dedicados. No obtienes GPT ni Claude; obtienes una experiencia consistente con un solo modelo. El cuerpo de la petición incluye las marcas model, messages y stream. A continuación hay un ejemplo básico de cURL para verificar la conectividad y obtener una respuesta de texto.

curl https://api.speechtotextapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Esta petición devuelve un objeto JSON con el texto generado. Si la clave no es válida, recibes un error 401. Si tu crédito prepago se agota, recibes un error 402. Estos son los principales bloqueos a verificar antes de depurar la lógica.

Integración con SDK Python

Para desarrolladores de Python, la biblioteca oficial openai funciona de inmediato. Inicializa el cliente con tu clave y la URL base personalizada. Pasa el ID del modelo uncensored en tu llamada de chat completion. Este enfoque es ideal para el postprocesamiento de la salida de ASR, limpiar el ruido de la transcripción o extraer datos estructurados de texto sin procesar. La naturaleza sin censura asegura que si tu transcripción contiene diálogo adulto o términos controvertidos, el LLM lo procesará sin bloquear ni reescribir para corrección. Esto es crítico para pipelines creativos donde la fidelidad al audio fuente es primordial. El SDK maneja la tokenización y la lógica de reintento automáticamente.

from openai import OpenAI

client = OpenAI(base_url="https://api.speechtotextapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Recuerda que el ID del modelo es estrictamente uncensored. No lo sustituyas por gpt-4 ni otros identificadores genéricos, ya que es posible que no se enruten a nuestros pesos sin censura específicos.

Integración con SDK Node.js

Los desarrolladores de Node.js pueden usar el paquete npm openai de manera similar. Establece el apiKey y el baseURL en el constructor del cliente. Luego llama a chat.completions.create con el modelo uncensored. Esto es útil para scripts de transcripción en vivo o tareas de generación de texto en el lado del servidor. La API admite cargas útiles JSON estándar. Puedes incluir mensajes del sistema para definir el tono o el rol del asistente. El modelo sin censura responde directamente a estos prompts sin capas de seguridad adicionales que puedan alterar la salida creativa. Asegúrate de manejar el stream de respuesta si estás procesando documentos grandes. El SDK de Node abstrae los detalles de HTTP, permitiéndote concentrarte en la lógica del pipeline de texto.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.speechtotextapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Los límites de velocidad se aplican por clave. Si excedes 300 peticiones por minuto, la API devuelve un error 429. Implementa un retroceso exponencial en tu lógica de reintento para manejar esto de manera fluida.

Respuestas en streaming (SSE)

Para aplicaciones de baja latencia, habilita el streaming estableciendo stream: true en tu petición. La API devuelve fragmentos de Server-Sent Events (SSE). Cada fragmento contiene un delta de texto parcial. Esto es esencial para la transcripción en vivo o interfaces de chat interactivas. El modelo sin censura admite streaming de forma nativa. No necesitas esperar a la finalización completa para empezar a mostrar texto. Esto reduce significativamente la latencia percibida. Configura tu SDK para manejar los eventos del stream. En Python, itera sobre el objeto stream. En Node, usa el iterador asíncrono. El stream termina con un fragmento final que contiene la razón de finalización. Este método es eficiente para el ancho de banda y la experiencia del usuario.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

El streaming no cambia la facturación por tokens. Se te cobra por el total de tokens de entrada y salida independientemente de si transmites o solicitas una respuesta completa.

Límites y restricciones

Tu cuenta tiene un límite estricto de 300 peticiones por minuto por clave de API. El cuerpo de la petición no puede exceder 8 MB. La ventana de contexto es de 100.000 tokens, cubriendo tanto el prompt como la respuesta. Esto es suficiente para la mayoría de las tareas de procesamiento de documentos y transcripción de contexto largo. Si envías un prompt que excede la ventana, la API devuelve un error. El modelo sin censura bloquea solo un límite estricto específico: contenido sexual que involucra a menores. Todo el contenido adulto lícito restante está permitido. Esto lo hace ideal para pipelines de medios donde se espera variedad de contenido. No hay suscripciones; pagas por uso. El crédito prepago no caduca. Usa el endpoint GET /v1/models para verificar la disponibilidad si es necesario, aunque el ID del modelo es siempre uncensored.

Ficha técnica de la API

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
ID del modelouncensored
Base URLhttps://api.speechtotextapis.com/v1
AutenticaciónAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Ventana de contexto100.000 tokens (entrada + salida)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Modo JSONresponse_format: {"type": "json_object"}
Límite de peticiones300 por minuto por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concurrencia8 peticiones a la vez por clave
Tamaño de peticiónhasta 8 MB
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Bono+5 % desde $50, +10 % desde $100
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Caducidadel crédito pagado no caduca, sin suscripción
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
AccesoGoogle o correo y contraseña

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Es esta la API oficial de OpenAI?

No, este es un servicio independiente. Alojamos nuestro propio modelo sin censura compatible con la interfaz de chat completions de OpenAI. No es GPT-4 ni GPT-3.5. Consulta la documentación de OpenAI para conocer sus precios y límites específicos, ya que los nuestros son diferentes.

¿Qué pasa si me quedo sin crédito?

Tu clave de API permanece activa, pero las peticiones devolverán un error 402 Pago requerido. Debes recargar tu cuenta prepaga a través de criptomonedas (USDT o USDC) para reanudar el uso. Los créditos nunca caducan, así que puedes añadir fondos cuando te sea conveniente.

¿El modelo sin censura filtra contenido para adultos?

Filtra el contenido sexual que involucre a menores, que es un bloqueo estricto. Para todo lo demás contenido legal para adultos, escenarios ficticios o temas controvertidos, el modelo no rechaza ni suaviza la salida. Esto asegura que tu pipeline preserve el tono y significado originales de tu texto fuente.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.

Obtener clave de APILeer la documentación