Documentación de API: Chat Completions para Pipelines de Texto
Haz funcionar tu LLM sin censura en tu pipeline de voz a texto con este inicio rápido. Usa el endpoint compatible con OpenAI para enviar texto, transmitir resultados o llamar a funciones mediante SDKs estándar.
URL base y autenticación
Comienza apuntando tu cliente a la URL base https://api.speechtotextapis.com/v1. Este endpoint es totalmente compatible con OpenAI, lo que significa que puedes usar cualquier SDK estándar openai simplemente sobrescribiendo el parámetro base_url. No necesitas reescribir la lógica de tus peticiones; solo cambia la URL e inyecta tu clave de API. Tu clave se genera inmediatamente al registrarte en la página de claves. Está vinculada a tu cuenta y puedes regenerarla en cualquier momento, lo que revoca la clave antigua al instante. No se requiere número de teléfono y el crédito de prueba se activa sin tarjeta. Esta configuración mantiene tu pipeline simple mientras te asegura acceso a un modelo sin censura que maneja contenido adulto lícito sin suavizar las salidas.
Primera petición
Envía una petición POST estándar a /v1/chat/completions. El identificador del modelo es siempre uncensored. Este modelo es una variante de pesos abiertos ajustada para un rechazo mínimo en temas lícitos. Se ejecuta en nuestros servidores GPU dedicados. No obtienes GPT ni Claude; obtienes una experiencia consistente con un solo modelo. El cuerpo de la petición incluye las marcas model, messages y stream. A continuación hay un ejemplo básico de cURL para verificar la conectividad y obtener una respuesta de texto.
curl https://api.speechtotextapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Esta petición devuelve un objeto JSON con el texto generado. Si la clave no es válida, recibes un error 401. Si tu crédito prepago se agota, recibes un error 402. Estos son los principales bloqueos a verificar antes de depurar la lógica.
Integración con SDK Python
Para desarrolladores de Python, la biblioteca oficial openai funciona de inmediato. Inicializa el cliente con tu clave y la URL base personalizada. Pasa el ID del modelo uncensored en tu llamada de chat completion. Este enfoque es ideal para el postprocesamiento de la salida de ASR, limpiar el ruido de la transcripción o extraer datos estructurados de texto sin procesar. La naturaleza sin censura asegura que si tu transcripción contiene diálogo adulto o términos controvertidos, el LLM lo procesará sin bloquear ni reescribir para corrección. Esto es crítico para pipelines creativos donde la fidelidad al audio fuente es primordial. El SDK maneja la tokenización y la lógica de reintento automáticamente.
from openai import OpenAI
client = OpenAI(base_url="https://api.speechtotextapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Recuerda que el ID del modelo es estrictamente uncensored. No lo sustituyas por gpt-4 ni otros identificadores genéricos, ya que es posible que no se enruten a nuestros pesos sin censura específicos.
Integración con SDK Node.js
Los desarrolladores de Node.js pueden usar el paquete npm openai de manera similar. Establece el apiKey y el baseURL en el constructor del cliente. Luego llama a chat.completions.create con el modelo uncensored. Esto es útil para scripts de transcripción en vivo o tareas de generación de texto en el lado del servidor. La API admite cargas útiles JSON estándar. Puedes incluir mensajes del sistema para definir el tono o el rol del asistente. El modelo sin censura responde directamente a estos prompts sin capas de seguridad adicionales que puedan alterar la salida creativa. Asegúrate de manejar el stream de respuesta si estás procesando documentos grandes. El SDK de Node abstrae los detalles de HTTP, permitiéndote concentrarte en la lógica del pipeline de texto.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.speechtotextapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Los límites de velocidad se aplican por clave. Si excedes 300 peticiones por minuto, la API devuelve un error 429. Implementa un retroceso exponencial en tu lógica de reintento para manejar esto de manera fluida.
Respuestas en streaming (SSE)
Para aplicaciones de baja latencia, habilita el streaming estableciendo stream: true en tu petición. La API devuelve fragmentos de Server-Sent Events (SSE). Cada fragmento contiene un delta de texto parcial. Esto es esencial para la transcripción en vivo o interfaces de chat interactivas. El modelo sin censura admite streaming de forma nativa. No necesitas esperar a la finalización completa para empezar a mostrar texto. Esto reduce significativamente la latencia percibida. Configura tu SDK para manejar los eventos del stream. En Python, itera sobre el objeto stream. En Node, usa el iterador asíncrono. El stream termina con un fragmento final que contiene la razón de finalización. Este método es eficiente para el ancho de banda y la experiencia del usuario.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
El streaming no cambia la facturación por tokens. Se te cobra por el total de tokens de entrada y salida independientemente de si transmites o solicitas una respuesta completa.
Límites y restricciones
Tu cuenta tiene un límite estricto de 300 peticiones por minuto por clave de API. El cuerpo de la petición no puede exceder 8 MB. La ventana de contexto es de 100.000 tokens, cubriendo tanto el prompt como la respuesta. Esto es suficiente para la mayoría de las tareas de procesamiento de documentos y transcripción de contexto largo. Si envías un prompt que excede la ventana, la API devuelve un error. El modelo sin censura bloquea solo un límite estricto específico: contenido sexual que involucra a menores. Todo el contenido adulto lícito restante está permitido. Esto lo hace ideal para pipelines de medios donde se espera variedad de contenido. No hay suscripciones; pagas por uso. El crédito prepago no caduca. Usa el endpoint GET /v1/models para verificar la disponibilidad si es necesario, aunque el ID del modelo es siempre uncensored.
Ficha técnica de la API
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| ID del modelo | uncensored |
| Base URL | https://api.speechtotextapis.com/v1 |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Modo JSON | response_format: {"type": "json_object"} |
| Límite de peticiones | 300 por minuto por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrencia | 8 peticiones a la vez por clave |
| Tamaño de petición | hasta 8 MB |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Bono | +5 % desde $50, +10 % desde $100 |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
Errores y qué hacer
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Es esta la API oficial de OpenAI?
No, este es un servicio independiente. Alojamos nuestro propio modelo sin censura compatible con la interfaz de chat completions de OpenAI. No es GPT-4 ni GPT-3.5. Consulta la documentación de OpenAI para conocer sus precios y límites específicos, ya que los nuestros son diferentes.
¿Qué pasa si me quedo sin crédito?
Tu clave de API permanece activa, pero las peticiones devolverán un error 402 Pago requerido. Debes recargar tu cuenta prepaga a través de criptomonedas (USDT o USDC) para reanudar el uso. Los créditos nunca caducan, así que puedes añadir fondos cuando te sea conveniente.
¿El modelo sin censura filtra contenido para adultos?
Filtra el contenido sexual que involucre a menores, que es un bloqueo estricto. Para todo lo demás contenido legal para adultos, escenarios ficticios o temas controvertidos, el modelo no rechaza ni suaviza la salida. Esto asegura que tu pipeline preserve el tono y significado originales de tu texto fuente.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.