PT ▾

speechtotextapis.comLLM sem censura para pipelines de pós-processamento de texto

Speech To Text API
Obter chave de API

Documentação da API: Conclusões de Chat para Pipelines de Texto

Faça seu LLM sem censura funcionar no seu pipeline de fala para texto com este início rápido. Use o endpoint compatível com OpenAI para postar texto, transmitir resultados ou chamar ferramentas via SDKs padrão.

URL Base e Autenticação

Comece apontando seu cliente para a URL base https://api.speechtotextapis.com/v1. Este endpoint é totalmente compatível com OpenAI, o que significa que você pode usar qualquer SDK padrão openai simplesmente sobrescrevendo o parâmetro base_url. Você não precisa reescrever a lógica das suas requisições; basta trocar a URL e inserir sua chave de API. Sua chave é gerada imediatamente após entrar na página de chaves. Ela está vinculada à sua conta e você pode regenerá-la a qualquer momento, o que revoga a chave antiga instantaneamente. Não há exigência de número de telefone, e o crédito de teste grátis é ativado sem necessidade de cartão. Essa configuração mantém seu pipeline simples enquanto garante acesso a um modelo sem censura que lida com conteúdo adulto lícito sem suavizar as saídas.

Primeira Requisição

Envie uma requisição POST para /v1/chat/completions. O identificador do modelo é sempre uncensored. Este modelo é uma variante de pesos abertos ajustada para recusa mínima em tópicos lícitos. Ele roda em nossos servidores GPU dedicados. Você não recebe GPT ou Claude; você recebe uma experiência consistente com um único modelo. O corpo da requisição inclui as flags model, messages e stream. Abaixo está um exemplo básico de cURL para verificar a conectividade e obter uma resposta de texto.

curl https://api.speechtotextapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Esta requisição retorna um objeto JSON com o texto gerado. Se a chave for inválida, você receberá um erro 401. Se seu crédito pré-pago estiver esgotado, você receberá um erro 402. Estes são os principais bloqueadores a verificar antes de depurar a lógica.

Integração com SDK Python

Para desenvolvedores Python, a biblioteca oficial openai funciona imediatamente. Inicialize o cliente com sua chave e a URL base personalizada. Passe o ID do modelo uncensored na sua chamada de geração de resposta. Esta abordagem é ideal para pós-processamento de saída de ASR, limpeza de ruído de transcrição ou extração de dados estruturados a partir de texto bruto. A natureza sem censura garante que, se sua transcrição contiver diálogos adultos ou termos controversos, o LLM processará sem bloquear ou reescrever por conveniência. Isso é crítico para pipelines criativos onde a fidelidade ao áudio original é primordial. O SDK lida com a tokenização e a lógica de nova tentativa automaticamente.

from openai import OpenAI

client = OpenAI(base_url="https://api.speechtotextapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Lembre-se de que o ID do modelo é estritamente uncensored. Não o substitua por gpt-4 ou outros identificadores genéricos, pois eles podem não rotear para nossos pesos sem censura específicos.

Integração com SDK Node.js

Desenvolvedores Node.js podem usar o pacote npm openai de forma semelhante. Defina o apiKey e o baseURL no construtor do cliente. Em seguida, chame chat.completions.create com o modelo uncensored. Isso é útil para scripts de legendagem em tempo real ou tarefas de geração de texto no lado do servidor. A API suporta payloads JSON padrão. Você pode incluir mensagens do sistema para definir o tom ou o papel do assistente. O modelo sem censura responde diretamente a esses prompts sem camadas extras de segurança que possam alterar a saída criativa. Certifique-se de lidar com o streaming da resposta se você estiver processando documentos grandes. O SDK Node abstrai os detalhes HTTP, permitindo que você se concentre na lógica do pipeline de texto.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.speechtotextapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Limites de taxa se aplicam por chave. Se você exceder 300 requisições por minuto, a API retornará um erro 429. Implemente backoff exponencial na sua lógica de retry para lidar com isso gracefulmente.

Respostas em Streaming (SSE)

Para aplicações de baixa latência, ative o streaming definindo stream: true na sua requisição. A API retorna chunks de Server-Sent Events (SSE). Cada chunk contém um delta de texto parcial. Isso é essencial para legendas ao vivo ou interfaces de chat interativas. O modelo sem censura suporta streaming nativamente. Você não precisa esperar pela conclusão completa para começar a exibir texto. Isso reduz significativamente a latência percebida. Configure seu SDK para lidar com os eventos de stream. Em Python, itere sobre o objeto stream. Em Node, use o iterador assíncrono. O stream termina com um chunk final contendo o motivo do término. Este método é eficiente para largura de banda e experiência do usuário.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

O streaming não altera a cobrança por token. Você é cobrado pelos tokens totais de entrada e saída, independentemente de transmitir ou solicitar uma resposta completa.

Limites e Restrições

Sua conta tem um limite rígido de 300 requisições por minuto por chave de API. O corpo da requisição não pode exceder 8 MB. A janela de contexto é de 100.000 tokens, abrangendo tanto o prompt quanto a resposta. Isso é suficiente para a maioria das tarefas de processamento de documentos e transcrição de contexto longo. Se você enviar um prompt que exceda a janela, a API retornará um erro. O modelo sem censura bloqueia apenas um limite rígido específico: conteúdo sexual envolvendo menores. Todo o outro conteúdo adulto lícito é permitido. Isso o torna ideal para pipelines de mídia onde a variedade de conteúdo é esperada. Não há assinaturas; você paga conforme o uso. O crédito pré-pago nunca expira. Use o endpoint GET /v1/models para verificar a disponibilidade se necessário, embora o ID do modelo seja sempre uncensored.

Ficha técnica da API

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
ID do modelouncensored
Base URLhttps://api.speechtotextapis.com/v1
AutenticaçãoAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Janela de contexto100.000 tokens (entrada + saída)
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Modo JSONresponse_format: {"type": "json_object"}
Limite de taxa300 requisições por minuto por chave
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concorrência8 requisições ao mesmo tempo por chave
Tamanhoaté 8 MB por requisição
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Bônus+5% a partir de $50, +10% a partir de $100
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Validadecrédito pago não expira, sem assinatura
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Chavesuma chave ativa por conta; uma nova substitui a anterior
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Esta é a API oficial da OpenAI?

Não, este é um serviço independente. Hospedamos nosso próprio modelo sem censura compatível com a interface de conclusões de chat da OpenAI. Não é GPT-4 ou GPT-3.5. Consulte a documentação da OpenAI para ver preços e limites específicos, pois os nossos são diferentes.

O que acontece se eu ficar sem crédito?

Sua chave de API permanece ativa, mas as requisições retornarão um erro 402 Payment Required. Você deve recarregar sua conta pré-paga via cripto (USDT ou USDC) para retomar o uso. Créditos nunca expiram, então você pode adicionar fundos quando quiser.

O modelo sem censura filtra conteúdo adulto?

Ele filtra conteúdo sexual envolvendo menores, que é uma restrição rígida. Para todo o resto de conteúdo adulto lícito, cenários fictícios ou tópicos controversos, o modelo não recusa nem suaviza a saída. Isso garante que seu pipeline preserve o tom e o significado originais do seu texto fonte.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de APILeia a documentação