Documentação da API: Conclusões de Chat para Pipelines de Texto
Faça seu LLM sem censura funcionar no seu pipeline de fala para texto com este início rápido. Use o endpoint compatível com OpenAI para postar texto, transmitir resultados ou chamar ferramentas via SDKs padrão.
URL Base e Autenticação
Comece apontando seu cliente para a URL base https://api.speechtotextapis.com/v1. Este endpoint é totalmente compatível com OpenAI, o que significa que você pode usar qualquer SDK padrão openai simplesmente sobrescrevendo o parâmetro base_url. Você não precisa reescrever a lógica das suas requisições; basta trocar a URL e inserir sua chave de API. Sua chave é gerada imediatamente após entrar na página de chaves. Ela está vinculada à sua conta e você pode regenerá-la a qualquer momento, o que revoga a chave antiga instantaneamente. Não há exigência de número de telefone, e o crédito de teste grátis é ativado sem necessidade de cartão. Essa configuração mantém seu pipeline simples enquanto garante acesso a um modelo sem censura que lida com conteúdo adulto lícito sem suavizar as saídas.
Primeira Requisição
Envie uma requisição POST para /v1/chat/completions. O identificador do modelo é sempre uncensored. Este modelo é uma variante de pesos abertos ajustada para recusa mínima em tópicos lícitos. Ele roda em nossos servidores GPU dedicados. Você não recebe GPT ou Claude; você recebe uma experiência consistente com um único modelo. O corpo da requisição inclui as flags model, messages e stream. Abaixo está um exemplo básico de cURL para verificar a conectividade e obter uma resposta de texto.
curl https://api.speechtotextapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Esta requisição retorna um objeto JSON com o texto gerado. Se a chave for inválida, você receberá um erro 401. Se seu crédito pré-pago estiver esgotado, você receberá um erro 402. Estes são os principais bloqueadores a verificar antes de depurar a lógica.
Integração com SDK Python
Para desenvolvedores Python, a biblioteca oficial openai funciona imediatamente. Inicialize o cliente com sua chave e a URL base personalizada. Passe o ID do modelo uncensored na sua chamada de geração de resposta. Esta abordagem é ideal para pós-processamento de saída de ASR, limpeza de ruído de transcrição ou extração de dados estruturados a partir de texto bruto. A natureza sem censura garante que, se sua transcrição contiver diálogos adultos ou termos controversos, o LLM processará sem bloquear ou reescrever por conveniência. Isso é crítico para pipelines criativos onde a fidelidade ao áudio original é primordial. O SDK lida com a tokenização e a lógica de nova tentativa automaticamente.
from openai import OpenAI
client = OpenAI(base_url="https://api.speechtotextapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Lembre-se de que o ID do modelo é estritamente uncensored. Não o substitua por gpt-4 ou outros identificadores genéricos, pois eles podem não rotear para nossos pesos sem censura específicos.
Integração com SDK Node.js
Desenvolvedores Node.js podem usar o pacote npm openai de forma semelhante. Defina o apiKey e o baseURL no construtor do cliente. Em seguida, chame chat.completions.create com o modelo uncensored. Isso é útil para scripts de legendagem em tempo real ou tarefas de geração de texto no lado do servidor. A API suporta payloads JSON padrão. Você pode incluir mensagens do sistema para definir o tom ou o papel do assistente. O modelo sem censura responde diretamente a esses prompts sem camadas extras de segurança que possam alterar a saída criativa. Certifique-se de lidar com o streaming da resposta se você estiver processando documentos grandes. O SDK Node abstrai os detalhes HTTP, permitindo que você se concentre na lógica do pipeline de texto.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.speechtotextapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Limites de taxa se aplicam por chave. Se você exceder 300 requisições por minuto, a API retornará um erro 429. Implemente backoff exponencial na sua lógica de retry para lidar com isso gracefulmente.
Respostas em Streaming (SSE)
Para aplicações de baixa latência, ative o streaming definindo stream: true na sua requisição. A API retorna chunks de Server-Sent Events (SSE). Cada chunk contém um delta de texto parcial. Isso é essencial para legendas ao vivo ou interfaces de chat interativas. O modelo sem censura suporta streaming nativamente. Você não precisa esperar pela conclusão completa para começar a exibir texto. Isso reduz significativamente a latência percebida. Configure seu SDK para lidar com os eventos de stream. Em Python, itere sobre o objeto stream. Em Node, use o iterador assíncrono. O stream termina com um chunk final contendo o motivo do término. Este método é eficiente para largura de banda e experiência do usuário.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
O streaming não altera a cobrança por token. Você é cobrado pelos tokens totais de entrada e saída, independentemente de transmitir ou solicitar uma resposta completa.
Limites e Restrições
Sua conta tem um limite rígido de 300 requisições por minuto por chave de API. O corpo da requisição não pode exceder 8 MB. A janela de contexto é de 100.000 tokens, abrangendo tanto o prompt quanto a resposta. Isso é suficiente para a maioria das tarefas de processamento de documentos e transcrição de contexto longo. Se você enviar um prompt que exceda a janela, a API retornará um erro. O modelo sem censura bloqueia apenas um limite rígido específico: conteúdo sexual envolvendo menores. Todo o outro conteúdo adulto lícito é permitido. Isso o torna ideal para pipelines de mídia onde a variedade de conteúdo é esperada. Não há assinaturas; você paga conforme o uso. O crédito pré-pago nunca expira. Use o endpoint GET /v1/models para verificar a disponibilidade se necessário, embora o ID do modelo seja sempre uncensored.
Ficha técnica da API
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| ID do modelo | uncensored |
| Base URL | https://api.speechtotextapis.com/v1 |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Modo JSON | response_format: {"type": "json_object"} |
| Limite de taxa | 300 requisições por minuto por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Tamanho | até 8 MB por requisição |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Validade | crédito pago não expira, sem assinatura |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Login | Google ou e-mail e senha |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Esta é a API oficial da OpenAI?
Não, este é um serviço independente. Hospedamos nosso próprio modelo sem censura compatível com a interface de conclusões de chat da OpenAI. Não é GPT-4 ou GPT-3.5. Consulte a documentação da OpenAI para ver preços e limites específicos, pois os nossos são diferentes.
O que acontece se eu ficar sem crédito?
Sua chave de API permanece ativa, mas as requisições retornarão um erro 402 Payment Required. Você deve recarregar sua conta pré-paga via cripto (USDT ou USDC) para retomar o uso. Créditos nunca expiram, então você pode adicionar fundos quando quiser.
O modelo sem censura filtra conteúdo adulto?
Ele filtra conteúdo sexual envolvendo menores, que é uma restrição rígida. Para todo o resto de conteúdo adulto lícito, cenários fictícios ou tópicos controversos, o modelo não recusa nem suaviza a saída. Isso garante que seu pipeline preserve o tom e o significado originais do seu texto fonte.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.