IT ▾

speechtotextapis.comLLM senza censura per pipeline di post-elaborazione del testo

Speech To Text API
Ottieni la chiave API

Documentazione API: Chat Completions per pipeline di testo

Fai funzionare il tuo LLM senza censura nella tua pipeline di speech-to-text con questa guida rapida. Usa l'endpoint compatibile con OpenAI per inviare testo, fare streaming dei risultati o chiamare strumenti tramite SDK standard.

Base URL & Autenticazione

Inizia puntando il tuo client all'URL di base https://api.speechtotextapis.com/v1. Questo endpoint è completamente compatibile con OpenAI, il che significa che puoi utilizzare qualsiasi SDK standard openai semplicemente sovrascrivendo il parametro base_url. Non hai bisogno di riscrivere la logica delle tue richieste; basta sostituire l'URL e inserire la tua chiave API. La tua chiave viene generata immediatamente al momento della registrazione nella pagina delle chiavi. È associata al tuo account e puoi rigenerarla in qualsiasi momento, revocando istantaneamente la vecchia chiave. Non è richiesto il numero di telefono e il credito di prova gratuito si attiva senza carta. Questa configurazione mantiene semplice la tua pipeline garantendo al contempo l'accesso a un modello senza censura che gestisce contenuti adulti leciti senza attenuare le risposte.

Prima richiesta

Invia una richiesta POST standard a /v1/chat/completions. L'identificatore del modello è sempre uncensored. Questo modello è una variante a pesi aperti ottimizzata per minimizzare i rifiuti su argomenti leciti. Il modello esegue sui nostri server GPU dedicati. Non ottieni GPT o Claude; ottieni un'esperienza con un modello singolo e coerente. Il corpo della richiesta include i flag model, messages e stream. Di seguito è riportato un esempio cURL di base per verificare la connettività e ottenere una risposta testuale.

curl https://api.speechtotextapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Questa richiesta restituisce un oggetto JSON con il testo generato. Se la chiave non è valida, ricevi un errore 401. Se il tuo credito prepagato è esaurito, ricevi un errore 402. Questi sono i principali ostacoli da verificare prima di eseguire il debug della logica.

Integrazione SDK Python

Per gli sviluppatori Python, la libreria ufficiale openai funziona out of the box. Inizializza il client con la tua chiave e l'URL di base personalizzato. Passa l'ID del modello uncensored nella tua chiamata di chat completion. Questo approccio è ideale per il post-processing dell'output ASR, per pulire il rumore di trascrizione o per estrarre dati strutturati dal testo grezzo. La natura senza censura garantisce che se la tua trascrizione contiene dialoghi adulti o termini controversi, il LLM lo elaborerà senza bloccare o riscrivere per correttezza. Questo è fondamentale per le pipeline creative dove la fedeltà all'audio sorgente è prioritaria. L'SDK gestisce automaticamente la tokenizzazione e la logica di retry.

from openai import OpenAI

client = OpenAI(base_url="https://api.speechtotextapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Ricorda che l'ID del modello è strettamente uncensored. Non sostituirlo con gpt-4 o altri identificatori generici, poiché potrebbero non instradare verso i nostri pesi specifici senza censura.

Integrazione SDK Node.js

Gli sviluppatori Node.js possono utilizzare il pacchetto npm openai in modo simile. Imposta apiKey e baseURL nel costruttore del client. Quindi chiama chat.completions.create con il modello uncensored. Questo è utile per script di sottotitolazione in tempo reale o attività di generazione di testo lato server. L'API supporta payload JSON standard. Puoi includere messaggi di sistema per definire il tono o il ruolo dell'assistente. Il modello senza censura risponde direttamente a questi prompt senza livelli di sicurezza aggiuntivi che potrebbero alterare l'output creativo. Assicurati di gestire lo stream di risposta se stai elaborando documenti di grandi dimensioni. L'SDK Node astrae i dettagli HTTP, permettendoti di concentrarti sulla logica della pipeline di testo.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.speechtotextapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

I limiti di velocità si applicano per chiave. Se superi 300 richieste al minuto, l'API restituisce un errore 429. Implementa un backoff esponenziale nella tua logica di retry per gestire questo gracefully.

Risposte in streaming (SSE)

Per applicazioni a bassa latenza, abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce chunk di Server-Sent Events (SSE). Ogni chunk contiene un delta di testo parziale. Questo è essenziale per la sottotitolazione in tempo reale o per interfacce di chat interattive. Il modello senza censura supporta lo streaming nativamente. Non è necessario attendere il completamento completo per iniziare a visualizzare il testo. Questo riduce significativamente la latenza percepita. Configura il tuo SDK per gestire gli eventi dello stream. In Python, itera sull'oggetto stream. In Node, utilizza l'iteratore asincrono. Lo stream termina con un chunk finale contenente il motivo di fine. Questo metodo è efficiente per la larghezza di banda e l'esperienza utente.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Lo streaming non cambia il fatturazione dei token. Vieni addebitato per i token totali di input e output indipendentemente dal fatto che tu faccia streaming o richieda una risposta completa.

Limiti e vincoli

Il tuo account ha un limite rigido di 300 richieste al minuto per chiave API. Il corpo della richiesta non può superare gli 8 MB. La finestra di contesto è di 100.000 token, che coprono sia il prompt che il completamento. Questo è sufficiente per la maggior parte delle attività di elaborazione documenti e trascrizione a lungo contesto. Se invii un prompt che supera la finestra, l'API restituisce un errore. Il modello senza censura blocca solo un limite rigido specifico: i contenuti sessuali che coinvolgono minori. Tutti gli altri contenuti adulti leciti sono permessi. Questo lo rende ideale per le pipeline multimediali dove ci si aspetta una varietà di contenuti. Non ci sono abbonamenti; paghi a consumo. Il credito prepagato non scade mai. Usa l'endpoint GET /v1/models per verificare la disponibilità se necessario, anche se l'ID del modello è sempre uncensored.

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
ID modellouncensored
Base URLhttps://api.speechtotextapis.com/v1
AutenticazioneAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Finestra di contesto100.000 token (input + output)
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Modalità JSONresponse_format: {"type": "json_object"}
Limite di frequenza300 richieste al minuto per chiave
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concorrenza8 richieste contemporanee per chiave
Dimensionefino a 8 MB per richiesta
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Bonus+5% da $50, +10% da $100
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Scadenzail credito pagato non scade, nessun abbonamento
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
AccessoGoogle oppure e-mail e password

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

È l'API ufficiale di OpenAI?

No, è un servizio indipendente. Ospitiamo il nostro modello senza censura compatibile con l'interfaccia di chat completions di OpenAI. Non è GPT-4 o GPT-3.5. Consulta la documentazione di OpenAI per i loro prezzi e limiti specifici, poiché i nostri sono diversi.

Cosa succede se rimango senza credito?

La tua chiave API rimane attiva, ma le richieste restituiranno un errore 402 Payment Required. Devi ricaricare il tuo account prepagato tramite cripto (USDT o USDC) per riprendere l'utilizzo. I crediti non scadono mai, quindi puoi aggiungere fondi quando preferisci.

Il modello senza censura filtra i contenuti per adulti?

Filtra i contenuti sessuali che coinvolgono minori, che sono bloccati in modo rigido. Per tutto il resto dei contenuti legali per adulti, scenari fiction o argomenti controversi, il modello non rifiuta né attenua l'output. Questo garantisce che la tua pipeline preservi il tono e il significato originali del testo sorgente.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.

Ottieni chiave APILeggi la documentazione