API-Dokumentation: Chat-Vervollständigungen für Text-Pipelines
Bring dein unzensiertes LLM in deiner Speech-to-Text-Pipeline mit diesem Quickstart zum Laufen. Nutze den OpenAI-kompatiblen Endpunkt, um Text zu senden, Ergebnisse zu streamen oder Tools über Standard-SDKs aufzurufen.
Basis-URL & Authentifizierung
Starte, indem du deinen Client auf die Base URL https://api.speechtotextapis.com/v1 zeigst. Dieser Endpunkt ist vollständig OpenAI-kompatibel, sodass du jedes Standard-openai-SDK verwenden kannst, indem du den Parameter base_url einfach überschreibst. Du musst deine Anfrage-Logik nicht umschreiben; tausche einfach die URL und injiziere deinen API-Schlüssel. Dein Schlüssel wird sofort nach der Anmeldung auf der Schlüsselseite generiert. Er ist an dein Konto gebunden und kann jederzeit neu generiert werden, wodurch der alte Schlüssel sofort widerrufen wird. Es wird keine Telefonnummer benötigt, und das Testguthaben wird ohne Kreditkarte aktiviert. Diese Einrichtung hält deine Pipeline einfach und stellt gleichzeitig sicher, dass du Zugriff auf ein unzensiertes Modell hast, das rechtlichen Erwachseneninhalt ohne Abschwächung verarbeitet.
Erste Anfrage
Sende eine Standard-POST-Anfrage an /v1/chat/completions. Die Modell-ID ist immer uncensored. Dieses Modell ist eine Open-Weight-Variante, die auf minimale Verweigerung bei rechtlichen Themen optimiert ist. Es läuft auf unseren dedizierten GPU-Servern. Du erhältst kein GPT oder Claude; du erhältst eine konsistente Single-Modell-Erfahrung. Der Anfragekörper enthält die Flags model, messages und stream. Unten findest du ein einfaches cURL-Beispiel, um die Konnektivität zu überprüfen und eine Textantwort zu erhalten.
curl https://api.speechtotextapis.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Diese Anfrage gibt ein JSON-Objekt mit dem generierten Text zurück. Wenn der Schlüssel ungültig ist, erhältst du einen 401-Fehler. Wenn dein Prepaid-Guthaben aufgebraucht ist, erhältst du einen 402-Fehler. Dies sind die primären Fehler, die du vor dem Debuggen der Logik überprüfen solltest.
Python-SDK-Integration
Für Python-Entwickler funktioniert die offizielle openai-Bibliothek sofort einsetzbar. Initialisiere den Client mit deinem Schlüssel und der benutzerdefinierten Basis-URL. Übergebe die Modell-ID uncensored bei deinem Chat-Vervollständigungsaufruf. Dieser Ansatz ist ideal zur Nachbearbeitung von ASR-Ausgaben, zum Bereinigen von Transkriptionsrauschen oder zum Extrahieren strukturierter Daten aus Rohdaten. Die unzensierte Natur stellt sicher, dass das LLM deine Transkripte verarbeitet, auch wenn sie erwachsene Dialoge oder kontroverse Begriffe enthalten, ohne sie wegen der Anständigkeit zu blockieren oder umzuschreiben. Dies ist entscheidend für kreative Pipelines, bei denen die Treue zur Audioquelle oberstes Gebot ist. Das SDK übernimmt die Tokenisierung und Wiederholungslogik automatisch.
from openai import OpenAI
client = OpenAI(base_url="https://api.speechtotextapis.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Denke daran, dass die Modell-ID streng uncensored ist. Ersetze sie nicht durch gpt-4 oder andere generische Bezeichnungen, da diese möglicherweise nicht zu unseren spezifischen unzensierten Gewichten geleitet werden.
Node-SDK-Integration
Node.js-Entwickler können das openai-npm-Paket ähnlich nutzen. Setze die apiKey und baseURL im Client-Konstruktor. Rufe dann chat.completions.create mit dem Modell uncensored auf. Dies ist nützlich für Echtzeit-Untertitelungsskripte oder serverseitige Textgenerierungsaufgaben. Die API unterstützt standardmäßige JSON-Payloads. Du kannst Systemnachrichten einfügen, um den Ton oder die Rolle des Assistenten zu definieren. Das unzensierte Modell reagiert direkt auf diese Prompts ohne zusätzliche Sicherheitsschichten, die kreative Ausgaben verändern könnten. Stelle sicher, dass du den Antwort-Stream verarbeitest, wenn du große Dokumente verarbeitest. Das Node-SDK abstrahiert die HTTP-Details, sodass du dich auf die Textpipeline-Logik konzentrieren kannst.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.speechtotextapis.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Ratenlimits gelten pro Schlüssel. Wenn du 300 Anfragen pro Minute überschreitest, gibt die API einen 429-Fehler zurück. Implementiere exponentielles Backoff in deiner Wiederholungslogik, um dies angemessen zu handhaben.
Streaming-Antworten (SSE)
Aktiviere für Anwendungen mit niedriger Latenz das Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt Server-Sent Events (SSE)-Chunks zurück. Jeder Chunk enthält einen partiellen Textdelta. Dies ist essentiell für Live-Captioning oder interaktive Chat-Schnittstellen. Das unzensierte Modell unterstützt Streaming nativ. Du musst nicht auf die vollständige Fertigstellung warten, um mit der Anzeige von Text zu beginnen. Dies reduziert die wahrgenommene Latenz erheblich. Konfiguriere dein SDK, um Stream-Ereignisse zu verarbeiten. In Python iteriere über das Stream-Objekt. In Node verwende den asynchronen Iterator. Der Stream endet mit einem finalen Chunk, der den Finish-Grund enthält. Diese Methode ist effizient für Bandbreite und Benutzererfahrung.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Streaming ändert die Token-Abrechnung nicht. Du wirst für die gesamten Input- und Output-Token berechnet, unabhängig davon, ob du streamst oder eine vollständige Antwort anforderst.
Limits & Einschränkungen
Dein Konto hat eine harte Grenze von 300 Anfragen pro Minute pro API-Schlüssel. Der Anfragetext darf 8 MB nicht überschreiten. Das Kontextfenster umfasst 100.000 Token, sowohl Prompt als auch Vervollständigung. Dies reicht für die meisten Dokumentenverarbeitungen und Langkontext-Transkriptionsaufgaben aus. Wenn du einen Prompt sendest, der das Fenster überschreitet, gibt die API einen Fehler zurück. Das unzensierte Modell blockiert nur eine spezifische harte Grenze: sexuelle Inhalte, die Minderjährige einbeziehen. Alle anderen rechtmäßigen Erwachseneninhalte sind erlaubt. Dies macht es ideal für Medienpipelines, in denen eine große Bandbreite an Inhalten erwartet wird. Es gibt keine Abonnements; du zahlst Pay as you go. Prepaid-Guthaben verfällt nie. Nutze den Endpunkt GET /v1/models, um die Verfügbarkeit zu überprüfen, falls erforderlich, obwohl die Modell-ID immer uncensored ist.
API-Spezifikation
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Base-URL | https://api.speechtotextapis.com/v1 |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| JSON-Modus | response_format: {"type": "json_object"} |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Anfragegröße | bis 8 MB |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dies die offizielle OpenAI-API?
Nein, dies ist ein unabhängiger Dienst. Wir hosten unser eigenes unzensiertes Modell, das mit der OpenAI-Chat-Completions-Schnittstelle kompatibel ist. Es ist kein GPT-4 oder GPT-3.5. Prüfe die OpenAI-Dokumentation für deren spezifische Preise und Limits, da unsere abweichen.
Was passiert, wenn mein Guthaben aufgebraucht ist?
Dein API-Schlüssel bleibt aktiv, aber Anfragen geben einen 402 Payment Required-Fehler zurück. Du musst dein Prepaid-Konto über Krypto (USDT oder USDC) aufladen, um die Nutzung fortzusetzen. Guthaben verfällt nie, sodass du Geld nachladen kannst, wann immer es dir passt.
Filtert das unzensierte Modell Erwachseneninhalte?
Es filtert sexuellen Inhalt mit Minderjährigen, was eine harte Grenze ist. Für allen anderen rechtmäßigen Erwachseneninhalt, fiktive Szenarien oder kontroverse Themen verweigert das Modell die Ausgabe nicht oder mildert sie nicht. Dies stellt sicher, dass deine Pipeline den ursprünglichen Ton und die Bedeutung deines Quelltexts beibehält.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.