JA ▾

speechtotextapis.comテキストパイプラインのポストプロセス用無検閲LLM

Speech To Text API
API キーを取得

テキストパイプライン用チャット完了APIドキュメント

このクイックスタートで、音声テキスト変換パイプラインに無検閲LLMをセットアップしましょう。OpenAI互換のエンドポイントを使用して、テキストを投稿、結果をストリーミング、または標準SDK経由でツールを呼び出します。

Base URLと認証

まず、クライアントのベースURLをhttps://api.speechtotextapis.com/v1に設定してください。このエンドポイントはOpenAIと完全に互換性があり、base_urlパラメータを上書きするだけで、標準的なopenaiSDKを使用できます。リクエストロジックを書き換える必要はありません。URLを入れ替え、APIキーを挿入するだけです。キーはキーページでのサインアップ直後に生成されます。これはアカウントに紐付いており、いつでも再生成できます。再生成すると古いキーは即時無効になります。電話番号の登録は不要で、トライアルクレジットはカードなしで有効になります。このセットアップによりパイプラインはシンプルに保たれ、法的に許可されたアダルトコンテンツを出力を柔らかくせず処理する無検閲モデルにアクセスできます。

最初のリクエスト

標準的なPOSTリクエストを/v1/chat/completionsに送信します。モデル識別子は常にuncensoredです。このモデルは法的なトピックに対する拒否を最小限に抑えるようチューニングされたオープンウェイトモデルです。専用GPUサーバー上で動作します。GPTやClaudeではなく、一貫性のある単一モデルの体験が得られます。リクエストボディにはmodel、messages、streamフラグが含まれます。以下は接続を確認し、テキスト応答を取得するための基本的なcURL例です。

curl https://api.speechtotextapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

このリクエストは生成されたテキストを含むJSONオブジェクトを返します。キーが無効な場合は401エラー、前払いクレジットが枯渇した場合は402エラーが返されます。これらはロジックのデバッグ前に確認すべき主なブロックです。

Python SDK統合

Python開発者向けには、公式の openai ライブラリがそのまま動作します。キーとカスタムベースURLを使用してクライアントを初期化してください。チャット完了呼び出しに uncensored モデルIDを渡します。このアプローチは、ASR出力の後処理、トランスクリプトノイズのクリーンアップ、または生テキストからの構造化データ抽出に最適です。無検閲な性質により、トランスクリプトに大人向けの対話や論争的な用語が含まれている場合でも、LLMは propriety(品位)のためにブロックや書き換えを行わずに処理します。これは、ソースオーディオへの忠実さが最も重要であるクリエイティブパイプラインにとって不可欠です。SDKはトークン化とリトライロジックを自動的に処理します。

from openai import OpenAI

client = OpenAI(base_url="https://api.speechtotextapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

モデルIDは厳密に uncensored であることに注意してください。gpt-4 やその他の汎用識別子に置き換えないでください。それらは当社の特定の無検閲ウェイトにルーティングされない可能性があります。

Node SDK統合

Node.js開発者は、同様に openai npmパッケージを使用できます。クライアントコンストラクタで apiKey と baseURL を設定します。次に、uncensored モデルを使用して chat.completions.create を呼び出します。これはリアルタイムの字幕生成スクリプトやサーバーサイドのテキスト生成タスクに役立ちます。APIは標準的なJSONペイロードをサポートしています。アシスタントのトーンや役割を定義するためにシステムメッセージを含めることができます。無検閲モデルは、クリエイティブな出力を変更する可能性のある追加の安全レイヤーなしで、これらのプロンプトに直接応答します。大きなドキュメントを処理する場合は、応答ストリームを処理してください。Node SDKはHTTPの詳細を抽象化し、テキストパイプラインロジックに集中できるようにします。

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.speechtotextapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

レート制限はキーごとに適用されます。1分あたり300リクエストを超えると、APIは429エラーを返します。これを適切に処理するために、リトライロジックに指数関数的バックオフを実装してください。

ストリーミングレスポンス(SSE)

低レイテンシアプリケーションでは、リクエストに stream: true を設定してストリーミングを有効にしてください。APIはServer-Sent Events (SSE) チャンクを返します。各チャンクには部分的なテキストデルタが含まれています。これはライブキャプションやインタラクティブなチャットインターフェースに不可欠です。無検閲モデルはネイティブにストリーミングをサポートしています。テキストの表示を開始するまで完全な完了を待つ必要はありません。これにより、知覚されるレイテンシが大幅に削減されます。SDKを構成してストリームイベントを処理してください。Pythonでは、ストリームオブジェクトをイテレートします。Nodeでは、非同期イテレーターを使用します。ストリームは、終了理由を含む最終チャンクで終了します。この方法は、帯域幅とユーザーエクスペリエンスの両面で効率的です。

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

ストリーミングはトークン課金を変更しません。ストリーミングするかフルレスポンスをリクエストするかにかかわらず、合計の入力トークンと出力トークンに対して課金されます。

制限と制約

アカウントには、APIキーごとに1分あたり300リクエストというハードリミットがあります。リクエストボディは8 MBを超えてはなりません。コンテキストウィンドウは100,000トークンで、プロンプトと応答の両方をカバーします。これは、ほとんどのドキュメント処理や長時間のコンテキストトランスクリプションタスクに十分です。ウィンドウを超えるプロンプトを送信すると、APIはエラーを返します。無検閲モデルがブロックする特定のハードリミットは、未成年者を含む性的コンテンツのみです。他のすべての法的な大人向けコンテンツは許可されます。これは、コンテンツの多様性が期待されるメディアパイプラインに最適です。サブスクリプションはなく、従量課金制です。前払いクレジットは期限切れになりません。必要に応じて GET /v1/models エンドポイントを使用して可用性を確認できますが、モデルIDは常に uncensored です。

API 仕様

購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。

項目内容
形式OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作
モデル IDuncensored
Base URLhttps://api.speechtotextapis.com/v1
認証Authorization: Bearer YOUR_KEY
エンドポイントPOST /v1/chat/completions · GET /v1/models
コンテキスト長100,000 トークン(入力+出力)
パラメータtemperature、top_p、stop、seed、presence_penalty、frequency_penalty
最大出力100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし)
関数呼び出し対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送
ストリーミング対応 — SSE、最後のチャンクにトークン使用量
JSON モードresponse_format: {"type": "json_object"}
レート制限キーごとに毎分 300 リクエスト
レスポンスヘッダーX-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency
同時実行キーごとに同時 8 リクエストまで
リクエストサイズ最大 8 MB
料金入力 100 万トークン $0.25 · 出力 100 万トークン $1.00
無料トライアル$0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大
ボーナス$50 以上で +5%、$100 以上で +10%
課金前払いクレジットから実使用量で課金。エラーと拒否は無料
有効期限購入クレジットは失効なし、サブスクなし
チャージUSDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額
キーアカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効
コンテンツ成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否
ログインGoogle またはメール+パスワード

エラーコード

エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。

コードタイプ意味
400bad_requestJSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過
401missing_key · invalid_key · key_revokedキーなし・誤り・新しいキーに置換済み
402no_credit残高ゼロ — チャージすれば即再開
403content_blocked未成年者を含む性的コンテンツ — 拒否、課金なし
404not_found不明なエンドポイント
413request_too_large本文が 8 MB 超
429rate_limited · concurrency毎分 300 回または同時 8 件を超過 — 待って再試行
503upstream_busyモデル混雑 — 数秒後に再試行

質問と回答

これは公式のOpenAI APIですか?

いいえ、これは独立したサービスです。OpenAIのチャット完了インターフェースと互換性のある独自の無検閲モデルをホストしています。GPT-4やGPT-3.5ではありません。価格や制限は異なるため、OpenAIのドキュメントをご確認ください。

クレジットが枯渇するとどうなりますか?

APIキーは有効ですが、リクエストは402番(支払い必要)エラーを返します。使用を再開するには、暗号通貨(USDTまたはUSDC)を通じて前払いアカウントにチャージする必要があります。クレジットは期限切れにならないため、都合のよい時に資金を追加できます。

無検閲モデルは成人向けコンテンツをフィルタリングしますか?

未成年者を含む性的コンテンツは厳格にブロックされます。それ以外の合法的な成人向けコンテンツ、フィクション、論争的な話題については、モデルは出力を拒否したり弱めたりしません。これにより、パイプラインがソーステキストの元のトーンと意味を保持することが保証されます。

キーはフォーム 1 つで手に入ります

アカウントを作成し、キーをコピーし、Base URLを変更するだけです。これがセットアップ全体です。

APIキーを取得ドキュメントを読む