VI ▾

speechtotextapis.comLLM không kiểm duyệt cho pipeline xử lý văn bản

Speech To Text API
Lấy khóa API

Tài liệu API: Chat Completions cho Pipeline văn bản

Khởi động LLM không kiểm duyệt cho pipeline speech to text của bạn với hướng dẫn nhanh này. Sử dụng endpoint tương thích OpenAI để gửi văn bản, truyền phát kết quả hoặc gọi công cụ thông qua các SDK tiêu chuẩn.

URL cơ bản & Xác thực

Bắt đầu bằng cách trỏ client của bạn đến base URL https://api.speechtotextapis.com/v1. Endpoint này tương thích hoàn toàn với OpenAI, nghĩa là bạn có thể sử dụng bất kỳ SDK openai tiêu chuẩn nào chỉ bằng cách ghi đè tham số base_url. Bạn không cần viết lại logic yêu cầu; chỉ cần thay đổi URL và đưa khóa API của bạn vào. Khóa được tạo ngay khi đăng ký trên trang khóa. Khóa liên kết với tài khoản của bạn và bạn có thể tạo lại bất cứ lúc nào, khóa cũ sẽ bị thu hồi ngay lập tức. Không yêu cầu số điện thoại và tín dụng dùng thử kích hoạt mà không cần thẻ. Cấu hình này giữ cho pipeline của bạn đơn giản trong khi đảm bảo bạn có quyền truy cập vào một mô hình không kiểm duyệt xử lý nội dung người lớn hợp pháp mà không làm mềm đầu ra.

Yêu cầu đầu tiên

Gửi yêu cầu POST tiêu chuẩn đến /v1/chat/completions. Định danh mô hình luôn là uncensored. Mô hình này là biến thể trọng số mở được tinh chỉnh để từ chối tối thiểu đối với các chủ đề hợp pháp. Nó chạy trên các máy chủ GPU chuyên dụng của chúng tôi. Bạn không nhận được GPT hay Claude; bạn nhận được trải nghiệm mô hình đơn nhất, ổn định. Thân yêu cầu bao gồm các cờ model, messages và stream. Dưới đây là ví dụ cURL cơ bản để xác minh kết nối và nhận phản hồi văn bản.

curl https://api.speechtotextapis.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Yêu cầu này trả về một đối tượng JSON với văn bản được tạo. Nếu khóa không hợp lệ, bạn nhận được lỗi 401. Nếu tín dụng trả trước của bạn đã cạn kiệt, bạn nhận được lỗi 402. Đây là các lỗi chính cần kiểm tra trước khi gỡ lỗi logic.

Tích hợp SDK Python

Đối với nhà phát triển Python, thư viện openai chính thức hoạt động ngay lập tức. Khởi tạo client với khóa và base URL tùy chỉnh của bạn. Truyền ID mô hình uncensored trong lệnh gọi hoàn thành hội thoại của bạn. Cách tiếp cận này lý tưởng để xử lý hậu kỳ đầu ra ASR, làm sạch nhiễu phiên âm hoặc trích xuất dữ liệu có cấu trúc từ văn bản thô. Bản chất không kiểm duyệt đảm bảo rằng nếu bản ghi âm của bạn chứa hội thoại người lớn hoặc các thuật ngữ gây tranh cãi, LLM sẽ xử lý mà không chặn hoặc viết lại để giữ sự lịch sự. Điều này rất quan trọng đối với các pipeline sáng tạo nơi độ trung thực với âm thanh nguồn là ưu tiên hàng đầu. SDK xử lý tự động việc phân đoạn token và logic thử lại.

from openai import OpenAI

client = OpenAI(base_url="https://api.speechtotextapis.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Hãy nhớ rằng định danh mô hình là uncensored. Đừng thay thế nó bằng gpt-4 hoặc các định danh chung khác, vì những định danh đó có thể không định tuyến đến trọng số không kiểm duyệt cụ thể của chúng tôi.

Tích hợp SDK Node.js

Nhà phát triển Node.js có thể sử dụng gói npm openai tương tự. Đặt apiKey và baseURL trong hàm tạo client. Sau đó gọi chat.completions.create với mô hình uncensored. Điều này hữu ích cho các kịch bản chú thích thời gian thực hoặc các nhiệm vụ tạo văn bản phía máy chủ. API hỗ trợ các tải trọng JSON tiêu chuẩn. Bạn có thể bao gồm các thông báo hệ thống để xác định giọng điệu hoặc vai trò của trợ lý. Mô hình không kiểm duyệt phản hồi trực tiếp với các prompt này mà không có các lớp bảo vệ bổ sung có thể làm thay đổi đầu ra sáng tạo. Đảm bảo bạn xử lý luồng phản hồi nếu bạn đang xử lý các tài liệu lớn. SDK Node trừu tượng hóa các chi tiết HTTP, cho phép bạn tập trung vào logic pipeline văn bản.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.speechtotextapis.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Giới hạn tốc độ áp dụng cho mỗi khóa. Nếu bạn vượt quá 300 yêu cầu mỗi phút, API sẽ trả về lỗi 429. Hãy triển khai cơ chế backoff theo cấp số nhân trong logic thử lại của bạn để xử lý tình huống này một cách nhẹ nhàng.

Phản hồi truyền phát (SSE)

Đối với các ứng dụng độ trễ thấp, hãy bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về các chunk Sự kiện gửi bởi máy chủ (SSE). Mỗi chunk chứa một phần delta văn bản riêng lẻ. Điều này rất cần thiết cho chú thích trực tiếp hoặc các giao diện trò chuyện tương tác. Mô hình không kiểm duyệt hỗ trợ truyền phát gốc. Bạn không cần chờ hoàn tất đầy đủ để bắt đầu hiển thị văn bản. Điều này giảm đáng kể độ trễ cảm nhận. Định cấu hình SDK của bạn để xử lý các sự kiện luồng. Trong Python, lặp qua đối tượng luồng. Trong Node, hãy sử dụng trình lặp bất đồng bộ. Luồng kết thúc bằng một chunk cuối cùng chứa lý do kết thúc. Phương pháp này hiệu quả cho băng thông và trải nghiệm người dùng.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Truyền phát không thay đổi việc tính phí token. Bạn sẽ được tính phí cho tổng số token đầu vào và đầu ra bất kể bạn có truyền phát hay yêu cầu phản hồi đầy đủ hay không.

Giới hạn & Ràng buộc

Tài khoản của bạn có giới hạn cứng là 300 yêu cầu mỗi phút trên mỗi khóa API. Thân yêu cầu không được vượt quá 8 MB. Cửa sổ ngữ cảnh là 100.000 token, bao gồm cả prompt và hoàn thành. Điều này đủ cho hầu hết các nhiệm vụ xử lý tài liệu và phiên âm ngữ cảnh dài. Nếu bạn gửi một prompt vượt quá cửa sổ, API sẽ trả về lỗi. Mô hình không kiểm duyệt chỉ chặn một giới hạn cứng cụ thể: nội dung tình dục liên quan đến trẻ em. Mọi nội dung người lớn hợp pháp khác đều được phép. Điều này làm cho nó lý tưởng cho các pipeline truyền thông nơi sự đa dạng nội dung được mong đợi. Không có gói đăng ký; bạn trả tiền theo mức sử dụng. Tín dụng trả trước không hết hạn. Sử dụng endpoint GET /v1/models để xác minh khả dụng nếu cần, mặc dù ID mô hình luôn là uncensored.

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
ID mô hìnhuncensored
Base URLhttps://api.speechtotextapis.com/v1
Xác thựcAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Chế độ JSONresponse_format: {"type": "json_object"}
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thưởng+5% từ $50, +10% từ $100
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Đây có phải là API OpenAI chính thức không?

Không, đây là dịch vụ độc lập. Chúng tôi lưu trữ mô hình không kiểm duyệt của riêng mình, tương thích với giao diện chat completions của OpenAI. Đây không phải GPT-4 hay GPT-3.5. Vui lòng kiểm tra tài liệu của OpenAI để biết giá cả và giới hạn cụ thể của họ, vì các thông số của chúng tôi khác biệt.

Điều gì xảy ra nếu tôi hết tín dụng?

Khóa API của bạn vẫn hoạt động, nhưng các yêu cầu sẽ trả về lỗi 402 Payment Required. Bạn cần nạp tiền vào tài khoản trả trước thông qua tiền điện tử (USDT hoặc USDC) để tiếp tục sử dụng. Tín dụng không bao giờ hết hạn, vì vậy bạn có thể thêm tiền bất cứ khi nào thuận tiện.

Mô hình không kiểm duyệt có lọc nội dung người lớn không?

Nó lọc nội dung tình dục liên quan đến trẻ vị thành niên, đây là giới hạn cứng. Đối với tất cả các nội dung người lớn hợp pháp khác, kịch bản hư cấu hoặc các chủ đề gây tranh cãi, mô hình sẽ không từ chối hoặc làm mềm đầu ra. Điều này đảm bảo pipeline của bạn giữ nguyên giọng điệu và ý nghĩa ban đầu của văn bản nguồn.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ quá trình thiết lập.

Lấy khóa APIĐọc tài liệu