Chuyển văn bản thành giọng nói tự nhiên và ngược lại — hỗ trợ 99+ ngôn ngữ, độ trễ thấp, tương thích chuẩn OpenAI. Tích hợp trong 5 phút.
Hạ tầng Việt Nam, chuẩn quốc tế
Tạo 1 phút audio chỉ mất 75 giây, hạ tầng GPU nội bộ xử lý 48 phút audio/giờ.
TTS đa giọng + ASR tự động phát hiện ngôn ngữ, dịch thuật tích hợp.
Tương thích SDK OpenAI — đổi base_url là xong, không cần viết lại code.
API key riêng, rate limit, content moderation, audit log đầy đủ.
Xử lý file dài nền, poll trạng thái hoặc tải kết quả khi xong.
Nạp theo nhu cầu, không cam kết dài hạn, hóa đơn rõ ràng.
Clone giọng 1 lần, dùng mãi mãi — lưu vào kho, tái sử dụng qua API mọi lúc.
Lồng tiếng video tự động — ASR nhận dạng, TTS đọc lại, ghép giữ nguyên hình ảnh.
Đọc sách dài 200K ký tự thành audiobook, hoặc stream từng câu realtime qua WebSocket.
10 giọng Việt + 6 giọng quốc tế — chọn giọng phù hợp với thương hiệu của bạn
from openai import OpenAI
client = OpenAI(
api_key="sk-vs-...", # ← lấy key tại Dashboard → API Keys
base_url="https://studio.skynet.ai.vn/v1" # ← base_url của Star AI Voice
)
# Text → Giọng nói
response = client.audio.speech.create(
model="star-ai-voice",
voice="🎤 Nữ trẻ - Nhẹ nhàng",
input="Xin chào, tôi là Star AI Voice."
)
response.stream_to_file("output.mp3")