Bỏ qua để đến nội dung

Studio Giọng nói AI (Voice Studio)

Trang Studio Giọng nói AI (Voice Studio) (/app/voice-studio) là nơi chuyển đổi văn bản thành giọng nói truyền cảm (Text-to-Speech - TTS) chất lượng studio, phục vụ làm video ngắn, cuộc gọi tự động hoặc tin nhắn thoại gửi cho khách hàng.

Cấu hình Nhà cung cấp & Định dạng Âm thanh

Phần tiêu đề “Cấu hình Nhà cung cấp & Định dạng Âm thanh”
  • Provider: Mặc định sử dụng ElevenLabs (eleven) chuyên sâu giọng tiếng Việt và đa ngôn ngữ.
  • Model giọng: Eleven Multilingual v2, Eleven Turbo v2.5.
  • Định dạng file xuất (Output Formats):
    • MP3 44.1kHz 128kbps (Khuyến nghị)
    • MP3 44.1kHz 192kbps (Chất lượng cao)
    • PCM 16kHz
    • uLaw 8kHz

Trước khi chuyển thành giọng nói, bạn có thể gọi Trợ lý AI để hỗ trợ viết kịch bản thoại hấp dẫn:

  1. Nhập Ý tưởng / Brief kịch bản (vd: “Bài thoại 30 giây quảng cáo chương trình sale 50% dịp cuối tuần”).
  2. Chọn Giọng điệu (Tone): Năng động, Thần thái, Thân thiện, Chuyên nghiệp.
  3. Chọn Thời lượng (Duration): 15 giây, 30 giây, 60 giây.
  4. Bấm AI Viết kịch bản thoại → AI tự động viết văn bản có chèn dấu ngắt nghỉ và ngữ điệu phù hợp đọc thoại.

5 Thanh tinh chỉnh Tham số Giọng đọc (Voice Tuning)

Phần tiêu đề “5 Thanh tinh chỉnh Tham số Giọng đọc (Voice Tuning)”

Tùy chỉnh sắc thái giọng đọc của ElevenLabs qua 5 dải trượt (Range Sliders):

Tham số Phạm vi Bước nhảy Mặc định Tác dụng
Độ ổn định (stability) 0.01.0 0.05 0.50 Thấp: Giọng nhiều cảm xúc và biến thiên ngẫu nhiên.
Cao: Giọng đọc ổn định và đồng nhất.
Độ giống giọng gốc (similarityBoost) 0.01.0 0.05 0.75 Tăng cường tái tạo chính xác màu giọng và ngữ điệu của người thật.
Cường độ phong cách (style) 0.01.0 0.05 0.00 Nhấn mạnh độ diễn xướng và sắc thái biểu cảm của bài nói.
Tốc độ đọc (speed) 0.71.2 0.05 1.00 Điều chỉnh tốc độ nói nhanh (vd 1.15) hoặc chậm rãi (vd 0.85).
Tăng cường loa (speakerBoost) Bật / Tắt Bật Lọc nhiễu và làm trong chất âm giọng đọc.

  1. Nhập văn bản hoàn chỉnh vào ô Nội dung bài nói.
  2. Hệ thống hiển thị Ước tính số ký tự và chi phí (costEstimate).
  3. Bấm Tạo giọng nói AI → Hệ thống xử lý trong 2-5 giây.
  4. Trình phát audio hiện ra cho phép nghe thử trực tiếp hoặc nhấp Tải xuống MP3.