Text-to-Speech / Văn bản thành Giọng nói

✍️
Từ điển và thuật ngữ trí tuệ nhân tạo

📖 Text-to-Speech

Definition (English):

Text-to-Speech (TTS) is a technology that converts written text into spoken audio output. Modern TTS systems use deep learning models to generate highly natural-sounding speech. Key architectures include Tacotron, WaveNet, and VITS. Applications include virtual assistants, accessibility tools, audiobook production, and customer service automation. Recent advances enable voice cloning with just a few seconds of audio.


📖 Văn bản thành Giọng nói

Định nghĩa (Tiếng Việt):

Văn bản thành Giọng nói (TTS) là công nghệ chuyển đổi văn bản thành đầu ra âm thanh. Các hệ thống TTS hiện đại sử dụng mô hình học sâu để tạo giọng nói tự nhiên cao. Các kiến trúc chính bao gồm Tacotron, WaveNet và VITS. Ứng dụng bao gồm trợ lý ảo, công cụ hỗ trợ accessibility, sản xuất sách nói và tự động hóa dịch vụ khách hàng. Các tiến bộ gần đây cho phép sao chép giọng chỉ với vài giây âm thanh.


📂 Phân loại: Generative AI

HỆ SINH THÁI CiCC

Đi tiếp cùng nội dung này

Hỏi AI Edu?