Speech-to-Text / Giọng nói thành Văn bản

✍️
Từ điển và thuật ngữ trí tuệ nhân tạo

📖 Speech-to-Text

Definition (English):

Speech-to-Text (STT) or Automatic Speech Recognition (ASR) is the technology that converts spoken language into written text. Modern systems like OpenAI Whisper, Google Speech-to-Text, and Deepgram use deep learning to achieve human-level accuracy in multiple languages. STT powers virtual assistants, transcription services, dictation software, and voice-controlled systems.


📖 Giọng nói thành Văn bản

Định nghĩa (Tiếng Việt):

Giọng nói thành Văn bản (STT) hoặc Nhận dạng Giọng nói Tự động (ASR) là công nghệ chuyển đổi ngôn ngữ nói thành văn bản viết. Các hệ thống hiện đại như OpenAI Whisper, Google Speech-to-Text và Deepgram sử dụng học sâu để đạt độ chính xác ngang tầm con người trên nhiều ngôn ngữ. STT cung cấp năng lượng cho trợ lý ảo, dịch vụ phiên âm, phần mềm đọc chính tả và hệ thống điều khiển bằng giọng nói.


📂 Phân loại: Generative AI

HỆ SINH THÁI CiCC

Đi tiếp cùng nội dung này

Hỏi AI Edu?