Speech-to-Text / Giọng nói thành Văn bản
📖 Speech-to-Text
Definition (English):
Speech-to-Text (STT) or Automatic Speech Recognition (ASR) is the technology that converts spoken language into written text. Modern systems like OpenAI Whisper, Google Speech-to-Text, and Deepgram use deep learning to achieve human-level accuracy in multiple languages. STT powers virtual assistants, transcription services, dictation software, and voice-controlled systems.
📖 Giọng nói thành Văn bản
Định nghĩa (Tiếng Việt):
Giọng nói thành Văn bản (STT) hoặc Nhận dạng Giọng nói Tự động (ASR) là công nghệ chuyển đổi ngôn ngữ nói thành văn bản viết. Các hệ thống hiện đại như OpenAI Whisper, Google Speech-to-Text và Deepgram sử dụng học sâu để đạt độ chính xác ngang tầm con người trên nhiều ngôn ngữ. STT cung cấp năng lượng cho trợ lý ảo, dịch vụ phiên âm, phần mềm đọc chính tả và hệ thống điều khiển bằng giọng nói.
📂 Phân loại: Generative AI
HỆ SINH THÁI CiCC