Q-Learning / Học Q
📖 Q-Learning
Definition (English):
Q-learning is a model-free reinforcement learning algorithm that learns the value of actions in states (Q-values) without requiring a model of the environment. It uses the Bellman equation to iteratively update Q-values based on rewards. Deep Q-Network (DQN) extends this with neural networks to handle high-dimensional state spaces (Atari games). Q-learning is foundational to modern RL.
📖 Học Q
Định nghĩa (Tiếng Việt):
Học Q là thuật toán học tăng cường không cần mô hình học giá trị hành động trong trạng thái (Q-values) mà không yêu cầu mô hình môi trường. Nó sử dụng phương trình Bellman để cập nhật Q-values lặp lại dựa trên phần thưởng. Deep Q-Network (DQN) mở rộng điều này bằng mạng nơ-ron để xử lý không gian trạng thái nhiều chiều (trò chơi Atari). Học Q là nền tảng cho RL hiện đại.
📂 Phân loại: RL Tech