跳到正文
原文
Hugging Face Blog·· 2022-05-18AI 评分12

Hugging Face 深度强化学习课程:Q-Learning 入门(第一部分)

An Introduction to Q-Learning Part 1

AI 导读

Hugging Face 深度强化学习课程更新第二单元第一部分,讲解基于价值的方法,并区分蒙特卡洛与时序差分学习。该部分涵盖状态价值函数、动作价值函数与贝尔曼方程,为后续学习 Q-Learning 及深度 Q-Learning 打基础。

来源:Hugging Face Blog · huggingface.co