教程 / 实战精选
Hugging Face 深度强化学习课程 Unit 2 第二部分:Q-Learning 原理与从零实现
原始标题:An Introduction to Q-Learning Part 2/2
内容摘要
Hugging Face 深度强化学习课程发布 Unit 2 第二部分,讲解 Q-Learning 算法、Q-Function 与 Q-Table,以及 Epsilon Greedy 策略和 TD 更新,并区分 off-policy 与 on-policy。
内容分类AI 教程与实战
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源Hugging Face:Blog(RSS)
站内情报编号intel-5689c7688421e14ef1f3568d