第 7 章:强化学习基础(RL4J)

奔向理想的星辰大海
优质创作者: 云计算技术领域
2026-03-22 20:33:49

课时名称课时知识点
第 7 章:强化学习基础(RL4J)强化学习概述

马尔可夫决策过程(MDP)

探索与利用的权衡

RL4J 框架介绍

环境接口(Environment)

智能体(Agent)与算法

实现一个简单的 Q-Learning 例子

创建自定义环境(如网格世界)

训练智能体寻找最优路径

...全文
59 回复 打赏 收藏 举报
写回复
用AI写文章
回复
切换为时间正序
请发表友善的回复…
发表回复

1

社区成员

发帖
与我相关
我的任务
社区管理员
  • 奔向理想的星辰大海
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告
暂无公告

试试用AI创作助手写篇文章吧