【强化学习】08周博磊强化学习纲要学习笔记——第四课下

今日课程提纲

今天是第四课,我将给大家介绍价值函数的近似,首先介绍价值函数近似的基本原理,价值函数近似如何在prediction,就是给定一个策略函数,如何去估计它的价值。另外会分析价值函数性是如何在控制里面的应用。最后分析非常有名的这个deep q network在atari游戏里面是如何应用的。

目录

  • [一、Intorduction on function approximation](#一、Intorduction on function approximation)

一、Intorduction on function approximation

相关推荐
爱三盖浇饭29 分钟前
挑战从零开始学习Kafka2: Kafka 常见问题解决方案
学习·kafka
dtq04241 小时前
数据结构 - 线性表 - 双向链表
c语言·数据结构·学习
M78佐菲8 小时前
Linux学习笔记:TCP协议
linux·笔记·学习·tcp/ip·算法
噜~噜~噜~8 小时前
操作系统笔记-2.3.5.1.1生产者-消费者问题
笔记·操作系统
yi.Ist9 小时前
数据定义语言-DDL操作
数据库·学习·mysql·oracle·大海豚
骐骥112 小时前
学习:javaScriptProxy和registerJavaScriptProxy有什么区别,能注册多少个对象
学习·鸿蒙
Huathy-雨落江南,浮生若梦12 小时前
Caddy 学习笔记 - 反向代理与 IP 封禁
笔记·学习·tcp/ip
谢白羽13 小时前
SGLang的AWQ量化笔记
笔记·python·sglang
噜~噜~噜~14 小时前
操作系统笔记-2.3.5.2 读者-写者问题
笔记·操作系统
m4Rk_14 小时前
【论文阅读】Agent 记忆机制(57):MemSearch-o1——从查询词元生长证据,重组 Deep Search 记忆路径
论文阅读·人工智能·学习·开源·github