一品网
  • 首页

强化学习 马尔可夫过程&动态规划


1. 背景介绍

2. 动态特性

3. 价值函数

4. 贝尔曼期望方程

5. 贝尔曼最优方程

6. 策略评估-解析解

7. 策略评估-迭代解

8. 策略改进定理

9. 策略改进-贪心策略

10. 价值迭代

机器学习

相关


[ML]机器学习中我未见过的概念

[机器学习笔记(一)] TensorFLow安装

机器学习 - 线性回归模型实战 02

机器学习-支持向量机SVM

TensorFlow——机器学习编程框架

机器学习(三、神经网络)

吴恩达机器学习作业2- 逻辑回归与正则化作业(python实现)

[ 机器学习 - 吴恩达 ] | 1-2 What is machine learning

《神经网络与机器学习》第8章泛化与正则化

【机器学习】逻辑回归(Logistic Regression)

机器学习--决策树算法(CART)

机器学习--决策树算法(CART)

标签

一品网 冀ICP备14022925号-6