资料 | Python强化学习实战:应用OpenAI Gym和TensorFlow精通强化学习和深度强化学习

资料 | Python强化学习实战:应用OpenAI Gym和TensorFlow精通强化学习和深度强化学习
2020年07月16日 09:58 雷锋网

原标题:资料 | Python强化学习实战:应用OpenAI Gym和TensorFlow精通强化学习和深度强化学习

下载地址:https://www.yanxishe.com/resourceDetail/1954?from=leiphonecolumn_res0716

内容简介  · · · · · ·

强化学习是一种重要的机器学习方法,在智能体及分析预测等领域有许多应用。

《Python强化学习实战:应用OpenAI Gym和TensorFlow精通强化学习和深度强化学习》共13章,主要包括强化学习的各种要素,即智能体、环境、策略和模型以及相应平台和库;Anaconda、Docker、OpenAIGym、Universe和TensorFlow等安装配置;马尔可夫链和马尔可夫过程及其与强化学习问题建模之间的关系,动态规划的基本概念;蒙特卡罗方法以及不同类型的蒙特卡罗预测和控制方法;时间差分学习、预测、离线/在线策略控制等;多臂赌博机问题以及相关的各种探索策略方法;深度学习的各种基本概念和RNN、LSTM、CNN等神经网络;深度强化学习算法DQN,以及双DQN和对抗网络体系结构等改进架构;DRQN以及DARQN;A3C网络的基本工作原理及架构;策略梯度和优化问题;最后介绍了强化学习的全新进展以及未来发展。

作者简介  · · · · · · 

Sudharsan Ravichandiran 是一位数据科学家、研究员、人工智能爱好者以及 YouTuber(搜索 Sudharsan reinforcement learning),获得了 Anna 大学信息技术学士学位。他的研究领域包括深度学习和强化学习的实现,其中包括自然语言处理和计算机视觉。他曾是一名自由职业的网页开发人员和设计师,所设计开发的网站屡获殊荣,同时也热衷于开源,擅长解答堆栈溢出问题。 

 原书审稿人简介Sujit Pal 是 Elsevier 实验室的技术研究总监, Elsevier 实验室是 Reed-Elservier 集团公司下的一个先进技术团队,研究领域包括语义检索、自然语言处理、机器学习和深度学习。他在 Elsevier 实验室主要从事搜索质量检测与改进、图像分类和重复率检测、医学和科学语料库的标注与本体开发。他曾与 Antonio Gulli 合作撰写了一本关于深度学习的著作,并在博客 Slamon Run 上撰写了一些科技文章。 

 Suriyadeepan Ramamoorthy 是一名来自印度 Puducherry 的 AI 研究人员和工程师,主要研究领域是自然语言理解和推理,同时积极撰写有关深度学习的博客文章。在 SAAMA 技术中,他将先进的深度学习技术应用于生物医学文本分析,同时也是一名积极推动 FSFTN领域发展的免费软件宣传者,另外对社交网络、数据可视化和创造性编程也非常感兴趣。

补充说明  · · · · · ·

本站所有资源版权均属于原作者所有,这里所提供资源均只能用于参考学习用,请勿直接商用。如需删除,请联系 kefu@yanxishe.com

AI 研习社已经和阿里大文娱、旷视、搜狗搜索、小米等知名公司达成联系,帮助大家更好地求职找工作,一键投递简历至 HR 后台,准备了一些内推渠道群。

欢迎大家添加研习社小学妹微信(aiyanxishe),小学妹拉你加入(备注求职)。

雷锋网雷锋网雷锋网(公众号:雷锋网)

资料 | 编写高质量Python代码的59个有效方法

资料 | 1800页33章数学方法精要笔记 —深入数学建模, 机器学习和深度学习的数学基础

资料 | JavaScript框架设计 第二版

资料 | 算法(第4版)【图灵程序设计丛书】算法领域的经典参考书

资料 |世界著名计算机教材精选:数据挖掘十大算法(中文版)

资料 | 树莓派Python编程入门与实战

资料 | 最优化理论与算法(第2版)

资料 | 《人工智能编程范式:通用Lisp中的案例研究》1048页PDF免费下载

资料 | Yann LeCun「人工智能发展的挑战在于无监督学习」原版演讲PPT

资料 | 算法图解:像小说一样有趣的算法入门书

资料 | 【复旦大学邱锡鹏老师】面向自然语言处理的深度学习基础,199页ppt

资料 | Python语言程序设计基础(第2版)

资料 | Python 神经网络编程

资料 | 神经网络与深度学习(邱锡鹏)

资料 | 科技之巅:《麻省理工科技评论》50大全球突破性技术深度剖析

资料 | 解析深度学习:卷积神经网络原理与视觉实践

资料 | 谷歌的故事

资料 | Python学习手册(第4版)

资料 | 深度学习之美:AI时代的数据处理与最佳实践

资料 | CVPR 2020 论文合集,共1466篇!

雷锋网版权文章,未经授权禁止转载。详情见转载须知。

新浪科技公众号
新浪科技公众号

“掌”握科技鲜闻 (微信搜索techsina或扫描左侧二维码关注)

创事记

科学探索

科学大家

苹果汇

众测

专题

官方微博

新浪科技 新浪数码 新浪手机 科学探索 苹果汇 新浪众测

公众号

新浪科技

新浪科技为你带来最新鲜的科技资讯

苹果汇

苹果汇为你带来最新鲜的苹果产品新闻

新浪众测

新酷产品第一时间免费试玩

新浪探索

提供最新的科学家新闻,精彩的震撼图片