首页 文章 精选 留言 我的
优秀的个人博客,低调大师

微信关注我们

原文链接:https://yq.aliyun.com/articles/174758

转载内容版权归作者及来源网站所有!

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

基于TensorFlow打造强化学习API:TensorForce是怎样炼成的?

本文将围绕一个实际的问题进行介绍:应用强化学习的社区可以如何从对脚本和单个案例的收集更进一步,实现一个强化学习API——一个用于强化学习的tf-learn或skikit-learn?在讨论TensorForce框架之前,我们将谈一谈启发了这个项目的观察和思想。如果你只想了解这个API,你可以跳过这一部分。我们要强调一下:这篇文章并不包含对深度强化学习本身的介绍,也没有提出什么新模型或谈论最新的最佳算法,因此对于纯研究者来说,这篇文章可能并不会那么有趣。 开发动机 假设你是计算机系统、自然语言处理或其它应用领域的研究者,你一定对强化学习有一些基本的了解,并且有兴趣将深度强化学习(deepRL)用来控制你的系统的某些方面。 对深度强化学习、DQN、vanilla策略梯度、A3C等介绍文章已经有很多了,比如Karpathy的文章(http://karpathy.github.io/2016/05/31/rl/)对策略梯度方法背后的直观思想就进行了很好的描述。另外,你也能找到很多可以帮助上手的代码,比如OpenAI上手智能体(https://github.com/openai/baseline...

ONTAP 9 能否成为NetApp Data Fabric的重要支撑?

当EMC被戴尔以670亿美元合并之后,作为与EMC竞争20多年的NetApp成为全球最大的独立存储厂商。同时NetApp上任了其新的CEO,人们自然而然关注NetApp的未来走向。包括今天谈存储必谈闪存、软件定义的趋势下,NetApp到底如何定义自身。 还好最近一些动作显示了NetApp积极的战略推进。在不久之前,IDC给出的统计数字,NetApp公司目前已经成为全闪存阵列市场上位列第二。同时NetApp发布了 ONTAP 9 软件,真正整合闪存、云和软件定义的架构,实现真正精简的管理数据。 NetApp希望让用户与合作伙伴了解自身的发展和优势。近日已“凌云之志,闪跃新篇”为主题的NetApp 2016创新论坛在北京举办。 通过NetApp专家的现场演讲以及媒体采访,可以让我们更深入了解NetApp如何帮助用户在云时代的今天更好的服务数据。 IT部门面临复合应用挑战 NetApp亚太区高级技术总监Nigel Lee NetApp亚太区高级技术总监Nigel Lee在现场的演讲中指出今天的企业IT部门需要为复合应用程序打造具有变革意义的数字化服务。比如一张目前普通的购物网页所包含的存储...

相关文章

发表评论

资源下载

更多资源
优质分享App

优质分享App

近一个月的开发和优化,本站点的第一个app全新上线。该app采用极致压缩,本体才4.36MB。系统里面做了大量数据访问、缓存优化。方便用户在手机上查看文章。后续会推出HarmonyOS的适配版本。

Mario

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长,特征是大鼻子、头戴帽子、身穿背带裤,还留着胡子。与他的双胞胎兄弟路易基一起,长年担任任天堂的招牌角色。

腾讯云软件源

腾讯云软件源

为解决软件依赖安装时官方源访问速度慢的问题,腾讯云为一些软件搭建了缓存服务。您可以通过使用腾讯云软件源站来提升依赖包的安装速度。为了方便用户自由搭建服务架构,目前腾讯云软件源站支持公网访问和内网访问。

Spring

Spring

Spring框架(Spring Framework)是由Rod Johnson于2002年提出的开源Java企业级应用框架,旨在通过使用JavaBean替代传统EJB实现方式降低企业级编程开发的复杂性。该框架基于简单性、可测试性和松耦合性设计理念,提供核心容器、应用上下文、数据访问集成等模块,支持整合Hibernate、Struts等第三方框架,其适用范围不仅限于服务器端开发,绝大多数Java应用均可从中受益。