热搜： 佳士科技 irobot 开云电竞官网下载app 机器人 ABB 机器人产业联盟发那科库卡码垛机器人机械手

从概念上看看智能机器人的新范式：深度强化学习

日期：2016-08-30 来源：科技小读作者：zy 评论：0

标签：

　　近两年机器智能取得重大突破，像围棋九段高手李世石败北Alpha Go，DeepMind团队研发的 机器人在Atari多项游戏上超越人类水平。这些突破主要得益于从基于深度学习的视觉、语音、语义感知到动作反馈的激励惩罚强化训练模式。本文从概念上分析深度强化学习的要点，部分摘于ICML 2016 Tutorial里的Deep Reinforcement Learning[1]的报告。

　　强化学习，即机器人根据环境里动作得到的惩罚和激励去自动调整策略。通过训练，机器人学到一组策略：在环境状态S下应采取动作A，（可）能获得最大累积奖励V。

　　强化学习有丰富的交叉学科背景，包括经济学、工程学、神经科学里的博弈论、优化控制，条件反射系统。

　　深度学习，使用深度神经网络实现机器人的记忆，视觉感知，语音语义理解和生成。

　　深度强化学习以深度学习做感知，强化学习训练策略，并且以深度神经网络作为策略载体。相比于传统的多模块组合，深度强化学习实现了从感知到控制的端到端直接训练，减少了模块间信息损失。

　　最近两年在学术理论上，GoogleDeepMind团队在连续性动作控制[2]，异步训练[3]，训练框架[4]，分布式训练[5]等都有重要突破，为 智能机器人的研发奠定理论和实践基础。

　　在特定任务的应用上，深度增强学习已有广泛实践尝试，例如流水线机器人。

　　在集成应用上，深度强化学习在自动驾驶，聊天机器人[6][7]都有良好的前景。例如，使用分布式训练或异步训练，自动驾驶汽车可以多辆同时在各种环境学习，并且相互交换知识，加速学习过程。聊天机器人可以通过对话过程中用户的反馈来调整自己的语言表达，逐步成长。

　　深度强化学习为智能机器人提供了新的计算范式：提供环境、激励和惩罚、神经网络结构即可训练得到最大化奖励的智能机器人。

更多> 相关开云电子链接

0条 相关评论

推荐图文

机器人赋能产业，智赢	机器人也会创造英国
2018年中国智慧机场行	智能工厂全面解读！
艾猫早教机器人亮相20	360智能硬件助力美国

推荐开云电子链接

点击排行

• 深圳博铭维又一力作，管道周边地质灾害探测神器	• 北京启动建设国家人工智能创新应用先导区
• Project Loon前CEO已加盟自主机器人交付企业Sta	• 嘉定将试点打造机器人“智慧园区”
• 提高工效、节省人力！美空军用机器人给战机“洗	• 人工智能是否可信？专家：一些疾病诊断AI准确率
• 上千亿激光焊接市场被激发，但国产机器人90%的	• 广州：无人机递药机器人送餐
• 即日起正式施行协作机器人末端接口技术条件标准	• 即将实施的协作机器人末端接口标准，将对协作机

恰佩克奖	机器人高峰论坛	北大机器人	金属加工在线	AI中国网	埃森焊接展	机气林
工博会	赶考网	中国机床网	ITES深圳工业展	电气自动化网	高压电气网	人工智能机器人
亚洲工业网	二手设备网	展览会信息网	重庆房交汇网	VLAI未来四足机器人官网	中国传动网	华北机床网
数控机床市场网	国家标准化委员会